12月1日晚,DeepSeek又上新了两款新模型 ,DeepSeek-V3.2和DeepSeek-V3.2-Speciale,在推理能力上全球领先。
两款模型有着不同的定位 。DeepSeek-V3.2的目标是平衡推理能力与输出长度,适合日常使用,例如问答场景和通用智能体任务场景。9月底DeepSeek发布了实验版V3.2-Exp ,此次是正式版更新。在公开推理测试中,V3.2达到了GPT-5的水平,仅略低于谷歌的Gemini3 Pro。
DeepSeek-V3.2-Speciale则是此次的重头戏 ,其目标是“将开源模型的推理能力推向极致,探索模型能力的边界” 。据介绍,Speciale是V3.2的长思考增强版 ,同时结合了DeepSeek-Math-V2的定理证明能力,该模型具备出色的指令跟随 、严谨的数学证明与逻辑验证能力。
据DeepSeek公布的数据,Speciale在多个推理基准测试中超越谷歌最先进的Gemini3 Pro。具体来看 ,在美国数学邀请赛、哈佛MIT数学竞赛、国际奥林匹克数学竞赛等测试中,V3.2-Speciale都超过了Gemini3 Pro,但在编程、理工科博士生测试中略逊于谷歌 。
同时 ,Speciale模型斩获了IMO(国际数学奥林匹克) 、ICPC World Finals(国际大学生程序设计竞赛全球总决赛)及IOI(国际信息学奥林匹克)金牌。其中,ICPC 与 IOI 成绩分别达到了人类选手第二名与第十名的水平。
尽管取得了这些成就,但在技术报告中,DeepSeek承认 ,与Gemini3 Pro等前沿闭源模型相比,自家模型仍存在一定的局限性 。首先,V3.2的世界知识广度仍落后于领先的专有模型 ,其次在令牌(Token)效率方面,V3.2通常需要更多的令牌才能达到像Gemini3 Pro这样的模型输出质量。在解决复杂任务方面也不如前沿模型。
DeepSeek称,团队计划在未来通过增加预训练计算量来填补知识空白 ,并专注于优化模型推理链的智能密度以提高效率,进一步改进基础模型和训练后方案 。
值得一提的是,在技术报告中 ,DeepSeek还谈到当前开源与闭源模型的差距在拉大。
DeepSeek表示,推理模型的发布是大模型发展的关键转折点,推动了整体性能的大幅跃升。自这一里程碑事件以来 ,大模型能力在快速发展 。然而,过去几个月中出现了明显的分化:尽管开源圈持续取得进步,但闭源专有模型如海外谷歌、OpenAI、Anthropic的性能增长速度却显著更快。
“闭源模型与开源模型之间的性能差距并未缩小,反而日益扩大 ,专有系统在复杂任务中展现出越来越强的优势。 ”DeepSeek认为,其中有三个关键的缺陷。
一方面,在架构层面 ,对标准注意力机制的过度依赖严重制约了长序列处理的效率;其次,在资源分配方面,开源模型在后训练阶段的计算投入不足 ,限制了模型在高难度任务上的表现;最后,在AI智能体领域,开源模型在泛化能力和指令遵循能力上与专业模型相比存在明显差距 ,影响实际部署效果 。
为了突破这些限制,DeepSeek在9月底发布实验版V3.2-Exp时,提出了稀疏注意力机制(DSA) ,希望大幅降低计算复杂度。在经过两个月的实验后,DeepSeek确认了稀疏注意力机制的有效性,并表示,在不牺牲长上下文性能的前提下 ,团队解决了关键的计算复杂性问题。
此次发布的两款模型均引入了这一机制 。据DeepSeek,除了在多个推理基准测试中,V3.2的性能大幅提升外 ,在智能体场景中,V3.2也成为一种具有成本效益的替代方案,不仅缩小了开源模型与前沿专有模型之间的性能差距 ,成本也显著降低。
目前,DeepSeek的官方网页端 、App 和 API 均已更新为正式版 DeepSeek-V3.2,但增强的Speciale版本目前仅以临时API服务形式开放 ,供社区评测与研究。
在海外社媒上,有网友认为,DeepSeek 此次发布是了不起的成就 ,“匹配 GPT-5和Gemini3 Pro的开源模型出现了,差距正式消除 。”DeepSeek不断证明,严谨的工程设计可以超越单纯的参数规模。但如同DeepSeek所述的那样,我们仍需正视开源与闭源在整体性能上的差距 ,不断突破开源的边界。
股票开户了在哪买:杭州股票配资-10倍压缩率、97%解码精度!DeepSeek开源新模型 为何赢得海内外关注
炒股10倍杠杆平台:新人开户买股票技巧-“DeepSeek冲击”后最大抛压!美国AI巨头举债豪赌算力 华尔街买账吗
股票怎么开账户:炒股入门知识配资平台-外交部:中方欢迎印度总理莫迪来华出席上合组织天津峰会
买股票开户哪个平台最好:网上杠杆炒股-一场天价官司:寒武纪“寒不寒心”
怎么办理加杠杆炒股:股票平台哪个收费低-盒马会员店将“归零”!继续聚焦主力店和NB折扣店两大业态
石家庄配资公司:炒股杠杆股票平台-金融监管总局发布最新数据!股份行净息差环比回升1个基点
嘉多网配资-轻松杠杆炒股首选-掌握股票配资专家门户!提示:文章来自网络,不代表本站观点。
记者王珍中国国际经济交流中心副理事长、国务院发展研究中心原副主任王一鸣周一在“中国发展高层论坛2025...
2025年3月24日下午三点A股收盘后,港股科技板块持续走强至四点十分收盘。消息面上,一方面美元相对于人民币连续3个交易...
记者|赵阳戈年初,证监会就修改《证券发行与承销管理办法》部分条款向社会公开征求意见,市场也将注意力投向了...
记者辛圆3月25日,博鳌亚洲论坛旗舰报告《亚洲经济前景及一体化进程2025年度报告》(以下简称《报告》...
近日,开源证券大连分公司遭大连证监局处罚,暂停其办理需要合格投资者认定相关业务六个月。该惩处力度在近年来券商分支机构中并...
沪深两市成交额连续第44个交易日突破1万亿,较昨日此时缩量超900亿。...
3月24日,业内权威专家表示,MLF(中期借贷便利)不再有统一的中标利率,标志着MLF利率的政策属性完全退出。3月24日...
3月12日,汇丰发布对于中国投资市场的最新观点。汇丰环球私人银行及财富管理中国首席投资总监匡正表示,DeepSe...
3月24日,易方达国证自由现金流ETF公开发售。该产品跟踪国证自由现金流指数,这个指数是什么?有哪些优势?投资价值如何?...
3月24日,海洋王照明科技股份有限公司(以下简称“海洋王”,002724.SZ)早盘一字跌停,此后股价拉涨,尾盘封涨停板...
2025年3月25日,倍轻松(688793.SH)公告称,公司股东宁波倍松投资有限公司(简称“宁波倍松”)拟通过大宗交易...
记者辛圆给补贴、建平台,为了吸引更多高层次人才,各地纷纷放出“大招”。据央广网周一发布消息,湖...
【隔夜行情】•周五(2025年3月21日),A股三大指数集体下跌,截至收盘,截止收盘,沪指跌1.29%,报收33...
3月24日,AI眼镜概念股开盘拉升,瀛通通讯直线涨停,明月镜片涨超10%,比依股份、博士眼镜、恒玄科技、国光电器等跟涨。...
文丨财联社据中汽协8月10日发布的数据显示,今年1至7月,我国汽车产销量达1565万辆和1562.6万辆...