12月1日晚,DeepSeek又上新了两款新模型 ,DeepSeek-V3.2和DeepSeek-V3.2-Speciale,在推理能力上全球领先。
两款模型有着不同的定位 。DeepSeek-V3.2的目标是平衡推理能力与输出长度,适合日常使用 ,例如问答场景和通用智能体任务场景。9月底DeepSeek发布了实验版V3.2-Exp,此次是正式版更新。在公开推理测试中,V3.2达到了GPT-5的水平 ,仅略低于谷歌的Gemini3 Pro 。
DeepSeek-V3.2-Speciale则是此次的重头戏,其目标是“将开源模型的推理能力推向极致,探索模型能力的边界”。据介绍,Speciale是V3.2的长思考增强版 ,同时结合了DeepSeek-Math-V2的定理证明能力,该模型具备出色的指令跟随 、严谨的数学证明与逻辑验证能力。
据DeepSeek公布的数据,Speciale在多个推理基准测试中超越谷歌最先进的Gemini3 Pro 。具体来看 ,在美国数学邀请赛、哈佛MIT数学竞赛、国际奥林匹克数学竞赛等测试中,V3.2-Speciale都超过了Gemini3 Pro,但在编程 、理工科博士生测试中略逊于谷歌。
同时 ,Speciale模型斩获了IMO(国际数学奥林匹克)、ICPC World Finals(国际大学生程序设计竞赛全球总决赛)及IOI(国际信息学奥林匹克)金牌。其中,ICPC 与 IOI 成绩分别达到了人类选手第二名与第十名的水平。
尽管取得了这些成就,但在技术报告中 ,DeepSeek承认,与Gemini3 Pro等前沿闭源模型相比,自家模型仍存在一定的局限性 。首先 ,V3.2的世界知识广度仍落后于领先的专有模型,其次在令牌(Token)效率方面,V3.2通常需要更多的令牌才能达到像Gemini3 Pro这样的模型输出质量。在解决复杂任务方面也不如前沿模型。
DeepSeek称,团队计划在未来通过增加预训练计算量来填补知识空白 ,并专注于优化模型推理链的智能密度以提高效率,进一步改进基础模型和训练后方案 。
值得一提的是,在技术报告中 ,DeepSeek还谈到当前开源与闭源模型的差距在拉大。
DeepSeek表示,推理模型的发布是大模型发展的关键转折点,推动了整体性能的大幅跃升。自这一里程碑事件以来 ,大模型能力在快速发展 。然而,过去几个月中出现了明显的分化:尽管开源圈持续取得进步,但闭源专有模型如海外谷歌、OpenAI 、Anthropic的性能增长速度却显著更快。
“闭源模型与开源模型之间的性能差距并未缩小 ,反而日益扩大,专有系统在复杂任务中展现出越来越强的优势。 ”DeepSeek认为,其中有三个关键的缺陷 。
一方面 ,在架构层面,对标准注意力机制的过度依赖严重制约了长序列处理的效率;其次,在资源分配方面,开源模型在后训练阶段的计算投入不足 ,限制了模型在高难度任务上的表现;最后,在AI智能体领域,开源模型在泛化能力和指令遵循能力上与专业模型相比存在明显差距 ,影响实际部署效果。
为了突破这些限制,DeepSeek在9月底发布实验版V3.2-Exp时,提出了稀疏注意力机制(DSA) ,希望大幅降低计算复杂度。在经过两个月的实验后,DeepSeek确认了稀疏注意力机制的有效性,并表示 ,在不牺牲长上下文性能的前提下,团队解决了关键的计算复杂性问题 。
此次发布的两款模型均引入了这一机制。据DeepSeek,除了在多个推理基准测试中 ,V3.2的性能大幅提升外,在智能体场景中,V3.2也成为一种具有成本效益的替代方案,不仅缩小了开源模型与前沿专有模型之间的性能差距 ,成本也显著降低。
目前,DeepSeek的官方网页端、App 和 API 均已更新为正式版 DeepSeek-V3.2,但增强的Speciale版本目前仅以临时API服务形式开放 ,供社区评测与研究。
在海外社媒上,有网友认为,DeepSeek 此次发布是了不起的成就 ,“匹配 GPT-5和Gemini3 Pro的开源模型出现了,差距正式消除 。”DeepSeek不断证明,严谨的工程设计可以超越单纯的参数规模。但如同DeepSeek所述的那样 ,我们仍需正视开源与闭源在整体性能上的差距,不断突破开源的边界。
东财图解·加点干货什么是炒股加杠杆融资:买股票怎么上杠杆-业内:2025年第一批稀土开采、冶炼分离总量控制指标已下发
散户适合买什么股票:杠杆融资炒股意味什么-遭知名歌手郑智化控诉“没人性” 深圳机场深夜再道歉:立行立改 将增加保障人员并试点启用有一定坡度的登机连接装置
手机用什么软件看股票:如何融资加杠杆炒股-特朗普突发!超六成美国人反对!
券商股票排行前十名有哪些:如何融资加杠杆炒股-事关加密货币 美联储宣布重大行动!什么信号?
股票怎么融资加杠杆:什么是炒股杠杆-董事长突遭拘留 万通发展转型“芯片”之路添变数
杠杆原理炒股方法:股票什么app软件-利好来了!多家A股公司发布利好公告
翔云优配-翔云优配官网-十大股票配资提示:文章来自网络,不代表本站观点。
翔云优配-翔云优配官网-十大股票配资㉖携手我们,共同迈向财富的未来!全国前10的配资公司,安全稳定,值得信赖。
界面新闻记者|杨志锦界面新闻编辑|王姝...
界面新闻记者|吕文琦在资本市场持续升温下,保险中介机构又开启了新一轮上市潮。2025年开年以来,手回...
实习记者|章宇璠记者|张一诺保险业再迎3项资金运用内部控制应用指引国家金融监督管...
近日,*ST中润(000506,全称为“中润资源股份有限公司”,以下简称“中润资源”)发布公告称,拟更换会计师事务所,由...
界面新闻记者|郭净净继2023年9月撤回科创板IPO申请后,疫苗生产商江苏中慧元通生物科技股份有限公司(简称...
界面新闻记者|吕文琦为孩子投保50万元保额的重疾,因暴发性心肌炎身故后只能获赔一万余元的已交保费。这一案例将...
界面新闻记者|曾令俊连连数字...
界面新闻记者|何柳颖界面新闻编辑|王姝...
记者|赵阳戈莱特光电(688150.SH)实控人王亚龙、李红燕夫妇共同控制的宇隆光电近日再度IPO辅导备...
文丨财联社自今年以来,中特估这一概念时常被市场提起。正如机构此前指出,这一概念是港股新核心资产,低估值、...
界面新闻记者|冯赛琪3月19日上午,法巴证券(中国)有限公司、上海国际再保险登记交易中心有限公司、安盛环球再...
李强主持召开国务院常务会议,研究建立健全涉企收费长效监管机制有关举措。会议指出,加强涉企收费监管是降低企业经营成本、优化...
界面新闻记者|孙艺真3月21日晚间,沪深交易所发布《以上市公司质量为导向的保荐机构执业质量评价实施办法(试行...
记者辛圆3月25日,博鳌亚洲论坛旗舰报告《亚洲经济前景及一体化进程2025年度报告》(以下简称《报告》...
3月21日,机器人产业延续回调,机器人产业ETF(159551.SZ)下跌2.7%。机器人概念股大幅走低,截至上午收盘...