首页 游戏 软件 资讯 排行榜 专题
首页
科技数码
DeepSeek开源模型挑战谷歌,揭示与闭源差距拉大关键

DeepSeek开源模型挑战谷歌,揭示与闭源差距拉大关键

热心网友
62
转载
2025-12-02

12月1日晚,DeepSeek再次发布了两款全新模型——DeepSeek-V3.2和DeepSeek-V3.2-Speciale,在推理能力上取得全球领先地位。

这两款模型定位各有侧重。DeepSeek-V3.2旨在平衡推理性能与输出长度,特别适合日常应用场景,例如智能问答和通用人工智能任务处理。9月底公司曾推出实验版V3.2-Exp,而这次则是正式版更新。根据公开推理测试数据显示,V3.2已经达到了GPT-5的水准,仅略微落后于谷歌的Gemini3+Pro。

DeepSeek-V3.2-Speciale堪称此次发布的重头戏,其设计目标是将开源模型的推理能力推向极致,探索人工智能技术的性能边界。据介绍,Speciale作为V3.2的长思考增强版本,同时融合了DeepSeek-Math-V2的定理证明能力,该模型在指令遵循、严谨的数学证明与逻辑验证方面展现出卓越实力。

根据DeepSeek公布的数据,Speciale在多个推理基准测试中均超越了谷歌最先进的Gemini3+Pro。具体而言,在美国数学邀请赛、哈佛MIT数学竞赛、国际奥林匹克数学竞赛等专业测试中,V3.2-Speciale表现均优于Gemini3+Pro,但在编程与理工科博士生测试环节则稍稍落后于谷歌模型。

DeepSeek-V3.2系列与其他模型在各类数学、代码与通用领域评测集上的得分(括号内为消耗Tokens总量约数)

值得关注的是,Speciale模型一举斩获了IMO(国际数学奥林匹克)、ICPC World Finals(国际大学生程序设计竞赛全球总决赛)及IOI(国际信息学奥林匹克)三大金牌。其中,在ICPC与IOI竞赛中的成绩分别达到了人类选手第二名与第十名的水平。

尽管取得了这些突破性成果,DeepSeek在技术报告中坦言,与Gemini3+Pro等前沿闭源模型相比,自家产品仍存在一定局限性。首先,V3.2的世界知识广度仍落后于领先的专有模型;其次在令牌效率方面,V3.2通常需要更多的令牌才能达到与Gemini3+Pro相当的输出质量;在处理复杂任务时也不如前沿模型表现优异。

DeepSeek表示,团队计划在未来通过增加预训练计算量来填补知识空白,并致力于优化模型推理链的智能密度以提升效率,持续改进基础模型和训练后方案。

值得一提的是,在技术报告中,DeepSeek还谈到当前开源与闭源模型之间的差距正在拉大。

DeepSeek指出,推理模型的发布是大模型发展的关键转折点,推动了整体性能的大幅跃升。自这一里程碑事件以来,大模型能力进入快速发展期。然而,过去几个月中出现了明显的分化趋势:尽管开源领域持续取得进步,但闭源专有模型如谷歌、OpenAI、Anthropic的性能增长速度明显更快。

“闭源模型与开源模型之间的性能差距并未缩小,反而日益扩大,专业系统在处理复杂任务时展现出越来越强的优势。”DeepSeek认为,这其中存在三个关键的技术缺陷。

一方面,在架构层面,对标准注意力机制的过度依赖严重制约了长序列处理的效率;其次,在资源分配方面,开源模型在后训练阶段的计算投入不足,限制了模型在高难度任务上的表现;最后,在人工智能领域,开源模型在泛化能力和指令遵循能力方面与专业模型相比存在明显差距,影响了实际部署效果。

为了突破这些限制,DeepSeek在9月底发布实验版V3.2-Exp时,提出了稀疏注意力机制,希望显著降低计算复杂度。经过两个月的实验验证,DeepSeek确认了稀疏注意力机制的有效性,并表示在不牺牲长上下文性能的前提下,团队成功解决了关键的计算复杂度问题。

此次发布的两款模型均引入了这一创新机制。据DeepSeek透露,除了在多个推理基准测试中V3.2性能大幅提升外,在智能体场景中,V3.2也成为一种具有成本效益的替代方案,不仅缩小了开源模型与前沿专有模型之间的性能差距,运营成本也显著降低。

目前,DeepSeek的最新网页端、App和API均已更新为正式版DeepSeek-V3.2,但增强版Speciale目前仅以临时API服务形式开放,供社区评测与研究使用。

在海外社交媒体上,有网友认为DeepSeek此次发布取得了不起的成就,“能够匹配GPT-5和Gemini3+Pro的开源模型已经出现,性能差距正式消除。”DeepSeek不断证明,严谨的工程设计可以超越单纯的参数规模。但正如DeepSeek所述,我们仍需正视开源与闭源在整体性能上的差距,不断突破开源技术的性能边界。

来源:https://www.itbear.com.cn/html/2025-12/1036363.html
免责声明: 游乐网为非赢利性网站,所展示的游戏/软件/文章内容均来自于互联网或第三方用户上传分享,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系youleyoucom@outlook.com。

最新APP

宝宝过生日
宝宝过生日
应用辅助 04-07
台球世界
台球世界
体育竞技 04-07
解绳子
解绳子
休闲益智 04-07
骑兵冲突
骑兵冲突
棋牌策略 04-07
三国真龙传
三国真龙传
角色扮演 04-07

热门推荐

企业网络安全等级保护合规指南:龙虾养殖业如何落地实施
AI资讯
企业网络安全等级保护合规指南:龙虾养殖业如何落地实施

摘要由实在Agent通过智能技术生成。此内容由AI根据文章内容自动生成,并已由人工审核。 随着企业数字化转型进入智能体(Agent)驱动的新阶段,如何平衡AI创新与安全合规成为关键挑战。尤其在《网络安全等级保护基本要求》(等保2 0)的严格框架下,企业级智能体的部署必须同时满足效率提升与合规保障的双

热心网友
05.23
外贸业务员年终总结PPT制作指南 AI高效提升总结效果
AI教程
外贸业务员年终总结PPT制作指南 AI高效提升总结效果

使用情景 对于外贸从业者来说,年终总结绝非简单的例行汇报。它是一次至关重要的年度复盘与战略规划,既要系统梳理过去一年的业绩成果与经验得失,也要为来年的市场开拓与业务增长指明清晰路径。在全球贸易竞争白热化的今天,一份逻辑严谨、数据详实、洞察深刻的总结报告,不仅是个人专业能力的集中体现,更是赢得管理层支

热心网友
05.23
WPS AI一键生成年度安全工作总结PPT高效制作专业汇报
AI教程
WPS AI一键生成年度安全工作总结PPT高效制作专业汇报

使用情景 又到年末了,年度安全工作总结是每个团队都绕不开的环节。这份总结的价值,远不止于一份简单的回顾。它更像是一份“体检报告”,清晰地告诉你过去一年安全工作的“健康状况”——哪里做得好,哪里还有隐患,从而为来年的精准施策打下坚实的基础。 不过,说起写总结、做PPT,不少人就开始头疼了:内容怎么组织

热心网友
05.23
ZEC价格暴涨520%后还能买吗 深度解析Zcash未来走势与投资潜力
web3.0
ZEC价格暴涨520%后还能买吗 深度解析Zcash未来走势与投资潜力

Zcash (ZEC) 月度暴涨520%:深度解析后市行情与关键点位 近期,隐私币龙头Zcash (ZEC) 上演了一场令人瞩目的行情,月度涨幅高达520%,价格一度逼近300美元,创下自2021年12月以来的新高。在加密市场整体承压的背景下,ZEC的逆势狂飙吸引了全球投资者的目光。本文将结合技术分

热心网友
05.23
电商售后数据自动汇总分析流程与智能化方案详解
AI资讯
电商售后数据自动汇总分析流程与智能化方案详解

在存量竞争的时代,电商售后数据早已超越了“成本中心”的单一角色,它正成为洞察产品质量、优化物流链路、提升用户忠诚度的核心战略资产。然而,现实往往骨感:多平台、多店铺、多套ERP系统并存,数据散落一地。靠人工手动汇总?不仅耗时费力,更关键的是,你永远无法实现真正的实时预警与敏捷响应。那么,电商售后数据

热心网友
05.23