阿里Qwen3-Max版评测：数学满分但推理耗token，性能引期待

时间：2025-11-30 14:53

阿里最新推出的Qwen3-Max-Thinking早期预览版引发了AI领域的广泛关注。这款推理模型作为Qwen 3系列中的顶级版本，虽然目前仍处于训练中期阶段，但已在多项高难度基准测试中展现出惊人实

日前，阿里推出的Qwen3-Max-Thinking早期预览版在AI领域引发了广泛关注。这款推理模型作为Qwen 3系列的旗舰版本，虽然目前仍处于训练中期阶段，却已在多项高难度基准测试中展现了惊人实力。在AIME 2025数学竞赛和哈佛-MIT数学锦标赛（HMMT）中，该模型凭借工具运用和测试时计算技术，实现了100%准确率的突破性成绩。

该模型的技术细节尚未完全公开，但通义千问团队透露其创新性地融合了思考模式与非思考模式。在Qwen Chat和阿里云平台开放试用后，开发者发现模型在智能体编程、常识推理以及数理科学领域均表现出显著提升。尤为值得注意的是，模型在思考模式下会通过多轮验证确保答案准确性，这一特性在处理复杂问题时尤为突出。

实测数据显示，在面对AIME 2025竞赛压轴题时，Qwen3-Max-Thinking不仅反复验证正确答案，还会主动调用代码解释器从不同角度证明结果。整个推理过程持续约4-5分钟，消耗1.2万至1.5万个token。这种深度推理能力虽然带来较高计算成本，但用户可通过1024-81920个token的可调预算控件进行灵活控制。

在智能体编程任务中，该模型与DeepSeek-V3.2的对比测试颇具看点。当要求开发开源项目分享平台的HTML原型时，Qwen3-Max-Thinking生成的1417行代码虽略显冗长，但完整实现了需求功能。相比之下，DeepSeek-V3.2仅用787行代码就完成了相似任务，显示出不同模型在代码效率上的差异。不过前者在需求分析准确性方面表现更优，生成的网页原型更符合实际使用场景。

目前Qwen3-Max-Thinking仅支持文本到文本的单一模态，且未在Hugging Face等主流平台开源。阿里云API提供的限时免费服务吸引了大量开发者尝鲜，但完整基准测试结果尚未公布。随着训练进程推进，更多版本预计将陆续发布，这款专为高难度推理设计的模型能否在通用场景中保持优势，仍有待进一步观察验证。

来源：https://www.itbear.com.cn/html/2025-11/1009475.html

上一篇中石化携手LG开发钠电池材料，推动能源转型与可持续发展 下一篇五菱灵犀动力双认证，高效品质如何引领混动新潮流

本站内容用于信息整理与展示，如有侵权或内容问题请及时联系处理。

同类最新

继续查看同栏目最近更新的文章。

科技数码 · 2026-07-02

LiblibAI云端WebUI降低AI绘画部署门槛

LiblibAI在线WebUI的核心优势在于——只需通过浏览器即可流畅运行Stable Diffusion，无需自行搭建本地环境。云端直接处理运算，模型即选即试，大幅降低了AI绘画的创作门槛。对于轻量创作和模型快速测试来说，体验相当顺畅，但用户仍需重视数据隐私保护和版权合规等问题。过去使用Stab

科技数码 · 2026-07-02

微软因用户不安叫停Edge浏览器AI历史搜索功能

微软紧急暂停Edge浏览器AI历史搜索功能，该功能因被用户吐槽“令人不安”而暂缓部署。尽管微软强调所有AI处理在设备端完成且数据不上传云端，但用户仍不信任。此举与WindowsK2计划减少功能堆砌的理念一致。

科技数码 · 2026-07-02

红魔游戏平板5 Pro发布 4999元起售将登陆全球市场

【CNMO科技消息】近日，红魔游戏平板5 Pro正式发布。这款平板从定位上就明确瞄准“极致游戏”体验，外观方面带来了一个重磅亮点——首次引入RGB水冷散热系统，背部那条可视化的水路通道，配合纯平透明背板设计，核心配置信息一览无余，科技感十足。图源网络屏幕方面同样表现突出。一块9 06英寸OLED

科技数码 · 2026-07-02

杭州全国首所机器人学校首批30台机器人入学

30台机器人整齐列队，有的刚从生产线卸下，机械零件还带着崭新的“工业气息”；有的已搭载运动控制模块，能稳健地小跑、跳跃几下。它们来自不同制造工厂，外形与功能各有千秋，但此刻都拥有了同一个身份——杭州机器人学校的第一批入学新生。 6月30日，杭州经信正式发布：由浙江大学机器人研究院、浙江省质量科学研究

科技数码 · 2026-07-02

美国计划发射航天器托举天文卫星

就在最近，NASA公布了一项非常果断的干预计划——他们定于6月30日实施一次“卫星维修任务”，派遣一台名为“连接”号的机器人服务卫星，为一颗超期服役的天文卫星延长运行寿命。这颗卫星是“尼尔·格雷尔斯·斯威夫特天文台”，其轨道高度正在不断衰减，如果不进行干预，今年年底前很可能会坠入地球大气层并烧毁。