游乐游手机版
首页/AI教程/文章详情

阿里云Qwen3.8-Max正式上线:API服务与Token Plan同步开放

时间:2026-08-15 14:14
Qwen3 8总参数量2 4万亿,在编程(Coding)和专业协作(Cowork)方面能力大幅提升,整体性能处于全球大模型前列。得益于模型架构、后训练方案和软硬一体化的协同创新,Qwen3 8在实际推理中能以更快的速度产出智能,可以独立自主编程16天,全程稳定可靠。目前,Qwen3 8-Max的AP

Qwen3.8总参数量2.4万亿,在编程(Coding)和专业协作(Cowork)方面能力大幅提升,整体性能处于全球大模型前列。得益于模型架构、后训练方案和软硬一体化的协同创新,Qwen3.8在实际推理中能以更快的速度产出智能,可以独立自主编程16天,全程稳定可靠。
目前,Qwen3.8-Max的API服务已首发上线千问AI平台,全球开发者可直接调用,国内每百万Tokens输入12元、输出36元,隐式缓存命中仅1.5元,而输入与输出的国际价格仅为Opus5的40%与24%,实现相近智能更高性价比。在构建Coding Agent、搭建多模态应用以及接入企业级智能体流程等场景,开发者都能通过千问AI平台一站式获取模型能力,灵活适配各类主流智能体框架。
千问AI平台也为Token Plan用户带来Qwen3.8-Max 的专属限时优惠:夜间时段使用新模型享5折Credits消耗;8月5日前所有已购买个人版Token Plan的用户本周可获取1次7天额度重置权益。

Qwen3.8Max发布.png

一、阿里云 Qwen3.8-Max 模型是什么?

Qwen3.8-Max 是通义千问系列目前综合能力最突出的多模态旗舰大模型,已于 2026 年 8 月正式发布。模型参数规模达到 2.4 万亿,采用 MoE(Mixture of Experts)架构,在文本生成、深度推理、视觉理解等多个关键维度上,都展现出了足以对标全球顶尖模型的性能表现。

其核心定位是面向高复杂度、高精度要求的专业任务,可端到端交付生产级成果,适用于法律、金融、UI/UX 设计、芯片设计、量化交易、教育解题、三维创作等数百种高价值场景。
此外,Qwen3.8-Max 支持自主编程,能独立完成跨越数天的真实项目开发,并通过反馈闭环实现自我进化。

二、Qwen3.8-Max 的模型能力

Qwen3.8-Max的能力边界远超传统对话机器人,它被定义为一个能够处理复杂、长周期任务的智能体基座。

在编程与开发领域,Qwen3.8-Max展现了惊人的自主性。它不仅能进行代码补全和生成,更能独立完成长达16天的真实软件工程项目开发。在内部测试中,它成功构建了一个名为“oh-my-cli”的自进化智能体框架,实现了从需求分析、代码生成、测试到日志分析的工程闭环,在FrontendCodeArena榜单中排名第四。

在长文本与多模态处理方面,该模型支持长达100万Token的上下文窗口。这意味着它可以一次性读取并理解整部电视剧集、长达100小时的直播内容或数百页的技术文档,并将其转化为可交互的知识库。其视觉智能能力(VisionArena排名第二)允许用户通过上传UI截图来重建完整的前端网页项目,或将2D平面图转换为3D室内效果图。

此外,在科学研究与复杂逻辑推理上,Qwen3.8-Max也表现优异。它不仅能复现已有的研究实验,还能设计出优于原始论文的新方法,并在WWW2025多模态对话意图识别挑战赛中超越了人类参赛者的表现。

1. 多模态输入与输出

输入模态:支持 文本(Text)、图像(Image)、视频(Video),其中视频最长支持 2 小时或 2GB,图像最高支持 1600 万像素。 输出模态:仅输出 文本(Text)。

2. 上下文与长度限制

最大上下文长度:1,000,000 tokens 最大输入长度:991,808 tokens 最大输出长度:131,072 tokens 最大思维链(CoT)长度:262,144 tokens

3. 高级功能支持情况(以华北2 北京区域为例)

功能项 支持情况
Function Calling(函数调用) 支持
结构化输出(如 JSON Schema) 支持
联网搜索(Web Search) 支持(仅限华北2 北京;其他国际区域如新加坡、东京、法兰克福、弗吉尼亚均不支持)
前缀续写(Prefix Completion) 支持
上下文缓存(Context Caching) 支持
批量推理(Batch Inference) 仅华北2 北京支持;其他区域不支持
模型调优(Fine-tuning) 全区域均不支持

4. 核心能力亮点

长程任务系统级规划:可在数千轮交互中重构算法与策略(如商业模拟、芯片设计)。 原生视觉生产力:贯穿任务全流程的视觉理解与行动能力,支持教育解题、视频语义解析、3D 创作等。 内置工具链(Harness):自动调用联网搜索、代码解释器、网页抓取、以图搜图、文搜图等工具。

三、Qwen3.8-Max 的模型价格(以华北2 北京为例)

对于企业级用户和开发者而言,成本是选择模型的重要考量。Qwen3.8-Max依托其MoE架构,在推理成本上相比同量级的密集模型具有显著优势。

根据官方披露的数据,Qwen3.8-Max的每百万输出Token成本约为6美元。这一价格远低于业内其他同类标杆模型(部分高达50美元/百万Token),极大地降低了高性能AI的使用门槛。

在阿里云百炼平台上,Qwen3.8-Max主要提供两种计费模式:

按量计费(标准API):适用于临时测试或低频调用场景,用户根据实际消耗的输入和输出Token数量付费,用多少付多少,灵活便捷。 Token Plan订阅制:适用于高频协作团队。用户通过购买预付费套餐(如团队版),获得固定的Credits额度。这种方式不仅单价更低,还能享受多模型统一管理的便利。
计费项 价格
输入 Token 12 元 / 百万 tokens
输出 Token 36 元 / 百万 tokens
缓存命中输入(使用上下文缓存) 1.5 元 / 百万 tokens

四、Qwen3.8-Max 的工具调用价格

在智能体(Agent)应用场景中,模型往往需要调用外部工具(如搜索引擎、代码解释器、API接口等)来完成任务。Qwen3.8-Max具备强大的工具调用与长周期自主执行能力。

关于工具调用的具体计费,通常遵循阿里云百炼平台的统一标准。在大多数情况下,模型在思考过程中产生的内部推理Token(包括工具调用的指令生成和结果分析)会纳入总Token消耗量进行计费。

有一点很关键,阿里云会不定期围绕特定功能推出优惠活动。比如在Token Plan团队版里,Qwen3.7-Max等模型就曾有过Credits消耗减半的优惠。至于作为最新旗舰的Qwen3.8-Max,具体是否有折扣、折扣力度多大,仍要以百炼控制台的实时公告为准。不过可以确定的是,开启enable_thinking参数,充分释放它的长周期推理和智能体能力,正是这款模型最核心的使用场景之一。

五、Qwen3.8-Max 的免费额度

阿里云为新用户提供丰富的免费试用资源:

百炼平台新用户:开通即赠 超 7000 万 tokens; 千问 AI 平台新用户:赠送 1 亿 tokens 额度; Token Plan 个人版:首发体验 Qwen3.8-Max,提供基础额度用量充裕,且夜间调用更省钱。

免费额度可用于包括 Qwen3.8-Max 在内的多种模型,具体可用额度请登录阿里云百炼大模型服务平台查看:https://www.aliyun.com/product/bailian

重磅发布Qwen3.8Max.png

六、Qwen3.8-Max 的 API 代码示例

虽然知识库未提供完整代码片段,但明确指出:

Qwen3.8-Max 兼容主流 AI 编程框架的 Responses API; 可通过 阿里云百炼 CLI 一行命令调用; 在百炼平台中,只需指定 modelId: "qwen3.8-max" 即可启用全部能力(包括内置工具)。

典型调用逻辑如下:

1、Completions API

2、Responses API

七、Qwen3.8-Max 支持的模型订阅计划有哪些?

目前 Qwen3.8-Max 主要通过以下方式提供服务,采用 按量付费 额度抵扣模式:

1、Token Plan(令牌计划)

个人版Token Plan:针对独立开发者、学生及AI爱好者。提供灵活的月度订阅档位,价格亲民。用户可以根据每月的预估Token消耗量选择合适的套餐,享受比按量计费更优惠的单价,适合个人项目开发和日常学习使用。 团队版Token Plan:专为中小企业及高频协作团队设计。提供更高额度的Credits和更高的并发限制。团队版支持多成员共享额度,并提供企业级的技术支持和数据安全保障。购买团队版后,系统会生成专属的API Key,用户可以在百炼控制台统一管理团队成员的使用情况,非常适合需要稳定、高频调用Qwen3.8-Max的商业应用场景。 可使用免费额度或购买 Token 包抵扣调用费用; Qwen3.8-Max 明确支持 TokenPlan 抵扣。活动详情可参考:https://www.aliyun.com/benefit/scene/tokenplan

Lite版本39.png

2、夜间错峰0.2折特惠(22:00 - 次日08:00)
这是当前最值得关注的福利。在北京时间每晚22:00至次日08:00期间,Qoder、Meoo以及TokenPlan的客户使用Qwen3.8-Max模型,可享受0.2折的超低折扣(计费系数降至0.01x)。这意味着,原本昂贵的旗舰模型调用成本将降低98%,用户可以用极低的预算完成大规模的数据处理、代码训练或长文本分析任务。活动详情可参考:https://www.aliyun.com/benefit/client/nightplan

Qwen3.8Max5折.png

3、百炼平台标准计费

按实际输入/输出 token 数量计费; 支持上下文缓存以降低重复输入成本。

综上,Qwen3.8-Max作为通义千问系列的新一代旗舰大模型,凭借2.4万亿参数规模、百万级超长上下文、16天自主编程能力和全球领先的多模态表现,重新定义了智能体基座的性能标杆。依托阿里云百炼平台极具竞争力的定价体系、新用户超亿级免费额度,以及Token Plan用户专属的夜间5折、额度重置等限时福利,开发者与企业无需承担过高成本,即可快速接入这款顶尖模型,在Coding Agent搭建、多模态应用开发、企业级智能体落地等场景中,以更低门槛释放AI生产力,抢占智能体时代的技术先机。

来源:https://developer.aliyun.com/article/1753965
上一篇用100次重复提问测试GEO概率波动规律 下一篇Claude Code接入Java LSP进入Java生态,通用Agent与专属引擎区别解析
本站内容用于信息整理与展示,如有侵权或内容问题请及时联系处理。

相关推荐

补充同频道和同主题内容,方便继续浏览更多相关内容。

同类最新

继续查看同栏目最近更新的文章。

更多
CAD零基础入门教程:坐标输入、图层管理与基础绘图命令
AI教程 · 2026-09-01

CAD零基础入门教程:坐标输入、图层管理与基础绘图命令

本文面向CAD零基础学习者,系统讲解坐标输入、图层管理与基础绘图命令的核心用法。通过分步实操与常见问题排查,帮助新手建立精确绘图习惯,掌握规范出图的基础能力。

CAD从入门到项目交付:绘图、标注、图块与实战工作流
AI教程 · 2026-09-01

CAD从入门到项目交付:绘图、标注、图块与实战工作流

掌握CAD的核心在于建立“画得准、标得清、复用快、交付稳”的工作流。本文提供从环境设置、高频命令组合、标注规范、图块标准化到项目分阶段交付的完整路径,帮助初学者避免常见返工陷阱,独立完成可检查、可复用、可打印的工程图纸。

Claude Code 登录指南:个人、Teams 与企业账号区分与授权步骤
AI教程 · 2026-09-01

Claude Code 登录指南:个人、Teams 与企业账号区分与授权步骤

本文详细解析 Claude Code 登录前的账号类型区分方法,涵盖个人订阅、Teams 席位与企业 Enterprise 席位的授权路径差异。提供终端登录命令、环境变量排查及常见异常处理步骤,帮助用户快速完成正确授权并避免登录路径混淆。

Claude Code 文件修改前的权限模式配置与命令审批指南
AI教程 · 2026-09-01

Claude Code 文件修改前的权限模式配置与命令审批指南

本文详细介绍Claude Code在修改文件前的权限模式配置方法,包括defaultMode可选值、permissions allow与deny规则设置、多层级配置文件管理以及 status验证技巧,帮助开发者安全高效地使用AI编程助手。

Claude Code接入VS Code后先测扩展和终端命令
AI教程 · 2026-09-01

Claude Code接入VS Code后先测扩展和终端命令

在VS Code中接入Claude Code后,建议优先验证扩展面板与集成终端两条入口。本文提供标准检查顺序、关键命令与常见故障排查路径,帮助你快速确认环境就绪,避免后续开发受阻。