360智脑API调用价格请以最新开放平台资费中心公示为准。目前常见主力模型的参考收费标准为:qwen/qwen3.8-max 输入 ¥12/1M tokens、输出 ¥36/1M tokens;moonshotai/kimi-k3 输入 ¥20/1M tokens、输出 ¥100/1M tokens;缓存写入 ¥15/1M tokens、缓存读取 ¥1.2/1M tokens;当长上下文超过 512k 时,部分场景可能触发隐性分块计费。新账号通常还可获得 500 万免费 tokens 赠款。

如果你想准确确认360智脑API调用到底要多少钱,避免后续账单突然上涨或接口请求被限频,最稳妥的方法就是直接查看官方计费页面,并同步核对 OneAPI 后台显示的单价。不要只参考第三方整理文档、论坛帖子或已经过期的截图信息。
查360智脑开放平台原始计费页
打开浏览器,访问 https://ai.360.cn/open → 点击右上角“登录”完成账号认证 → 进入控制台后,点击左侧菜单栏【资费中心】或【计费管理】→ 在页面中查找“模型调用价格表”或“API费用说明”等相关模块。
注意:部分企业账号需要先开通「按量付费」权限,价格表才会完整展示;如果尚未开通,页面可能只会显示“请联系商务”或出现空白表格。
截至当前(2026年8月),公开可查询的主流模型价格大致如下:【qwen/qwen3.8-max 输入 ¥12 / 1M tokens,输出 ¥36 / 1M tokens】;【moonshotai/kimi-k3 输入 ¥20 / 1M tokens,输出 ¥100 / 1M tokens】。至于360自研模型,例如360GPT-S2-V8等,价格通常没有统一公开展示,往往需要在创建应用后,进入「应用详情→计费配置」页面单独查看实际费用设置。
在OneAPI后台核对实际生效单价
方法一:渠道级单价确认
登录 OneAPI 管理后台(http://你的IP:3000)→ 点击左侧【渠道】→ 找到已添加的「360智脑」渠道 → 点击右侧【编辑】→ 滚动到底部「计费设置」区域,查看「输入单价(元/百万token)」与「输出单价(元/百万token)」这两个字段的具体数值。
方法二:请求级实时计费验证
在 OneAPI 中新建一个测试渠道(可临时启用),发起一次简单请求(例如发送“你好”并获取回复)→ 调用完成后,进入【统计】→【用量明细】→ 找到对应记录 → 展开详情,重点查看「input_tokens」「output_tokens」以及系统自动计算出的「费用(元)」三项数据,再反推实际统计单价是否与后台填写的价格一致。
这一步实际操作并不复杂,按流程检查即可。不过需要特别注意:OneAPI 中手动填写的单价主要用于用量统计和费用展示,【不会参与真实扣款,实际扣费仍以360开放平台账户余额结算为准】。
识别隐藏成本项
第一步,先确认缓存功能是否开启。
进入 OneAPI 的「360智脑」渠道编辑页,找到「缓存设置」开关即可。如果这里已经启用,就不能只看基础模型调用费用,还要把「缓存写入」和「缓存读取」的成本一起计算进去——目前 360智脑 的部分模型支持缓存能力,写入价格为 ¥15 / 1M tokens,读取价格为 ¥1.2 / 1M tokens。
第二步:确认长上下文是否触发阶梯计费
360智脑多数模型支持 100 万 token 上下文,但当单次请求的 input_tokens 超过 512k 时,部分渠道可能会自动启用分块处理逻辑,从而导致 token 计数放大甚至翻倍。你可以在测试请求的【用量明细】中,对比「input_tokens」与原始 prompt 的字符估算值;如果偏差超过 20%,就要警惕是否存在隐性分块计费。
第三步:查看是否还有免费额度可用
新注册的360智脑企业账号通常会赠送 ¥100 首充代金券 + 500万免费 tokens(限 360GPT-S2-V8 模型),这部分额度会在360开放平台「资费中心→账户余额」中显示为「可用赠款」,并优先用于抵扣,只有赠款耗尽后才会进入真实扣费阶段。
