要在Kimi K3上真正启用不同层级的思考强度,关键在于确保调用路径完整穿透兼容层,且参数被模型端正确接收并生效。否则,即便终端显示“已切换”状态,模型仍可能以默认的max模式运行。具体来说,网页版和Kimi Work需在3.1.0及以上版本中,通过模型选择器切换并新建会话;Kimi Code终端则须在/model kimi-k3后立即执行/thinking命令;API调用时需设置reasoning_effort字段,指定model为kimi-k3,工具历史中包含reasoning_content,且账户余额不低于1美元。

网页版与Kimi Work桌面端设置
打开kimi.com或Kimi Work 3.1.0及以上版本,在左下角点击模型选择器,弹出菜单中直接选择【K3 · Max】、【K3 · High】或【K3 · Low】对应选项,新建会话后即可开始输入问题。请注意:旧会话无法动态切换思考强度,必须新建对话窗口才能生效。Kimi Work在macOS Apple芯片和Windows设备上均支持该菜单,但低于3.1.0版本不会显示此选项。
Kimi Code终端中设置
启动Kimi Code后,输入命令 /model kimi-k3,紧接着执行 /thinking low、/thinking high 或 /thinking max,系统将自动重置当前会话上下文并应用新的思考强度。这一操作步骤非常简单,直接按顺序输入指令即可。但需要特别注意的是,必须在/model之后立即执行/thinking命令,且中间不能夹杂其他消息,否则Hermes v0.19之前的版本会静默忽略该参数;v0.19版本起虽已修复链路,但历史消息中若包含工具调用且缺少reasoning_content字段,仍可能触发HTTP 400错误。
API调用中设置reasoning_effort
首先,构造请求体时,在顶层添加"reasoning_effort": "low"(可选值为"low"、"high"、"max");其次,确保model字段明确设置为"kimi-k3";然后,若请求中包含工具调用历史,请确认每条历史消息都携带reasoning_content字段,否则上游接口将拒绝解析;最后,发送请求前检查账户余额是否不低于1美元——未充值将直接返回402 Payment Required,而非模型不可用提示。
