在实际调用Qwen3.7-Plus模型之前,需要先完成三项前置准备:获取阿里云百炼平台的API密钥,使用国际站地址调用模型,并设置enable_thinking=False与thinking_budget=0以避免产生额外推理费用。该模型支持图文混合解析、集成Dify以及零代码GUI操作,可广泛应用于办公、开发和业务等多种场景。

换句话说,你完全可以在办公、开发或业务场景中直接调用Qwen3.7-Plus,实现看图写代码、界面操作、长文档分析等实际任务,而不仅仅是停留在网页对话框中进行简单的文字聊天。
第一步:获取API密钥与确认模型入口
登录阿里云百炼平台(dashscope.aliyun.com),依次进入「Model Studio」→「API密钥管理」,点击「创建新的API密钥」,复制生成的sk-xxx字符串。此步骤必须完成,否则后续所有调用将会返回401错误。
请务必使用最新的国际站基础地址:【https://dashscope-intl.aliyuncs.com/compatible-mode/v1】。国内站地址(dashscope.aliyuncs.com)不支持qwen3.7-plus的完整多模态能力,如果强行使用,会导致图像解析失败或thinking_budget参数被忽略。
确认模型ID为【qwen3.7-plus】,而不是qwen-plus、qwen-turbo或qwen3.6-plus。旧的别名已停止使用,调用时会报错model_not_found。
使用Python快速发起图文混合请求
安装最新版dashscope SDK:pip install dashscope==1.25.0(注意:低于1.24.0版本无法识别qwen3.7-plus的视觉输入字段)。
准备一张包含文字的截图(例如Excel表格、网页表单、手机App界面),保存为screen.png。
运行以下代码:
import dashscope
dashscope.api_key = "sk-你的密钥"
response = dashscope.MultiModalConversation.call(
model="qwen3.7-plus",
messages=[
{"role": "user", "content": [
{"image": "file:///path/to/screen.png"},
{"text": "请提取表格中所有姓名和对应手机号,并按JSON格式输出"}
]}
],
enable_thinking=False,
thinking_budget=0
)
print(response.output.choices[0].message.content)
请注意:必须显式设置enable_thinking=False和thinking_budget=0,否则即使只进行OCR提取也会触发推理计费,费用将增加6倍。
在Dify中接入模型并控制推理深度
第一步:进入Dify后台,点击「模型配置」,选择「添加自定义模型供应商」,填写名称(例如Aliyun-Qwen3.7-Plus)。
第二步:在「Base URL」字段填入https://dashscope-intl.aliyuncs.com/compatible-mode/v1,「Model Name」填写qwen3.7-plus,「Credentials」选择「API Key」并粘贴你之前复制的密钥。
第三步:关键配置位于「Model Configuration」的JSON编辑区,必须包含以下三项内容:
{
"model": "qwen3.7-plus",
"extra_body": {
"enable_thinking": false,
"thinking_budget": 0
}
}
⚠️ 在流式响应模式下,仅设置thinking_budget=0无效,【必须同时传递enable_thinking: false】,否则仍会输出reasoning_content并产生计费。
使用GUI零代码调用(适合非技术人员)
方法一:打开阿里云百炼的「在线对话」控制台,在左侧选择模型下拉框,切换为「qwen3.7-plus」,点击输入框旁的「图片图标」上传截图,然后输入自然语言指令(例如:“这个界面上的提交按钮在哪?坐标是多少?”),最后点击发送。
方法二:在钉钉工作台搜索「通义智能体」小程序,绑定百炼账号,点击「上传截图」,通过语音或文字输入需求,系统会自动返回可执行结果(例如click at (x=842, y=517)或生成的Python脚本)。
这一步无需编写任何代码,行政、销售、店长等角色只需拖拽截图即可使用,但需确保截图清晰、目标区域无遮挡。模糊的截图会导致坐标偏移超过20像素。
