5月29日,基础大模型公司阶跃星辰(StepFun)正式发布并开源了Step 3.7 Flash模型。这是一款面向生产级Agent场景打造的大模型,定位十分清晰:在响应速度、部署成本、执行稳定性以及复杂任务处理能力之间,实现更优平衡。简单来说,就是既要高效,又要稳定,还要能够胜任真实业务环境中的高强度复杂任务。
那么,这款模型的核心亮点到底在哪里?
先从模型架构来看。Step 3.7 Flash采用稀疏MoE架构,总参数规模达到196B,视觉模块额外配备1.8B(ViT),实际激活参数为11B。其最高生成速度可达400 Tokens/s,这样的性能表现意味着,在高频调用、多轮交互的Agent应用场景中,整体任务执行效率有望实现明显提升。
当然,只有速度快还远远不够。Step 3.7 Flash支持直接理解和处理UI界面、图表、文档、图片以及各类应用程序界面,能够将复杂视觉信息转化为结构化结果和可执行任务。更值得关注的是,当遇到信息不确定或存在歧义时,它还能主动发起搜索并进行交叉验证。这种能力,正是AI Agent在真实应用场景中实现可靠落地的重要基础。
谈到生产级Agent,工具调用的稳定性和可靠性始终是核心能力之一。针对这一点,Step 3.7 Flash也进行了专门优化。在长流程、多轮次的任务工作流中,它可以更稳定地调用API、浏览器、终端、Office工具等外部能力,显著降低任务偏航、执行中断和调用失败的风险。对于企业级应用、自动化办公以及需要稳定交付结果的实际落地场景而言,这一点尤为关键。

