OpenAI近日正式面向企业客户开放全新升级的 GPT-5.6Sol UltraFast 超高速模式预览版。该模式在模型推理效率方面取得显著突破,整体运行速度最高可提升至标准模式的14倍,峰值内容生成速率可达到每秒750个tokens。
据了解,Cerebras公司为这一超快模式提供了强劲的底层算力加速支持。为保障系统稳定性,并实现计算资源的合理分配与公平使用,目前该模式采用准入机制。如果企业希望接入使用,需要向OpenAI提交详细的业务应用场景说明及具体使用需求。最终是否获得使用权限,将由官方从技术适配度、负载特征、安全合规性等多个维度进行综合评估。

OpenAI特别强调,在实际应用范围上,UltraFast模式并不是适用于所有场景的通用提速方案,而是更适合那些对低延迟、高并发和高吞吐有严格要求的核心业务场景。例如实时语音转写与交互系统、需要毫秒级响应的智能客服平台、嵌入式商业决策工具、面向复杂任务编排的开发智能体(Agents)、高频金融建模与研报生成,以及对算力性能和响应时效高度敏感的下一代网络安全分析等领域。
随着预览阶段持续推进,依托Cerebras不断迭代的高性能计算基础设施,模型调度能力与资源弹性预计将进一步提升。接下来,OpenAI还将结合企业用户在真实业务负载下的实际调用反馈,持续优化服务策略,并分阶段开放更多API接入权限,帮助更多企业和组织高效集成这一高速AI能力。
