2026年7月19日,2026世界人工智能大会的焦点中,天数智芯正式发布了新一代通用GPU旗舰产品——天垓300。这款产品基于SIMT通用计算架构,不仅支持标量、矢量和张量等多种计算类型,还针对Attention、MoE、AF分离、PD分离以及大规模系统扩展等关键技术进行了深度优化。

从关键数据来看:天垓300的Attention计算效率超过90%,在64k上下文场景下,Attention效能比Hopper方案提升了10%——这意味着长序列任务的训练和推理能更高效地利用计算资源。在MoE(混合专家模型)方面,平均效能同样优于Hopper方案10%,换言之,在同等算力条件下,可完成更多推理任务。
延迟表现同样显著改善。首字延迟比Hopper架构方案降低约20%,平均通信延迟降低约13%。这主要得益于针对Decode阶段高频、多卡、小数据量通信场景的专项优化——降低了协议开销,优化了链路路径与数据流转机制。最终Decode效能相比Hopper方案提升了10%。
值得一提的是,目前天垓300已具备规模化应用条件。据官方透露,这款产品已与国内多家云厂商、服务器厂商、互联生态及超节点系统完成深度适配,支持从单机到大规模集群的灵活部署。从技术指标到生态落地,这一进展展现出扎实的落地能力。
