7月18日,在2026世界人工智能大会(WAIC)上,是石科技创始人兼董事长闫博文正式发布了国产Token优化工厂——拓元(Vectron)。这款产品的亮相,精准击中了行业痛点:算力基建看似火热,但背后真正的“隐形杀手”是效率瓶颈。
先看一组数据:中国已建成50多个智算中心,智能算力总规模超过1000 EFLOPS,然而平均利用率远未达到理想水平。换句话说,算力堆砌得再高,如果无法高效产出,就只是资源浪费。AI基础设施的竞争,正从“谁的芯片更多”转向“谁的算力用得更好”——算力效率竞赛,将成为下一阶段的核心战场。
拓元的定位十分明确:将每一份算力转化为稳定高效的Token。在同等算力下,产出更多有效Token;在同等显存下,长上下文运行更稳定。其核心逻辑是通过一套系统实现AI推理的全链路优化,而非依赖硬件堆叠。
兼容性方面,拓元已适配昇腾、昆仑芯、天数智芯、太初、瀚博半导体、摩尔线程、沐曦、燧原等10余款国产算力芯片,同时支持20余个主流模型,每日Token吞吐量达到千亿级别。这组数字的背后,是扎实的工程落地能力。
如何实现?核心在于三大技术:任务自适应优化、硬件专属算子融合编译、异构集群调度。通过这些技术,拓元将国产异构算力池统一调度,并实现推理加速。简单来说,就是让不同芯片、不同架构的算力“拧成一股绳”,不再各自为战。

团队背景值得一提。是石科技的创始团队来自清华大学计算机系,拥有国家级计算中心的工程化经验。目前已经服务超过200家重点客户,覆盖头部互联网、大模型公司、航空航天、生物制药、新能源等行业。从实验室到产业落地,这条路径走得非常扎实。
