先说个行业的背景趋势:大模型和智能体应用正在加速走向产业落地,企业对算力的需求已经不是单纯的“反赌”,而是如何更灵活、更高效地管理、部署和迭代模型。与此同时,AI算力格局也在悄然生变——从GPU一家独大,逐步演变为TPU、NPU、DCU等多元算力协同发展的新常态。在这种背景下,中昊芯英的TPU算力正式完成与OpenCSG旗下CSGHub平台的适配接入,算是一次“专用芯片”与“开源基础设施”的深度握手。

TPU这个架构,懂行的人都知道,它天生就是为张量计算和AI工作负载而生的。通过优化计算单元维度和数据传输路径,它在AI场景中能效比和计算密度都明显优于传统通用架构。说白了,这是降低AI算力成本、提升模型迭代效率的一条关键路径,也是国产AI算力生态中极具战略价值的方向。这次中昊芯英的TPU芯片与CSGHub平台完成适配,意味着开发者可以直接在社区里调度这种专用算力。
具体来说,中昊芯英已经向OpenCSG开源社区贡献了TPU适配代码,并合入了CSGHub主仓库。现在CSGHub平台已经能识别和调度中昊芯英的TPU算力,在硬件资源模型、资源类型校验、部署调度、运行时资源请求生成、集群节点标签识别等关键链路中都新增了TPU支持。这无疑让国产AI算力生态变得更加丰富。
中昊芯英这家公司,长期专注于高性能TPU AI芯片、AI计算集群与算力平台的设计研发,是国内最早实现全自研高性能TPU架构AI专用算力芯片流片与量产的企业。他们的芯片产品「刹那®」和「须臾®」拥有100%自研的IP核、指令集与计算平台,AI算力性能比同期海外主流GPU产品高出近1.5倍,能耗降低30%,单位计算成本降低近50%。这些数字意味着什么?意味着像万亿参数大模型分布式训练、多智能体协同运算、全平台海量token并发推理这样的重负载业务,都能被稳稳扛住。
另一边,OpenCSG聚焦的是开放AI基础设施建设。他们面向模型、数据集、应用、智能体和算力资源,提供统一管理、部署与运营能力。通过CSGHub、AgenticHub等产品,帮助各类客户构建可管理、可部署、可运营的AI能力底座,并以开放架构持续连接模型生态、开发者生态与算力生态。
双方技术团队这次合作,完成了一整套联合适配测试,覆盖模型上传与部署、单机与多卡推理、大模型微调、算子调度、稳定性连续负载、量化加速等核心场景。测试结果很干脆:中昊芯英TPU算力芯片可以原生兼容、稳定流畅运行OpenCSG开源平台的全部核心功能,软硬件协同性能达标,满足商用部署和开源生态接入需求。
基于这个成果,CSGHub平台即将上线中昊芯英TPU算力租赁规格,提供从单卡128GB到八卡1024GB共八档配置。这意味着中昊芯英TPU算力将成为平台上一种标准化的、可按需调用的算力资源。开发者和企业用户无需再为底层硬件适配和集群管理费心,直接在平台上就能选择和调度TPU算力,完成从模型开发、微调训练到推理部署的全流程工作。
这次合作的意义,不止是两家公司的一次技术对接。它标志着国产AI专用算力芯片与开源AI基础设施正在从单点突破走向平台化、标准化的规模协同。对于中昊芯英来说,TPU算力进入OpenCSG的开放生态,相当于把这种专为AI而生的高性能算力,通过开放平台,将其在计算密度、能效比和综合成本上的优势真正释放给开发者和企业。对于OpenCSG而言,新增TPU支持进一步完善了平台对国产异构算力的连接能力,也让其作为开放AI基础设施平台的生态属性更加扎实。
可以预见,随着国产大模型、国产AI芯片和企业级AI应用加速发展,开放、兼容、可持续演进的基础设施平台将成为连接上层应用与底层算力的关键枢纽。而以TPU为代表的创新型AI专用芯片架构,正在成为这一枢纽中不可或缺的算力基石。未来,中昊芯英与OpenCSG将持续深化合作,推动更多创新架构的国产AI专用算力资源进入统一、开放、可运营的AI基础设施体系,为企业AI转型和产业智能化升级提供坚实底座。
