2026年7月17日,上海,2026世界人工智能大会(WAIC 2026)盛大开幕,本届大会以“智能伙伴 共创未来”为主题。大会的一大亮点,是新一代AI基础设施服务商阡视科技带来的重磅产品——专为Token工厂打造的超节点真机。该产品直接将下一代国产超节点技术的底层智算逻辑与系统级性能拓展路径,完整呈现在现场观众面前。

先说背景:当前人工智能技术正从“推理时计算”向“递归自我改进”阶段演进。长程连续迭代与闭环规划任务成为下一阶段的核心范式。在此范式下,KV Cache的频繁读写导致存力成为新的瓶颈。传统超节点架构主要聚焦GPU互联平面,重点解决芯片间横向通信问题,但无法满足Token工厂场景中超长上下文的运算效率需求。阡视科技自研的wylon超节点系统专为Token工厂打造,不仅实现了横向算力互联——全域无阻塞的卡间全互联通信,还定义了全新的纵向存力贯通平面。系统打通了异构存力资源的层级架构,构建起百TB级GPU近存、系统内存以及PB级大带宽闪存空间。再结合HitenOS大模型操作系统的高效软硬件深度协同设计,在国产GPU平台上实现了“同一速度下更高吞吐,同一吞吐下更快响应”的帕累托改进,性能提升可达10倍以上。

通过对Token工厂场景的深入剖析与软硬件协同设计,wylon超节点系统具备了KV分层管理、算力亲和调度、硬件拓扑感知等底层能力。该系统确保模型负载直达硬件底层,消除中间层性能损耗,为大模型运行提供一体化高效算力空间。这不仅满足了Agent时代对大算力、大带宽、大存储的迫切需求,同时也在持续降低Token成本。

阡视科技在WAIC 2026上发布的专为Token工厂打造的wylonQ72/288,单机柜集成72颗国产GPU,通过4机柜横向互联域扩展至288卡规模。GPU高带宽显存可达18 TB,互联总带宽高达72 TB/s,支持FP8/4浮点运算精度。专为KV Cache设计的统一DRAM缓存可达上百TB,为大模型推理提供一体化高效算存空间,实现高效稳定的Token生产。基于wylon超节点架构的wylon新云Token工厂,目前已在华东集群节点上线并开启测试邀请。wylon超节点系统深度联合寒武纪、壁仞、沐曦、曦望、海光、摩尔线程等国内GPU芯片领军企业,构建从芯片到系统、从算力到生态全栈贯通的国产AI基础设施,持续拓展国产超节点系统性能的帕累托前沿。
