2026年7月17日至20日,以“智能伙伴,共创未来”为主题的2026世界人工智能大会暨人工智能全球治理高级别会议(WAIC 2026)在上海盛大举行。本次大会由国家十部委与上海市政府联合主办,展览总面积首次突破10万平方米,吸引1100余家企业参展。在众多亮点中,具身智能无疑成为本届大会最受瞩目的焦点板块之一。

首先分享几个核心观点:今年的WAIC上,具身智能已从“概念展示”迈入“实际作业”阶段。擎朗智能依托自研的融合世界模型VLA架构,打造了一个覆盖商超零售、咖啡亭、甜品屋以及全新酒店洗衣房场景的“具身社区”——全场人形机器人实现零遥操、纯自主运行,每个场景均源于真实合作品牌的运营需求。展台上,XMAN系列通用人形机器人与配送、清洁等专用机器人“协同上岗”,这不仅是擎朗“通用+专用”协同路线的集中体现,更是具身智能产业化落地的亮眼成果。
融合世界模型的VLA架构:实现机器人纯自主运行
擎朗在本届WAIC展会上展示的机器人服务,均实现“全程零遥操、纯自主运行”。支撑这一能力的是擎朗自研的融合世界模型的VLA架构,其核心逻辑包含以下四个层面:
· 感知-决策-执行一体化:将视觉理解、语言指令与动作生成统一于单一端到端模型,大幅降低传统模块化架构的信息损耗。
· 世界模型补位物理推演:在VLA架构中嵌入世界模型,使机器人在执行动作前先行预演物理结果——预测物体受力后的运动轨迹、衣物折叠时的形变路径——从而提前规避失败,实现预判式而非试错式行动。
· 岗位化垂域模型KEENON ProS:在通用VLA架构基础上,针对咖啡师、零售拣选、洗衣等具体岗位,训练了岗位级垂域模型,赋予机器人多模态环境感知与精细力控能力。
· 真实场景数据驱动迭代:擎朗大模型架构的训练数据来源于全球真机训练场中按岗位化搭建的真实场景,以及大量客户实际场景岗位化上岗后的海量真机运行数据,形成数据飞轮效应,持续反哺优化。
这几个层面叠加,最终实现:擎朗机器人展台上无需任何人为干预,即可在动态变化的场景中连续工作、稳定产出。
每个岗位均源于真实品牌需求
擎朗在WAIC展台打造的具身社区,并非为展会而设的概念场景,而是基于真实合作品牌运营痛点构建的服务矩阵。每个场景背后,都有真实的商业需求驱动。

在擎朗与挪瓦咖啡联合呈现的“机器人咖啡馆”中,人形机器人XMAN-R1以“特聘咖啡师”身份,依托擎朗自研的岗位化垂域模型KEENON ProS,自主完成取杯、咖啡萃取等步骤,并将制作好的咖啡放置拉花机供客人DIY印花。该模型赋予机器人多模态环境感知与精细力控能力,可在操作中实时调整动作轨迹,确保出品稳定流畅。

擎朗洗衣房模拟丽柏酒店洗衣房作业,两台擎朗人形机器人在统一调度平台下自主协同完成洗衣、叠衣全流程。基于KEENON ProS的多任务规划能力,机器人可对柔性物体进行识别与处理,并实时应对设备状态变化,实现端到端闭环操作——该技术后续可延伸至连锁洗衣工厂、干洗店乃至家用场景。



擎朗甜品屋中,人形机器人通过视觉识别系统实时辨别并精准抓取目标颜色的MM豆。在非结构化零售环境中,机器人需对不同颜色、形状、材质的物品进行快速识别及自适应抓取,验证其在复杂场景下的泛化操作能力。现场特设大转盘互动——观众转到哪个颜色,机器人便抓取对应颜色的MM豆。

擎朗零售店则模拟了零售物流中的典型拣选动作:人形机器人自主识别货架布局与目标物品位置,完成精确抓取并递送至顾客手中,验证了其在真实商业环境中的物体识别、空间定位与灵巧操作能力。

值得注意的是,展台现场配送机器人T10与清洁机器人C40同步作业,与人形机器人形成“通用+专用”协同的完整服务闭环。专用机器人在配送、清洁等效率型岗位上各司其职,人形机器人则负责操作、舞蹈等复杂交互任务——两者配合,才能全面覆盖服务业的复杂需求。


岗位化驱动具身智能商业化落地
据2025年IDC报告,擎朗全球出货量占比持续位居行业第一。这一数据背后是16年商用场景积累的信任——全球超10万台机器人,每天在酒店、商场、餐厅、医院里真实地“干活”。
擎朗智能创始人兼CEO李通在现场表示,“能否真正干活,才是人形机器人商业化的本质,这也是擎朗提出岗位化观点的原因,这是人形机器人大规模商业化的必由之路”。所谓岗位化,就是找到流程可拆细、结果可量化的具体点位,让机器人在这个岗位上率先做到连续工作、稳定产出,用真实数据跑通闭环。
擎朗智能在本届展会上呈现的,不仅是四个看得见的服务场景,更是一套完整的技术与商业化逻辑:以融合世界模型的VLA架构为技术底座,以通用人形+专用服务机器人协同为产品策略,以岗位化落地为商业化路径,让具身智能一步步走进真实服务场景。
