在2026世界人工智能大会期间,腾讯展示了多项具身智能领域的最新突破,引发行业广泛关注。
此次发布的三个开源模型,各具特色,直接实现了“感知-身体-行动”的完整闭环。
首先是新一代具身视觉语言模型(VLM)基座——Hy-Embodied-VLM-1.0。它解决了“看物知用”、“看景知变”、“看远知返”等实际难题——简而言之,让机器人能够识别物体并知道如何使用,观察场景并理解变化,远距离目标并规划返回路径。在覆盖37个任务的评测中,这三类能力均显著优于同等规模模型;更关键的是,它仅以A3B参数规模、约十分之一的计算量,就几乎达到了上一代A32B旗舰模型的性能,同时更加轻量化,更适合在机器人端直接部署。
第二款是具有原生具身属性的世界认知模型Hy-Embodied-RxBrain-1.0。它融合了“推理”与“想象”能力,使机器人不仅能够理解指令,还可以对环境和自身动作进行预判。
第三款是视觉-语言-动作模型(VLA)Hy-Embodied-VLA-0.5。它构建了一套完整的具身智能学习框架,涵盖数据采集、模型训练与部署应用,各环节协同优化。该模型基于亚毫米级高精度UMI采集系统,已积累超过一万小时的人类示教数据。
值得关注的是,这些模型已在真实工业场景中投入应用,在导购导览、养老服务等多项任务中完成了落地验证。此外,它们还联动腾讯云HAI、多网聚合加速、TRRO,以及腾讯音乐(TME)的海量曲库与IoT生态连接能力。
在具身智能体领域,腾讯发布了持续在线具身智能体Apexio。其设计极具创意,由三层不同频率同时运行的能力层构成:最上层是认知系统,按需唤醒,负责深度思考;中间层是感知行动系统,以约15Hz频率持续接收多模态信息并快速调整;最下层是执行系统,以更高频率运行,像条件反射一样瞬间处理碰撞与失衡问题。
同期发布的还有具身原生智能体框架TairosAgent。其感知反应、认知决策、探索沉淀三层系统均围绕具身任务进行原生设计,并持续维护环境记忆、本体记忆与任务记忆三种记忆类型。
基于上述模型与智能体,腾讯对2025年发布的Tairos具身智能开放平台(钛螺丝)进行了全面升级。升级后的Tairos保持开源与开放,继续提供模型、智能体及开发工具等一系列能力与服务,旨在降低从模型到本体再到应用的全链条开发门槛。
过去一年,腾讯Robotics X实验室已与宇树、智元、越疆、松延动力、乐聚、华沿等机器人企业,以及博世、蓝思、景德镇、敦煌等场景合作伙伴,共同探索具身智能在多种机器人及产业场景中的落地应用。
特别值得一提的是,在之前研发的“小五”机器人基础上,腾讯推出了新一代示范性机器人“小六”。它能够与人安全交互,动作更加拟人,基于键绳传动技术,并具备独有的“畅气通络按摩手法”。通过自研的融合力觉、触觉、视觉的数据采集系统,获取了高质量手法数据,再经过强化学习训练,实现了按摩轨迹与力道的精准复现。
