高德发布ABot系列基座模型:全球首款具身操作与导航双突破
近日,阿里巴巴集团旗下高德正式发布具身操作基座模型ABot-M0与具身导航基座模型ABot-N0,补齐了具身机器人规模化落地的两块核心能力——操作的通用性和导航的长程性,并刷新了全球多项权威评测纪录,高德也成为全球首个在具身导航与具身操作上同步达到SOTA(目前最好、最先进的模型)的厂商。
免费影视、动漫、音乐、游戏、小说资源长期稳定更新! 👉 点此立即查看 👈
ABot-M0:全球首个统一架构的机器人基础模型,让机器人拥有"通用大脑"
长期以来,机器人技术的规模化应用面临诸多挑战,其中关键之一在于数据的割裂、动作表示的不统一以及空间理解能力的不足。不同厂商、不同形态的机器人往往使用各自独立的数据体系,导致模型难以跨平台复用,训练效率受限,部署成本高。
高德推出的 ABot-M0 作为一款通用的具身操作基础模型,从“数据统一—算法革新—空间感知”三个方面进行了系统性重构,致力于提升模型在多样化机器人形态和任务场景下的泛化能力。

ABot-M0模型架构图
ABot-M0 基于全球开源资源,整合超过 600 万条真实操作轨迹,构建了目前规模最大的通用机器人数据集。通过统一动作表示、坐标系与控制频率,并采用增量式动作建模,实现了跨平台数据融合,支撑了完全基于公开数据的预训练。
算法革新上,ABot-M0 提出了全球首个动作流形学习:有效的机器人动作受限于物理规律、任务目标与环境约束,集中分布在低维结构化的流形上。设计了 AML(Action Manifold Learning)算法,使模型能够直接预测结构合理、物理可行的动作序列,提升策略的稳定性与解码效率。
为增强空间感知,ABot-M0 引入 3D 感知模块,增强模型对“前后、远近、遮挡”等空间语义的理解,在复杂环境中实现更精准的操作决策。
在 Libero、Libero-Plus、RoboCasa 基准测试中,该模型在包含复杂任务组合与动态场景扰动的设定下,平均任务成功率均达到 SOTA。其中,Libero-Plus 基准上达到了 80.5%,较业界先进方案pi0提升近30%,展现了其在高扰动高难度具身操作任务中的领先性能。

ABot-M0在Libero-Plus的评测
通过系统的工程设计与算法改进,ABot-M0 探索了一条通向通用具身智能的技术路径,也为未来开放、共享的机器人生态提供了可复现、可扩展的基础支持。
ABot-N0:全球首个五大导航任务统一的全栈导航基座模型
导航是机器人进入物理开放世界的核心基础能力,机器人需要在动态且存在干扰的环境里展现出通用的行动能力,如跨场景送物或跟随服务,这同时也是具身智能演进的终极命题。
然而,当前的具身导航研究普遍深陷“碎片化”:主流方法往往针对特定任务构建孤立的专用架构,这不仅限制了模型的跨任务泛化能力,更阻碍了智能体从海量异构数据中提取统一物理先验的可能性。
这也是当前机器人常陷于“环境看不懂、动作做不准”的核心原因,复杂指令(如“去门口帮我看看快递”)更是难以执行。
高德推出的具身导航基座模型ABot-N0,以“全任务一统”为核心目标,并实现全球首次在单一模型中完整集成Point-Goal(点位导航)、Object-Goal(目标导航)、Instruction-Following(指令跟随)、POI-Goal(兴趣点导航)与Person-Following(人物跟随)五大导航任务,有效突破了传统架构中任务割裂的瓶颈。
比如,当用户对搭载ABot-N0的具身机器人说:“带我去奶茶店买一杯奶茶,再帮我占个座。”时系统会自动分解为具体的导航任务:首先执行Point-Goal,根据地图记忆接近奶茶店区域;之后切换至POI-Goal,精准锁定店铺入口并靠近;随后触发Instruction-Following,进入店铺并导航至柜台;最后执行Object-Goal,在店内寻找空沙发并停靠。
相较于只能支持部分任务的具身导航模型,高德ABot-N0所实现的五大导航任务给长程复杂任务的执行提供了可行的解决方案。这一能力背后,是高德在架构设计、数据引擎和系统框架上的关键革新。

ABot-N0的数据、性能、任务概览
在模型架构上,ABot-N0采用层次化的“大脑‑动作”设计哲学:由“认知大脑”理解指令并做推理,由基于流匹配(Flow Matching)的“动作专家”生成精确且多峰分布的连续轨迹 。训练上,先让模型做认知训练热身,再用部分认知数据和海量导航动作进行联合监督微调,最后用强化学习把导航决策对齐到人类偏好的行为价值,最终打造出真实环境中更通用的VLA基座模型。
在数据侧,依托高德长期沉淀的场景资产和专家示例,高德构建了业内最大规模的具身导航数据引擎,涵盖约 8000 个高保真 3D 场景等海量时空数据与近1700万条专家示例,从而增强模型在真实环境中的泛化能力与鲁棒性。
基于ABot-N0的系统性创新,其在CityWalker、SocNav、R2R-CE/RxR-CE、HM3D-OVON、BridgeNav、EVT-Bench七大权威基准测试中全面刷新了世界纪录。其中在SocNav闭环仿真中,成功率(SR)飙升40.5%,在HM3D-OVON评测中成功率(SR)提升8.8%,均显著强于之前的SOTA模型。

Point-Goal任务:在CityWalker及SocNav上分别进行开环和闭环评测
此外,为了解决机器人在执行长程复杂任务时的任务拆解与容错问题,高德提出了可落地的Agentic Navigation System具身导航系统框架,行成从“读懂指令”到“长程复杂任务执行”的闭环能力架构,支持机器人在执行过程中持续感知、记忆、决策与纠错。系统已成功部署于真实四足机器人平台,并在边缘侧实现了高效推理与闭环控制,验证了其在动态现实环境中的泛化性能与工业级稳定性。
相关攻略
BCBC币(BCBC)深度解析:技术底色与市场前景 在百花齐放的数字货币领域,总有项目希望以独特的技术路径站稳脚跟。BCBC币(BCBC)正是其中之一,它依托一套组合技术方案来构建其安全与稳定的基石,目标直指高效、低成本的支付新体验,同时也不失为投资者眼中一个潜在的增值选项。 技术架构:不止于共识的
BNB Chain完成第31次季度销毁,近10亿美元BNB永久退出流通 近日,全球顶尖的区块链基础设施BNB Chain正式完成了其第31次季度代币销毁。根据官方公布的数据,本次共计销毁了1,579,207 716枚BNB,按销毁时市场价值计算,总额高达约9 16亿美元。此次大规模销毁再次向市场展现
OpenClaw 核心命令完全指南:从入门到精通 当您开始接触一个新工具时,最常见的障碍是什么?往往是面对复杂的命令列表感到困惑,只能被动地复制粘贴。这不仅影响效率,而且在遇到问题时更难以排查。 本文将为您深入解析 OpenClaw 的关键指令,帮助您从基础操作者转变为理解原理的熟练用户,全面提升配
让AI告别“重视觉效果、轻物理逻辑”的行业短板,近期五一视界(51WORLD)发布全球首款物理直觉世界模型51World Model,实现AI遵循物理规律推演、与真实场景全要素交互的核心突破,彻底破
一台售价8 5万元的人形机器人,拆开来看,成本只有4 16万元,预估毛利率40 7%。但宇树G1的真正壁垒,藏在硬件之外。3月30日,中邮证券电新团队分析师苏千叶、盛炜、杨帅波发布《宇树G1人形机器
热门专题
热门推荐
V社联合创始人G胖调整角色:从主导开发转向赋能团队,释放创意生产力 近期一则消息引发游戏行业广泛关注:Valve联合创始人加布·纽维尔(“G胖”)在公司内部进行了一次重要角色转型。此次调整的关键原因,与他个人在公司中的特殊影响力息息相关。根据透露,这位创始人决定减少在具体游戏开发工作中的直接深度参与
红魔姜超透露:全新游戏平板将于四月或五月发布,承诺带来惊艳体验 游戏硬件领域即将迎来重磅更新。努比亚红魔游戏手机的产品线负责人姜超,近日通过社交媒体进行了一次颇具悬念的“前瞻剧透”,成功引发了广大游戏玩家和科技爱好者的高度关注。他明确指出,红魔全新一代游戏平板的发布日期已锁定在四月或五月,并使用了“
金铲铲之战S17天煞羁绊:效果解析与实战应用 在《金铲铲之战》S17赛季中,【天煞】是一个定位独特的专属羁绊,仅由5费英雄“劫”所携带。激活这一羁绊需要特定的前置条件——玩家必须在强化符文选择阶段获得【入侵者劫】。一旦成功解锁,劫将获得全新的技能机制,从而在战局中发挥出颠覆性的作用。 金铲铲之战S1
索尼调整第一方工作室阵容,王牌重制团队蓝点工作室正式“退出”核心名单 近日,索尼在其PlayStation Studios官方网站的更新中做出了一项关键调整,引发了游戏玩家和行业观察者的广泛关注:曾凭借《恶魔之魂:重制版》等作品赢得盛誉的蓝点工作室,已不再出现在索尼核心第一方工作室的名单之中。此次页
未来人类X98W移动工作站正式发布:重新定义移动端专业性能的新标杆 在专业移动计算领域,总有一些产品能够打破常规认知。近日,未来人类(TerransForce)正式在其官网上线了全新的X98W高性能移动工作站,并宣布将于本月内全面发售。这款设备的问世,无疑为那些在移动办公环境中仍需要桌面级别强悍性能





