智源研究院此次发布的RoboBrain2.5,直击具身智能领域长期存在的两大核心痛点——空间感知精度不足与执行过程抖动问题。简单来说,机器人往往“看得见但抓不准”,“规划得好却执行不稳”。新版本通过两项关键升级,聚焦于一个根本目标:让机器人真正具备稳定、可靠的作业能力。
首先来看第一个突破:高保真3D空间推理。 这意味着机器人不再只是被动地“看”一张二维画面,而是能够将图像中的视觉信息,精准映射为真实世界中的可执行轨迹。无论是抓取还是放置,动作都能实现“抓得准、放得稳”,彻底告别过去那种“差之毫厘、谬以千里”的误差累积。
第二个突破是细粒度时序价值评估。 这项能力更像“边干边学”——机器人在执行任务的过程中,持续评估自身进度、预判潜在风险,并动态调整策略。这使得机器人能够在复杂多变的环境中,自主纠错、闭环运行,而不是一条路走到黑,从而大幅提升任务成功率。

作为RoboBrain系列的最新迭代,RoboBrain 2.5 在继承原有通用感知、三维建模和时序表征能力的基础上,核心升级点在于训练数据。通过更大规模、更高质量的时空对齐监督数据,两个关键能力模块——Precise 3D Spatial Reasoning 和 Dense Temporal Value Estimation——得到了系统性地强化。机器人不仅能够理解任务语义,更重要的是学会了严格遵循物理规律,并实时响应过程反馈。换句话说,具身智能已经从“看得懂、说得清”,真正迈向了“动得准、控得稳、靠得住”的新阶段。
目前,RoboBrain2.5 已在多个空间推理与价值建模的标准评测任务中刷新了SOTA(最佳性能)纪录。这一成果为具身智能从实验室走向实际部署,实现闭环控制与规模化应用,奠定了坚实的技术底座。
获取方式
项目主页:https://www.php.cn/link/c7bf6d5cc46eabd157d7bb7e037b3e00
技术报告:https://www.php.cn/link/81e27154d63971cc85b7c14401e5e926
GitHub 仓库:https://www.php.cn/link/1287d29d6578e1fdbbd41fc0a38aef10
模型权重(Hugging Face):https://www.php.cn/link/b82d949cf4a38f15b1297f97b82d0a77
多芯片适配版本:https://www.php.cn/link/32e87be821dd3aeec6a5b09e59d9cd4e
