高德一口气发5个机器人模型:脚、手、脑全套 夺17项测试第一

倚天百科 百科资讯 3

7月23日消息,高德ABot具身智能迎来全栈升级,把“身随眼动、手脚并用、过目不忘”的能力,装进同一套自进化技术体系。

昨天,高德一次性发布5款模型:ABot-N1、ABot-M0.5、ABot-ER、ABot-AgentOS、ABot-C0,并在17项权威基准中拿下最优。

不少人都觉得现在的机器人有明显短板,要么只会原地抓取东西,出门就认不清路;要么能四处走动,上手操作就频繁出错。

市面上很多智能模型只专攻单一能力,走路、干活、记忆各做各的,数据不通、经验没法共享,很难完成连贯完整的任务。

高德这次直接补齐整套短板,更新ABot具身智能全套体系,一次性推出五款配套模型,把机器人走路、动手、思考、记忆、动作控制全部打通。

五款模型对应人体不同部位,分工清晰。

ABot-N1相当于机器人的双脚,专门负责自主导航。以往机器人出门,必须提前采集高精度地图,成本高还跟不上道路临时变化。这款模型只用普通路网和普通摄像头,就能在城市道路自主穿行。

它分两套运行逻辑,一套规划长远路线,一套实时调整行进状态,路线出现偏差时自动依靠视觉修正。户外自主导航成功率达到92.9%,认路、找人、找店铺等五类导航任务全部优于同类产品,在五项专业测试榜单排在首位,人群避让、上下楼梯、识别红绿灯都能独立完成。

ABot-M0.5承担双手的作用,解决移动和操作无法同步的老问题。过去机器人移动和抓取动作分开执行,视线被遮挡、动作出现微小偏移,整套任务就会中断。

这款模型把移动、操作分成两条独立运行流程,同步匹配视觉和肢体动作,还加入模拟纠错训练,提前预判动作偏差并自行调整。

同时引入帧级隐式动作,让让机器人“眼、手、脚”在更细的时间颗粒上实时对齐,真正像人一样能够手脚并用。在家务实操测试里,复杂连贯任务表现比上一个纪录高出20.4个百分点。

更关键的是,ABot-M0.5采用“梦境自愈”训练机制:训练中让模型基于自身预测的含噪视觉画面继续生成动作,自己学会在偏差中找平衡,从根本上解决“一步错、步步错”。

ABot-ER和ABot-AgentOS组合起来就是机器人的大脑与中枢。

ABot-ER负责分析环境、理清任务逻辑,看懂物体、空间和指令之间的关联。ABot-AgentOS负责统筹调度,搭配长期记忆系统,机器人每次完成任务的成功经验、失误教训都会留存下来,下次遇到同类场景直接复用。

这套系统能听懂日常口语指令,多轮对话记住需求,中途目标被遮挡也能依靠记忆重新定位,人形、四足、轮式各类机器人都能适配这套系统。

值得一提的是,ABot-ER与AgentOS构建终身记忆系统,5项记忆基准全部刷新世界纪录。

最后一款ABot-C0是整套体系的运动神经,负责把大脑下达的指令稳定转化为机器人实际动作,统一适配不同外形机器人的肢体控制,保证思考指令可以顺畅落地。

整套ABot体系最大亮点是可以自我优化,手脚执行产生的数据全部反馈给大脑,不断积累经验迭代能力,不再是单一功能的零散模型。

以往行业里做导航、机械操作、智能决策的团队各自独立,很难协同,高德这套一体化方案把所有能力整合,实现从看懂环境、自主行走、动手干活、留存经验到执行动作的完整闭环。

这次五款模型同步发布,不只是几项技术提升,而是搭建起完整的机器人智能框架。后续这套体系会持续适配更多类型机器人,让机器在真实生活场景里持续学习进化,不用频繁单独优化单项能力,降低通用机器人落地的技术门槛。