横扫四榜,DM0.5 凭什么面面俱到?

7x24快讯 2026-09-16 08:24 热度 2701 · 浏览 425
摘要
单科冠军不够,具身智能落地需要没有结构性短板的底座    作者丨邓哲敏    编辑丨齐铖湧                                      &n
正文

单科冠军不够,具身智能落地需要没有结构性短板的底座    作者丨邓哲敏    编辑丨齐铖湧                                                                                                       一个模型同时占据四个能力子榜单的榜首,这在具身智能行业里不多见。RoboColiseum 是由智元机器人发起,联合高校、科研机构、开源社区及机器人企业共同建设的评测平台,它把评测拆成四个维度:指令跟随、空间理解、扰动适应、通用操作。参评者只要在任何一个维度上有结构性短板,就会在对应的子榜上掉下来。而原力灵机的通用具身基础模型 DM0.5 在四个子榜上全部排名第一,且目前是唯一做到这一点的模型。AI科技评论(雷峰网公众号)想知道,这张成绩单有多可信?DM0.5 又凭什么霸榜?01一把可信的尺子演示效果和真实场景之间存在差距,这在机器人行业早不是什么新鲜事。普通商品尚有卖家秀与买家秀之别,遑论技术尚未成熟的具身智能。因此,模型越是层出不穷,行业就越需要可信赖、细颗粒的公共标尺,帮助挑选出真正的强者。然而现实并不乐观,AI科技评论观察到,具身评测行业长期存在几个痛点,让分数的可信度打了折扣。第一个痛点,是仿真跑分高、真机落地差。 仿真环境里的物理参数、视觉渲染和真实世界相差甚远,模型在仿真里得了高分,搬到真机上可能是一塌糊涂。市面上大部分仿真评测基准并没有做系统的真机-仿真对比实验,更没有公开结果。针对 Sim2Real 的一致性问题,RoboColiseum 负责人吴墨告诉AI科技评论(雷峰网公众号),平台通过空间智能技

×

登录后免费使用全部功能

注册即享所有功能免费使用,无次数限制,无任何门槛。

无限 AI 对话
Agent 源码免费下载
Skill/Prompt 免费复制
免费AI诊断 + 需求发布