全球机器人“全科考试”放榜 两江新区这家企业拿下第一

来源: 第1眼TV-华龙网

原力灵机DM0.5在搭积木场景中的演示。(企业供图)
原力灵机DM0.5在搭积木场景中的演示。企业供图

第1眼TV-华龙网讯(首席记者 曹妤)8月25日,记者从两江新区获悉,近日,具身智能领域权威评测基准RoboDojo公布最新榜单,两江新区企业原力灵机(重庆)智能科技有限公司(简称“原力灵机”)自主研发的通用具身基础模型DM0.5,以综合排名第一的成绩登顶。

作为“模力高地”首批签约落地项目,原力灵机已发布全球首个具身原生大模型DM0,并获得智谱、阶跃星辰、商汤科技、阿里等资方青睐。此外,华勤、上汽恒旭等产业投资方持续加注。

DM0.5结构示意图。(企业供图)
DM0.5结构示意图。(企业供图)

全球近20所顶尖机构联合出的“全科考卷”

RoboDojo是由香港大学多媒体实验室联合加州大学伯克利分校、清华大学等全球近20所顶尖学术机构共同发起,RoboTwin系列基准原班团队推出的具身智能综合评测体系。

在行业视角下,RoboDojo的存在标志着具身智能评估从“单点Demo展示”走向“标准化全科考试”,是判断一个模型能否从实验室走向真实物理世界的关键试金石。

RoboDojo的核心并非简单堆任务数量,而是把机器人操作拆成五类更接近真实场景的能力维度:泛化能力、记忆能力、精细操作、长程执行、开放语义理解,全面检验一个模型能否从实验室走向真实世界。

在这张榜单上,参评者不乏腾讯、小米等知名团队的模型。DM0.5以24.90的综合得分和19.34%的平均成功率位列第一。

尤其值得一提的是“记忆力”这一科目。DM0.5在记忆维度取得47.74分,而该维度的第二名为13.37分,领先优势超过3倍。从榜单的五维综合评价结果来看,“记忆力”也是DM0.5拉开差距并最终登顶的关键优势。

一个直观的例子是“盖积木”任务:机器人要先从左到右用杯子盖住随机摆放的红、绿、蓝三块积木;颜色被完全遮住后,它必须凭此前的观察记住每块积木的位置,再按红、绿、蓝的顺序依次揭开。这就像我们玩“翻牌记忆游戏”,看不见牌面,全靠脑子记。

DM0.5在这项任务中多次测试均取得100%成功率,证明模型并非依靠单次偶然命中完成任务,而是真正形成了“历史观察-状态记忆-顺序执行”的完整能力闭环。

不仅会“考试” 更会“干活”

原力聚合(重庆)信息技术有限公司副总裁谢忆楠表示,RoboDojo也是DM0.5发布一个月以来取得的第五个“第一”。此前,在真机操作评测RoboChallenge Table30 V2、仿真操作评测LIBERO、导航场景仿真测试R2R和RxR中,DM0.5也曾获得多项第一。

DM0.5为何能取得如此成绩?答案来自模型的架构与训练方式。

谢忆楠给记者解释,在预训练阶段,DM0.5装了一个40亿参数的“聪明大脑”,负责看东西、听指令、拿主意;再配一个6.8亿参数的“动作教练”,两者共同组成的VLA(视觉—语言—动作,Vision-Language-Action)架构,围绕历史上下文、具身推理、动作监督和数据质量进行了系统升级,在长程记忆、指令理解、动作连续性、抗干扰和跨任务泛化等方面形成了更加完整的基础能力。

在此之上,团队还做了一轮Supervised Fine-Tuning(监督微调):可以理解为在模型完成基础学习后,用带标准答案的高质量数据给它“强化训练”,让模型把通用能力精准迁移到具体任务中。

榜单成绩之外,DM0.5在真实场景中的表现同样亮眼。比如,在精细操作方面,精准度已达到亚毫米级。在搭积木场景中,DM0.5不仅能在0.1–1毫米的尺度内完成抓取扣合,用极细腻的“寸劲儿”把积木严丝合缝地扣住,还能在拼装失误后自主感知、自主纠错。

目前,DM0.5已全面开源,模型权重、训练框架及完整下游工作流均已上线开源社区平台GitHub与HuggingFace,开发者可直接下载、复现和二次开发。

RoboDojo最新榜单。(企业供图)
RoboDojo最新榜单。企业供图