Coderwall.com

在具身智能加速发展的当下,真实场景的客观评测成为检验机器人模型能力的关键。RoboChallenge作为全球首个具身智能大规模真机评测平台,采用“任务成功率+进度评分”的双指标体系,对主流开源模型进行测试。结果显示,基于Physical Intelligence(Pi)系列构建的π0和π0.5在成功率与进度得分上整体领先其他模型,而自变量的开源大模型WALL-OSS-FLOW在31次测试中大部分成功率为零,表现明显偏弱。这与其宣称的“和PI、Google在同一水平线”形成反差,凸显了第三方客观评测的重要性。真实世界正成为检验大模型能力的最终标准,而认识到差距,正是追赶的开始。...

特别声明:本页面标签名称与页面内容,系网站系统为资讯内容分类自动生成,仅提供资讯内容索引使用,旨在方便用户索引相关资讯报道。如标签名称涉及商标信息,请访问商标品牌官方了解详情,请勿以本站标签页面内容为参考信息,本站与可能出现的商标名称信息不存在任何关联关系,对本页面内容所引致的错误、不确或遗漏,概不负任何法律责任。(反馈错误)

推荐关键词

最新资讯

24小时热搜

查看更多内容

大家正在看