超级智能评测机构近日发布了最新一期具身智能系统能力评估榜单,旨在客观反映当前主流人工智能模型作为机器人核心决策系统的实际性能。
在本次评测中,OpenAI推出的GPT-6 Astra模型以显著优势位居全球综合排名第一。国内方面,阿里巴巴达摩院与中兴通讯研发的具身智能模型得分完全相同,并列国内榜首。
所谓具身大脑,是指专为物理机器人设计的智能中枢系统。它不仅需具备视觉理解与语音交互能力,更需统筹环境感知、动作规划、实时决策与动态响应等功能,能够驱动机器人完成物品抓取、自主导航、异常处置等真实场景任务,其技术复杂度远超通用语言对话模型。
本次评估突出实测导向,大量采用真实机器人平台开展任务验证,而非仅依赖仿真环境中的理论推演。评测维度涵盖多模态环境感知、细粒度物体识别、长周期任务编排、物理规律推理与动态环境适应力等关键能力,统一标准下对国内外代表性模型进行横向比对。
结果显示,GPT-6 Astra在复杂逻辑推演与多步骤任务分解方面表现尤为突出,综合能力大幅领先其他参评模型。在国内梯队中,阿里达摩院模型展现出较强的时空连续性记忆能力,可在任务中断后准确恢复执行上下文;中兴模型则聚焦端侧部署效能,在硬件兼容性、低延迟响应及嵌入式运行稳定性方面更具优势,更适配实体机器人整机集成。
整体来看,国内领先模型与国际顶尖水平在总分上仍存在一定差距。尤其在高度耦合、步骤繁多的复合型任务中,国产模型偶有逻辑偏差或执行偏差;面对未见过的物理环境时,泛化适应能力亦有待加强。
当前,具身智能研发正加速升温,科技企业与创新团队持续加大投入。然而行业缺乏统一、可信的评估体系,各类榜单因测试数据集、任务设定及评测方式差异较大,排名结果常不具可比性。本榜单通过强化真实机器人平台的全流程任务验证,提升了结果的实践参考价值。
人形机器人尚处于发展初期,其功能边界很大程度上取决于具身大脑的技术成熟度。随着算法持续优化、硬件协同演进以及真实场景数据不断沉淀,国内外技术差距有望逐步收窄。

评论
更多评论