研究机器人 🇨🇳 24.07.2026 01:02

机器人为何困在Demo中?讯飞新公司给出答案:缺少“身体认知”

科大讯飞科大讯飞 NVIDIANVIDIA
科大讯飞新成立公司“耀方智能”,旨在开发具身智能的“大脑”。该公司认为主流VLA架构并非最终解决方案,世界模型需要关键要素:“身体认知”——即机器人理解自身物理能力的能力。其模型iFLYTEK-Embodied-Omni整合了视频生成、逆运动学及“双核”大脑,在泛化基准测试中实现了更高成功率。
科大讯飞(iFlytek)近期悄然注册了一家新公司——安徽耀方智能科技有限公司,注册资本3亿元人民币,由讯飞首席科学家、国家科学技术进步一等奖(National Science and Technology Progress First Prize)核心贡献者潘嘉领衔。该公司专注于打造机器人的“大脑”,团队认为,当前主流的VLA(Vision-Language-Action,视觉-语言-动作)架构并非终极方案,原因在于其缺乏对行为后果的预测能力。他们提出,世界模型还需要增加一个关键组成部分——“身体认知”,即机器人理解自身物理极限的能力。 该团队已发布技术报告《iFLYTEK-Embodied-Omni》,介绍了一种统一的多模态具身基础模型,该模型将VLM(Vision-Language Model,视觉-语言模型)、VGM(Video Generation Model,视频生成模型)与AGM(Action Generation Model,动作生成模型)相结合,并采用共享的多模态自注意力机制。该模型将逆运动学作为训练任务之一,以增强机器人的身体认知能力。在基准测试中,该模型在LIBERO-Plus零样本泛化任务中的平均成功率达到89.6%,在RoboTwin 2.0双臂任务中的成功率超过93%。 该公司计划与讯飞旗下子公司灵动通用机器人展开合作,将这一“大脑”系统部署到真实机器人中。
来源: QbitAI 量子位 — 原文
我们之前关于此话题的帖子 ↓
最新新闻