行业观点 量子位

讯飞新公司爻方智能:机器人困在Demo,缺一味「本体认知」VLA并非终局

讯飞孵化的新公司爻方智能指出,当前机器人行业普遍陷入Demo困境,核心原因在于缺少“本体认知”。公司认为,视觉-语言-动作(VLA)模型并非最终解决方案,机器人需要更深层次的自我感知与物理世界理解能力,才能真正走出实验室。

在机器人产业高歌猛进的表象下,一个深层的技术瓶颈正被行业先锋揭开。讯飞孵化的新公司爻方智能近日发出警示:当前机器人行业普遍陷入“Demo困境”,即大量机器人在演示中表现出色,却难以在真实场景中落地应用。其核心症结并非算力或算法不足,而是缺少一种被称为“本体认知”的关键能力。

爻方智能指出,机器人若想真正走出实验室,不能仅依赖视觉-语言-动作(VLA)模型这类外部感知与指令系统。VLA模型虽能帮助机器人理解环境并执行指令,却无法赋予机器人对自身物理形态、运动状态及与环境交互的深层感知。这种“本体认知”缺失导致机器人在面对非结构化场景时,难以自主调整行为,从而陷入“演示即巅峰”的困境。公司认为,机器人需要发展类似人类的本体感觉,即对自身身体位置、运动及力量的实时感知,才能实现从“被编程的机器”到“自主智能体”的跨越。

这一观点挑战了当前行业对VLA模型的过度追捧。尽管VLA在语言理解和视觉识别上取得突破,但机器人最终需要的是对物理世界的整体理解,而非碎片化的感知与执行。爻方智能的切入,或将为机器人行业提供新的技术路径,推动产业从“炫技式Demo”转向“实用化落地”,尤其对工业、服务等复杂场景具有深远意义。