幻兹百科
VLA模型 (视觉-语言-动作模型)
具身智能
VLA model (Visual-Language-Motion Model)
摘要
VLA模型 (视觉-语言-动作模型) 是机器人的"最强大脑"。不仅能看懂图、听懂话,还能直接把这些信息转化为"伸右手抓杯子"的物理动作指令。

产品或技术定位

VLA模型 (视觉-语言-动作模型) 涉及真实设备、环境感知或物理执行能力。评估这类词条时,需要区分演示、试点、量产和规模化部署,不把规划能力直接视为已经普遍可用。

典型场景

  • 学习理解:用于解释概念、整理资料或形成可继续验证的初步判断。
  • 业务辅助:在明确目标和人工复核前提下,支持内容、分析或协作流程。
  • 方案评估:帮助比较不同技术路径、产品能力和适用边界。

需要注意的边界

硬件和具身智能产品会受到安全、法规、成本、环境适应性和供应链条件影响。辅助驾驶不等于完全无人驾驶,概念原型也不等于成熟量产产品。

相关词条包括具身智能边缘计算多模态

基础信息
中文名
VLA模型 (视觉-语言-动作模型)
英文名
VLA model (Visual-Language-Motion Model)
类别
具身智能
相关工具
相关工具数据待接入
Copyright © 幻兹网 All Rights Reserved粤ICP备2026034579号粤公网安备44030002012995号