物理AI成AI最大增量方向 智能驾驶优先受益

时间:2026年08月01日 09:41:29 中财网
  AI大模型正沿着从文本到视觉再到动作控制的路径加速演进。LLM以文本为输入输出,VLM加入视觉理解能力,而VLA则进一步把动作作为输出模态,使AI能够真正驱动机器人和智能驾驶车辆在物理世界运行。

  
  一份研报观点认为,LLM、VLM、VLA属于同一技术脉络上逐层扩展的三类模型。研报指出,VLM通过图文对齐和视觉编码器把图像信息接入语言模型,VLA则需要机器人示教、遥操作轨迹和真实环境反馈等数据,其训练难度显著抬升。动作输出既可离散化为token,也可用扩散策略生成连续轨迹。

  
  研报认为,数字AI底座发展路径已较为清晰,但难以完成物理世界的建模闭环,而物理AI将成为物理世界的AI解决方案,在当前AI发展阶段成为增量更大的方向。信息显示,海外Google、NVIDIA、Figure等企业已在VLA和机器人领域布局,国内智元、银河通用等公司也聚焦VLA与机器人本体。

  
  研报指出,智能驾驶作为最先跑通闭环的代表场景,技术成熟后有望率先实现规模化落地。这意味着相关产业链公司在数据、硬件、算法和场景应用等环节都将迎来实质性发展机遇,值得重点跟踪。

  中财网
各版头条