搜索

VLA与华为的WA有啥不同？

人工智能

VLA与华为的WA有啥不同？

网友回复

自动驾驶 VLA（视觉 - 语言 - 动作模型）与华为的 WA（世界行为模型）主要有以下不同：

核心原理不同：VLA 是在大模型的语言模型相对成熟的背景下，把视频等信息转化成语言的 token 进行训练，再将其变成 action 来控制车的运动轨迹，即先 “理解世界”，再做决策，类似于人类驾驶时 “看懂场景→用语言 / 逻辑思考→行动” 的过程。而 WA 则是直接通过 vision 这样的信息输入实现控车，无需把各种信息转成语言，再通过语言大模型来控制车，它更像是端到端的强化版，模型学习到世界的动态规律后，能够预测结果并直接控制车辆。

架构流程...

点击查看剩余70%

by thinkfuture

我知道答案，我要回答

我有问题

最新提问

大模型越来越像loop agent了，越来越耗时了
win10上powershell运行wsl报错Wsl/0x80072f7d如何解决？
人工智能技术属于科学范畴吗？
pi与claw及codex有啥不同？
有没有在电脑上运行iphone虚拟机的软件？
如何将电脑扬声器声音同步输出到另外一台手机或电脑上/
为啥图片和视频大模型的提示词支持json和python代码？
Chromium的 Kiosk 模式是干啥的？
豆包如何生成15秒以上的视频？
ai文本大模型最后会升级成做任何动画片吗？