群发资讯网

#小鹏第二代VLA首次模型重大升级# VLA和VLM开始融合意味着什么? 过去车里的AI其实是分开的。VLM负责听懂说什么,座舱语音、导航搜索、车内交互都属于这一层。VLA负责看见环境之后怎么行动,也就是转向、加速、刹车、避让这些驾驶决策。两套系统各干各的,所以以前你跟车说一句“前面找个方便停车的咖 ​

小鹏第二代VLA首次模型重大升级VLA和VLM开始融合意味着什么?

过去车里的AI其实是分开的。VLM负责听懂说什么,座舱语音、导航搜索、车内交互都属于这一层。VLA负责看见环境之后怎么行动,也就是转向、加速、刹车、避让这些驾驶决策。两套系统各干各的,所以以前你跟车说一句“前面找个方便停车的咖啡店”,它最多帮你搜一个地点,再打开导航。至于怎么过去,最后怎么停,是另一套智驾系统的事。

VLA+VLM融合之后。你说一句“前面找个安静点的地方停一下”,AI会先理解你的真实意图,再看地图道路和周围交通,最后把意图变成车辆可以执行的一连串动作。也就是说座舱AI开始拥有驾驶能力,智驾AI也开始拥有语言理解能力。

我觉得按这个趋势,未来车机都不需要菜单了。你只需要告诉它想干什么。剩下的让车自己想办法。