第一讲结论,其实就是能力上务求对齐FSD,实现高质量驾舱融合。
第二讲发布会现场,很干很爽很快,50分钟全程无尿点,每个像素对我大脑都是有效训练。
接着我尝试用最简单的话把这次第二代VLA的重大升级说明白。
核心就是记住过去30秒、理解现在这个Moment、预判未来6秒。
说来容易做时难,其实影响未来交通决策的更多是过去3秒,为了更全面,让VLA吞下去的30秒就是海量长文本了,既考验芯片算力,内存容量,又考验模型能力。而且加上理解现在,预判未来这三个动作本来就不是孤立的,是并行处理动态的过程。
新版模型引入MoT混合架构,端侧模型参数量提升3.5倍,是主流VLA的15倍以上,结合超前轨迹预判、超长有效时序、更快决策响应,使得多维综合安全能力提升20倍。
简单比喻一下,白云机场从早期的一个航站楼,发展成三个航站楼,吞吐量大幅攀升之余依然保持着安全有序的运行。
另一个重点是Master Agent,这个Agent可以理解你的复杂需求并给答案之余,当然结合导航、车机应用、智驾多域融合,甚至可以用语音指挥智驾动作。这不就是FSD+Grok的玩法吗?
上两周试G9L还是老版本智驾,新版我挺期待的,希望快快有得试。我打算开着这智驾坐船之余再买杯咖啡的。
大v聊车小鹏第二代VLA首次模型重大升级








