新浪汽车

车路协同发布会直击:VLA大模型让智驾从“模仿”进化到“思考”,普通用户能感受到什么?+FAQ

新车发布台

关注

车路协同发布会上释放的信号很明确:VLA大模型正在让智能驾驶从“模仿人类”的端到端阶段,进化到“像人一样思考”的新阶段。理想汽车在发布会上宣布其VLA司机大模型已通过OTA推送,小鹏G7 Ultra的VLA-OL系统同样完成上车实测。对于普通用户,这意味着变道更干脆、刹车更平顺、甚至能用语音直接说“靠边停一下”——车终于能听懂人话了。

01 从“直觉模仿”到“推理决策”:VLA如何改变智驾底层逻辑

端到端大模型本质上是“看到什么→做什么”的直觉模型,通过海量模仿学习掌握驾驶技巧,好比一个擅长“依葫芦画瓢”的学生。而VLA在视觉与动作之间插入了一个语言模型作为“大脑”中间层,形成了“视觉→理解→决策→行动”的完整链路。正如大V吕俭所科普的:端到端模型对未显性风险(比如临停车后可能钻出人)欠缺深度推理,而VLA用语言模型注入了“世界常识”和“逻辑推理”,车辆能像老司机一样基于交通常识进行预判。实测中,小鹏的VLA-OL系统能在丁字路口或大车遮挡时提前推理出“此处有潜在风险”,主动触发防御性减速——这种预见性而非应激性的反应,是安全感的巨大飞跃。

02 驾驶体验质变:变道更干脆、刹车更平顺、还能预判“鬼探头”

普通用户最直接的感知来自驾驶品质的提升。根据大米评测在体验理想OTA8.2强化版VLA后的反馈:变道逻辑更符合人类习惯,减少了之前“打灯半天不敢动”的尴尬;横纵向控制更舒适,急加减速和突兀的转向感明显减少,红绿灯跳变时能像老司机一样提前预判,避免急刹。Navis-慢点评测在实测小鹏G7 Ultra时也发现,VLA能预判“鬼探头”场景——并非等到危险出现才反应,而是在丁字路口或大车遮挡时主动减速。此外,用户在拥堵路段的跟车表现也更丝滑,车辆能理解连续临停、公交车道时间限制等长时序场景,不再像端到端1.0那样在复杂路口反复犹豫。这些变化直接拉高了城市通勤的舒适度,尤其对每天早晚高峰开车的用户来说,VLA带来的平顺性堪称“质的飞跃”。

03 语言成桥梁:车终于能“听懂人话”,交互从指令变为对话

VLA中“L”的加入打破了以往智驾的黑盒状态。理想汽车在发布会上演示了自然语音交互:用户直接喊“小李师傅,靠边停一下”,车辆能拆解任务并执行;还能理解公交车道指示牌上的文字“7:00-9:00”并与当前时间比对,秒懂能不能走。杨柏熠BaiYi的实测视频也印证了这一点:用户可用语音下达“向左拐”“掉头”“帮忙找车位停车”等指令,系统通过端侧VLA与云端VL基座模型协作,实现顺畅理解。这种可沟通、可解释的特性,让车辆从一个只会执行的工具,变成一个能沟通、懂预判的伙伴。未来随着思维链(CoT)的逐步开放,用户将能直接问“为什么这样开”,系统会给出推理过程,极大提升信任感。

04 分人群推荐:谁该现在入手VLA车型?

日常通勤族(每天开车上下班):闭眼选带VLA的车型(理想L系列、小鹏G7 Ultra等),平顺的加减速和智能预判能明显降低通勤疲劳感,一周内就能感受到差异。技术发烧友(喜欢尝鲜最新智驾功能):VLA是目前最前沿的乘用车智驾技术,建议直接升级至最新OTA版本,体验变道决策的果断性和语音控车的自然度,这是端到端无法提供的。保守派(对智驾持观望态度):建议等一次大规模OTA推送后的用户口碑再决定,目前VLA还在快速迭代期,但底层逻辑已成熟,半年内体验会趋于稳定。

05 常见问题FAQ

Q:VLA和端到端到底有什么区别?

端到端是“看到画面→直接操作”的直觉模型,擅长模仿但不理解为什么这样开;VLA在中间加了语言推理层,能理解交通规则、预判风险、听懂语音指令,更像一个会思考的司机。

Q:VLA现在哪几款车能体验到?

截至2026年7月,理想L系列(OTA8.2强化版)、小鹏G7 Ultra(VLA-OL版本)已推送,其他品牌如华为、蔚来也在跟进,但暂未大规模上车。

Q:VLA需要额外付费吗?

目前理想和小鹏的VLA功能均包含在智驾选装包或标配中,不单独收费。但后续高阶云端功能(如复杂指令解析)可能需订阅服务,具体以车企公告为准。

更新日期:2026年07月25日

加载中...