普通人何时能体验大模型驾驶的技术?
数码新声
大语言模型能不能直接开车?刚刚过去的2026年9月,一项名为DrivingBench的真实道路实测给出了答案:GPT-6的Astra模型在134.7米停车场赛道上两次尝试即100%完成全程,而Claude和Grok的最好成绩分别只有45%和11%。
一、真实道路实测:谁能开、谁还开不好
DrivingBench项目:由3位研究员发起,用一台丰田卡罗拉配合Comma 4的openpilot,通过OBD-C线连接CAN总线,在湾区停车场用锥形桶布置了一条134.7米的测试路线,包含左转、长直道、右转和停车终点区。
实测结果:GPT-6的Astra第2次尝试即100%完成,耗时5分22秒、发出24条命令;Claude Fable 5.1最好成绩为45%;Grok 4.6三次尝试均止步于第一个弯道(8%、11%、10%)。
关键差异:不同于仿真器测试,DrivingBench同时考验感知、规划、控制、延迟处理和适应现实物理反馈的能力,模型需要边看摄像头画面边做决策。
二、技术路线:从语音指令到VLA全栈融合
当前主流方案:普渡大学提出的Talk2Drive框架,将乘客口头命令(如“我开会要迟到了”)通过语音识别转成文本,云端大模型结合天气、路况和交规生成驾驶代码,经CAN总线控制油门、刹车和转向,GPT-4因延迟低、推理强被选用。
VLA大模型方向:视觉-语言-行动模型将视觉感知、语言理解和驾驶动作决策融于一体,是端到端统一大模型,理想、小鹏等厂商已实际推进。
量产级进展:理想VLA司机大模型2025年8月随理想i8交付,9月10日全量推送,参数40亿量级,支持语音指令控车和驾驶习惯记忆;小鹏第二代VLA端侧模型参数量提升3.5倍,响应速度提升300%。
三、普通人何时能体验:三个判断维度
时间窗口:VLA大模型已从实验室走向量产车,理想、小鹏的产品2025年已开始交付推送,但CEO李想也坦言推送版本是“残血版”,部分核心功能尚未开放。
体验层面:世界模型正为自动驾驶搭建“虚拟驾校”,在数字空间反复模拟极端路况后再落地实车,这一模式显著提升安全性验证效率。
收敛预期:关于完全自动驾驶智能汽车何时到来,有“最快3年、保守5年”的行业预判,但大模型直接开车与L4级全自动驾驶之间仍有差距,普通用户现阶段更多体验到的是语音指令控车和增强辅助驾驶。