武汉跑了一年的自动驾驶出租车,为何死活不肯摘掉方向盘
截至2024年第三季度,武汉自动驾驶出租车累计运营里程已超过800万公里,服务人次突破200万。但每个坐进后排的乘客都会注意到一个令人困惑的事实:驾驶座上依然坐着一名安全员,他们的双手虽然往往悬空,但随时准备接管方向盘。这个现象并非武汉独有,北京亦庄、上海嘉定、广州南沙的无人驾驶测试区里,方向盘后的人影同样挥之不去。技术公司对外宣称的“全无人”运营,实际上只在极少数限定区域、限定时段、限定天气条件下实现过短暂展示。那么问题来了:当激光雷达每秒能扫描30万个点,当高精地图分辨率达到厘米级,当神经网络已经通过数亿公里数据的训练,为什么那个圆形的方向盘仍然被认为是最后的安全绳?答案藏在一个反直觉的统计数据里。根据加州交通管理局2023年度的自动驾驶脱离报告,瓦安y米o和秒e两家头部企业的平均行驶里程中,每8万到10万公里才会发生一次需要安全员介入的脱离。这个数字听起来相当漂亮,相当于一个普通人连续开五年车才遇到一次麻烦。但这是平均数,剔除了所有极端场景后的平滑结果。如果按分位段去看,在排名前0.1%最棘手的场景中,脱离密度会陡然上升几百倍。换句话说,自动驾驶系统在99.9%的时间里表现得像个老司机,但在剩下那0.1%的片段里,它的表现可能还不如一个刚拿到驾照的新手。而这0.1%,恰恰是决定一辆车能否在没有人类后备的情况下上路的生死线。武汉作为国内最早大规模运营自动驾驶出租车的城市,提供了大量可供解剖的真实案例。有一次,一辆测试车在江汉路附近的狭窄巷弄里遇到一群小学生放学,一个孩子突然蹲下系鞋带,然后直起身朝马路对面追皮球。系统在第一帧里识别到了那个移动的白色物体,但标签打成了“飞行的垃圾袋”,因为它的运动轨迹和形态与之前训练数据里的皮球样本相差太大。等到神经网络重新分类完成时,时间已过去0.8秒,安全员已经条件反射地踩死了刹车。类似的事情每天都在发生:一个穿着黑色衣服的行人在逆光中几乎与沥青路面的灰度融为一体,系统直到距离仅剩5米才触发紧急制动;一块被风吹飞的广告布从立交桥上飘落,激光雷达的回波被误判为密集的雨滴;一只流浪猫从车底突然窜出,毫米波雷达的噪声过滤算法直接把它当作地面杂波屏蔽了。技术公司对这些极端案例心知肚明,但它们更清楚的是,单纯增加数据量并不能解决所有问题。武汉某自动驾驶企业的高级工程师透露,他们内部有一个名为“长尾故障库”的数据库,收录了超过十万个在路测中遇到的异常场景,其中大约三分之一属于物理世界中的低概率事件,比如一只轮胎从卡车上脱落滚到路中间、一辆洒水车在路口突然掉头并且同时打开喷雾形成视觉遮挡、一个井盖被暴雨顶起半米后又落回原位。这些场景在全世界任何城市的交通法规和驾驶手册里都没有标准解法,因为它们太罕见、太具体,以至于人类驾驶员也只能凭直觉和运气应对。但人类有一个优势:当遇到完全陌生的状况时,人会本能地采取保守策略——减速、观察、甚至停车等待。而当前的自动驾驶系统,在面对训练数据里不存在的物体或态势时,最常见的反应是输出一个“高置信度但是错误”的决策,因为它不得不从已有的分类中找到最接近的匹配项,哪怕匹配本身就建立在错误的假设之上。更致命的挑战在于感知系统的物理极限。激光雷达在雨雾天气中光束会严重衰减,武汉每年有超过120天的雨日,夏秋之交的浓雾能让256线激光雷达的有效探测距离从200米骤降到30米。摄像头在逆光、暗光、强光交替的环境下,动态范围远不如人眼。一个典型场景是下午五点的武汉长江大桥,落日刚好位于车道正前方,阳光透过挡风玻璃直射入摄像头模组,造成大面积饱和,此时如果有一辆银色轿车从阴影处驶出,系统几乎无法分辨它与背景的色差。毫米波雷达虽然不受光线影响,但在识别静态物体和行人的能力上存在严重短板,它能把一个站在路边的警察误判为路牌。多传感器融合的初衷是让它们互相补短,但在实际的算力异构、时钟同步和特征对齐过程中,任何一秒的延迟都会导致融合结果失真。武汉夏季的高温还经常导致激光雷达内部的散热系统降频,使点云密度在高温下降低20%以上。