1 发展历程

1.1 概念萌芽期(1920s-1980s)

1.1.1 早期原型与幻想

自动驾驶的雏形可追溯至20世纪20年代。1925年,美国发明家弗朗西斯·霍迪纳(Francis Houdina)展示了一款名为“美国奇迹”的无线电遥控汽车,通过后方车辆发射信号控制转向、制动和加速,这更像是一台“遥控玩具”,但已具备无人操控的雏形。1939年纽约世博会上,通用汽车在“未来世界”展馆中设想了1960年高速公路上的自动引导系统——车辆通过电磁感应沿埋设电缆行驶。1950年代,美国无线电公司在实验室中实现了基于磁钉导航的自动公路模型。这一时期的技术受限于电子硬件,停留在概念验证与科幻作品(如《杰森一家》中的自动驾驶飞船)层面,尚未形成系统化的技术路径。

1.2 技术探索期(1990s-2010s)

1.2.1 无人车挑战赛

1990年代起,计算机视觉与传感器融合技术取得突破。2004年至2007年,美国国防部高级研究计划局(DARPA)连续举办三届“大挑战赛”(Grand Challenge),成为自动驾驶发展的关键转折点。2004年首届比赛在莫哈韦沙漠举行,参赛车辆无一完成全程;2005年,斯坦福大学的“Stanley”机器人车以自主导航完成212公里沙漠赛道夺冠;2007年“城市挑战赛”中,车辆需在模拟城区遵守交通规则、应对动态障碍物。卡内基梅隆大学的“Boss”和斯坦福的“Junior”等车辆展示了激光雷达、GPS与视觉融合的初步能力。这些竞赛催生了后来的Waymo、Uber ATG等技术团队,并推动学术界进入无人车研究热潮。

1.2.2 激光雷达的崛起

激光雷达(LiDAR)在2000年代初期从实验室走入自动驾驶领域。2005年,Velodyne公司创始人戴夫·霍尔从DARPA挑战赛中注意到旋转式激光雷达的潜力,将原本用于气象探测的多线激光雷达改造为64线旋转扫描原型,单台成本高达7.5万美元。激光雷达能生成高密度点云,提供厘米级环境三维信息,克服了摄像头在弱光与测距上的短板。2010年后,固态激光雷达与混合固态方案逐渐降低尺寸和成本,成为L3级以上系统的核心感知元件。这一阶段还催生了禾赛科技、速腾聚创等中国激光雷达厂商的崛起。

1.3 商业落地期(2020s至今)

1.3.1 萝卜快跑与Waymo的“神仙打架”

2020年代,自动驾驶从研发测试进入小规模商业运营。Waymo于2020年在美国凤凰城推出完全无人驾驶出租车服务(Waymo One),无安全员;2022年扩大至旧金山,与Cruise形成双雄格局。在中国,百度旗下“萝卜快跑”于2022年起在北京、武汉、重庆等地开展载人测试,2023年在武汉实现跨江运营;其成本控制策略(采用混合传感器方案)与规模化测试里程(超过1亿公里)引发行业关注。两家企业分别代表“重安全长周期”与“快速规模化”路线。截至2025年,L4级Robotaxi已在十余个城市落地,但受限于法律法规与长尾场景,尚未真正取代传统出租车。

2 技术分级(SAE J3016标准)

2.1 L0-L2:人类主导的辅助驾驶

2.1.1 车道保持与自适应巡航

L1级提供单一辅助功能,如自适应巡航控制(ACC)维持车速与车距、车道保持辅助(LKA)干预方向盘。L2级则同时控制横向和纵向运动,例如特斯拉Autopilot早期版本、丰田Safety Sense等。系统可以提供加速、制动与转向的协同辅助,但驾驶员需全程监控环境并随时接管。这一级别的核心传感器包括单目摄像头与毫米波雷达,算法相对简单。

2.1.2 “剁手级”的L2:方向盘还是要握紧

尽管L2系统能完成局部驾驶任务,但法律与设计上要求驾驶员双手不能脱离方向盘。部分车主在社交平台炫耀“脱手驾驶”后遭遇系统警告甚至功能禁用。行业戏称这种“看似高级、实则仍须盯盘”的状态为“剁手级”——一旦手离开太久,警告音和方向盘振动会像“剁手”一样提醒你。消费者容易高估L2能力,引发如2016年特斯拉撞上白色卡车侧面的事故,原因是摄像头将车身误认为天空。因此L2只是“辅助”,方向盘还是要握紧。

2.2 L3:有条件自动化

2.2.1 责任转移的“幽灵时刻”

L3的关键特征是系统可在限定条件下(如高速公路、低速拥堵)全权承担驾驶任务,但驾驶员需在系统请求时接管。这一瞬间被称为“责任转移的幽灵时刻”——系统突然发出接管请求时,驾驶员可能因注意力涣散而反应延迟。研究表明,从分心状态到有效接管至少需要10-15秒,期间的事故责任界定成为法律难点。

2.2.2 奔驰L3的“合法躺平”

2021年,奔驰率先获得联合国UN R157法规认证,在德国推出Drive Pilot系统,允许L3级自动驾驶在60km/h以下的高速公路拥堵路段启用。驾驶员可以合法地观看车内屏幕、阅读甚至处理邮件,但需保持随时接管的准备。2023年,奔驰在美国加州和内华达州获准上路。该系统的冗余设计(双制动回路、双转向电机)和精确的地理围栏(仅限高速公路)是商业落地的关键。行业将其视为“合法躺平”的样本——终于可以在车里打个瞌睡而不违法,但前提是车流得堵得像蜗牛。

2.3 L4-L5:完全自动化

2.3.1 地理围栏内的“老司机”

L4级自动驾驶在特定运行设计域(ODD)内完成全工况无人驾驶,无需人类干预。典型ODD包括限定区域(如园区、快速路、特定城市道路)和限定条件(白天/晴天)。Waymo在凤凰城的服务覆盖约面积200平方公里的区域,通过高精地图预标定所有车道、路缘和信号灯,车辆在区域内表现稳定,堪称“地理围栏内的老司机”。L4系统通常配备远程监控功能以处理异常。

2.3.2 终极梦想:无需方向盘的科幻座舱

L5级实现全时空、全道路无人驾驶,无任何ODD限制。届时车辆不再需要方向盘、踏板和后视镜,座舱可设计为移动起居室、会议室或睡眠空间。这一目标面临极端天气、无规则道路(如越野)、施工区域等几乎无限的Corner Case,目前尚无接近商用化的产品。行业内存在争议:是否真正需要L5?如果城市道路都能通过V2X改造实现L4,L5或许仅在理论上成立。但科幻作品中早已描绘了它的模样,比如《机械公敌》中的自适应座舱。

3 核心技术

3.1 感知层

3.1.1 摄像头:车辆的眼睛

摄像头是成本最低、语义最丰富的传感器。通常使用可见光与近红外单目/双目/多目方案,完成车道线识别、交通标志阅读、行人/车辆检测、红绿灯颜色判断等任务。深度学习(特别是卷积神经网络)使摄像头能在弱光、逆光条件下保持较高识别率。但摄像头天生受限于光照和天气,且单目无法直接测距(需借助视觉几何或神经网络估算),因此需要与其他传感器互补。

3.1.2 毫米波雷达:雨天的救星

毫米波雷达发射30-300GHz频段电磁波,对金属物体敏感,穿透雨雪雾气的能力远超摄像头和激光雷达。其多普勒效应可直接测量目标速度,因此在自适应巡航、自动紧急制动中发挥不可替代的作用。传统毫米波雷达角分辨率较低(约10°),易将路牌或天桥误判为障碍物;4D成像雷达的出现(增加俯仰维度)显著改善了目标分类能力。

3.1.3 激光雷达:点云世界的“扫地僧”

激光雷达通过发射激光束并接收反射信号,生成高精度三维点云。早期旋转式64线激光雷达每帧可获得数十万个点,但成本和机械旋转可靠性是痛点。固态激光雷达(如OPA、Flash)大幅降低了体积和成本(国产厂家已降至数千元级),且无机械运动部件,代表方案如华为96线、禾赛AT128等。激光雷达在暗光、雨雾中的表现优于摄像头,因此被视为L3+的必选项,但其在雪地或强沙尘中也会“眼瞎”。

3.1.4 超声波雷达:倒车时的“防撞棉袄”

超声波雷达利用40-50kHz声波测量短距(0.2-5米)障碍物,广泛用于泊车辅助。成本低廉(单个约10-20元),工作稳定,但在侧向风或探头积污时会失效。它是L2以下泊车系统的核心传感器,也常作为L4系统的近距离冗余数据源。

3.2 决策层

3.2.1 规划算法(全局与局部路径规划)

规划分为三层:路由规划(全局路径,从A到B,常基于A*或Dijkstra算法);行为规划(决策如换道、超车、通过路口,常用有限状态机或行为树);运动规划(生成无碰撞轨迹,优化平滑性、舒适性和可行性)。在动态环境中,模型预测控制(MPC)被广泛用于实时轨迹跟踪。近年强化学习也被尝试用于端到端决策。

3.2.2 行为预测(行人/车辆意图猜猜猜)

预测模块需要推断周围交通参与者的未来轨迹,常用方法包括:基于运动模型(卡尔曼滤波、匀速模型)、基于学习和场景解析(LSTM、Transformer)、以及交互预测(考虑车辆间相互博弈)。例如,行人站在斑马线前却低头看手机——系统需要猜他是要过马路还是等车?一种戏称“猜猜猜”的算法会输出概率分布,标注“50%横穿、30%后退、20%静止”。

3.2.3 端到端与模块化方案之争

模块化方案将感知-预测-规划-控制拆解为独立模块,可解释性强,便于调试和测试,但流程长、误差累积。端到端方案(如特斯拉FSD Beta的神经网络)直接输入传感器数据、输出控制指令,简化系统同时利用大量数据进行训练,但黑箱特性使其难以通过传统安全验证。行业主流采用混合架构——感知模块化、决策端到端化。争论本质是“可解释性 vs 性能上限”的平衡。

3.3 执行层

3.3.1 线控转向与制动

自动驾驶需要电信号直接控制转向、制动和油门,而非传统机械或液压连接。线控转向系统通过电机驱动转向齿条,取消了转向柱的物理耦合,可自由调整转向比、支持冗余电机。线控制动用电子踏板驱动制动主缸或采用集成式液压模块(如博世iBooster)。线控系统响应时间小于100毫秒,远快于人类反应。

3.3.2 冗余设计的“保命哲学”

L3以上系统必须具备冗余:双电源、双控制器、双通讯总线。以转向为例,通常配置两个独立电机,一旦主电机失效,备用电机可切换,并提供降级转向(如减速靠边)。制动系统采用电子制动助力+液压备份冗余,甚至四轮独立电机制动。这种“保命哲学”设计目标是单一故障不导致功能丧失,满足ASIL D功能安全等级。

3.4 高精地图与定位

3.4.1 厘米级地图的“虚拟轨道”

高精度地图包含车道线、路缘、标志牌、坡度的精确三维坐标,准确度达10-20厘米,相当于为车辆铺设了一条“虚拟轨道”。地图还需动态更新(施工、封路、临时标志),通常由采集车队周期性扫描或众包更新。与导航地图不同,高精地图不用于图形显示,而是直接输入规划算法。

3.4.2 惯性导航与RTK的“无GPS焦虑”

GPS在城市峡谷或隧道中信号丢失,自动驾驶需要其他定位手段。惯性导航系统(IMU)通过加速度计和陀螺仪测量瞬时运动,但误差随积分时间累积,需定期校准。实时动态差分定位(RTK)利用基站差分修正,可达到厘米级精度。组合导航算法(如卡尔曼滤波)融合GPS、IMU、轮速和视觉/激光雷达匹配,实现无缝高精度定位,让车辆在无GPS环境下也能“不迷路”。

3.5 车路协同(V2X)

3.5.1 红绿灯也能“打招呼”

车联网通信(V2X)包括V2V(车-车)、V2I(车-基础设施)。通过短程通信(DSRC)或蜂窝网络(C-V2X),车辆可实时接收红绿灯相位和剩余时间,从而做出“绿波速度”引导,甚至实现“无红绿灯路口的协同通行”。中国多个城市已部署V2X路侧设备,红绿灯信息推送至车载HUD,犹如交通设施主动“打招呼”。

3.5.2 路侧单元:上帝视角的补丁

路侧单元(RSU)安装在路口或危险路段,融合自身摄像头、雷达信息,将车辆盲区内的行人、非机动车实时广播给来车。这相当于为单车智能提供一个“上帝视角”补丁,特别是针对“鬼探头”场景——路侧传感器先将小孩从遮挡物后跑出的信息发给车辆,使系统提前减速。RSU的成本与覆盖率是普及瓶颈,目前多用于示范区和智慧公路。

4 应用场景

4.1 乘用车场景

4.1.1 高速领航辅助(NOA/FSD)

高速领航辅助驾驶是L2+最成功的商用功能。车辆可在导航设定后自动进出匝道、变道超车、维持车道,仅需驾驶员监控。代表产品包括特斯拉FSD(北美)、小鹏NGP、华为ADS 2.0。这些系统依赖高精地图、多传感器融合,在结构化高速公路上表现惊艳。2023年,中国高速NOA渗透率已超过15%。

4.1.2 城市道路全场景挑战

城市NOA面临更复杂的交通参与者:闯红灯的行人、逆行的电动车、无保护左转、施工围挡等。2024年,华为、小鹏、理想等车企陆续推送城市NOA功能,但用户普遍反映系统过于保守(被加塞率极高)或过于激进(急刹频繁)。城市全场景L2+仍在打磨,核心难题在于长尾场景和交互博弈。

4.2 出行服务(Robotaxi)

4.2.1 无人出租车:随时摇来的“空车”

Robotaxi采用L4级技术,用户通过App叫车,车辆无安全员、无人行驶。Waymo One在旧金山提供全天候服务,车费与出租车相当,但接单范围受限。2024年,百度萝卜快跑在武汉运营规模超过300辆,单日订单量突破10万,用户画像主要为年轻人(体验科技)和老年人(出行便捷)。车内通常配备语音交互屏,乘客可一键呼叫人工客服。

4.2.2 远程接管与云端“老司机”

当车辆遇到无法处理的异常(如交警手势、临时封路),远程操作员可以在控制中心通过5G网络查看多路摄像头,并下达指令:设定终点、降速、靠边停车,甚至直接遥控制动。这种“云端老司机”模式是当前L4应对长尾场景的主要解决方案。争议在于网络延迟如何保证安全——通常要求延迟小于100毫秒。

4.3 商用与特种车辆

4.3.1 自动泊车与最后一公里

自动代客泊车(AVP)是L4在封闭场景的典型应用。车辆到达停车场入口后自动寻找空车位并泊车,用户通过手机取车。最后一公里配送机器人(如美团无人配送车、Nuro R2)在封闭园区或低速非机动车道行驶,完成外卖、快递配送。这类场景速度低、路况简单,技术成熟度较高。

4.3.2 无人配送车:外卖小哥的“电子替身”

京东、美团、L4级新石器等公司的无人配送车已在国内数十个城市落地,车身尺寸接近儿童手推车,时速不超过15km/h,配备多线激光雷达和摄像头。它们可自主过马路、避让行人,但在高峰时段常被围观或堵塞,且面临法律法规对“机动车/非机动车”属性界定模糊的问题。网友戏称其为“外卖小哥的电子替身”,因为暂时还不能替代小哥上楼梯送餐。

4.3.3 封闭园区物流与矿山作业

港口、矿山、机场等封闭场景是L4率先商业化的领域。天津港、青岛港部署的无人集装箱卡车,通过5G+V2X实现精准停位和自动装卸;卡特彼勒、小松的无人矿车在澳大利亚西澳铁矿执行24小时运输作业,无需任何人类在场。这类场景由于环境可控、事故后果小,运营成本大幅降低。

5 挑战与争议

5.1 技术瓶颈

5.1.1 长尾场景(Corner Case)的“秃头率”

自动驾驶算法99%的时间表现优异,但剩余的1%极端场景(Corner Case)导致事故频发。例如:路上突然出现掉落的床垫、行人穿充气恐龙服、交通锥被风吹成随机形状、“道路泥水结冰后变成镜面”等等。统计显示,L4系统平均每10万公里会遇到约50个Corner Case,其中5个会触发人工干预。解决长尾场景需要无限大的数据集和模拟场景生成能力,被称为“秃头率”——工程师为这些罕见案例调试到秃头,也难以穷尽。

5.1.2 恶劣天气下的“白内障”

大雨、雪、浓雾、沙尘对视觉传感器影响严重。摄像头镜头被雨滴遮挡、激光雷达被雪折射产生噪点、毫米波雷达对地面反射产生的误检(如将飞溅的水花识别为障碍物)。特斯拉在2023年的一次大雪后统计,其Autopilot在雪地场景中的接管率是晴天的8倍。目前应对策略包括软件去噪算法、传感器自清洁系统(如加热镜头、超声波防水膜)、以及雷达+摄像头互补。

5.2 法规与责任

5.2.1 事故责任:算车算人算算法?

当L2系统发生事故,驾驶员通常承担全部责任;当L3启用且系统请求接管前发生事故,责任归制造商;但如果L3系统发出合适接管请求后,驾驶员未及时接管导致事故,责任归驾驶员。问题在于如何精确判定“接管请求”的时间点,以及是否存在系统故障(如误报接管请求)。2022年德国通过《自动驾驶法》规定:L3系统事故中制造商需证明自身无过失,否则承担全部责任。这相当于“算法坐上了被告席”。

5.2.2 保险与监管的“野蛮生长”

传统车险基于人为因素定价,但L3/L4的责任主体可能为制造商。中国北京、深圳等地试点自动驾驶保险,要求每辆车保额不低于500万元。监管方面,美国各州立法不同(加州允许无安全员测试,得州则要求远程监控),欧盟通过UN R157统一认证。全球尚未形成统一的跨国监管框架。

5.3 伦理悖论

5.3.1 电车难题的“无人驾驶版”

经典的电车难题在自动驾驶中升级:车辆在无法避免碰撞时,是选择撞向一个行人还是撞向三个行人?是保护车内乘客还是车外路人?实际算法中难以预设这种“牺牲规则”。大部分企业宣称不存在“选择牺牲谁”的条款——系统应尽一切努力避免碰撞,不能主动判断生命价值。但现实场景中,急刹车可能导致追尾、转向可能撞向其他车辆,法律上通常采用“等概率最小伤害”原则,但舆论仍然争议不断。

5.3.2 隐私与数据安全的“潘多拉魔盒”

自动驾驶车辆每秒采集数亿点云数据,包含道路沿线建筑内的人和物。这些数据可能被用于非法监控、位置跟踪。2018年,一辆Google地图采集车被拍到拍摄住宅围墙后的泳池——引发隐私担忧。中国要求高精地图数据必须由有资质企业处理,严禁外泄。此外,车载传感器收集的车辆状态、用户行程、车内对话等也面临被黑客窃取的风险。行业正在推动数据脱敏、车内边缘计算等解决方案。

5.4 社会影响

5.4.1 驾驶员失业?不,是“副驾驶失业”

自动驾驶最先替代的是司机职业的“低技能部分”:出租车司机、卡车司机、快递员。但历史经验表明,每次自动化都会创造新岗位(如远程操作员、地图数据标注员、系统维护工程师)。不过这一转型期可能带来结构性失业。业内调侃:与其担心驾驶员失业,不如担心“副驾驶”失业——因为自动驾驶让你后排的朋友再也不用帮你看着车侧,聊天时终于不用喊“慢点开”了。

5.4.2 公共信任危机:你敢在车里睡觉吗?

尽管技术日益成熟,公众对完全无人驾驶的信任度依然较低。2023年一项针对中、美、德三国的调查显示,仅30%的受访者愿意乘坐无人驾驶出租车,而愿意在行驶中睡觉的比例不足5%。这源于对“机器失灵”的本能恐惧和媒体对自动驾驶事故的放大报道。企业通过开放试乘体验、公布安全数据来逐步建立信任,但真正改变公众心理或许需要一代人的时间。

6 未来展望

6.1 技术演进路线图

6.1.1 传感器融合的终极形态

未来传感器将从“多传感器堆叠”向“单芯片感知融合”进化。例如,4D成像雷达融合激光雷达点云与摄像头语义,实现“一芯多模态”。固态激光雷达预计在2030年降至200美元以内,普惠L3+系统。同时,事件相机(Event Camera)等新型传感器将提升高速运动物体捕捉能力。

6.1.2 人工智能的“自我进化”

深度学习模型的泛化能力将通过大规模仿真训练(如Waymo的Carcraft模拟器,每天模拟数百万公里)不断提升。大语言模型(如GPT-4)开始被用于驾驶场景理解:比如解析交警手势或临时禁令标志。未来自动驾驶系统可能实现“越开越聪明”的终身学习,但需解决灾难性遗忘问题。

6.2 商业模式猜想

6.2.1 出行即服务(MaaS)

自动驾驶将使“拥有汽车”变为“使用汽车”。消费者订阅出行服务,按公里付费,车辆由运营平台统一维护。预计2035年全球Robotaxi市场规模将达2万亿美元。车企角色从制造商转变为出行服务商,用户不再关心品牌和配置,只关心单公里成本。

6.2.2 订阅制自动驾驶的“氪金玩家”

一些车企(如特斯拉、奔驰)已开始提供硬件预埋+软件付费的订阅模式:用户购车时仅配备基础L2硬件(摄像头、芯片),后续按月付费才能开启L3或城市NOA功能。这被称为“氪金玩家”模式——就像游戏里解锁角色皮肤,客户需持续续费才能维持高级驾驶体验。但消费者对这种“买车还要买操作系统”的模式褒贬不一。

6.3 跨界融合

6.3.1 自动驾驶+智慧城市

智慧城市中的智能交通信号灯、数字孪生路网、停车场预约系统可以与自动驾驶车直接交互。例如,当车预见前方拥堵时,路侧系统可建议绕行并提前预约空余停车位。未来城市中心可能禁止人工驾驶,只允许L4以上车辆通行,以实现交通零拥堵、零死亡。

6.3.2 飞行汽车:从地面延展到天空的“三体运动”

空中自动驾驶成为“地面自动驾驶的2.0版本”。亿航、小鹏汇天、Volocopter等公司正在研发电动垂直起降飞行器(eVTOL),依赖激光雷达、IMU和视觉感知,在低空空域自主飞行。虽然更接近《三体》里脱水者般的科幻场景,但其面临空域管理、噪音、电池续航三大难题。2025年,中国广州已开展eVTOL商业试飞,但大规模普及仍需10-20年。

7 冷知识与小梗

7.1 第一起自动驾驶事故(受害者是只猫?)

2015年,一辆Google无人车(雷克萨斯RX450h)在硅谷以低速行驶时,被后方车辆追尾——这是第一起公开报道的自动驾驶相关事故,且Google车辆完全无责。更早的“第一起”其实是2005年DARPA比赛中,卡内基梅隆大学的车撞上一只野兔(或一只浣熊,报道相互矛盾),成为“首个击中动物的自动驾驶车辆”。受害者到底是猫是兔已不可考,但坊间戏称“自动驾驶的第一个敌人是兔子”。

7.2 “老司机”认证:特斯拉的自动驾驶被吐槽像“新手”

不少特斯拉车主抱怨Autopilot在车道居中时“左右画龙”,仿佛新手司机手里的方向盘。这是由于早期算法参数过度补偿所导致。2018年一辆Model 3在高速上直冲向撞坏的消防车,事后分析系统可能误将消防车的红色闪光认为路障而已。网友总结:“它的驾驶风格像考驾照时被教练不断骂的那种学员,但至少没路怒症”。

7.3 黑客攻击:如何让一辆车变成“谐星”

2015年,安全研究员查理·米勒和克里斯·瓦拉塞克远程攻击了一辆Jeep自由光,通过Uconnect车载系统的漏洞,控制其空调、雨刮器、音响——甚至让车辆在高速上突然刹车。2019年,腾讯安全团队展示攻击特斯拉Model 3的“幽灵模式”:在屏幕上凭空显示出一辆假车,导致Autopilot猛打方向盘。这些攻击展示引发行业重视:一辆被控制的智能车足以变成“谐星”——因为你能让它放《最炫民族风》的同时在停车场原地画圈。