报道(文/梁浩斌)自今年年初,ChatGPT的热潮催生了一轮AI大模型行业的大爆发,各家纷纷入局。半年多过去,不少应用已经落地,甚至开始商业化。

最初大家还在用大模型做聊天机器人,但业界真正关心的是——它还能往哪些场景延伸?随着汽车智能化越来越受重视,AI技术在自动驾驶、路径规划、智能座舱等领域的应用需求也在快速增长。最近一段时间,关于大模型“上车”的消息也密集起来。
自研还是合作?车企开始推动AI大模型上车
进入8月,多家车企通过合作或自研的方式,把AI大模型搬进了汽车。
8月初,吉利旗下的亿咖通科技宣布成为百度Apollo首批文心大模型智能座舱应用探索的汽车科技伙伴。按照官方的说法,百度Apollo针对车载场景对大模型做了专项训练和模型精调,覆盖了出行规划、用车顾问、知识问答、灵感绘画等更多场景需求,核心是让人机交互从“指令式”升级为“对话式”。目前文心大模型已在亿咖通的计算平台上完成了多项创新功能验证,部分功能后续有望在领克及smart相关量产车型中率先启用。
几乎同一时间,长城汽车也宣布与百度Apollo合作,同样围绕大模型能力在车载交互场景展开探索。多项创新功能已在长城量产车型平台完成验证,未来旗下多款车型将会搭载。百度Apollo的目标很明确:基于文心大模型提供更智能的对话式人机交互,帮车企打造差异化竞争力。
8月16日,长安汽车也加入了百度阵营,不过这次合作的范围更广——双方在云计算、人工智能、大数据和物联网等领域深度合作,文心大模型不仅用于智能座舱,还覆盖研发、生产、供应、销售、服务等多个环节。
另一家国产大模型供应商科大讯飞也在推进与车企的合作。奇瑞旗下星途品牌近期与科大讯飞联合发布,星火认知大模型首发搭载于星途星纪元ES车型,计划今年第四季度上市。这套大模型主要应用于智能座舱,星纪元ES搭载的“LION AI”大模型平台,核心是提升语音交互体验——跨业务场景、多轮交互、知识实时更新、深度语义理解、学习进化、多风格等能力,这些都是传统车机语音助手做不到的。
有合作的,也有选择自研的。广汽在8月8日推出了自研的AI大模型平台,基于海量的用车和研发数据集(包括多模态座舱数据、驾驶行为数据、汽车感知数据等),在AI中台层进行训练,形成了视觉大模型、NLP大模型、多模态大模型和专用模型等多种模型,以应对不同的应用需求。这套模型与广汽智能网联底层能力深度融合,在智能座舱提供语音交互、出行建议等服务,同时也能为智能驾驶赋能,优化感知能力,提升安全性和可靠性。
语音体验和智能驾驶是大模型上车的着力点
回顾一下,语音助手在智能手机上已经发展了十几年,但似乎陷入了瓶颈——很多时候它能准确识别你说的话,却无法真正理解你的意图,更别说给出合适的回应了。
车载语音交互这些年也有进步,比如一些新势力车企已经能做到连续识别多条指令,但本质上仍然只能匹配固定的指令组合、执行固定的操作。说白了,称不上“智能”。
而AI大模型带来的对话能力,从ChatGPT以及国内优秀大模型的表现来看,已经可以实现对用户语言的理解,还能结合上文语境进行有逻辑的交流。这种能力无论是放在汽车上还是手机上,都是革命性的。从长远看,它会真正改变汽车座舱内的主流交互方式。
从底层技术看,目前主流AI大模型属于NLP(自然语言处理)领域,但NLP不限于文字应用——视觉识别领域中的Transformer大模型早就被广泛使用,而Transformer本身就是NLP领域的一种训练模型。
值得关注的是,通过人类反馈强化学习(RLHF)技术,利用用户输入来判断回答质量、不断迭代改进的方式,也能应用到自动驾驶领域。毫末智行此前推出的自动驾驶认知大模型DriveGPT就是一个例子:在相同的驾驶环境下,如果人类驾驶的动作与算法决策一致、不选择接管,就记为一个good case;如果人类司机接管了,就记为一个bad case。通过持续反馈,引导自动驾驶算法做出更接近人类驾驶员的决策,从而提升体验。
小结
虽然目前大模型上车的主要落地场景仍然是智能座舱和语音交互,但像广汽这样的案例已经表明,它在优化智能驾驶感知方面也有潜力。换句话说,AI大模型在汽车领域的应用还处在摸索阶段,随着技术继续演进,未来有望拓展出更广阔的空间。
