Waymo把Gemini装进无人车

Waymo为新一代Robotaxi Ojai加入Gemini车载助手和三屏界面,但刻意将AI与自动驾驶系统隔离。Gemini接管的是乘客交互,而不是方向盘。
Waymo给无人出租车配上了一个“会说话的乘务员”
Waymo在7月29日正式公布了 Gemini in Waymo,并同步展示为新一代自动驾驶网约车 Ojai 重新设计的车载界面。乘客可以通过语音查询行程、调节空调、了解附近地点,甚至提出靠边停车请求;但Gemini不能改变路线、速度或驾驶方式,也无法读取实时驾驶数据。
**Gemini in Waymo 是部署在Waymo无人驾驶汽车座舱内的对话式AI助手。**它负责理解乘客意图、回答问题和操作部分车舱功能,相当于一名数字乘务员,而不是负责转向、制动和路径规划的数字司机。
这条边界比功能列表更重要。Waymo并没有把大模型直接塞进自动驾驶决策链,而是让它停留在乘客体验层:AI可以听懂“我有点冷”,但不能听从“前面超车”;可以接受“找个安全的地方停下”的请求,但真正判断何时、何地停车的仍然是自动驾驶系统。
截至2026年7月30日,Waymo尚未公布Gemini in Waymo所使用的具体Gemini模型版本、端侧与云端的任务分工、平均响应延迟、上下文长度或准确率数据。Waymo也没有宣布这项功能是否额外收费,只表示近期将邀请更多公众乘客体验Ojai。

Ojai不是简单换屏,而是在重做Robotaxi的车舱逻辑
**Ojai 是Waymo面向无人驾驶网约车场景从零设计的新一代自动驾驶汽车。**与传统汽车围绕驾驶员布置仪表和控制按键不同,Ojai试图把整个车舱变成由乘客自主使用的移动空间,车辆行驶本身反而退到后台。
Ojai车内配备3块屏幕,但这并不等于给每位乘客各放一台内容相同的平板。系统会根据实际座位动态分配界面:如果只有一名乘客坐在右后座,其正前方屏幕可以显示完整的行程与车舱控制,其余两块屏幕则展示简化的路线状态或环境式媒体播放器。
三屏协同的价值在于解决Robotaxi里一个长期被低估的问题:没有司机以后,乘客究竟该看哪里、该问谁、该如何确认车辆理解了自己的需求。传统网约车可以直接问司机“还有多久”“能不能在前面停一下”,无人车必须把这些隐性的人际交互重新做成产品功能。
Waymo此次界面改版是其数年来第一次重大的车载UI更新,重点信息被收敛为三类:行程状态、音乐控制,以及车厢与媒体设置。这个方向是对的,因为Robotaxi界面不应该像汽车中控台那样展示大量驾驶参数,它更接近飞机客舱娱乐系统和酒店客房控制面板的结合体。
**Calm Mode 是Ojai用于降低屏幕存在感的极简显示模式。**开启后,三块屏幕会调暗,只保留最低限度的行程信息,避免动画、地图和媒体内容持续争夺注意力。
Calm Mode看似只是一个显示开关,实际上反映了Waymo对车载AI交互的基本判断:真正成熟的智能系统不应该一直证明自己存在。对于通勤、休息或夜间乘车的用户而言,少说话、少发光、需要时再出现,往往比持续推荐内容更有价值。
Gemini能做什么,以及明确不能做什么
Gemini in Waymo目前开放的能力集中在信息、舒适性控制和服务引导三个层面。乘客点击屏幕上的Gemini图标后即可开始语音交互,例如说“把空调调到65华氏度”,对应约18摄氏度;也可以询问附近咖啡店、当地地标历史、当前行程信息或Waymo服务规则。
Gemini最大的产品价值不是回答百科问题,而是把分散在多层菜单里的功能变成自然语言入口。用户不再需要先找到空调菜单、识别温度按钮并确认单位,只要表达目标,AI就可以把一句模糊的人类语言转换成确定的车舱操作。
Waymo目前披露的能力边界可以归纳如下:
| 乘客需求 | Gemini in Waymo是否可处理 | 实际边界 | |---|---:|---| | 查询行程信息 | 可以 | 展示或回答与本次乘车相关的信息 | | 调节部分车内设置 | 可以 | 官方示例包括将空调设为65°F(约18°C) | | 查询附近咖啡店 | 可以 | 提供地点与日常知识信息,不代表可代替用户完成预订 | | 了解地标历史 | 可以 | 属于Gemini的通用知识问答 | | 请求靠边停车 | 可以提出请求 | Gemini接收乘客意图,但不直接控制车辆运动 | | 要求加速或改变驾驶风格 | 不可以 | 驾驶决策属于Waymo Driver | | 临时更改车辆路线 | 不可以直接执行 | 官方明确Gemini不控制路线 | | 解释实时避障或制动原因 | 能力受限 | Gemini无法访问实时驾驶数据,不应猜测驾驶系统的判断 |
“请求靠边停车”尤其容易引起误解。更准确的说法是,Gemini提供了一个语音化的请求入口,而不是获得了车辆控制权;从Waymo公开描述看,乘客意图会进入既有的乘车与停车流程,最终执行仍受自动驾驶系统及其安全规则约束。
这种设计也意味着,Gemini不能成为实时驾驶解说员。它无法根据传感器信息告诉乘客“刚才急刹是因为右侧有自行车”,更不能对前方车辆、行人或道路风险做即时判断,因为它没有被授予实时驾驶数据访问权限。
最关键的设计:Gemini和Waymo Driver必须是两个角色
**Waymo Driver 是Waymo负责感知环境、预测交通参与者行为并控制车辆运动的自动驾驶系统。**它与Gemini in Waymo属于两套职责不同的系统:前者开车,后者服务乘客。
Waymo采用的是明确的控制面隔离,而不是让一个通用大模型同时聊天和驾驶。Gemini即使误解了问题、产生幻觉或遭遇诱导,也不应该直接改变车辆速度、转向和路线;车辆的安全关键动作继续由经过专门训练、验证和约束的Waymo Driver处理。
这套架构可以类比飞机上的乘务系统与飞控系统。乘务员可以响应乘客的温度、座位和服务需求,也可以把异常情况转交给机组,但不会因为乘客说“飞快一点”就直接修改飞行参数。
去年12月,研究人员通过分析Waymo移动应用代码,曾发现一份超过1200行、名为“Waymo Ride Assistant Meta-Prompt”的内部规范。该文件显示,Waymo要求助手始终区分“Gemini对话助手”和“Waymo Driver自动驾驶系统”,并对回复长度、越权请求、事故话题及重复追问设置严格规则。
此次正式发布验证了此前曝光内容中的多项核心能力,包括空调控制、行程问答和清晰的角色隔离。不同之处在于,Waymo现在不再只是在应用代码中试验,而是把Gemini与Ojai的新车舱界面作为完整产品体验公开展示。
Waymo的AI比Grok克制,但更适合无人出租车
车载对话式AI正在形成两条不同路线:一条强调人格、娱乐和长对话,另一条强调任务完成、低打扰和安全边界。Waymo明显选择了后者。
Waymo与特斯拉的出发点并不相同。特斯拉车辆通常仍由车主或驾驶员掌握最终控制权,Grok更适合承担有性格的车内聊天伙伴;Waymo提供的是没有人类司机的Robotaxi服务,乘客更需要一个能够解释产品、操作车舱并在不安时提供明确引导的数字乘务员。
| 对比维度 | Gemini in Waymo | 特斯拉车载Grok | |---|---|---| | 主要定位 | Robotaxi乘客助手、车舱控制入口 | 车内对话与娱乐型助手 | | 典型用户 | 无人出租车乘客 | 特斯拉车主与车内乘员 | | 对话风格 | 简短、实用、低打扰 | 更强调个性化与持续对话 | | 车辆控制权限 | 与Waymo Driver隔离,不控制移动或路线 | 不承担车辆驾驶控制 | | 实时驾驶数据 | Waymo明确表示无法访问 | 公开能力因车型和软件版本而异 | | 座舱形态 | Ojai三屏按座位动态分配内容 | 以车辆中控和后排屏幕配置为主 | | 价格 | Waymo尚未公布 | 取决于特斯拉与xAI当期产品政策 |
Gemini in Waymo的优势是目标足够明确。它不需要在车内复刻一个全能聊天机器人,而是重点解决温度调节、行程理解、地点查询、服务说明和停车请求等高频任务,这些能力直接影响乘客是否敢用、会用并愿意再次乘坐无人车。
Gemini in Waymo的不足同样明显。Waymo尚未给出响应延迟、嘈杂环境下的语音识别成功率、多乘客同时发言时的说话人识别能力,以及断网或弱网条件下的可用性;这些指标比百科问答效果更能决定车载助手是否可靠。
对话式AI正在接管“乘车体验”,而不是接管驾驶
这次更新不意味着大模型开始直接驾驶Waymo汽车。恰恰相反,Waymo通过产品设计反复强调:生成式AI可以接管人机交互层,但安全关键的车辆控制必须留在专用自动驾驶系统中。
对Robotaxi而言,对话式AI解决的是“无人服务”问题。车辆可能已经能独立完成大部分道路行驶,但乘客仍会遇到空调太冷、找不到停车按钮、不理解路线状态、临时感到紧张等情况;过去这些问题由司机顺手处理,现在需要软件主动补位。
三屏界面与Gemini结合后,Waymo实际上把座舱交互从“点击应用”升级成了“表达意图”。屏幕负责提供确定性和可视化反馈,语音负责降低操作成本,两者互相兜底:不想说话时可以点屏幕,不方便找菜单时可以直接开口。
这套设计也可能成为无人驾驶行业更现实的AI落地模板。相比让大模型参与毫秒级的感知与控制决策,让它先承担乘客服务、知识问答和人机界面编排,收益更直接,安全风险也更容易被限制在可控范围内。
真正的考验不是能不能聊,而是出问题时能不能稳住乘客
Gemini in Waymo接下来最需要验证的是异常场景中的表现。正常行程里调空调、查咖啡店并不困难,真正棘手的是车辆临时停车、绕路、乘客身体不适、儿童误操作,或者用户连续要求AI解释某次急刹时,系统能否给出准确、简短且不会误导的回应。
Waymo此前曝光的长篇行为规范说明,公司已经意识到车载AI不是普通聊天窗口。人在封闭、移动且没有司机的空间里,会天然把语音助手视为车辆的代表;Gemini哪怕只说错一句“我看到了前面的障碍物”,也可能让乘客误以为它掌握实时传感器数据。
Waymo目前选择“能力少一点、边界硬一点”是更稳妥的方案。对于Robotaxi,AI是否幽默并不关键,关键是它能否在3秒内理解停车请求、明确告诉乘客接下来会发生什么,并在无法处理时把用户引导到可靠的支持通道。
Ojai和Gemini in Waymo因此不是一次普通的车机升级,而是Waymo开始补齐无人驾驶商业化的另一半。Waymo Driver解决“车怎么自己开”,Gemini与三屏系统解决“没有司机以后,乘客怎么与这辆车相处”。
从现阶段公开信息看,Gemini还没有接管方向盘,也不应该接管方向盘;它接管的是过去属于司机的解释、响应与服务工作。对自动驾驶出行来说,这可能比在车里再放一个无所不聊的机器人更有用。
参考来源
- IT之家:谷歌Waymo展示网约车Ojai,整合Gemini AI与三屏协同显示——整理Waymo于2026年7月29日公布的Gemini in Waymo、三屏界面、Calm Mode及驾驶权限边界。



