AI 快讯Chrome让Gemini接管填表
产品更新

Chrome让Gemini接管填表

2026-07-21T15:10:23.355Z

Chrome Canary开始测试Gemini智能填表,可从Gmail、Google照片等服务查找信息并直接写入网页表单。它比传统自动填充更懂语义,但跨服务取数也把隐私授权和误填风险推到台前。

Chrome让Gemini接管填表

Chrome Canary正在测试一项名为“使用 Gemini 填充”的功能,让用户不必离开当前网页,就能从 Gmail、Google 照片等谷歌服务中查找信息,并把结果写入表单。

这不是给传统自动填充换一个 AI 图标,而是谷歌第一次把“理解表单、检索个人数据、生成答案、执行填写”压缩进浏览器原生交互。更准确地说,Gemini 并非第一次进入 Chrome,也不是第一次控制网页,但它开始接管高频、结构化且直接涉及个人信息的填写环节,这才是此次测试真正值得关注的地方。

截至 2026 年 7 月 21 日,该功能仍只出现在 Chrome Canary 测试渠道,正式版发布时间、支持地区、账号范围、具体 Gemini 模型版本和收费方式均未公布。Canary 是 Chrome 更新最激进、稳定性最低的实验版本,因此现在看到的是产品方向,而不是一项已经可以依赖的生产级能力。

Gemini 填表到底做了什么

“使用 Gemini 填充”是一项由 Gemini 理解网页字段、查找用户授权信息并完成表单填写的 Chrome 原生功能。根据 7 月 20 日曝光的测试界面,用户可以在支持的输入框中键入 @@ 唤起功能,也可以点击右键菜单中的“随处搜索并填充”。

首次启用时,Chrome 会明确提示该能力由 Gemini 提供支持,并可能从 Gmail 等谷歌自有应用中查找信息。用户不再需要打开邮箱、搜索订单或邀请函、复制一段内容、切回原网页再粘贴,浏览器会把这条原本由人手完成的信息搬运链路合并起来。

一个典型场景是填写航班延误申请表。传统自动填充最多写入姓名、地址、手机号和银行卡信息,而 Gemini 可以尝试从确认邮件中找到航班号、出发日期、预订编号,再对应到网页上的不同字段。对于会议报名、报销、酒店入住、售后申请和求职登记,这种能力同样有实际价值。

这项功能的技术重点不是“生成一段文字”,而是建立页面语义与个人数据之间的映射。网页可能把同一个概念写成“预订编号”“订单参考号”或“Booking reference”,模型需要先判断字段意图,再从邮件或照片中定位候选信息,最后决定应该填写哪一条数据。

它与传统自动填充不是一回事

传统自动填充是一套基于字段标签和固定资料库的规则系统,擅长处理姓名、地址、密码和支付信息。它的优势是速度快、结果可预测,短板则是只认识预先定义好的数据类型,一旦表单要求填写开放式内容或临时信息,规则很快失效。

Gemini 智能填表是一套基于上下文推理和跨应用检索的动态填写机制。它不只读取输入框名称,还需要理解当前网页在办理什么业务,以及 Gmail 或Google照片中的哪条信息与这个业务相关。

| 能力 | Chrome传统自动填充 | 第三方AI填表扩展 | Gemini智能填表 | Chrome自动浏览 | |---|---|---|---|---| | 产品形态 | 浏览器原生规则功能 | 浏览器扩展 | 浏览器原生AI功能 | 浏览器原生AI代理 | | 主要数据源 | 已保存的地址、密码、支付资料 | 用户预设画像或扩展可访问的数据 | Gmail、Google照片等授权服务 | 页面内容、用户指令及已分享信息 | | 字段理解 | 依赖HTML属性和规则匹配 | 使用大模型理解字段 | Gemini理解页面上下文 | Gemini规划并执行多步骤任务 | | 可处理任务 | 姓名、地址、密码、银行卡 | 求职表、问卷、开放题 | 跨谷歌服务检索后填写表单 | 搜索、比较、导航、填写等连续操作 | | 操作范围 | 单次字段或一组固定字段 | 通常覆盖当前页面 | 聚焦当前页面的搜索与填写 | 可跨页面执行多步骤工作流 | | 使用门槛 | Chrome内置 | 需要安装和配置扩展 | Canary测试,资格未公布 | 个人账号需Google AI Pro或Ultra | | 已知额度 | 无AI请求额度 | 取决于具体扩展 | 尚未公布 | Pro每天最多20项,Ultra每天最多200项 | | 主要风险 | 规则匹配错误 | 扩展权限和数据去向 | 跨服务授权、语义误判 | 错误操作和连续任务失控 |

第三方 AI 填表扩展已经证明了市场需求,但原生集成仍然具有明显优势。扩展通常要求用户创建个人画像、授予页面读取权限,并自行判断开发者是否可信;Chrome 则掌握页面结构、浏览器权限体系、Google账号和密码管理工具,理论上可以减少安装、配置和数据重复上传的成本。

原生集成也意味着谷歌拥有其他厂商很难复制的数据闭环。Gemini 不只是看到网页上的空格,它还能在用户许可下连接 Gmail 和Google照片;Chrome 不只是展示模型结果,它还能直接把结果送进正确的控件。模型、账号、数据源和执行端都属于同一家公司,这种垂直整合会比单纯增加一个侧边栏更有竞争力。

真正变化是AI开始进入执行层

浏览器 AI 的第一阶段是摘要,第二阶段是问答,第三阶段才是执行。摘要和问答即使答错,用户通常还能在阅读后纠正;自动填写则会直接改变页面状态,并可能把错误信息提交给招聘网站、政府服务、保险机构或支付相关页面。

Gemini 此次进入的是一个受约束的执行环境,而不是完全开放的网页代理。表单字段提供了明确的目标,Gmail 等服务提供了相对明确的数据源,用户还可以在提交前检查结果,这比让智能体自主浏览多个网站、点击按钮和完成交易更容易控制。

这种受约束自动化可能比“万能智能体”更早普及。用户不一定愿意把一次旅行规划完全交给 AI,却很容易接受 AI 帮忙从确认邮件里抄写十几个字段,因为任务边界清楚、节省时间可见,而且最终提交按钮仍在用户手中。

Chrome 已经提供由 Gemini 驱动的“自动浏览”能力,可执行多步骤网络任务。谷歌官方帮助文档显示,该功能面向符合条件并主动启用的用户,个人账号需要订阅 Google AI Pro 或 Google AI Ultra;其中 Pro 每天最多处理 20 项要求,Ultra 每天最多处理 200 项要求,无痕模式和学校专用 Google 账号不支持。

智能填表与自动浏览的关系更像“专用工具”和“通用代理”。自动浏览需要规划一连串网页动作,能力更广但出错面也更大;智能填表只处理搜索和写入字段,能力较窄,却更容易建立确认、撤销和敏感字段保护机制。

隐私承诺还不等于风险消失

Chrome 在用户启用 Gemini 填表时,会把当前网页的标题和 URL 发送到谷歌服务器。页面标题和 URL 看似只是基础上下文,但现实中可能包含订单编号、搜索关键词、文档名称、客户标识,甚至由网站直接放进地址参数的个人信息。

谷歌目前给出的核心承诺是,自动填入表单的信息不会用于训练 AI 模型,也不会由人工审核。这两点直接回应了用户最容易担心的问题,但仍没有覆盖完整的数据生命周期,例如请求日志保留多久、哪些元数据会被记录、企业账号能否统一禁用、第三方网页内容如何隔离,以及不同地区是否采用不同的数据处理政策。

“不用于训练”也不等于“不上传服务器”。模型要理解网页和查询 Gmail,至少需要处理任务上下文;如果推理主要发生在云端,数据仍然会经过谷歌基础设施。用户真正需要知道的不只是模型学不学习这些内容,还包括发送了什么、保存多久、谁能访问,以及能否逐次撤回授权。

提示注入是另一个不能回避的风险。提示注入是网页通过隐藏文字或诱导性内容影响 AI 决策的攻击方式。如果恶意页面能够让 Gemini 把无关邮件、验证码或敏感资料当成表单所需信息,浏览器就可能从“替用户抄写”变成“替网站索取数据”。

谷歌需要把数据源授权做得比普通扩展更细。理想状态不是一次同意后让 Gemini 搜索整个邮箱,而是在每次跨服务取数时显示来源、候选内容和目标字段,例如明确提示“将把 7 月 18 日某封航班邮件中的预订编号写入此网站”,并默认屏蔽密码、验证码、完整支付卡号和身份凭证。

准确率比模型跑分更重要

智能填表的效果不能只用通用模型跑分衡量,因为真实表单充满了格式和业务约束。同一个日期可能要求 2026-07-2121/07/2026 或下拉框组合;姓名可能区分姓、名和拼音;地址可能需要拆成国家、省份、城市、街道和邮编。

一个看似合理的答案也可能在业务上完全错误。Gemini 从邮箱中找到最近一张机票,并不代表它就是当前理赔对应的航班;从照片中识别到证件号码,也不代表当前网站有权收集这项信息。因此,Chrome 不应只追求“填上了多少字段”,还要衡量字段来源是否正确、格式校验是否通过、用户修改率是多少,以及敏感信息是否被错误调用。

目前没有公开测试数据能证明 Gemini 填表的成功率、延迟或误填率。谷歌也没有披露该功能使用 Gemini 的哪个具体版本,所以现阶段不应把 Gemini 2.5、Gemini 3 或其他型号直接写进产品参数。对开发者和企业用户而言,模型名称反而不是最关键的指标,稳定的字段识别、来源可追溯和策略控制更重要。

谷歌真正想守住的是浏览器入口

Gemini 智能填表强化了 Chrome 作为任务执行入口的地位。当浏览器能够理解当前页面、连接个人数据并代替用户操作时,用户就不必先打开独立聊天产品,再把结果复制回来;AI 从一个目的地变成浏览过程中的基础能力。

这一变化也会压缩一部分浏览器扩展的生存空间。只做简历画像、字段匹配和一键填写的产品,很难在默认安装、账号体系和 Gmail 数据连接上正面对抗 Chrome;它们需要转向垂直行业模板、本地处理、企业审计、多浏览器支持或更严格的数据隔离。

开发者工具不会因此失去价值,因为原生功能和可编程自动化服务于不同人群。Google 的相关 Codelab 已展示 Gemini CLI、BrowserMCP、Playwright 和 Chrome DevTools MCP 如何组合完成界面测试,这些工具强调可重复、可调试和可集成;Chrome 智能填表则强调普通用户在当前页面上立即完成任务。

BrowserMCP 是一种让 AI 智能体读取并操作浏览器的 MCP 服务。它把浏览器能力暴露为模型可以调用的工具,更适合测试、研发和定制工作流;Gemini 填表无需用户搭建 MCP 服务,却也不会提供同等程度的流程控制和可观测性。

现在值得期待,但还不值得完全托管

Gemini 智能填表是一个比网页摘要更实用的 Chrome 更新,因为它解决的是每天都有人经历的复制、核对和录入工作。它不需要制造一个宏大的“替你使用互联网”故事,只要能稳定处理报名、报销、售后和预订信息,就足以形成高频价值。

这项功能目前最大的未知数不是模型是否足够聪明,而是权限边界是否足够清楚。谷歌必须让用户在填写前看到数据来自哪里、为什么匹配到这个字段,并对证件、财务、医疗和验证码等信息设置更严格的默认限制。

短期内,最合理的产品形态仍然是“AI 填写、人类提交”。让 Gemini 完成查找和录入,再由用户检查并点击最终确认,可以保留大部分效率收益,同时避免浏览器在错误上下文中直接完成不可逆操作。

长期来看,智能填表可能成为 Chrome 自动浏览的低风险入口。谷歌先用结构化表单训练用户接受 AI 执行,再逐步扩展到跨页面搜索、比较、预约和交易;如果这条路线成立,浏览器竞争的核心将不再只是速度、内存和标签页管理,而是谁能更安全地替用户完成网页上的实际工作。

参考来源

相关推荐

查看全部