- 谷歌在美国推出适用于安卓系统的Chrome浏览器Gemini功能,将摘要和操作功能集成到浏览器中。
- 自动浏览功能允许 AI Pro 和 AI Ultra 用户委托执行复杂的任务,例如预订停车位或安排行程。
- 该功能包含强制确认和防止指令注入等安全措施。
- 预计在完成美国阶段并适应隐私法规后,将业务拓展至欧洲和西班牙。
近几周来,我们在移动设备上的操作方式发生了显著变化。谷歌终于在美国面向安卓用户开放了 Chrome 安卓版浏览器中的 Gemini 助手,其创新之处不仅在于集成了语音助手,更在于该助手能够接管以往需要屏幕操作和手动输入的任务。这项功能在经过数月的测试以及桌面版的先行发布后,于 8 月 18 日正式发布。
这项集成旨在消除用户在不同应用程序之间切换或从头开始搜索的需要。现在,浏览器变成了一个助手,它可以读取并理解当前打开的页面,并在同一网站上执行复杂的命令。通过叠加面板,用户可以使用 Gemini 3.1 型号(该公司面向消费者用户提供的最先进的型号)与系统进行交互,而不会丢失上下文信息。
直接访问和主要功能

要使用 Gemini 助手,无需安装任何额外软件:它就位于 Chrome 浏览器的顶部栏中。您可以点击 Gemini 图标,或者点击三点菜单并选择“询问 Gemini”。之后,系统会在页面上打开一个窗口,您可以在其中提问、请求摘要,甚至连接到 Google 应用。集成的服务包括日历和 Keep,它们可以帮助您安排约会或随时记录灵感。
另一个值得一提的功能是,借助 Nano Banana 技术,可以直接从网页生成或编辑图像。您可以请求它修改照片或根据内容创建插图,而无需切换应用程序。此外,整个体验由 Gemini 3.1 架构提供支持,可在浏览器内提供最贴合上下文且自然流畅的响应。
自动浏览:多步骤任务的代理

此移动版本最强大的功能是自动浏览模式,这项智能功能可让您将通常需要几分钟才能完成的任务委托给人工智能 (AI)。AI Pro 和 AI Ultra 套餐的订阅用户可以使用此工具,例如,您可以请求 AI 为您预订活动停车位、更新商店订单,或搜索并组合航班和酒店以安排行程。系统会按步骤运行,打开页面、填写字段并完成任务。
实现自主运行的关键在于安全性。谷歌在代理执行任何敏感操作(例如付款、提交表单或修改账户信息)之前,都实施了双重验证系统。此时,人工智能会将方案呈现给用户并等待批准。此外,它还能够检测潜在的提示注入攻击——即网站上试图篡改助手行为的隐藏信息。自动浏览功能可以使用保存在密码管理器中的凭据登录某些网站,但谷歌强调密码不会被泄露。
系统要求和限制
要体验此功能,用户必须满足以下几个条件:移动设备需运行 Android 12 或更高版本,且至少配备 4 GB 内存。此外,用户还需要最新版本的 Chrome 浏览器,登录个人帐户,并将系统语言设置为英语。此功能在隐身模式下不可用,企业或学校帐户需要管理员手动激活。
为了防止过度使用,谷歌设置了每日限额:AI Pro 用户每天最多可以执行 20 个多步骤任务,而 AI Ultra 用户每天最多可以执行 200 个。您可以随时停止该过程并进行手动控制,谷歌建议对特别敏感的操作进行手动控制。支持页面提醒用户,系统可能会出错,用户最终要对 AI 在其帐户上执行的操作负责。
抵达西班牙及欧洲扩张
目前该功能已在美国全面推出,西班牙的具体上线日期尚未公布。谷歌通常会先在英国和加拿大等英语国家推出这些功能,然后再根据 GDPR 的要求进行必要的调整,逐步扩展到欧洲其他地区。目前,西班牙用户可以在 Chrome 浏览器中使用 Gemini 的基本功能,例如摘要和页面问答,但自动代理功能稍后才会推出。
然而,谷歌对这款助手的巨额投入显而易见。独立的Gemini应用用户已突破1.000亿,而将这项功能集成到全球最受欢迎的移动浏览器中,显然是一项旨在将人工智能融入用户体验核心的战略举措。自动浏览功能的国际推广也将分阶段进行,目前仍在筹备中。
目前,这项功能主要面向美国普通用户,但预计未来几个月内将推出面向欧洲市场的更新版本。无需亲自操作即可管理预订或购买机票,这预示着科技的发展方向。用户能否信任代表他们行事的代理人,以及跨越大西洋需要多长时间,还有待观察。



