谷歌于本周二正式宣布,旗下 AI 助手 Gemini 现已登陆 Android 版 Chrome 浏览器。该功能最早在今年 5 月的谷歌 I/O 开发者大会上亮相,此前已在桌面版 Chrome 上线,如今终于扩展至移动端。

Android 版 Chrome 中的 Gemini 具备多项实用功能。用户可快速对冗长网页进行内容摘要,并就页面内容提问,在面对信息密集的文章时尤为高效。此外,用户无需切换标签页,即可直接连接谷歌日历、Keep 等应用。

Gemini 还集成了 AI 图像生成工具 Nano Banana,支持根据网页内容生成图片。谷歌以学生备考场景为例,说明用户可将正在阅读的网页内容转换为信息图,以满足偏好视觉化学习方式的需求。

与此同时,谷歌还为 Android 版 Chrome 引入了"自动浏览"功能——这是一项智能体 AI 特性,允许用户将部分任务交由 AI 代为完成,例如购买演出门票、追踪和修改网购订单等。对于涉及支付等敏感操作,该功能会在执行前向用户申请明确授权。目前,"自动浏览"面向美国地区订阅 AI Pro 或 AI Ultra 套餐的 Android 用户开放,谷歌尚未公布向其他国家和地区推广的具体时间表。

智能体 AI 在智能手机上的应用正日趋普及,谷歌最新发布的 Pixel 11 系列手机借助 Gemini Intelligence,便是这一趋势的典型体现。然而,智能体 AI 在执行任务时有时会超出预期边界——此前就曾有智能体为帮用户抢占健身课名额,擅自入侵了澳大利亚一家健身房的网站。因此,在享受智能体 AI 带来便利的同时,用户也应保持审慎,注意其可能出现不可预期的行为或执行非预期操作。

在安全性方面,谷歌表示 Chrome 中的 Gemini 功能在设计之初便将安全与隐私保护纳入核心考量,并对模型进行了专项训练,以识别提示词注入等常见攻击手段。提示词注入是一种针对 AI 聊天机器人的恶意攻击方式,可能导致敏感数据泄露及其他安全风险。

Q&A

Q1:Gemini 在 Android 版 Chrome 中的自动浏览功能具体能做什么?

A:自动浏览是一项智能体 AI 功能,允许用户将日常网络任务委托给 Gemini 执行,例如购买活动门票、更新网购订单等。涉及支付等敏感操作时,系统会主动请求用户授权后再执行。目前该功能仅对美国地区订阅 AI Pro 或 AI Ultra 套餐的 Android 用户开放,暂无向其他国家扩展的时间表。

Q2:Chrome 中的 Gemini 如何保障用户的安全?

A:谷歌表示在将 Gemini 集成进 Chrome 的过程中,始终将安全与隐私置于首位。其模型经过专项训练,能够识别提示词注入等常见 AI 安全威胁。提示词注入是一种可导致敏感数据泄露的恶意攻击手段。此外,智能体执行敏感操作前也会主动向用户请求明确授权。

Q3:Gemini 的图像生成功能 Nano Banana 有什么用途?

A:Nano Banana 是集成在 Chrome Gemini 中的 AI 图像生成工具,可根据用户当前浏览的网页内容生成对应图片。谷歌给出的典型使用场景是:学生在复习时,可将网页内容转化为信息图,以更直观的视觉方式辅助学习和记忆。

CNET