载入中… | 今日精选 · 实时更新
每日精选全球 AI 与科技资讯
编辑部 · 北京时间 每日 08:00 更新
首页

Google AI Mode 升级:从“回答”到“执行”,你的语音助手终于会干活了

· · 阅读 5 分钟

当智能助手能直接帮你预订航班、修改日程、发送邮件,而不仅仅是告诉你“怎么操作”,AI 的实用价值才算真正落地。近日,Google 宣布对旗下搜索中的 AI Mode 进行重大升级,它不仅继续扮演知识问答的角色,更首次实现了与第三方应用的深度链接与交互——现在,你只需用自然语言说一句话,AI 就能在日历、邮件、笔记等常用应用里完成真实操作。

## 从“听写”到“执行”:AI Mode 的进化逻辑

在本次更新之前,Google AI Mode 更像一个超强版的“问答机器人”:它能够整合网页信息、分析复杂问题、生成多步骤回答,但所有输出都停留在文字层面。如果你想让 AI 帮你“把明天下午三点的会议改成线上”,它只能告诉你“您可以进入日历应用修改”,而无法直接替你完成。

此次升级彻底打破了这种限制。Google 将 AI 的“理解能力”与“执行能力”进行了系统级打通。用户在与 AI Mode 对话时,可以明确要求 AI “在 Google Keep 中创建一个购物清单”或“通过 Gmail 给团队发一封会议提醒”。AI 会解析指令、调用对应应用的接口,并自动完成操作,整个过程无需用户手动跳转。

## 首批支持的应用与交互方式:自然语言即操作指令

据官方介绍,本次更新首批支持的应用包括 Google 自家的核心服务——Gmail、Google Calendar、Google Keep、Google Tasks 以及第三方合作的部分应用(如 Spotify、Walmart 等),后续将逐步开放更多。用户不需要额外安装插件或学习新语法,只需像平时一样用口语化表达即可。

举例来说:
– 对 AI Mode 说“帮我查一下下周二的航班,如果价格低于 1500 元就订一张,然后把行程加到日历里”,AI 会依次查询航班信息、判断价格、执行预订(通过关联的第三方应用),并同步更新日历。
– 说“把这份邮件里提到的地址添加到 Google Maps 收藏”,AI 能自动识别邮件内容中的地址,然后打开 Maps 完成收藏。

交互方式上,AI Mode 支持语音和文字两种输入。在移动端,用户可以通过长按主页键或特定手势唤醒 AI Mode,然后直接下达操作指令。后台,Google 使用了其 Gemini 大模型进行意图识别和任务分解,再通过应用内建的 API 或系统级权限(需用户授权)完成操作。

## 安全与隐私:权限控制的细节

由于 AI 获得了“替用户执行操作”的能力,安全和隐私成为焦点。Google 为此设计了三重保障:

1. 显式授权:首次连接某个应用时,AI Mode 会弹出确认窗口,明确告知“此操作会由 AI 代你完成”,用户需要点击确认授权。并且每次执行高风险操作(如支付、发送邮件、修改重要日程)时,AI 都会二次确认。
2. 任务日志:用户可以在 AI Mode 的侧面板中查看所有历史操作记录,包括已执行和待执行的任务,随时可以撤销或修改。
3. 数据隔离:AI 仅会在执行任务时短暂访问所需数据,不会存储长期用户行为画像。所有操作均在用户设备端(或经用户同意的云端)完成,Google 承诺不会将操作数据用于广告或训练模型。

## 行业影响:AI 助手的“最后一公里”被打通

此次更新标志着 AI 助手从“信息层”正式迈入“行动层”。此前,无论是 Google Assistant、Siri 还是 Alexa,所谓的“操作”大多停留在打开应用、播放音乐等浅层功能,无法处理跨应用的多步骤任务。而 AI Mode 借助大模型的理解能力,将“思考”和“动手”合二为一,这直接让智能助手的实用性跃升了一个台阶。

对于开发者生态而言,Google 的这一动作也释放了明确信号:未来,所有支持系统意图 API 的应用都可能被 AI Mode“调度”。这会倒逼应用开发者主动适配 AI 可执行接口,从而形成一个围绕 AI 助手的超级应用生态。类似当年苹果的 SiriKit,但这一次 AI 具备更强的语义理解和任务规划能力,能处理更复杂的指令。

当然,挑战同样存在。AI 执行操作的准确率和容错率是核心问题——如果 AI 把“修改会议时间”误执行成“删除会议”,后果可能很严重。Google 目前的策略是“高敏感操作二次确认”,但要真正让用户放心地把日常工作交给 AI,还需要更长时间的信任积累。

总体来看,Google AI Mode 的这次升级,是智能助手从“工具”向“代理人”转变的关键一步。它不再满足于告诉你“是什么”和“怎么做”,而是直接帮你“做出来”。这或许才是人工智能真正融入日常的起点。