Gemini Call for Me 能代打商务电话,但信任才是真正的等待时间
Google 推出了 Gemini Call for Me,这项早期实验允许符合条件的 Pixel 11 用户将日常商务电话交由 AI 处理。
这项功能不只是拨打号码或在等待音乐中挂机等待。Gemini 可以自我介绍、操作电话菜单、与员工交谈,并汇报结果。用户无需亲自开启对话,便可让它预订座位、查询商品是否有货,或改约预约时间。
这一转变让 Gemini 超越了 Google、Apple 和 Samsung 已有的来电筛查工具。现在,助手会在与真人的实时交流中代表用户。Google 希望消除一种常见的摩擦,但这也意味着要将上下文、个人信息和决策交给一个不可预测的环境。
这也不是 Google 首次尝试自动拨打电话。Duplex 曾在 2018 年演示过为餐厅和沙龙拨打电话,而后续的 Pixel 功能则可以处理电话菜单和等待时间。Gemini Call for Me 将这些早期构想与能够完成用户指定目标的对话式智能体结合在一起。
核心问题已不再是 AI 能否生成逼真的声音,而是用户和商家是否会信任这个声音,让它准确行动、清楚披露自身身份,并在情况变化时及时停止。
Gemini Call for Me 不止于代为等待
Google 正从协助用户通话,转向代表用户完成整段对话。
Google 于 2026 年 9 月 24 日宣布这项实验。初期仅向使用搭载美国 SIM 卡 Pixel 11 的美国成年用户开放。用户还需要订阅 Google AI、安装最新版 Gemini app,并加入 Phone by Google 的公开测试版。
该公司将逐步推出此功能,因此满足这些条件并不保证能够立即使用。设备语言还必须设为英语。
符合资格的用户可在 Gemini 移动 app 中发起操作。用户需要描述期望结果,包括相关日期、偏好和备选方案。例如,用户可以让 Gemini 预订餐桌、索取服务报价,或在本地商店寻找某件特定商品。
Gemini 会在拨号前展示任务摘要。摘要包括商家的电话号码,以及 Gemini 计划分享的个人信息。用户可在点击授权拨号的按钮前修改指令。
Google 的通话说明称,每通电话都会以身份披露开始。Gemini 会表明自己是 Google AI 助手,说明正代表用户致电,并告知对方通话正在录音。
通话将使用机主的蜂窝网络连接和个人电话号码,标准运营商规则仍然适用。这使电话看起来是由客户本人发起,而非来自陌生的集中式服务号码。
接通后,Gemini 可以处理交互式语音应答系统,也就是通过数字菜单将来电者引导至不同部门的电话系统。它可以在等待中保持在线,并在人接听后开始交谈。
用户可以通过实时文字记录跟进对话,也可收听音频,不过其麦克风默认保持静音。点击“接管”会启用麦克风,提示 Gemini 宣布交接,并让助手退出对话。
通话结束后,Gemini 会提供结果摘要。完整文字记录和本地音频录音仍可通过 Phone app 的通话记录查看。
这套流程与 Hold for Me 相比有明显变化。Hold for Me 会等待真人重新接听,然后提醒用户接手。Direct My Call 则会将语音电话菜单转换为可点击选项。这两项工具通常都不会协商最终请求。
相比之下,Call for Me 会贯穿整个语音渠道完成任务:它接收指令,将其转化为对话,回应后续问题,并记录结果。用户从主要发言者变成监督者。
这种差异构成了本文真正的张力所在。节省时间取决于赋予 Gemini 足够的发言和应变权限;但每增加一分自主性,也会多一分误解的可能。
Google 为何重返 AI 商务通话领域
这项新实验重启了 Google Duplex 的雄心,同时改变了技术、披露模式和用户控制程度。
Google 追求自动化商务电话已有近十年。在 2018 年开发者大会上,该公司演示了 Duplex 拨打电话安排预约和预订。其合成语音中包含对话停顿,听起来极为接近真人。
这种真实感令许多观察人士印象深刻,但也立即引发了有关身份披露与同意的疑问。Google 随后强调,系统会表明自身身份。这一事件为面向消费者的通话智能体确立了一条长期原则:技术上的流畅性不能取代社会层面的透明度。
Duplex 专注于范围狭窄、结构化的交流。餐厅预订和沙龙预约涉及日期、时间、人数和可用时段等可识别字段。该系统并未被定位为可处理所有电话任务的通用代理人。
Google 后来将电话辅助功能拆分为更小的产品特性。Call Screen 会询问陌生来电者的来电原因。Direct My Call 会以可视化方式展示菜单选项。Hold for Me 会在排队等待时持续监听,而 Talk to a Live Rep 则帮助用户联系人工客服。
Ask for Me 将自动外呼扩展至查询商家服务和商品可用性。不过,该系统通常只是返回信息,而非完成更广泛的个人交易。
Gemini 商务通话将这些模块整合在一起。现代语言模型能够理解结构较弱的语音,并生成与上下文相关的回应。这使 Google 有空间支持不遵循固定预订脚本的对话。
助手现在可以分享选定的个人信息、提出或回答后续问题,并追求明确的结果。这让功能更实用,但也提高了错误回应的代价。
查询商品库存的电话可以说明这种差异。脚本化系统可以询问某一具体型号是否有货。智能体则可能需要应对其他颜色、替代取货时间、相似商品,或员工索要联系方式的请求。
更改预约会引出不同分支。用户想要的时间可能不可用;员工可能提供多个替代选项、询问现有预约,或要求 Gemini 无法披露的信息。
Google 表示,由于真实对话充满细微差别,因此正从小规模开始。这种谨慎比助手的音质更重要。再流畅的声音也无法解决权限不明确的问题,或自动从每个意外请求中恢复。
这一时机也反映出移动助手之间更广泛的竞争。Apple、Samsung 和 Google 已经利用自动系统筛查来电或识别来电意图。竞争前沿正转向完成外呼任务。
Google 拥有一项重要优势,因为它控制着 Gemini、Android 集成、Pixel 硬件和 Phone app。它可以将助手接入实时通话界面,而不必完全依赖第三方应用。
不过,这种集成最初仅通过一组严格条件提供。Call for Me 尚非通用 Android 功能,也无法在所有运行 Gemini 的设备上使用。
有限预览让 Google 能在将系统推广给更大规模受众前观察失败情况。它也让 Pixel 11 所有权和付费 AI 订阅成为使用 Google 最自主的消费级功能的门槛。
这一策略会促使其他手机制造商明确说明:其助手究竟能实际完成什么。摘要和建议回复固然有用,但能够完成现实任务的电话智能体,更直观地检验了实际价值。
当对话出现变化时,Gemini 通话如何运作
这一机制只有在 Gemini 能够在不可预测的问题中保持用户意图、又不越过获准权限时才会成功。
一通普通电话中往往包含初始指令里很少写明的信息。员工会确认姓名、重复日期、提供替代方案,并介绍来电者未曾预料到的政策。
因此,Gemini 所需要的不只是语音识别和语音生成。它还必须维持任务状态、理解对方回应,并判断某个答复是否仍在获准请求的范围内。
以餐厅预订为例。用户可能希望在特定时间预订两人的露台座位。餐厅可能立即提供室内座位,或在一小时后提供露台座位。
一个有用的智能体应当知道这些选项是否符合用户已说明的偏好。若提示中包含可接受的替代方案,Gemini 就可以继续;若未包含,助手就不应为了完成任务而擅自编造偏好。
查询库存时也会遇到同样的问题。员工可能确认商品有货,但提到只剩展示机。“有货”在技术上属实,但商品状况可能让这一结果失去意义。
这就是 Google 要求用户在通话前提供日期、偏好和备选方案的原因。更完善的指令能为智能体划定更清晰的边界,也能减少需要做出不确定判断的时刻。
使用自动化智能体的用户,可能已从其他AI 工作流中认识到这一规律:当目标结果、允许的输入和升级处理节点明确时,委派最为有效。
电话环境让不完善的指令更难纠正。电话另一端的人期待及时回应,智能体无法无限暂停,只为重新推断用户可能想要什么。
Google 通过实时监督来应对这一问题。机主可以查看文字记录、收听通话并接管对话。这些控制机制将完全委派转化为一个可监督的过程。
然而,监督也削弱了完全摆脱通话的承诺。若用户必须关注每一句话,节省的注意力可能少于预期。只有在人们足够信任系统、能够放心移开注意力后,它才会变得更有价值。
Gemini 还受到严格的任务限制。它不能拨打紧急服务电话、完成金融交易或提供支付凭证,也不能分享密码、社会保障号码、健康信息或敏感财务信息。
该功能仅限个人通话。Google 的附加条款禁止将其用于商业、政府、执法、政治、垃圾信息和电话营销场景。用户不能将其变成自动化销售拨号器。
这些限制能够防范明显的滥用,但也界定了任务必须停止的边界。需要支付订金的预订无法通过同一互动完成;涉及健康信息的医疗预约也超出了支持范围。
Gemini 即使在获准执行的任务中仍可能出错。Google 的 agentic calling terms 明确警告,该助手可能误解回复内容或提供不准确信息。该公司并不保证任务一定能成功完成。
这项免责声明凸显了对话与责任之间尚未弥合的缺口。如果 Gemini 预订了错误的日期,商家完全可能合理地将该预约视为已确认。用户仍需负责发现并纠正错误。
摘要又增加了一个潜在的失误环节。即使对话本身正确,最终的回顾也可能不准确。尤其在日期、数量、取消条款或取货说明至关重要时,用户应将重要结果与通话记录进行核对。
因此,Gemini 的通话机制并没有语音听起来那么神奇。它是一条受到监督的链路,涵盖理解、授权、对话与核验。只有链路中的每个环节都保持可见且可纠正,这款产品才值得信赖。
最难的部分,是赢得双方的信任
Call for Me 必须同时满足两个人的需求:委托任务的用户,以及意外与 AI 对话的员工。
Google 为用户构建了多项控制机制。Gemini 会预览其拟分享的信息、要求获得批准、提供实时通话记录,并允许用户立即接管。
接听方会在通话开始时获知相关说明。他们会听到来电者是代表某位具名人士行动的 Google AI 助手,也会被告知该通话正在录音。
这种透明度必不可少,但也可能提高被拒绝的概率。商家早已接到自动骚扰电话、欺诈请求和合成语音来电。即使背后的客户真实可信,一些员工在听到 AI 披露后也可能直接挂断。
对于小型企业而言,这个问题尤为突出。繁忙的餐厅接待员或店员可能并没有处理 AI 代表的相关政策。他们最稳妥的回应或许是要求客户亲自致电。
员工也承担了对话中的大部分负担。Pixel 用户节省了时间,但员工仍需回答问题、重复不清楚的信息,并在系统处理回复时等待。
如果这些互动比人与人之间的通话耗时更长,商家可能会抵触。因此,一项实用的消费者功能可能会给接听电话的人带来新的运营成本。
口音、背景噪声以及不一致的电话设备也带来了额外压力。一名 Google 发言人向 WIRED 表示,这项实验将测试其在不同口音和嘈杂环境中的表现。这些情况在真实的商店、美发沙龙和餐厅中十分常见。
该助手还必须区分不确定与拒绝。员工说“我觉得没有”与已确认的库存查询结果并不相同。一个有能力的系统应在摘要中保留这种模糊性。
语气也带来另一项挑战。人们会利用犹豫、幽默和间接表达来缓和社交摩擦。来电者可能会说:“那个时间对我们来说可能太晚了”,期待对方否决所提议的时间。
一个按字面理解的代理可能将其误读为暂时接受。一个过度主动的代理则可能犯相反的错误,放弃用户原本愿意接受的选项。
隐私模式同样值得严格审视。Google 的 privacy explanation 表示,通话记录会被发送并存储在其服务器上,但录音不会存储在那里。
通话记录和音频录音都会在 Phone 应用的通话历史中保存一份本地副本。用户可以从设备中删除这些材料,并通过其 Gemini 账户管理相关活动。
Google 表示,不会使用代理通话记录或录音来训练其 AI 模型。但它会使用通话记录生成摘要,并在 Gemini 中显示此前的通话活动。
这一区别减轻了一项担忧,但并未消除录音对话的敏感性。通话记录可能包含姓名、预约详情、日程安排以及商家提供的信息。
商家也需要一种切实可行的拒绝方式。Google 为组织提供了阻止 Gemini 用户自动来电的选项。这项控制机制承认,同意权不仅属于 Pixel 用户。
每日通话限额也提供了另一层保障,尽管 Google 并未在其支持页面公布统一的具体数值。在公司研究正常使用情况和故障模式期间,限制通话量可以减少滥用。
用户反应很可能沿着熟悉的立场出现分化。已经依赖来电筛选的人可能会将 Call for Me 视为缺失的外呼对应功能。那些不信任机器人电话的人,则可能将 AI 来电者视为人与人之间又多了一层隔阂。
最有说服力的测试不会是一场精心打磨的演示。关键在于,普通商家能否在不发生混乱、反复解释或频繁人工接管的情况下完成这些通话。
Google 的优势也给 Pixel 带来压力
Call for Me 为 Google 提供了一项独特的移动功能,但其受限的推出范围也表明,这项体验距离全面普及仍有多远。
此次预览版初期设置了五道门槛:较新的 Pixel、美国 SIM 卡、成年用户、Google AI 订阅,以及公开测试版 Phone 软件。英语是唯一受支持的设备语言。
这些要求意味着,此次发布是一场受控的实地测试,而非面向大众的 Gemini 发布。对于听说 Gemini 能打电话却无法使用该功能的消费者而言,这也令产品叙事变得更加复杂。
Google 可以从安全角度为这些限制辩护。分阶段部署能够在公司观察口音、噪声、商家反应及任务完成情况时减少通话量。它也提供了一个明确的群体,用于收集结构化反馈。
然而,排他性同样服务于竞争目的。Google 日益借助 Gemini 能力,使 Pixel 与其他 Android 手机形成差异化。即使竞争设备共享类似的底层 AI 服务,这项软件功能仍为消费者选择 Google 硬件提供了理由。
Apple 和 Samsung 已经推出了筛选来电、转录对话或协助用户处理通信的功能。它们面临的直接压力并不是复刻 Google 的界面,而是证明自家的助手能否安全地完成可比的现实任务。
更大的竞争关乎自主性。多年来,智能手机助手一直在响应诸如启动计时器或发送口述消息等指令。生成式模型则承诺以更少的监督来理解目标并完成多步骤任务。
电话提供了一场公开测试,因为成功与否很容易理解:要么餐厅接受了预约,要么商店确认了商品,要么预约时间被更改。结果无法躲在一段流畅的文字背后。
这种清晰度也会暴露失败。聊天机器人中的幻觉式回答可能只停留在用户与屏幕之间。商务通话中的错误陈述则会传达给另一个人,并可能形成实际承诺。
Google 的垂直整合能力有助于其管理这一风险。Gemini 可以与 Phone 应用、蜂窝网络连接、通话历史、通话记录以及 Pixel 的接管界面协同工作。更松散的服务组合将难以提供相同的控制机制。
不过,紧密集成也可能成为分发限制。该代理显然在执行一项高度依赖云端的对话任务,但访问权限仍绑定于特定代际的手机。用户可能会质疑,这种限制究竟源于技术必要性,还是产品定位。
商家还面临碎片化问题。员工可能会遇到来自 Gemini 的一套协议、未来 Siri 代理的另一套协议,以及面向企业的 AI 供应商提供的其他系统。每种系统都可能以不同方式披露身份,并通过不同程序处理更正。
标准的社会预期尚未跟上。对于员工何时应相信 AI 可以确认预约或接受替代方案,目前没有共同规则。对于如何验证代理背后的真实身份,也没有通用方法。
使用客户个人号码会有所帮助,但来电显示并不能证明意图。对于高价值商品、敏感账户变更或带有取消罚金的预约,商家仍可能要求客户直接确认。
因此,这一预览版测试的不仅是 Pixel 的市场需求。它还将揭示,商家是否愿意将消费者代理视为日常商业活动中的合法参与者。
如果接受度提高,电话可能成为自动化系统之间的接口。客户的助手最终或许会与商家的代理交谈,双方都将对话转换为结构化数据。
与在线表单或短信相比,这种结果听起来效率不高。然而,许多本地商家仍依赖语音,因为其库存、日程和例外情况尚未完全数字化。
Call for Me 瞄准了这一顽固的缺口。它利用 AI 在现代软件与主要仍只能通过电话联系的商家之间搭建桥梁。只有当这座桥对双方都证明可靠时,Google 的优势才会持续。
Pixel 11 实验之后值得关注的事项
下一阶段取决于三个信号:完成质量、商家接受度,以及能否突破当前资格门槛。
第一个信号,是无需人工接管即可成功完成通话的比例。Google 尚未公布此次预览版的任务完成基准。在发布初期,这种缺失可以理解,但它也让最重要的产品问题仍悬而未决。
一项有用的衡量指标应区分多种结果。Gemini 可能成功联系商家、听懂员工、完成请求,并正确总结结果。任何一个步骤失败,都会降低委派的实际价值。
接管频率同样重要。接管按钮是一项重要的安全控制措施,但如果需要反复介入,就说明该代理尚无法处理日常变化。
应关注用户对日期、姓名、替代方案和条件性答复的反馈。这些细节不如语音质量引人注目,却决定了人们能否信赖最终形成的预约。
第二个信号是商家接受度。Gemini 表明身份后,员工必须继续保持通话。他们还必须理解,该助手代表的是一名使用真实电话号码的真实客户。
频繁挂断、反复因身份披露而产生困惑,或商家大范围屏蔽的报告,都会削弱 Google 的论点。若有证据表明通话仍然简短且易于理解,则会增强其说服力。
独立评测应测试艰难但常见的场景,包括嘈杂的商店、明显的地区口音、冗长的电话菜单、缺货情况,以及多个可接受的预约时间。
它们还应检验系统是否能够优雅地失败。当助手没有权限时,应明确说明、礼貌结束通话,并解释用户下一步需要做什么。假装已经完成,比承认边界更糟糕。
第三个信号是产品扩展。Google 尚未提供针对其他 Pixel 代际、非 Pixel Android 手机、更多语言或美国以外市场的广泛时间表。
扩展将表明,该公司对其安全控制与商家接受度已具备足够信心。若继续仅限 Pixel 11,则可能意味着技术上的谨慎,或仍在执行硬件差异化战略。
支持任务列表的变化同样值得关注。支付、医疗保健、紧急情况和敏感个人信息被适当地排除在外。真正有意义的扩展,将通过政策和例外情况更复杂的日常任务体现出来。
Google 的早期实验从一些容易理解的场景开始:查询库存、预订餐厅座位和更改预约。这些示例目标明确,无需涉及敏感交易。
最有力的证据将来自持续使用,而非新鲜感。人们需要反复委托它拨打电话、信任其摘要,并且无需事后纠正助手。
因此,Gemini Call for Me 是对可靠代理能力的一次检验。这项技术不仅必须理解语言,还要理解边界、不确定性,以及何时应由人类重新接手。
目前,符合条件的 Pixel 11 用户应从低风险通话开始,并在依赖结果前查看通话记录。提供替代方案,留意早期尝试,并核实涉及罚款或截止期限的细节。
你今天会放心让 Gemini 处理一次常规预订,还是会觉得盯着通话记录本身也是另一种等待?这个答案将决定 AI 通话会成为日常便利,还是继续停留在令人印象深刻的 beta 阶段。



