top of page

Apple 终于修好了 Siri,但一切似乎已经太晚

尽管竞争对手已在这段延迟期间将先进 AI 助手变成日常期待,Apple 终于推出了两年前承诺的 Siri 升级。Apple 的 TechCrunch 故事如今不再关乎 Siri 是否能理解上下文,而是关乎后来居上是否仍算得上一个定义产品时代的重要时刻。

这个答案让 Apple 感到不安。Siri AI 看起来比它取代的助手实用得多。它能理解屏幕上的信息、搜索个人数据、跨 app 执行操作,并处理开放式问题。

然而,这些能力是在 ChatGPT、Gemini 和 Claude 改变人们对 AI 助手定义之后才到来。Apple 交付了 Siri 本应一直成为的产品。但由于 Apple 到达前标准已经提高,这项成就显得小了些。

这并不意味着 Siri AI 无关紧要。Apple 掌控着独立聊天机器人难以触及的操作系统、设备、权限和个人上下文。它的优势在于将智能融入日常设备使用,而不是打造又一个令人印象深刻的聊天机器人演示。

矛盾存在于 Apple 迟来的承诺与市场的新现实之间。Siri 终于具备了足够的重要性,但仅有能力已不足以带来兴奋感。

Apple 的 TechCrunch 报道遇上 Apple 承诺中的 Siri

新版 Siri 之所以重要,是因为 Apple 用能够理解上下文并跨操作系统执行操作的助手,取代了脆弱的命令式界面。

Apple 于 2026 年 6 月 8 日在其全球开发者大会上推出 Siri AI。随后,公司于 7 月通过 iOS 27 向公开测试用户开放该功能。

这一过程将分阶段展示转化为大范围产品测试。用户终于能够判断,Apple 是否解决了导致其推迟推出的问题。

根据 Apple 的 Siri AI 公告,该助手可以搜索信息、电子邮件、照片和其他个人信息。它还可以理解屏幕内容,并在支持的 app 之间执行操作。

以一个日常旅行问题为例。用户可能记得亲属发送过航班详情,却不记得是通过电子邮件还是 Messages 收到。Siri 可以搜索相关个人上下文、找到行程单,并帮助将信息添加到另一个 app。

这种交互结合了检索、理解和执行。旧版 Siri 通常要求用户知道确切命令,并自行提供所需细节。

Siri AI 也能更自然地处理后续问题。用户可以改变请求的一部分,而无需重述每个细节。该助手会保留足够的对话上下文来理解发生了什么变化。

其屏幕感知能力带来了另一项实用差异。用户可以询问设备上已经显示的地址、活动、产品或对话。Siri 无需在回应前获得精心准备的口头描述。

Apple 还扩展了该助手的出现位置。除了熟悉的语音界面,Siri AI 还拥有独立 app,并与 Apple 的系统搜索功能 Spotlight 深度整合。

这款专用 app 类似于让 ChatGPT 和 Gemini 变得熟悉的界面。它为用户提供可见的对话历史,以及输入较长请求的位置。

不过,操作系统整合更为重要。Siri 可以出现在工作已经发生的位置,从而减少将信息复制到独立聊天机器人的需要。

这种方式覆盖 iPhone、iPad、Mac、Apple Watch、CarPlay、AirPods、Apple TV 和 Vision Pro。具体可用性和单项功能仍因设备和地区而异。

早期 beta 测试显示出显著改善,同时也出现了熟悉的测试问题。TechCrunch 发现,Siri 可以查找照片、总结群组消息,并添加通过文本收到的预约事项。

同一轮 公开 beta 测试 也产生了错误。例如,一项关于伊朗新闻的请求让 Siri 在联系人中搜索同名人士。

这个错误准确反映了当前状态。Siri AI 代表着重大的产品变化,但它仍是处于积极测试中的软件,而非已经稳定定型的最终体验。

重要转变依然很明确。Apple 不再试图逐个意图地改进一个语音命令系统。它已围绕能够同时理解语言、上下文和可能操作的模型重构 Siri。

这就是 Apple 多年前描述的 Siri。它也是如今参与竞争所需的最低版本。

为什么新版 Siri 的历史意义不如预期

Apple 解决了旧 Siri 的问题,但整个行业已经为 AI 助手设下了更困难的考验。

Apple 最初于 2024 年 6 月的 WWDC 展示了个人上下文、屏幕感知和扩展 app 操作。其 最初的 Siri 承诺 描述了一款能够理解用户正在查看什么、并在 app 内执行操作的助手。

这些是重要承诺,也建立了 Apple 无法按原定进度实现的预期。

这次延迟成为产品身份的一部分。每一次新聊天机器人的发布,都为用户提供了将 Apple 尚未完成的助手与已可使用产品比较的新理由。

到 2026 年,让 AI 总结文本或回答开放式问题已不再令人惊讶。维持对话也成为基本期待。

市场开始用更严苛的问题评估助手:它们能否可靠完成多步骤工作?能否安全使用工具?用户能否核验其答案?能否在不造成侵扰的情况下记住相关偏好?

Siri AI 在这一环境中,成为对一场早先竞争的迟来回应。它的改进真实存在,但新鲜感已经贬值。

这比任何单一缺失功能都更能解释这种反高潮式反应。Apple 正在展示竞争对手花费数年才转化为常见行为的能力。

从旧 Siri 直接转向 Siri AI 的用户会感受到巨大差异。已经依赖 ChatGPT 或 Gemini 的用户,则会在其中认出许多熟悉的对话体验。

Apple 的实现提供了更深入的设备访问,但可见的交互方式仍可能显得传统:文本框、语音界面、生成式回答,以及此前对话的历史记录。

Apple 的 TechCrunch 叙事捕捉到了工程投入与公众反应之间的这种错位。Apple 完成了一次庞大的内部重构,而用户得到的却是他们愈发视为正常的能力。

公司还面临自身规模带来的负担。创业公司可以发布实验性 agent,并容忍明显失败。Apple 交付的软件则被人们用于通话、消息、导航、无障碍功能、工作和紧急情况。

因此,可靠性比炫技更重要。能够正确完成常规操作的助手,可能比能带来最戏剧化演示的助手更有价值。

这一标准也限制了 Apple 的容错空间。聊天机器人给出错误答案令人沮丧;涉及消息、日历条目、文件或目的地的错误操作,则可能扰乱用户的一天。

Apple 面临的挑战,是让生成式行为在确定性的操作系统中显得可靠。生成式模型根据概率产生回应,而操作系统通常执行精确定义的命令。

重构后的 Siri 位于两者之间。它必须理解不确定的语言、识别正确信息、选择操作并确认结果。

这是一项艰难的工作,只是没有新界面或令人惊讶的 AI 演示那么显眼。

因此,Siri AI 可以在技术上重要,却在文化层面平淡无奇。Apple 在市场不再将这一解决方案视为新鲜事物之后,才解决了难题。

公司已经追赶到足以重返赛场,但尚未证明自己能够再次定义这场竞争。

Apple 的优势在于上下文,而非聊天机器人

Siri AI 的独特性体现在它利用 Apple 对个人设备的访问,而非模仿独立聊天机器人时。

ChatGPT、Gemini 和 Claude 确立了现代对话界面。它们让用户习惯于通过自然语言提出宽泛问题、细化请求、分析文档和生成内容。

Apple 无需仅凭对话质量赢得这一界面。它更强的位置来自其平台内部可获得的信息和操作。

一部 iPhone 包含消息、照片、联系人、预约事项、app 活动、与位置相关的信息以及当前屏幕内容。用户已经依赖这些资料作出数百个小决定。

独立助手通常只能看到用户上传、连接或粘贴的内容。Siri 在保存这些信息的系统内运行,因此有可能减少这种设置步骤。

这正是回答一个通用旅行问题,与找到朋友上周二发送的预订信息之间的区别。它也是建议创建一个日历条目,与从现有对话中直接创建一个条目之间的区别。

其底层目标类似于个人知识管理。助手必须找到正确的信息片段、保留其上下文,并在进行中的任务中使其发挥作用。

Apple 将这一能力的一部分称为个人上下文理解。这个词意味着 Siri 在回应请求时,可以从用户设备中识别相关信息。

屏幕感知增加了即时上下文。app 操作提供执行层。两者结合,为 Siri 提供了从理解请求到完成请求的路径。

竞争对手更难在 Apple 硬件上复制这种组合。第三方助手受 Apple 的权限模型和平台限制约束,无法获得同样的默认位置或系统访问权限。

Apple 也在利用外部技术支持其重新确立的方向。2026 年 1 月,Apple 和 Google 宣布了一项涉及 Gemini 模型和 Google 云技术的多年合作。

双方的 联合 AI 声明 表示,下一代 Apple Foundation Models 将基于 Google 的 Gemini 技术。这些模型将支持未来的 Apple Intelligence 功能,包括更具个性化的 Siri。

这项合作削弱了 Apple 的一种传统叙事:Apple 并未独自构建每一个关键组件。

不过,模型来源并非核心产品问题。用户关心的是 Siri 是否理解其请求、保护其数据并正确完成操作。

Apple 表示,Siri 结合了设备端处理与 Private Cloud Compute。该系统会将部分复杂请求发送至 Apple 控制的服务器,同时限制处理过程中暴露的个人信息。

该公司表示,通过 Private Cloud Compute 处理的数据不会被存储,也不会向 Apple 开放访问。这仍是一项重要声明,因为 Siri 的实用性取决于它能否接触高度私人的信息。

能力更强的助手需要更广泛的上下文。更广泛的上下文意味着:当权限、检索或安全机制失效时,后果也会更严重。

因此,Apple 的隐私架构并非独立的营销主题,而是支撑其竞争地位的一部分。如果用户要让 Siri 搜索私人通信内容并执行操作,信任就是必要条件。

不过,仅凭隐私并不足以让 Siri 成为用户首选的助手。用户还需要证据证明,该系统能在各种应用和日常情境中正常发挥作用。

开发者将影响这一结果。当第三方应用提供系统能够理解和执行的清晰操作时,Siri 会变得更有用。

风险在于支持程度不均衡。Apple 自家的应用可以提供深度集成,而外部应用可能只开放较少操作,或表现不一致。

这会以更复杂的形式重现 Siri 的老问题:在请求越过不受支持的应用边界之前,助手或许看起来很智能。

Apple 真正的优势不只是 Siri 内置于 iPhone。更在于 Apple 能在整个设备范围内协调模型、权限、应用框架、硬件与用户上下文。

它能否持续发挥这一优势,将决定 Siri AI 是变得不可或缺,还是仅仅够用。

这一承诺仍须经受日常使用的考验

精致的测试版可以证明 Siri 已有所改善,但只有持续使用才能说明 Apple 是否解决了可靠性、信任和采用率问题。

早期评测者普遍认为 Siri AI 的能力更强了。但他们也指出,在不同请求和设备上,其表现仍不一致。

Engadget 的 iOS 27 预览称,这款新助手实用但并不惊艳。评测认为它取得了明显进展,同时也指出 Siri 仍有差距需要弥补。

这一评价契合更大的叙事。Apple 并不需要用户在受控测试中赞叹 Siri,而是需要他们在新鲜感消退后依然信任这名助手。

语音助手历来难以完成这种转变。人们会尝试宽泛的指令,遭遇几次失败后,便把使用范围缩减为计时器、天气、音乐和基本消息功能。

Siri AI 必须打破这种习得性行为。如果用户仍然默认复杂请求会失败,仅仅改进底层系统还不够。

Apple 面临的是多年有限表现造成的采用问题。用户需要理由再次尝试 Siri,发现新能力,并改变旧习惯。

专属 Siri 应用可能有所帮助。它让助手更显眼,也为聊天机器人用户提供了熟悉的界面。

但它也带来了概念上的张力。Siri 最强的优势是全系统可用,而独立应用会让它看起来更像其他所有聊天机器人。

Apple 必须教会用户哪些任务能从设备上下文中受益。否则,他们可能会在通用问题上将 Siri 与 ChatGPT 比较,而这正是 Apple 差异化较弱的领域。

可靠性仍是更棘手的问题。对话式回答可以容忍轻微变化,但设备操作必须选对应用、收件人、内容和时机。

设想一下,请 Siri 将最新的项目文件发送给同事。系统必须识别正确的项目,区分不同文件版本,选择目标联系人,并确认该操作。

每一步都可能出错。界面必须展示足够的信息,让用户能在错误造成后果前发现问题。

这正是确认设计至关重要的原因。Siri 应当快速执行低风险任务,但在发送、删除、购买或发布内容时放慢节奏。

测试版也无法证明其在 Apple 完整已安装设备基础上的表现。设备机龄、本地索引、语言支持、网络质量、账户设置和地区限制都可能改变体验。

索引尤其重要,因为个人上下文依赖于可搜索的设备信息。系统在安装或更新后准备数据时,用户可能会获得不均衡的结果。

区域可用性又带来另一项限制。在最初的测试阶段,Siri AI 在欧盟的多个 Apple 平台上不可用。

这一限制削弱了单一全球发布叙事的意义。Apple 可以发布同一名助手,却在不同市场提供不同能力。

与 Gemini 的合作关系也带来了另一个悬而未决的问题。Apple 和 Google 已在较高层面解释了这项合作,但用户无法独立审查每一项模型路由决策。

他们必须依赖 Apple 对请求如何在设备、Private Cloud Compute 与支持技术之间流转的说明。

这并不能证明系统不安全。它意味着,随着 Siri 处理更多敏感上下文,Apple 的隐私主张仍需持续接受技术审视。

公司还必须处理幻觉问题,即看似可信但缺乏依据的模型输出。当错误但自信的回答影响设备操作时,后果会更加严重。

Siri 的界面应当区分检索到的个人事实、网络信息、生成的摘要和已完成的操作。将这些输出一视同仁,会掩盖它们在可靠性上的差异。

这些未解问题并未抹去这次升级。它们解释了为何在稳定版 iOS 27 发布前,“修好了”仍应是暂时性的判断。

Apple 已经展示了 Siri 可以像现代助手一样运作。它现在必须证明,当数百万人提出模糊、个人化且不可预测的请求时,这种行为依然有用。

ChatGPT 和 Gemini 改变了“追赶”意味着什么

Apple 不再是在与旧式语音助手竞争,因为通用 AI 系统重塑了人们对实用性和速度的期待。

最初的 Siri 帮助确立了智能手机上的语音交互。它早期的价值在于,将狭窄的指令转化为便捷的设备操作。

这一类别多年来演进缓慢。Siri、Google Assistant 和 Alexa 通过增加支持的意图、集成和语言逐步改进。

生成式 AI 改变了比较标准。用户不再只根据助手能否识别指令来评价它们,而是开始期待系统能够理解目标,并帮助规划下一步。

ChatGPT 让对话灵活性广泛可及。Gemini 将生成式回答与 Google 的搜索、生产力和 Android 服务连接起来。Claude 则在文档分析和延展性知识工作方面建立了声誉。

这些系统仍会出错。但它们也创造了比消费者从年度操作系统发布中预期更快的产品迭代周期。

模型提供商可以在服务器端更新行为,无需等待新手机或重大平台版本。Apple 则受到不同的可靠性、隐私和硬件限制。

这些限制解释了 Apple 的部分节奏,但并未减轻竞争压力。

每一个延迟的月份,都给了竞争对手深化集成、让新工作流成为常态的时间。用户学会打开专属 AI 应用来进行研究、写作、规划、编程和分析。

Siri AI 必须说服他们,让操作系统再次成为主要助手。默认位置有帮助,但习惯的力量可能超过分发优势。

Apple 可以在许多简短、上下文密集的任务上取胜,而无需取代每一款专业工具。查找照片、修改预约、总结对话线程,或根据屏幕内容执行操作,都符合它最强的定位。

但 Siri 是否应成为进行延展性研究或复杂内容创作的目的地,目前并不明确。强行参与这类竞争,可能会分散对 Apple 系统优势的关注。

因此,Apple TechCrunch 的问题有两个答案。Siri 令人觉得虎头蛇尾,是因为它可见的 AI 能力已经很常见;它仍然重要,是因为没有竞争对手能像 Apple 一样全面控制 iPhone 体验。

这给双方都带来了压力。

Apple 必须让集成式辅助足够可靠,从而改变用户习惯。OpenAI、Google 和 Anthropic 则必须找到方法,在 Apple 无需单独应用就能呈现 Siri 时继续保持实用性。

Google 处于一个不同寻常的位置。Gemini 既作为面向消费者的助手与 Siri 竞争,也为 Apple 的基础模型提供技术支持。

这一安排反映出模型与产品之间日益扩大的分离。一家公司可以供应核心技术,却不控制最终界面、分发或用户关系。

Apple 押注的是,产品集成比拥有每一个底层模型更重要。这与其历史上的其他做法相似:将外部组件与严格控制的软件和硬件结合起来。

不同之处在于,AI 模型比许多传统组件更能直接塑造产品行为。对合作伙伴的依赖可能影响能力、时机、成本和战略灵活性。

Apple 即使从 Gemini 中受益,也需要持续改进自己的模型。否则,其最显眼的 AI 产品可能会过度依赖一家正在争夺同一批用户的公司。

竞争对手也有回应空间。Google 可以深化 Gemini 在 Android 和 Workspace 中的整合。OpenAI 可以扩展设备合作关系和智能体能力。Anthropic 可以强化其在专业工作流中的地位。

Siri AI 并未终结助手竞赛。它让 Apple 从令人尴尬的落后状态,进入了一场可信但拥挤的竞争。

公司的分发能力保证了关注度。只有表现才能将这种关注转化为持久使用。

三个信号将显示 Siri 是否真的修好了

下一场考验不是又一场主题演讲,而是稳定版软件能否将 Siri 的新能力转化为值得信任的日常行为。

第一个信号是稳定版 iOS 27 的发布。测试版展示方向,而公开发布则确立 Apple 对可靠性和可用性的真正承诺。

要关注关键功能是否一同推出。个人上下文、屏幕感知、跨应用操作、网络知识和对话连续性彼此依赖。

部分发布会削弱 Apple 已修好 Siri 的说法。协调一致的发布以及一致的设备支持则会加强这一说法。

第二个信号是用户完成设置和索引后 Siri 的表现。Apple 需要在个人搜索、应用操作和普通后续请求中实现可重复的成功。

轶事会很快出现,但有价值的模式将随着时间浮现。用户会超越计时器和天气功能,还是会退回相同的狭窄指令?

关注具体行为。人们是否让 Siri 在消息和电子邮件中查找信息?他们是否用它完成多步骤操作?他们是否足够信任结果,因而再次使用?

开发者支持也属于这一信号的一部分。Siri 的实用性将取决于热门第三方应用是否开放有意义的操作,以及是否能一致地处理这些操作。

强劲采用将表明,Apple 的平台优势比其姗姗来迟的起步更重要。采用疲弱则说明,多年的糟糕表现损害了用户使用 Siri 的习惯。

第三个信号是竞争回应。在 Apple 从测试版迈向稳定版软件的同时,ChatGPT、Gemini 和 Claude 也将持续改进。

Google 的回应尤其值得关注,因为它既是供应商也是竞争对手。Gemini 在 Android 上更好的整合,可能会缩小 Apple 在设备级上下文方面的优势。

OpenAI 也可以通过让智能体在应用和服务之间具备更强能力来向 Apple 施压。如果独立助手获得更广泛的权限,Siri 的独占集成优势就会变得不那么稳固。

这些信号将澄清“修好了”的真正含义。这个词不应描述一场成功演示或更具吸引力的界面。

它应当意味着 Siri 能够可靠地理解个人上下文、完成有用操作、传达不确定性,并赢得重复使用。

Apple 终于打造出了一款属于生成式 AI 时代的助手。只是当它到来时,整个行业早已让这一成就变得司空见惯。

这样的时机解释了为何反响平淡,但并不能决定最终结果。iPhone 仍然是助手最具价值的运行平台之一。

Apple 在 TechCrunch 上的叙事,如今将从延期交付转向执行表现。Apple 不再会因承诺推出更智能的 Siri 而获得认可。它必须证明,数百万用户会信任这款完成后的产品。

请用那些能够展现其真正优势的任务来试用稳定版。让 Siri 查找你无法定位的信息、理解屏幕上的内容,并跨 app 完成一项操作。然后逐一核查每个结果。

Siri 是否能在无需频繁纠正的情况下节省时间?它是否理解了足够多的上下文,从而减少手动操作?它是否会在行动前说明不确定性?

这些答案将比 WWDC 上的掌声更重要。Apple 已经追赶上了可见的能力。未来几个月将揭示,它究竟重建了这款助手,还是只重建了演示。

 
 

免费开始

一款本地优先的AI助手,具备个人知识管理功能

为了获得更好的人工智能体验,

remio 目前仅支持Windows 10+ (x64)M-Chip Mac

在你的大脑里添加一个搜索栏

Ask remio

记住一切

​无需整理

bottom of page