罗永浩让旧科技新闻重现:Apple 承诺改进听写功能
罗永浩于 3 月 20 日批评了 Apple 的语音输入功能,但近五个月后,这一抱怨又回到了科技新闻的信息流中。这位中国企业家称,iPhone Dictation 的可靠性有所下降,而 Siri 仍明显落后于现代 AI 助手。这篇帖子反映的是个人判断,并非受控产品测试。
时间差很重要。8 月 12 日,一条热榜将该报道排在第 13 位,却未注明其最初发布时间。相关事件并不新鲜,发生在 Apple 于 6 月宣布 Siri AI 以及承诺提升全系统听写准确性之前。
这一时间顺序让一则旧抱怨成为及时的测试。Apple 现在表示,其下一代软件将改善语音理解能力,并让听写文字更准确地显示出来。用户仍需要独立证据证明,这些提升在不同语言、设备、口音和真实对话环境中确实有效。
这项抱怨早于 Apple 6 月的听写承诺
流传中的标题是最新的,但其背后的抱怨可追溯至 2026 年 3 月 20 日。
罗永浩在中国社交平台 Weibo 上发布了批评内容。一篇中文原始投诉报道归纳了他当天的多项尖锐评论。
他认为,Apple 内置语音输入的体验已经变差。他还批评了 Siri 的智能水平,并称大型公司一旦基础产品质量开始下滑,往往很难纠正。
这些评论格外受到关注,是因为罗永浩此前创办了 Smartisan Technology。这家公司曾开发 Android 手机及操作系统,以细致的界面设计和生产力功能著称。
他的背景并不能让这项评价成为科学结论。但这确实解释了为何一则简短的产品抱怨会在中国智能手机爱好者中引发关注。
原始材料未说明测试设备、操作系统版本、麦克风、网络条件或所选输入语言。它没有提供错误率,也没有给出转录文本对比。
罗永浩也没有发布可复现的基准测试。读者无法判断问题是否涉及声学识别、标点、语言选择、麦克风质量,或转录后的自动纠正。
这一验证缺口应始终是报道的核心。一位知名用户报告了糟糕体验,但他的帖子无法证明 Apple Dictation 对所有人都变得明显更差。
8 月的传播模式又增加了一层复杂性。热榜通常衡量当下正在吸引互动的内容,而不是当下发生的事件。
因此,一条重新流传的信息可能看似是新的产品故障。本案中,事件属于 3 月,而最新的科技新闻背景则来自 Apple 6 月的软件发布公告。
Apple 于 6 月 8 日推出 Siri AI,距离罗永浩发帖近三个月。该公司称,新助手将带来更好的语音理解能力,并显著改善全系统听写。
这一主张改变了问题。重点不再是某位有影响力的用户是否在 3 月不喜欢现有系统。
关键在于,Apple 宣布的升级是否修复了导致罗永浩这类抱怨的弱点。在最终软件覆盖更广泛用户之前,这一点仍未得到证实。
Apple 现有的支持文档称,Dictation 可让用户在任何能够输入文字的位置录入文本。它还支持自动标点,以及在语音与键盘输入之间切换。
这些功能使 Dictation 成为日常键盘体验的一部分。它并不只是另一个向 Siri 提问的界面。
这一区别很重要,因为最初报道将对 Dictation 的不满与对 Siri 更广泛的批评混在一起。两者都依赖语音技术,但承担的是不同任务。
Dictation 将语音转换为书面文字。Siri 则理解请求、检索信息,并在操作系统中执行操作。
用户可能会遇到糟糕的听写体验,而 Siri 依然能理解命令。反过来,当语音转录准确、但助手误解了预期操作时,也可能出现相反情况。
将两种失败视为同一个问题,在情感上容易理解,但在技术上并不精确。Apple 的 6 月公告也通过将改进后的听写纳入更广泛的 Siri AI 叙事,把两者联系了起来。
正因如此,这项重新流传的批评值得审视。Apple 提出了新的承诺,但公众测试仍须提供证据。
Apple Dictation 如今成了检验 Siri AI 的科技新闻测试
语音输入已成为可信度测试,因为 Apple 为其下一代 Siri 平台附上了明确的准确性承诺。
Apple 表示,Dictation 请求在多种语言中可在本地处理。其当前的设备端处理文档也称,这些语言无需互联网连接即可使用。
本地处理具有明显优势。它可减少对网络的依赖、降低延迟,并让更多语音数据留在设备上。
但它也带来工程限制。手机的计算能力和内存都低于大型云服务,而电池消耗仍然很重要。
Apple 必须在这些限制与识别准确率之间取得平衡。该公司还要服务那些切换语言、带有地区口音、听写姓名,以及在嘈杂环境中工作的用户。
普通话也有其独特挑战。识别系统必须根据上下文选择汉字,因为许多发音音节对应不同的书写形式。
标点和句子边界又增加了一层难度。即使转录记录了正确的声音,逗号、句号或段落换行位置不正确,文本仍可能难以使用。
姓名、品牌、俚语和技术术语能够迅速暴露弱点。这些词在通用训练数据中可能很少出现,却在特定用户的工作中频繁出现。
因此,令人满意的系统不只需要通用语音识别能力。它还需要词汇处理、上下文预测、语言识别和谨慎的纠正机制。
这也有助于解释为何个人体验存在差异。两个人使用同一部手机,也可能因环境和词汇不同而得出相反结论。
Apple 在 6 月宣布的全系统听写升级提高了人们对现有功能之外的期待。该公司称,改进后的语音理解将帮助文字更清晰、准确地显示出来。
Apple 还表示,Siri AI 会在支持的产品上使用其最先进的设备端模型。部分处理可在 Apple 的隐私架构内扩展至设备之外。
这些都是公司主张,而非独立基准测试结果。Apple 的公告没有提供普通话、英语、混合语言语音或地区口音的公开错误率。
它也没有展示性能与罗永浩在 3 月批评的软件相比有何差异。该公告描述了预期改善,但没有量化基线。
硬件适用性进一步使情况复杂化。Apple 表示,Siri AI 需要较新的产品,包括 iPhone 16 系列或之后机型,以及 iPhone 15 Pro 系列。
较旧 iPhone 的用户可能继续使用传统 Dictation,却无法获得全部 Siri AI 功能。因此,一句关于“Apple 语音输入”的宽泛说法,可能涵盖数个不同系统。
软件版本也构成另一项变量。某个 iOS 版本下记录的抱怨,可能在后续模型或语言包推出后不再适用。
正是在这里,科技新闻的框架变得有用。罗永浩的批评并非全系统回归的证据,但它指出了 Apple 提出修正方案之前一个显眼的失败案例。
Apple 实际上已承认语音输入仍需改进。其 6 月公告将准确性列为明确益处,而不是让用户自行推断进展。
该公司如今承担着可衡量的预期。在普通条件下,听写文本应当需要更少修改,而且这种提升应在精心设计的演示之外依然存在。
一项好的评估应在不同软件版本之间比较完全相同的录音。它应覆盖安静房间、街道、车辆、Bluetooth 麦克风,以及重叠的背景语音。
它还应测试姓名、技术词汇、语言切换、标点和长篇听写。结果应按语言和硬件代际分别呈现。
如果缺乏这样的结构,病毒式传播的帖子仍会主导人们的看法。个人抱怨依然是有价值的信号,但无法说明问题的规模或分布。
6 月的承诺让评测者有机会超越轶事。Apple 是否成功,应在最终版本发布后通过可重复的测试来判断。
真正的冲突在于 Apple 的承诺与日常使用体验
Apple 竞争的并不只是另一款助手;它还在与用户每次听写后所承受的修改负担竞争。
当语音输入能够减少工作时,它才算成功。如果用户必须反复修改姓名、标点或被替换的词语,速度优势就会消失。
这形成了一项简单的产品标准。转录文本不必完美,但它必须节省的时间多于所制造的时间成本。
罗永浩的抱怨正是在这一点上攻击 Apple。他的论点并非 Dictation 缺少显眼功能,而是称在人工智能快速进步之际,该体验反而感觉变差。
这种对比比缺少某项选项更具破坏性。用户期待成熟软件悄然改进,尤其是在其制造商宣传先进机器学习时。
Apple 的处境不同寻常,因为它控制着操作系统、键盘、处理器、麦克风和许多设备端模型。这种整合本应赋予其强大的技术优势。
同样的整合也抬高了期待。用户很难将糟糕结果归咎于无关联供应商之间的协作问题。
第三方键盘提供了替代选择,尤其是在中国。iFlytek、Tencent、Baidu 及其他开发商的服务,通过语言覆盖、词汇预测和语音功能展开竞争。
原始报道称,罗永浩在尝试其他选项后更偏好 iFlytek 的语音输入。由于他和文章都没有公布可比较的测试结果,这一偏好仍属轶事。
以云端为中心的服务可以投入更多计算资源用于识别。它们也可以无需等待操作系统发布,就更新语言模型。
不过,云端处理也会带来与连接性、响应时间和数据处理有关的权衡。用户必须判断,更高的识别质量是否值得这些成本。
Apple 一直将隐私和本地计算作为差异化优势。当用户不得不在私密处理与需要大量修订的转录文本之间做选择时,这一策略的说服力便会下降。
最强的产品应避免让用户面临这种选择。它应为常见使用场景提供可靠的本地识别,同时在更困难的请求需要时,使用经过严格保护的服务器资源。
苹果在 AI 领域更广泛的表现加大了压力。该公司在 2024 年宣布推出更个性化的 Siri,但重要能力未能按原计划推出。
因此,2026 年 6 月的发布被视为一次复苏努力。一项姗姗来迟的 Siri 改造让 Apple 面对那些更快推进对话式助手的竞争对手。
听写的范围比对话式助手更窄。这种聚焦使其成为一项尤其能说明问题的测试。
用户不需要 Dictation 给出哲学性的回答。他们需要手机以有用的标点和尽可能低的延迟,准确输出自己说过的话。
任务越聚焦,模糊的 AI 表述就越无处藏身。生成的文本要么减少了修改工作,要么没有。
压力不仅来自 Apple 的产品营销。开发者越来越期待语音成为应用、搜索和自动化操作的另一层输入方式。
糟糕的转录可能会损害后续的每一个环节。当最初的词语出现错误时,助手就无法可靠地理解消息、创建任务或检索笔记。
对于知识工作者而言,语音采集通常发生在信息进入可搜索系统之前。有效的信息采集取决于在这第一次转换中保留原意。
一个小小的识别错误就可能改变一个人的姓名、截止日期、测量数值或所要求执行的操作。这些失误比一句略显生硬的话更重要。
这形成了一条信任链。麦克风采集音频,语音模型生成文本,另一个模型再解释结果。
每个阶段都可能引入错误。一段润色得体的助手回复,可能掩盖转录错误而非将其暴露出来。
因此,Apple 必须向用户展示系统听到了什么,并让纠正操作变得简单。更高的智能不能替代透明的控制。
Luo 的批评之所以引起共鸣,是因为语音输入既私密又高频。用户会在消息、搜索框、文档和提醒事项中不断遇到其弱点。
偶尔演示中的一次失败或许可以容忍。但在每天数十次互动中反复出现的失败,会成为用户放弃该功能的理由。
Apple 6 月的承诺将日常使用置于其复苏的核心。营销可以吸引人们尝试 Siri AI,但留存将取决于普通互动中的表现。
这项投诉仍无法证明什么
一项病毒式传播的批评可以揭示产品风险,却无法证明识别质量出现了普遍下滑。
最有力的质疑点在于缺少测试条件。Luo 没有公布足够的信息,让其他用户复现其结果。
设备型号不清楚。iOS 版本、所选键盘语言、麦克风路径、网络状态和环境噪声也同样不明。
我们也不知道他具体说了什么。包含姓名和罕见术语的句子,与普通口语文本面对的挑战并不相同。
报道将其体验描述为变差,但没有提供更早的转录文本作为对比。记忆和不断变化的期待都可能影响这一判断。
现代助手提高了所有语音界面的标准。一个数年前让人觉得可以接受的系统,即便没有客观退步,如今也可能显得薄弱。
这并不意味着这种挫败感无效。它意味着“越来越差”可能是在描述感知到的竞争力,而非经测量的准确率下降。
这项投诉也将 Siri 和 Dictation 混为一谈。用户可能通过同一个麦克风图标理解两者,但底层任务不同。
语音识别将音频转换为文本。语言理解则决定该文本的含义,以及接下来应执行什么操作。
糟糕的 Siri 回复也可能始于正确的转录。同样,再准确的助手模型也无法找回语音识别阶段丢失的每一个姓名或数字。
Apple 6 月的宣传通过明确承诺改进系统范围内的听写,缩小了这种不确定性。但该公告没有提供按语言划分的基准数据。
Apple 表示,用户可以自然说话,并相信生成的文字。这个说法需要在真实设备上接受测试,而不能直接视为已得到确认的结果。
普通话表现尤其值得关注,因为 Luo 的公开评论是在中国发表的。以英语展示的改进并不会自动转移到每一种受支持语言上。
地区可用性同样重要。Apple 的 Siri AI 推出计划已经在不同市场产生了不同的时间表。
欧盟委员会对 Apple 以此为由暂不向欧盟提供 Siri AI 的解释提出异议。由此产生的推广争议表明,可用性可能取决于技术准备度之外的因素。
中国面临独立的监管、服务和部署问题。Apple 的全球公告本身并不能证明中国大陆会获得完全相同的功能。
这一差异限制了对 Luo 的即时反驳。在受支持硬件上展示的新英语功能,并不能证明他的普通话工作流已经改善。
硬件要求也可能造成结果分化。新的端侧模型可能在较新的处理器上表现更好,而旧款手机保留不同的能力。
因此,评测者应避免发布一个笼统的“iPhone Dictation 准确率”分数。这个标签可能掩盖不同代际和软件配置之间的重要差异。
隐私问题也需要同样精确的讨论。Apple 表示,许多语言的 Dictation 会在设备上处理,但用户应查看适用于自身配置的设置和披露内容。
第三方键盘遵循各自的数据政策。主观准确率更高,并不能消除有关语音、文本和个性化数据如何处理的问题。
这带来了真实的取舍,而不是一个轻易可判定的赢家。用户对准确率、速度、语言覆盖、隐私、电池续航和离线访问的重视程度各不相同。
Apple 的优势在于能够跨硬件和软件优化这些因素。它的劣势则在于,每一项妥协都会成为同一套高度可见系统的一部分。
Luo 的帖子应被视为一个警示信号。不应将其转化为没有依据的说法,即 Apple 整个识别系统客观上已经退化。
同样的谨慎也适用于 Apple 的回应。一次发布公告无法确认问题已经解决。
双方描述的都是体验或意图。独立、针对特定语言的测试必须决定已发布的产品是否改变了结果。
三个信号将表明 Apple 是否解决了问题
下一次结论应依次来自已发布的软件、对比测试和持续的用户行为。
第一个信号是搭载 Siri AI 的 iOS 27 公开发布。Apple 在 6 月宣布开发者可获取该版本,并表示将在秋季面向更广泛的客户推出。
最终版本比预览演示更重要。评测者应在与旧版 iOS 相同的条件下测试已发布的系统。
如果常用短语、姓名和标点需要的手动修改更少,Apple 的说法就会获得支持。如果提升只出现在脚本化演示中,核心担忧仍然存在。
测试必须将普通话与英语一并纳入。还应将旧有的 Dictation 行为,与仅在兼容 Siri AI 的硬件上提供的功能区分开来。
这种区分将显示 Apple 是改善了通用键盘体验,还是主要为较新设备增加了一条更好的路径。
第二个信号是独立的词错误率测试。词错误率以准确的参考转录文本为基准,衡量替换、遗漏和插入的词语。
没有任何单一分数可以概括完整的用户体验。不过,一致的方法论能够揭示识别质量是否朝承诺的方向发展。
测试应覆盖清晰语音和困难环境。应使用多位说话者、地区口音、不同语速以及常见的 Bluetooth 配件。
普通话评估应考察汉字选择、专有姓名、中英混合术语和标点。长篇听写应与短消息分开评估。
如果结果只在安静环境中的英语语音上有所改善,将削弱 Apple 更广泛的叙事。如果跨语言和环境出现可重复的提升,则会增强这一叙事。
评测者还应衡量纠正负担。两个系统可能记录到相似的错误率,却带来截然不同的编辑体验。
一个让用户能快速修正姓名的界面,仍可能保持实用性。一个反复改动已修正文本的界面,则可能让人感觉糟糕得多。
延迟也值得测量。一个准确度很高、却出现得过于缓慢的转录文本,会打断说话和编辑的自然节奏。
第三个信号是持续的用户采用。人们经常会在操作系统更新后尝试新的语音功能,然后在摩擦不断累积时放弃它。
Apple 通常不会按语言公布详细的 Dictation 使用数据。评测者仍可观察长期用户反馈、支持讨论以及第三方键盘的使用行为。
反复出现的投诉若有所减少,将支持 Apple 的说法,尤其是当用户描述的是具体改进而非泛泛的热情时。
持续转向第三方语音键盘则指向相反方向。这会表明 Apple 的整合优势仍不足以克服识别或工作流问题。
最佳证据将结合这三个信号。已发布版本确定可用性,基准测试确定技术变化,持续使用则确定实际价值。
这一顺序可避免又一轮热点榜单周期成为最终结论。社交互动可以揭示挫败感,却不能取代受控比较。
它也避免 Apple 的营销语言成为最终结论。该公司已将系统范围内的听写准确性列为一项益处,因此用户可以要求可衡量的结果。
Luo 3 月的投诉仍然具有意义,因为它捕捉到了 Apple 所称正在改变的产品体验。它在 8 月重新浮现,并不会让底层事件变得新鲜。
最新的科技新闻是 Apple 的回应,以及它为自己创造的测试。更好的 Dictation 必须在普通消息、笔记、搜索和纠正过程中发挥作用。
关注最终的 iOS 27 发布、针对特定语言的基准测试以及长期用户行为。然后,将结果与 Luo 所描述的问题进行比较。
如果这些信号一致,旧投诉将记录 Apple 修复一项被忽视界面之前的时期。如果它们不一致,重新浮现的批评将继续找到新的受众。



