Friend 的会说话吊坠在 OpenAI 之前测试无屏 AI 未来
- Martin Chen

- 8月2日
- 讀畢需時 13 分鐘
据报道,Friend 已让其吊坠能够开口说话,为关注 Google 新闻的读者提前测试 OpenAI 希望打造的无屏 AI 未来。
这一变化听起来并不起眼。Friend 此前通过吊坠聆听,但会以 iPhone 短信的形式给出回应。加入语音回复后,设备无需佩戴者查看屏幕,便完成了从聆听到回应的闭环。
这一结果同样也是一种警示。据报道,OpenAI 希望与 Jony Ive 的设计团队推出无屏消费级硬件。Friend 率先测试了同一项核心承诺:当 AI 脱离屏幕时,环境式 AI 可以变得更有用。
然而,语音输出并不能解决这一产品类别最棘手的问题。AI 陪伴设备必须理解并不完美的对话,在恰当时机回应,保护旁观者隐私,并证明自己持续存在的合理性。Friend 的经历表明,这些要求比取消屏幕更重要。
Friend 的语音更新改变了产品的社交角色
一个会说话的吊坠不再只是向应用提供数据的传感器。它会成为房间中的积极参与者。
Friend 最初是一款由 Avi Schiffmann 创建、始终保持聆听的陪伴设备。这枚小型吊坠连接 iPhone,并通过云端 AI 系统处理附近的语音。它最初的回复会以通知形式显示在配套应用中。
这种设计形成了一种不同寻常的分工。用户朝胸前的设备说话,但设备却在别处作答。他们仍需通过手机屏幕,查看这个所谓的陪伴者想说什么。
据报道,新增语音功能消除了这一断裂。用户可以对着吊坠说话,并通过同一个实体设备听到回答。这种互动比将语音提示换成文字通知更接近真实对话。
这一发展之所以重要,是因为 Schiffmann 曾拒绝采用语音输出。在 2024 年的一次采访中,他认为文字比合成语音更快、更私密,也更可靠。因此,这一新方向代表着一次重要转向,而非例行的功能扩展。
细节仍然有限。最初的 语音吊坠报道 将 Friend 的举动与 OpenAI 更广泛的硬件雄心联系起来。Friend 尚未提供足够经过独立验证的信息,说明其语音质量、可用性、处理方式或推广规模。
这些空白值得关注。一次演示可以证明扬声器能够发声,却无法说明人们是否希望它在一整天中不断讲话。延迟、中断处理、音量和环境噪声都会塑造实际体验。
语音也改变了产品的使用场景。在办公室、公共交通工具上,或进行私密谈话时,文字信息相对低调。语音回复则会将 AI 的理解暴露给附近所有人。
这种可见性可能有所帮助。佩戴者周围的人会更清楚地意识到,一个 AI 系统正在参与其中。但它也可能让设备更具侵扰性,因为突如其来的合成评论会打断人与人之间的交流。
因此,这项功能让 Friend 更独立于手机,但也增加了它的社交负担。每一次回复都成为关于时机、语气、隐私和许可的决定。
Friend 早期的设计在理解出错时,还能退回到屏幕后方。会说话的吊坠会让错误变得可听见。这种差异使模型准确性成为一种公开行为。
这枚吊坠仍代表着一种狭窄的产品定位。它被设计为陪伴设备,而非用于信息、音乐、导航或家居控制的通用助手。它的目标是聆听、记住上下文,并给出带有个人色彩的评论。
这种聚焦带来了一项有益的实验。如果 Friend 无法凭借有限的使命让语音陪伴设备获得欢迎,那么更大型的无屏平台将面临更艰难的任务。
为什么 Google 新闻将 Friend 与 OpenAI 联系起来
Friend 作为 OpenAI 竞争对手的意义较小;它更像是对 OpenAI 核心硬件论点的一次现场试验。
OpenAI 尚未宣布推出吊坠。其首款消费级设备仍基本未公开,关于设计的描述很大程度上依赖匿名消息源的报道。
可以明确的是,这家公司有意超越熟悉的界面。OpenAI 曾将其硬件工作描述为,尝试创造一种在传统产品之外与 AI 互动的新方式。
该公司以近 65 亿美元的估值收购了由 Jony Ive 共同创办的硬件初创公司 io Products。这笔收购让经验丰富的 Apple 设计师和工程师加入 OpenAI 打造消费设备的努力。
根据 无屏扬声器报道,首款设备预计将类似一台便携式家庭陪伴设备。报道描述其将配备摄像头、环境传感器、可充电电源和先进的语音系统。
同一报道指出,该设备可能包含用于营造个性的可动机械组件。据报道,它可回答问题、处理消息、播放媒体,并控制联网家居设备。
OpenAI 尚未确认这些规格,也没有公开说明该产品将如何收集、保留或保护传感器捕捉的信息。任何与 Friend 的比较都必须保留这一区别。
Google 新闻中出现的联系在于概念层面。两款产品都假设,AI 需要持续的上下文才能变得更有用。两者也都将对话视为主要界面,而非辅助功能。
传统语音助手等待唤醒词,并执行范围有限的命令。环境式陪伴设备则试图理解用户提出请求前发生了什么。这类上下文可能涉及人物、地点、日常习惯和先前的对话。
无屏设备需要这些上下文,因为它无法依赖菜单、图标或可见控件。系统必须从语音和周边环境中推断更多信息,也必须更少依赖图形进行说明。
Friend 测试的是这一模式中最个人化的版本。它的吊坠随佩戴者在现实世界中移动,并会接触到未必是对它说的话。
据报道,OpenAI 的家庭设备将在更稳定的环境中运行。客厅拥有更可预测的电源、声学条件和连接性,但也包含家庭对话、来访客人和敏感的生活习惯。
场所不同,产品挑战却相似。AI 必须判断何时拥有足够的上下文来提供帮助,以及何时应保持沉默。
这正是 Friend 的说话功能变得重要的原因。无屏 AI 需要一种不会迫使用户重新转向手机的输出方式。语音是最显而易见的答案,但语音也取消了以视觉方式预览信息的安全缓冲。
文字通知可以等待。语音输出会立刻出现,并占据共享空间。系统必须在开口前判断,这个回答是否适合出现在那个空间中。
OpenAI 拥有比 Friend 更强的模型、更多的资本和更大的软件用户群。但它也面临更广泛的期待。用户会将其设备与 ChatGPT、智能手机、智能音箱,以及 Apple、Amazon、Google 和 Meta 的产品相比较。
Friend 可以将成功定义为:为接受实验性人格的一小群用户提供陪伴。OpenAI 则必须在家庭、关系、语言和无障碍需求之间提供可预测的价值。
这使 Friend 成为一个有用的信号,而非蓝图。这家初创公司正在揭示,当工程师移除屏幕后,哪些问题依然存在。
真正的较量是无屏便利与社会信任
主要的较量不是 Friend 对阵 OpenAI,而是环境式便利与让人愿意将麦克风留在身边所需的信任之间的较量。
无屏硬件承诺减少视觉干扰。用户可以在做饭、步行、维修设备或照顾他人时提问。互动不需要解锁手机或操作应用。
语音也能改善那些觉得触控界面难以使用的人群的可及性。它支持免手操作,并能让用户在进行体力活动时保持注意力。
这些好处解释了为何公司不断回到对话式硬件。十多年前,Amazon 和 Google 已将无屏音箱带入家庭。随后,Meta 将语音 AI 融入人们熟悉的 Ray-Ban 眼镜之中。
较新的陪伴模式要求获得更多访问权限。它希望拥有足够的上下文记忆,能够在没有明确命令的情况下主动提供帮助。这需要持续感知、持久个性化,或两者兼具。
Friend 让这笔交换格外直观。吊坠上的麦克风会在佩戴者日常活动时聆听。随后,其 AI 可以基于并非对设备说出的语音发送评论。
一项为期 两周的 Friend 测试 发现,这种行为让其他人感到不适。评测者还在日常活动中遇到无关、带有评判意味和不准确的回复。
其中一位评测者避免将该设备带入编辑会议和与消息源的谈话中。这一反应说明了采用过程中的核心障碍。一台可穿戴设备可以属于其主人,却仍会捕捉范围内每一个人的信息。
Friend 表示,它不会将个人数据出售给第三方用于营销或用户画像。其披露内容允许将数据用于包括个性化、研究和法律合规在内的功能。
隐私政策并不能解决社会层面的问题。在佩戴者附近说话的人可能不知道吊坠捕捉了什么、处理发生在何处,或信息会保留多久。
加入语音可以改善提示效果,因为设备变得更难被忽视。然而,知情并不等同于同意。一次语音打断可能暴露出系统一直在跟踪一段对话,而捕捉行为早已发生。
据报道,OpenAI 的设备在家庭内部面临相关问题。摄像头和传感器可能有助于它理解谁在说话、对方需要什么。同样的硬件也可能暴露家庭日常习惯和私人通信。
家庭设备可能识别出有人正在准备晚餐,并主动提供计时器。它也可能听到医疗讨论、财务争执或孩子的谈话。上下文让这两种情境在技术上都具有价值。
这种权衡无法仅靠模型智能解决。产品控制机制必须明确展示何时进行感知、保留哪些信息,以及用户如何删除这些信息。
旁观者同样需要易于理解的提示。一个小型状态灯往往不够,因为人们可能看不到它,或无法理解其含义。声音确认有所帮助,但持续播报会让产品令人疲惫。
实体控制依然重要。用户需要一种无需操作软件即可快速关闭传感器的方法。设备应让静音状态清晰可见,并且不易被意外解除。
开发者也需要为主动行为设定边界。一个每次检测到情绪线索就开口的陪伴设备,会制造令人尴尬的错误。一个等待每条命令才行动的系统,则会失去其承诺的优势。
这种平衡构成了真正的产品机制。系统必须结合感知、上下文记忆、轮次检测、响应生成和社交克制。
轮次检测是指识别一个人何时说完,以及这句话是否是对 AI 说的。人类对话中包含停顿、打断、讽刺、声音重叠和未说完的想法。
一枚会说话的挂坠必须在不断变化的声学环境中解决这个问题。安静的卧室、拥挤的咖啡馆、行驶中的车辆和户外人行道,都会产生截然不同的音频条件。
模型还必须选择输出渠道。有些信息适合通过语音表达,有些适合以私密通知呈现,还有些根本不该被主动提出。完全无屏的系统仍需要一种处理敏感细节的方式。
这也是手机仍会参与其中的原因之一。屏幕非常适合查看长文本、确认购买、纠正错误和管理权限。将其从主要交互中移除,并不意味着它失去了实用价值。
胜出的产品或许会减少对屏幕的依赖,但不会假装每项任务都适合通过语音完成。Friend 的更新正在检验:用户是否欢迎这种折中,还是期待这枚挂坠能够独立运行。
对于知识工作者而言,其影响不止于陪伴。环境式设备可以捕捉通常会在一段对话后消失的决定、承诺和想法。
这种能力类似于一种移动版的个人知识管理。但要实现有用的回忆,需要准确归属、获得许可,并清晰区分个人信息与共享信息。
一个什么都记住却记得很差的设备,不是第二大脑。它只是一个能接触敏感材料的不可靠证人。
说话并不能解决 Friend 的准确性和采用难题
语音让 Friend 显得更有存在感,但存在感会放大其理解、判断和可靠性上的每一个弱点。
早期评测描述了一款对周边环境理解不稳定的设备。嘈杂房间会干扰其转录,无关的音频有时也会触发不相关的信息。
有一篇评测发现,Friend 将一场关于 Claude Code 用户的讨论误认为是在谈 Microsoft Outlook。用户无法查看一份完整记录,了解设备究竟听到了什么。
这一限制很重要,因为上下文 AI 需要可追溯性。当陪伴设备发表令人意外的评论时,用户需要知道是哪一个信号促成了它的判断。否则,纠正就只能靠猜测。
语音输出会加剧这个问题。错误的文本可以被私下忽略;错误的语音回应则可能打断会议、误述一段关系,或暴露敏感推断。
个性化还带来另一种风险。Friend 有意避免工具型助手常见的中性语调。Schiffmann 将不完美和观点视为陪伴体验的一部分。
这种选择可以让互动显得不那么机械化,也可能模糊模型错误与刻意塑造的角色特征之间的界线。
手机通知里的尖刻评论很容易被忽略。同样的评论若在人类交谈中被说出来,可能显得敌意十足或带有操纵性。语气成为产品安全的一部分。
该设备进入的也是一个已有失败先例的市场。Humane 的 AI Pin 曾尝试打造无屏可穿戴界面,却因可靠性、电池限制、发热和日常价值不明确而受到批评。其消费者服务后来被终止。
Rabbit 的 R1 保留了屏幕,却承诺提供一条完成常见数字任务的替代路径。评测质疑其软件是否能取代用户早已熟悉的手机应用。
这些产品失败,并不只是因为模型不够智能。它们要求用户携带新硬件,却无法持续胜过智能手机。
Friend 作出的承诺更小。它不需要取代消息、导航或商务功能。它需要让陪伴足够有吸引力,以证明佩戴一枚麦克风是合理的。
这个更狭窄的使命降低了技术门槛,却抬高了情感门槛。用户可以容忍天气助手偶尔出错,却会根据陪伴设备是否理解上下文、是否作出恰当回应来评判它。
会说话的版本提高了用户对连续性的期待。自然语音暗示设备可以跟上打断、记住先前话题,并解读声音中的情绪。任何不匹配都会立刻变得明显。
语音延迟也影响可信度。长时间停顿会让互动更像一次远程请求,而不是一场对话。快速但错误的回复则会造成另一种失效模式。
Friend 尚未公开提供独立测试,以证明其新的语音行为在不同口音、嘈杂环境或多位说话者场景中的表现。因此,Google 新闻报道应被视为一种发布信号,而非成熟度的证据。
OpenAI 也将面临同样的验证考验。其传闻中的硬件可以借助 ChatGPT 的语音能力,但专用设备带来的期待比可选的应用模式更严格。
应用可以在屏幕上展示转录内容、重试失败的回应并呈现设置。无屏物件则需要在语音识别或推理失败时提供替代性的恢复路径。
硬件还引入了固定约束。麦克风位置、扬声器尺寸、电池容量、散热限制、无线连接稳定性和制造质量,无法仅靠模型更新来修正。
OpenAI 与 Jony Ive 的合作表明其重视实体设计,但这并不能保证消费者会接受一个在家中观察、聆听或移动的设备。
该公司在硬件推进上还面临法律压力。Apple 提起诉讼,指控 OpenAI 和前 Apple 员工挪用商业机密。
OpenAI 表示,对其他公司的商业机密没有兴趣。这些指控仍是正在进行的诉讼中的主张,并非已被确认的事实。
这场Apple 硬件争议可能影响招聘、开发或发布时间。尽管如此,OpenAI 的财务主管仍向美联社表示,预计将在 2026 年底前后推出消费级硬件。
Friend 面临的是另一种压力。2026 年的报道称,该公司在审查是否符合欧盟《通用数据保护条例》期间暂停了欧洲销售。
这一事件表明,环境式采集可能限制地域扩张。围绕持续聆听构建的产品,不能将隐私审查视为上线前的最后一项任务。
更大的不确定性在于需求。积极的演示表明,设备可以制造引人入胜的瞬间,但并不能证明在新鲜感消退后,用户仍会继续佩戴它。
留存率比社交关注更能说明问题。如果数月后,设备所有者仍让它保持充电、联网和可见,这个品类就找到了有意义的使用行为。
如果初步尝试后使用率下降,再好的语音也无法拯救这种形态。问题将出在设备与日常生活之间的关系上。
Google 新闻读者接下来应关注什么
三个信号将显示 Friend 是预告了一种可行的界面,还是暴露了 AI 硬件的另一条死路。
第一个信号是 Friend 实际的语音推出情况。公司需要明确可用性、支持的设备、输出控制方式,以及语音是否通过现有云系统运行。
独立评测应测试打断、嘈杂房间、多位说话者和私密设置等场景,还应考察用户能以多快的速度让挂坠静音。
稳定一致的表现将强化对对话式可穿戴设备的看好。有限的演示或不稳定的行为则会表明,发布公告跑在了产品前面。
第二个信号是 OpenAI 的硬件发布。报道称这是一款便携式家用设备,但 OpenAI 尚未确认其最终形态、传感器或发布时间表。
最重要的细节将关乎控制,而非外观。买家需要知道设备何时聆听、摄像头如何工作、哪些处理在本地完成,以及哪些数据会成为持久记忆。
OpenAI 还必须说明如何从错误中恢复。一款围绕语音设计的设备,需要提供切实可行的方法来查看、纠正和删除被误解的信息。
具备实体隐私控制的清晰架构将强化无屏论点。含糊的保证则会重演 Friend 已经暴露出的信任问题。
第三个信号是持续的用户行为。出货总量可以反映兴趣,但活跃使用才能揭示产品是否在用户日常生活中赢得一席之地。
有用的指标包括每周佩戴时长、数月后的留存率、静音频率,以及由用户主动发起的互动占比。公司未必会公布所有这些数据。
评测者仍可以观察底层行为。设备所有者会把它带进工作场所和社交场合,还是因为他人反对而把它留在家中?
这一信号很重要,因为无屏 AI 是一种社会技术。它的成功不仅取决于购买设备的人,也取决于佩戴者身边那些没有购买设备的人。
Meta 的 Ray-Ban 眼镜提供了一个有启发性的对照。它将 AI 置于一个熟悉的物件中,而这个物件本身已具备眼镜、音频设备和相机的价值。
Friend 要求用户接受一个几乎完全以人工陪伴为目的的新物件。传闻中的 OpenAI 家用设备同样需要证明,除了接入一个应用之外,它还有存在的理由。
开发者应密切关注渠道选择。最强大的产品不会将语音视为每种互动的答案。
一个上下文系统应当识别何时说话、何时发送私密文本,以及何时保持沉默。这个决策层的重要性可能超过合成语音本身。
企业买家应在生产力之前考虑治理问题。工作场所中的环境式采集可能包含客户详情、法律讨论、人事信息和机密战略。
能够自动总结会议的设备必须区分经授权的采集与偶然听到的内容,还需要制定符合组织政策的留存规则。
知识工作者应根据回忆质量和用户控制权来评判这些产品。捕捉更多音频,并不会自动带来更好的记忆或更好的决策。
为AI 知识库设计的工具提供了一个有用标准。人们需要可搜索的来源、可追溯的上下文,以及对哪些内容会成为自身记录一部分的控制权。
Friend 的会说话挂坠为无屏未来赋予了一个可辨识的声音,也让这个品类尚未解决的交换条件更难被忽视。
下一波 Google 新闻将聚焦于设计、声音和发布日期。决定性的问题却更安静:在人们看完演示后,是否会足够信任环境式 AI,让它继续留在身边?
观察用户在挂坠听错一场私密谈话,或在错误时刻开口时会怎么做。如果他们纠正它并继续佩戴,无屏陪伴设备就有一条前进道路。如果他们将其静音、摘下,或回到手机,OpenAI 继承的将是一个警告,而非路线图。


