top of page

OpenAI 在 ChatGPT 中推出 Health,但信任才是最难整合的部分

OpenAI 于 7 月 23 日面向美国成年人推出了 ChatGPT 中的 Health,将此前的小范围测试扩展为更广泛的消费级产品。首批上线覆盖网页版和 iOS 版的已登录用户,可连接医疗记录和 Apple Health 数据。矛盾随之而来:更好的健康回答需要更多个人背景信息,但这些背景恰恰包含个人最敏感的部分信息。

OpenAI 表示,每周有超过 3 亿人向 ChatGPT 提出与健康相关的问题。他们用它解读化验结果、准备就诊、理解医学术语,并建立更健康的生活习惯。如今,ChatGPT 中的 Health 让这些对话更贴近其背后的医疗记录、用药情况、活动数据和个人病史。

此次发布也改变了竞争格局。Anthropic 已为部分 Claude 订阅用户提供健康数据连接,而 Google 正在让 Gemini 与健康及可穿戴设备数据建立更紧密的联系。OpenAI 并非独自开创消费级健康助手这一品类。它押注于 ChatGPT 的规模和既有对话习惯,希望使其成为理解个人健康信息的主要界面。

这一定位伴随着非同寻常的责任。错误的餐厅推荐最多带来不便;错误解读用药史、症状或化验趋势,则可能影响人们何时就医。OpenAI 承认 ChatGPT 可能出错,并表示该产品旨在支持而非取代合格的医疗专业人员。

OpenAI Health 将个人数据带入日常 ChatGPT 对话

重要的变化不只是新增一个 Health 标签页。OpenAI 正在让已连接的健康背景信息伴随用户进入日常对话。

用户可以连接 Apple Health、美国医院系统支持的医疗记录、One Medical 和 Function Health。之后,ChatGPT 可在回答问题时参考相关信息,但须遵循用户选择的权限设置。

公司在其 Health 发布公告中列举了几种实际用途。ChatGPT 可以将新的化验结果与过往检查进行比较,概括某次就诊以来的变化,或将睡眠和活动模式与日常习惯联系起来。它还可以帮助准备就医问题,或将临床术语转化为更通俗的英语。

该功能正向所有 Free、Go、Plus 和 Pro 套餐中年满 18 岁的用户推出,可通过 ChatGPT 网页界面和 iOS 应用使用。OpenAI 表示,Health 尚未在 Codex 中提供。

此次上线扩展了 2026 年早些时候推出的专属健康体验。那个独立空间要求用户先进入 ChatGPT 的特定区域,才能获得基于已连接健康信息的回答。OpenAI 发现,这一边界并不符合人们自然使用产品的方式。

据该公司称,早期参与者中超过 70% 的健康相关对话发生在专属 Health 体验之外。计划膳食的人可能需要助手记住食物过敏情况;规划家庭活动的另一位用户,可能希望它考虑近期受伤的影响。

OpenAI 因此决定:在用户授权的情况下,让健康背景信息可用于所有 ChatGPT 对话。Health 区域仍是连接账户、查看同步记录、了解近期趋势及回顾健康对话的控制中心。

默认情况下,ChatGPT 会在回答中使用已连接的医疗记录或 Apple Health 信息前询问用户。用户可以一次性批准访问,也可以允许持续访问。他们还可以在消息中添加“@Health”,明确要求系统考虑已连接的信息。

这种架构让 Health 更实用,但也让产品边界变得不那么显眼。专属标签页会提醒用户,他们已进入一个敏感环境;而出现在日常饮食、旅行或运动聊天中的背景信息,则可能显得不那么明确。

这一转变解释了核心矛盾。OpenAI 发现,用户最看重的是健康背景信息能在相关问题出现的任何场景下发挥作用。然而,这种便利也要求用户确信,健康信息不会意外出现,或流向无关的操作。

公司列举了针对这一问题的保障措施。例如,如果 ChatGPT 根据 Apple Health 数据制定训练计划,它不应通过另一项已连接服务随意披露这些信息。OpenAI 表示,涉及敏感信息的外部操作会接受额外检查,并可能需要确认。

因此,ChatGPT 中的 Health 与其说像医疗记录查看器,不如说更像一层基于权限的背景信息层。它试图将分散的记录转化为可用于对话的知识。只有系统能选取正确背景、准确解读信息,并尊重预期边界时,这才有价值。

OpenAI 为何想掌握健康背景信息层

OpenAI 竞争的目标,是成为患者与碎片化健康信息之间的界面,而不只是另一个提供医疗答案的来源。

健康信息很少集中在一个地方。化验结果可能存放在某个医院门户中,影像记录在另一个系统里,用药清单则分散在多家医疗服务提供方之间。睡眠和运动数据也可能仍留在可穿戴设备应用中。家族病史往往只存在于个人记忆里。

这种碎片化会带来持续负担。患者在就诊前需要收集文件,反复讲述同一段病史,并在有限时间内理解专业术语。当记录无法在不同系统之间顺畅传递时,临床医生也可能无法获得完整视图。

对话式助手提供了不同的界面。用户无需分别浏览每个来源,只需询问最近一次检查后发生了哪些变化。助手可以概括相关记录,解释陌生术语,并建议下次就诊时可以提出的问题。

OpenAI 的早期用户案例正聚焦于这一问题。一位技术项目经理描述了如何将重叠的诊断、影像结果和手术记录整理成更清晰的时间线。随后,该用户为与物理治疗师或教练的交流创建了摘要。

这一体验说明了产品吸引力,但并不能证明其医疗可靠性。摘要可以让记录更易使用,也可能删去限定条件,或突出无关细节。质量取决于源数据、模型的解读,以及用户核实结果的能力。

已连接的背景信息提高了助手的价值,因为它减少了重复操作。用户无需为每个问题重复上传同一份化验报告。模型可以将新的担忧与用药情况、近期就诊、活动水平或已说明的目标联系起来。

这与 AI knowledge base 背后的更广泛逻辑相似:当系统能检索相关的个人背景信息,而不是仅依赖通用提示时,回答会更有用。然而,与普通工作文档相比,健康数据对准确性和隐私的要求要严格得多。

此次发布也为 OpenAI 提供了更强的理由,让用户持续回到产品中。健康问题很少是孤立事件。一项化验结果会引出就诊准备、后续问题、生活方式调整和日后的比较。持续存在的背景信息可以将这些时刻转化为与 ChatGPT 的长期关系。

这种持续使用会给竞争对手带来压力。Anthropic 于 2026 年早些时候为美国订阅用户推出了 Claude 健康连接功能。其 医疗健康产品可以连接医疗记录和健康数据、总结病史,并帮助用户准备问题。

Google 则从另一个方向切入这一机会。它已掌控 Android、可穿戴设备集成、Fitbit 服务、搜索行为以及广泛的健康研究业务。其 Personal Health LLM 研究旨在通过适应健康场景的模型,帮助人们理解健康信息。

每家公司都有不同的起点优势。ChatGPT 拥有消费者覆盖规模和既有的对话使用习惯。Claude 强调安全定位和医疗工具。Google 则掌握围绕移动设备、搜索和可穿戴设备的大型数据入口。

因此,竞争并不局限于哪个模型最擅长回答医疗问题,而在于哪家公司能够组织个人健康背景信息、赢得同意,并在临床就诊之间持续保持实用性。胜出的界面可能影响人们如何准备问题,以及如何理解日常健康变化。

OpenAI 的每周受众数据表明了它为何此时推进这一产品。数亿人已在没有连接医疗记录的情况下向 ChatGPT 询问健康问题。将这种行为正式产品化,能让 OpenAI 加入控制机制、专门评估和结构化数据连接。

但这也增加了公司的风险敞口。一旦 ChatGPT 使用的是用户真实的病史,用户自然会期待得到的不只是通用聊天机器人的免责声明。即便 OpenAI 谨慎避免将其称为诊断或治疗,产品仍会让人感觉更接近个性化指导。

医生测试提升了模型,但并未解决根本问题

OpenAI 已加强健康评估,但基准测试无法复现诊室外每一个复杂混乱的决策。

该公司表示,它与全球数百名医生合作,设计贴近真实情境的案例和详细评分标准。这些评估考察准确性、安全性、沟通质量、完整性、背景意识,以及是否适当建议寻求专业医疗服务。

OpenAI 报告称,所有 GPT-5.6 模型在 HealthBench Professional 上的表现都优于对应的 GPT-5.5 模型。该基准使用基于真实临床医生任务的高难度对话。多名医生负责撰写并裁定用于评估每项回答的标准。

相关的 HealthBench 研究包含 5,000 段多轮对话和 48,562 项评分标准,涵盖紧急情况、临床数据转换和全球健康等主题。其形式比标准的多项选择医学考试更贴近真实场景。

OpenAI 表示,GPT-5.5 Instant 在多项对消费者使用至关重要的行为上有所改善,包括识别何时适合寻求紧急医疗服务、询问缺失背景信息、解释不确定性,以及让复杂信息更易理解。免费用户可使用该模型。

付费用户可使用 GPT-5.6 Sol,OpenAI 将其描述为最擅长处理健康问题的模型。公司称,它在需要综合多项细节进行推理并谨慎沟通的任务中表现更佳,例如比较化验趋势,或审视医生讨论的不同治疗方案中的各项因素。

这些说法需要谨慎看待。OpenAI 开发或参与开发了用于支持这些说法的基准测试。由医生撰写的评分标准提升了评估质量,但并不构成对患者结果的完全独立证据。

基准测试衡量的是受控条件下针对选定案例的回答。真实记录可能包含重复内容、相互矛盾的条目、过期的用药清单、不完整的家族病史和编码错误。用户也可能含糊地描述症状,或遗漏他们未意识到与问题相关的细节。

OpenAI 明确警告,已连接的信息可能不完整或已过时。某种药物可能在人们停用后仍列在记录中。用户必须更正过时的细节,并将重要信息与原始来源进行比对。

可穿戴设备数据又增加了一层不确定性。Apple Health 可以汇集来自众多健身、睡眠和营养应用的信息。然而,ChatGPT 可获取的指标因应用而异,专有评分也未必能够转移。

模型可能基于错误输入进行正确推理,却仍得出不安全的结论。它也可能给出颇具说服力的解释,掩盖其中的不确定性。对话的流畅性让这类失误更难被察觉,因为回答听起来可能连贯且贴合用户需求。

该产品最安全的使用场景是解读和准备工作。翻译就诊记录、整理时间线或生成就诊提问,都能帮助用户更积极地参与医疗过程。即便如此,用户在将摘要分享给临床医生前,仍应核实其中细节。

当人们将助手视为诊断、治疗调整或紧急决策的权威时,风险更高的使用方式便出现了。OpenAI 表示,ChatGPT 不能替代专业判断。然而,当用户感到焦虑、困惑,或无法及时获得医疗服务时,产品设计的重要性不亚于免责声明。

该公司决定让健康背景信息贯穿 ChatGPT,也相应提高了这种设计责任。专门的医疗界面可以持续显示警告,并提供更有限的选项。普通对话则可能显得随意,即使回答使用了敏感记录也是如此。

医生测试强化了该系统的基础。但这并不能取代独立评估、事件报告,以及关于人们如何据此采取行动的证据。下一阶段的证明标准必须超越回答是否满足书面评分标准。

隐私控制面临更广泛的信任问题

OpenAI 增加了有意义的控制措施,但最棘手的问题是,用户是否理解医疗数据离开医疗服务提供者后会发生什么。

OpenAI 表示,已连接的医疗记录、Apple Health 信息以及使用这些数据的对话,不会被用于训练其基础模型。该公司还表示,不会使用这些信息进行广告定向投放。

健康隐私声明是对通用 OpenAI 隐私政策的补充。这一区分至关重要,因为用户需要了解适用于健康记录、已连接应用、对话历史和生成记忆的明确规则。

OpenAI 表示,所有 ChatGPT 对话在静态存储和传输过程中均会加密。已连接的健康信息还会获得额外的加密保护。该公司还开展红队演练,重点测试涉及已连接数据的攻击和意外泄露。

用户可随时断开健康账户连接。OpenAI 表示,来自该来源的同步数据将在 30 天内从其系统中删除。不过,已纳入对话历史的信息会一直保留,直到用户删除这些对话。

这种区别很容易被忽视。断开医院门户的连接,并不会自动抹除所有引用其记录的讨论。当用户希望移除健康背景信息时,必须同时管理已连接账户和对话历史。

记忆功能构成另一条边界。OpenAI 表示,ChatGPT 可以从健康对话中创建记忆,但不会直接从已连接记录或 Apple Health 数据中创建。用户可以关闭记忆功能,或在不希望对话形成未来个性化内容时使用 Temporary Chat。

这一设计试图将源数据与由对话推导出的细节分开。实际使用中,用户可能难以区分两者。围绕已连接诊断结果的讨论,可能会形成被记住的偏好或事实,而无需直接复制原始记录。

法律环境进一步复杂化了人们的预期。许多美国人会将任何医疗信息都与《健康保险流通与责任法案》(Health Insurance Portability and Accountability Act,简称 HIPAA)联系起来。但这一假设往往过于宽泛。

美国卫生与公众服务部解释称,发送至消费者自行选择的第三方应用的数据,可能不再受 HIPAA 保护。其健康应用指南指出,医疗服务提供者通常不能仅因接收应用采用不同的隐私做法,就阻止由患者指示的数据传输。

这并不意味着消费者健康应用可以在没有规则约束的情况下运行。美国联邦贸易委员会对许多健康应用和已连接设备适用消费者保护法及其《健康数据泄露通知规则》。更新后的规则明确了传统 HIPAA 关系之外产品的泄露通知义务。

不过,法律覆盖并不能保证用户理解这条边界。记录可以通过获授权的连接,从受监管的医院门户转移到消费者 AI 服务中。相同的信息随后便处于不同的技术和法律关系之内。

问题不仅在于 OpenAI 今天是否承诺妥善处理数据。用户还必须信任账户安全、内部访问控制、删除系统、已连接合作伙伴、未来的政策变更,以及针对恶意提示的防御能力。这比单一的隐私开关涉及更广泛的信任范围。

健康数据带来的后果也不止是尴尬。记录可能揭示怀孕、残障、遗传风险、心理健康治疗、用药情况、物质使用或慢性疾病。未经授权的披露可能影响家庭关系、就业顾虑、保险担忧和人身安全。

OpenAI 关于不训练模型和不进行广告定向投放的承诺,回应了两项常见质疑。但这并未消除所有需要谨慎对待的理由。数据仍可能因账户遭入侵、软件漏洞、非预期的工具操作或未被正确理解的授权而暴露。

因此,用户应将权限视为一项主动决策,而非设置过程中的例行步骤。一次性批准访问权限可能适合解决一个具体问题。始终开启的访问权限更方便,但会使后续对话中的边界变得不那么清晰。

谨慎的用户可以在不连接任何内容的情况下开始使用。ChatGPT 仍可回答一般健康问题。如果确实需要个人背景信息,用户可以连接某个来源、查看导入的信息,并在提出聚焦问题前限制访问范围。

信任检验将取决于长期行为。清晰的设置和强有力的技术声明在发布时很重要。公开的事件处理方式、易于理解的删除机制和可预测的权限提示,将决定这些承诺能否经受日常使用的考验。

OpenAI Health 正进入一场三方平台竞争

竞争的关键在于,ChatGPT 能否在竞争对手将既有数据优势转化为更强产品之前,成为用户首选的健康交互界面。

Anthropic 是最直接的对比对象。Claude 在美国为消费者提供健康记录和健康数据连接。它可以总结病史、解释检测结果、识别规律,并协助准备就诊问题。

Anthropic 还为符合条件的组织部署提供符合 HIPAA 要求的产品。这一企业定位与消费者健康连接相互独立,但它为该公司进入医疗服务提供者、付款方和健康技术公司提供了路径。OpenAI 也采取类似的双重战略,既面向消费者提供 Health,也面向医疗机构推出相关产品。

两家公司共享一项核心承诺:用户应能够理解零散的健康数据,而无需手动将每条记录复制到提示词中。双方也都表示,已连接的健康信息不会用于模型训练。

它们的差异将体现在权限设置、模型行为、集成覆盖范围和用户信任上。健康助手的实用性取决于它能够访问哪些记录;其安全性则取决于它如何应对模糊症状、相互矛盾的记录,以及超出预期角色范围的请求。

Google 带来了更广泛的平台挑战。其消费者健康布局涵盖 Android、Fitbit、可穿戴设备数据、搜索和 Gemini。Google Research 也正在开发用于可穿戴传感器数据的模型,包括能够解读不同设备和活动模式的系统。

Google 可以在用户提出问题之前就触达他们。手表或健身追踪器会持续收集信息,从而支持摘要和提醒。ChatGPT 拥有庞大的对话用户群,但其大量传感器背景信息依赖外部连接。

即使 Apple 未提供同类通用聊天机器人体验,它仍然至关重要。Apple Health 是手表、健身应用和其他服务数据的核心交换平台。任何通过 Apple Health 连接的助手,都依赖于 Apple 和各个应用愿意提供哪些数据。

这形成了分层竞争格局。OpenAI 和 Anthropic 围绕对话信任展开竞争。Google 通过一体化设备与数据平台竞争。Apple 则掌控着 iPhone 用户的重要权限与数据聚合层。

医院和电子健康记录供应商同样保有影响力。消费者助手需要可靠地访问结构化医疗信息。覆盖缺口、身份验证摩擦和记录不一致,都可能限制即使是优秀模型的价值。

市场不会由单一基准分数决定。连接成功率、记录完整性、权限清晰度和升级处理行为,将塑造日常采用情况。严重错误发生的频率同样如此。

OpenAI 拥有一项重大优势:人们已经在使用 ChatGPT 询问健康问题。该公司无需创造这一行为,只需将信息不足的非正式对话转化为一个拥有更好信息和更强控制措施的产品。

这一优势也提高了预期。OpenAI 的规模意味着,罕见失误也可能影响许多人。当数亿用户每周询问健康问题时,极低的错误率也可能带来重大后果。

竞争对手可以通过强调狭窄工作流或更强边界来攻击这一弱点。一个仅为就诊准备而设计的产品或许灵活性较低,但用户预期会更明确。与医疗服务提供者连接的工具则可以加入通用消费者聊天机器人所缺乏的临床监督。

OpenAI 选择了广度。健康背景信息可以出现在膳食规划、运动讨论、旅行准备或关于日常作息的普通问题中。这让产品更有用,但也扩大了需要谨慎选择背景信息的情境数量。

最终胜出的方式未必是集成数量最多的助手。它可能是最能清晰呈现不确定性、并始终引导用户寻求专业医疗服务的那一个。健康界面需要赢得信心,但不能鼓励依赖。

三个信号将显示 ChatGPT 中的健康功能是否有效

此次发布只有在采用率、安全证据和权限控制同步改善时才能成功。任何一项指标都无法替代其他两项。

第一个信号是已连接数据的采用率。OpenAI 已披露一般健康问题的规模,但尚未公布医疗记录或 Apple Health 连接的公开采用率。该数字将显示,用户是否愿意将个人数据交给 ChatGPT,而不仅仅提出泛泛的问题。

仅有连接数量还不够。OpenAI 应区分一次性授权某个来源的用户,与持续保持连接的用户。重复使用将表明,摘要、趋势分析和就诊准备能够提供持久价值。

第二个信号是独立的安全性证据。OpenAI 由医生开发的基准测试提供了有用的技术衡量指标。研究人员现在需要测试该产品如何处理过期的用药清单、相互矛盾的记录、缺失的症状,以及涉及真实用户的紧急情况。

外部评估还应审视性能不均衡的问题。医疗记录会因医疗系统、语言背景、保险安排和临床状况而异。一个在干净的英文记录上表现良好的系统,可能难以应对零散或不完整的病史。

已报告的事件将与平均分数同样重要。当 ChatGPT 未能建议寻求紧急医疗服务、误读检查结果,或给出错误摘要时,读者应关注 OpenAI 如何回应。透明的纠正措施会增强该公司的说服力;反复出现且不透明的失败则会削弱它。

第三个信号是权限行为。OpenAI 表示,访问请求默认会显示,用户也可以切换为持续授权。该公司应证明,人们理解这些选择,并且能够可靠地移除已连接的信息。

关注 Health 界面、记忆设置和外部操作确认方式的变化。更细粒度的控制将表明 OpenAI 正在了解用户在哪些方面需要更强的边界。更少的可见提示或许能提升便利性,但也可能让人更容易忘记自己已给予同意。

监管行动也属于这一信号的一部分。FTC 已明确,许多健康应用面临数据泄露通知义务。任何针对生成式 AI 健康产品的新指引,都将影响删除、披露和事件报告方面的预期。

竞争对手的回应将提供另一项有价值的比较。Anthropic 可以扩展 Claude 的集成功能,或强调安全控制措施。Google 可以将 Gemini 与更深入的可穿戴设备和移动端数据结合。它们的选择将揭示,市场究竟奖励覆盖广度、临床专注度,还是平台所有权。

对于用户而言,眼下的决定应保持聚焦。从一个具体目标开始,例如为就诊准备问题,或总结多份实验室报告中的变化。在依赖输出之前,先检查已连接的记录。

保留原始文件。修正过期的用药信息和缺失的病史。对于任何重要解读,都应与合格的临床医生核实,尤其是在问题涉及治疗、紧急医疗服务或重大医疗决策时。

ChatGPT 中的 Health 代表着消费级 AI 的一次真实变化。它将个人记录置于数百万用户已在咨询的对话式界面之中。该产品可以减少信息摩擦,但也会将敏感背景信息集中在一个仍可能出错的系统内。

未来几个月将表明,OpenAI 能否将有用的演示转化为可靠的使用习惯。关注已连接记录的采用情况、独立安全结果,以及权限控制的演变。然后提出一个务实的问题:这名助手是否帮助你与临床医生沟通,还是在不知不觉中鼓励你取代这种关系?

 
 

免费开始

一款本地优先的AI助手,具备个人知识管理功能

为了获得更好的人工智能体验,

remio 目前仅支持Windows 10+ (x64)M-Chip Mac

在你的大脑里添加一个搜索栏

Ask remio

记住一切

​无需整理

bottom of page