ChatGPT 接入病历与 Apple Health,健康评测五项指标反超医生
7 月 24 日,OpenAI 面向美国用户推出 ChatGPT Health 功能。经用户授权,ChatGPT 可连接 Apple Health 及部分医疗机构病历数据,在通用对话中调用个人健康信息回答问题。在 OpenAI 公布的健康评测中,GPT-5.6 Sol 在准确度、交流清晰度与健康决策帮助性三项指标上全面领先医生撰写的回答。
7 月 24 日,OpenAI 面向美国用户推出 ChatGPT Health 功能。经用户授权,ChatGPT 可连接 Apple Health 及部分医疗机构病历数据,在通用对话中调用个人健康信息回答问题。在 OpenAI 公布的健康评测中,GPT-5.6 Sol 在准确度、交流清晰度与健康决策帮助性三项指标上全面领先医生撰写的回答。
OpenAI 与全球数百名医生共同设计了接近真实诊疗场景的测试题与详细评分标准,评估准确性、安全性、沟通能力、上下文理解、完整性以及能否建议用户寻求专业帮助。以下是三项关键维度的高分评价比例对比:
注:上图展示「准确度」维度高分评价比例(满分 100),柱形自 40 分起缩放,非零起点;GPT-5.6 Sol 在该维度领先医生回答 25.7 个百分点。在「交流清晰度」「健康决策帮助性」维度,GPT-5.6 Sol 的高分率分别为 86.7% 和 83.0%,较医生回答分别高出 25.7 和 32.2 个百分点。
OpenAI 今年早些时候曾向一小部分用户开放独立的 ChatGPT Health 体验。测试发现了一个关键事实:用户的健康问题往往自然出现在其他对话中,而不是集中在专门的健康页面。
用户需进入专门的健康页面提问,与日常对话割裂,使用门槛高。
授权后可在任意对话中调用健康数据,也可用「@Health」主动唤起;左侧边栏管理数据源。
底层能力也在分化。面向免费用户的 GPT-5.5 Instant 在识别紧急就医需求、补充询问、解释复杂医学内容方面已有提升,达到评测时前沿 Thinking 模型水平;面向付费用户的 GPT-5.6 Sol 则是 OpenAI 目前健康能力最强的模型。
病历和健康指标高度敏感,Health 功能构建了多层隐私和安全保障:
无论用户是否允许对话训练模型,健康信息及相关对话不用于模型训练、不用于广告投放。
每次 ChatGPT 准备使用医疗记录或 Apple Health 数据时,都会先征求授权;可改为「仅本次」或「始终允许」。
用户可随时断开数据源,断开后该来源信息将在 30 天内从 OpenAI 系统删除。
若其他已连接插件需发送可能含健康信息的内容,系统会检查是否符合用户意图,执行前要求再次确认。
补充:Health 对话可为后续聊天生成记忆,但系统不会直接根据接入的医疗记录创建记忆;用户可使用临时聊天或在「设置—记忆」中关闭。OpenAI 同时提醒:ChatGPT 仍可能犯错,用户应核查重要信息,并与专业医务人员讨论医疗决定。
本篇核心评测数据(GPT-5.6 Sol 五项指标反超医生)均来自 OpenAI 单方披露,测试题与评分标准虽由 OpenAI 与数百名医生共同设计,但未见独立第三方复测。读者宜将其视为产品发布期的能力声明,而非临床级验证——模型在受控测试题上的表现,与真实诊疗场景下的稳定性之间仍有距离。
当 AI 从「回答健康问题」走向「调用个人健康数据辅助决策」,竞争壁垒正在从模型能力转向数据接入权与隐私工程——谁能拿到最敏感的数据、用最克制的方式处理它,谁就拿到了下一个入口。
Health 已向美国 18 岁及以上 ChatGPT 用户逐步开放,覆盖网页版与 iOS 版,Free / Go / Plus / Pro 订阅计划均可使用。
chatgpt.com → 对话中输入 @Health