OpenAI 将 ChatGPT 集成到患者医疗记录和医疗保健系统中

OpenAI 正在 ChatGPT 中部署一项健康功能用户现在可以选择将 Apple 健康数据和医疗记录连接到聊天机器人。年满 18 周岁且已登录的用户现在即可在网页和 iOS 设备上使用该功能,免费版、Go 版、Plus 版和 Pro 版用户均可使用。
用户可将 Apple Health 与美国医院系统、One Medical 或 Function Health 中的记录(在支持的情况下)关联起来。同步完成后, ChatGPT可以将药物信息、化验结果、近期就诊记录、睡眠数据和活动日志导入任何对话中。 在应用程序中,而不是将该内容限制在单独的部分中。
📊 从专属健康模式到综合体验的演变
OpenAI 曾对这一想法进行过早期版本的研究,测试组规模较小,要求用户打开一个专门的健康区域,以获得基于他们自身数据的反馈。
该公司发现,该群体中超过 70% 的健康相关对话发生在完全不同的地方,例如在制定膳食计划或询问无关症状的过程中,而不是在为此目的而专门建造的空间内。
这些数据促成了这次重新设计。与其强迫用户进入特定模式才能获得上下文相关的答案, ChatGPT 现在可以在任何对话中利用关联的健康信息前提是用户已授予权限。
计划外出就餐的人可能会收到一份根据其记录的饮食限制而推荐的餐厅建议。询问周末计划的人可能会收到一份根据其同步记录中记录的近期伤病情况而调整的活动建议。
侧边栏中的“健康”选项卡仍然存在,但其功能已转变为管理中心: 连接账户、查看同步数据和趋势、浏览建议提示以及返回过去的健康相关聊天记录。
💬 健康功能早期测试者报告
OpenAI 公布了其早期访问小组的许多报告,这些细节值得与该公司自己将该工具定位为辅助工具而非诊断工具的说法进行权衡。
布莱克,一名技术项目经理, 说:
“最有用的部分是将零散的病史整理成我能理解和解释的内容。我有很多相互交织的问题,ChatGPT 帮助我将这些零散的信息串联起来,形成清晰的时间线,用通俗易懂的语言解释医学术语,并生成我可以与理疗师或教练分享的摘要。”
关于从零散记录到可用模式的转变,布莱克补充道:
“我不再只是看到零散的诊断结果、影像学检查结果和手术记录,而是能够理解其中的整体模式。这使信息更易于利用,也让我能够更好地用语言向医护人员和培训师表达自己的诉求。”
雷维蒂,一位投资组合经理研究指出,纵向分析是区别于标准搜索或一次性就医的关键所在:
“我想要的是推断出那些并不明显的模式,并建立起我自己想不到的联系。ChatGPT 可以访问我现有的实验室数据,因为我已经把所有数据都连接起来了,而且它还能进行长期分析——这是它最大的优势。它就像一个研究分析师。这让我能够更加积极主动地管理自己的健康,更好地掌控自己的健康之旅。”
⚠️ 通过人工智能界面进行临床发现
然而,并非每个账户都一帆风顺,考虑到通过聊天机器人界面公开临床数据所涉及的风险,其中一个账户值得特别注意。 香农,一名护士她描述了通过该工具在自己的病历中发现意外条目的情况。
“使用 Health 功能实际上印证了我一直以来的一个想法:人工智能最大的优势之一并非取代医疗专业人员,而是帮助患者更好地理解和管理自己的健康信息。通过 Health 功能发现一条意料之外的病历记录,让我更加深刻地体会到这一点。这并非人工智能造成的问题,而是它帮助我发现了一些问题,现在我可以就此与我的医疗服务提供者进行适当的后续沟通。”
这种区别在于,工具用于发现需要人工跟进的信息,而工具则直接做出临床判断。这是 OpenAI 希望产品在使用规模扩大时能够保持的底线。
🔄 实际整合优势
其他测试人员不太关注临床上的细微差别,而更关注该功能旨在取代的手动数据处理的实际繁琐工作。 丹尼尔,一名顾问连接多个数据源后发现,组合视图比单独的聊天会话更有用。
“它对于协调实验室工作并将其转化为我能理解的语言非常有用。将 Apple Health 和 MyChart 连接起来,使我获得的洞察能够更贴近我生活中正在发生的事情,而不仅仅局限于聊天互动。”
凯瑟琳,一位小企业主 一位因工作压力而失去了长达十年的健身习惯的人,描述了一个风险较低但仍然具体的用例,该模型会根据它可以直接看到的活动差距来调整建议。
“我会说,‘我今天需要一些运动来帮助我活动’,健康应用可以看到我过去七天没有锻炼,并建议我循序渐进地开始——比如散步或做一些拉伸运动。这帮助我把事情安排得更容易,并以合理的方式重新开始锻炼。”
卡尔顿,一名运营经理此前,用户不得不从 Apple Health 导出电子表格,并在每次聊天前手动上传,而新的集成旨在消除这种变通方法。
“在使用 Apple Health 之前,我需要从 Apple Health 导出大量的电子表格,然后再导入到 ChatGPT 中。现在,整个流程感觉流畅多了。能够在 Apple Health 中查看我多年的健身历程,让我能够以不同的视角——更宏观的眼光——看待问题。”
OpenAI 估计,每周与健康相关的 ChatGPT 查询量超过 3 亿人次。涵盖了从解读化验结果到就医准备等方方面面。如果这个数字准确,那么ChatGPT所达到的水平,是大多数数字健康平台需要数年时间和大量市场营销投入才能实现的。
该公司明确将 Health 定位为辅助工具而非诊断工具,并告知用户任何重要信息都应向其医疗保健提供者确认。
🧠 OpenAI 的 AI 模型性能声明和测试方法
OpenAI 将该功能的可行性部分归功于更新的模型: GPT-5.5 即时版免费用户也可使用, GPT-5.6 太阳仅限付费会员使用。
该公司表示,GPT-5.5 Instant 在识别何时可能需要紧急护理和解释不确定性方面取得了进步,并且在最严格的健康评估中,它的表现与当时 OpenAI 的前沿 Thinking 模型相当。 GPT-5.6 Sol 被誉为该公司迄今为止最强大的健康模型。专为对多个数据点(例如实验室随时间变化的趋势)进行推理而构建。
为了验证这些说法,OpenAI表示,他们与数百名医生合作,构建了健康场景和评分标准,对医生的回答进行评分:
- 准确性
- 安全
- 沟通
- 情境感知
- 完整性
- 适当升级至专业护理
该公司报告称,所有 GPT-5.6 模型在 HealthBench Professional(一款为此目的而构建的内部评估工具)上的表现均优于 GPT-5.5。
OpenAI公告中包含的一张图表显示 GPT-5.6 Sol 的得分高于 GPT-5.5 Instant 和 GPT-4o。 评估类别包括准确性、沟通、完整性和遵循指示,并以医生书面答复作为比较基准。
OpenAI 表示,医生在发布前对 Live Health 产品进行了专门测试,以评估其在现实世界中利用连接数据的性能和安全性,这比单纯的基准评分更进一步,尽管该公司尚未详细公布该测试的方法或结果。
🔒 健康数据处理和权限架构
关联的医疗记录和 Apple Health 数据,以及任何基于这些数据的对话,均不包含在基础模型训练和广告定向中据该公司称,无论用户的整体 ChatGPT 训练设置如何,不涉及健康数据的对话仍将遵循用户单独设置的任何训练偏好。
默认情况下,访问权限受到权限限制。ChatGPT 在使用连接的健康数据来个性化回复之前会征求用户意见,但用户可以切换到其他模式。 “始终允许” 并完全关闭提示。该设置位于 设置 > 插件 > 健康 并且可以随时撤销。断开数据源连接后,OpenAI 的系统会在 30 天内删除相关数据,但已出现在聊天记录中的内容会一直保留,直到用户手动删除这些对话。
记忆创建的范围也十分有限。记忆可以从健康对话中创建,但不能直接从原始连接记录或 Apple 健康数据本身创建。如果用户希望完全避免创建记忆,可以使用临时聊天功能或在设置中禁用记忆功能。
OpenAI 还特别指出了一种特殊情况: 可能通过其他连接的插件泄露健康数据的操作例如,将根据 Apple Health 指标生成的训练计划发送给跑步伙伴。该公司表示,在执行此类操作之前会进行额外的检查,对于敏感情况,ChatGPT 可能会要求明确确认。OpenAI 表示它运行 红队演练 针对这些场景进行的演练,虽然尚未公布任何测试结果或失败率。
⚙️边缘精度会发生什么变化
实际的痛点在于数据质量。即使患者早已停止服用某种药物,该药物仍可能长期保留在其同步记录中。OpenAI 正是利用这种情况来说明同步数据为何无法自动保持最新。它给用户的指导非常明确: 直接向 ChatGPT 发送标记更改,并对照原始来源检查任何重要信息。 而不是相信同步功能本身就能保持准确。
可穿戴设备和健身应用程序数据本身存在一些不足,因为数据的可用性取决于每个第三方应用程序选择通过 Apple Health 分享哪些数据,而且 OpenAI 指出,健身应用程序的一些专有评分可能根本无法传输。
相关问题不在于 ChatGPT 能否在演示中正确总结实验室结果,而在于当用户同步的记录已过时三个月时,其权限模型、数据删除时限和升级逻辑是否仍然有效。 该模型需要对相互矛盾的输入进行推理。
OpenAI 的医生测试解决了部分问题;但它并没有缩小受控评估与用户在四个不同应用程序的数据同步不完整的情况下管理多种慢性疾病之间的差距。
对于那些想要尝试该功能的人来说, 符合条件的美国用户现在可以通过侧边栏“健康”菜单使用该功能。。











