AI vs MD:ChatGPT在提供高质量、富有同理心的医疗建议方面胜过医生AI vs MD: ChatGPT Outperforms Physicians in Providing High-Quality, Empathetic Healthcare Advice

环球医讯 / AI与医疗健康来源:scitechdaily.com美国 - 英语2026-08-26 17:29:14 - 阅读时长7分钟 - 3086字
一项发表在《美国医学会内科杂志》上的新研究比较了医生和ChatGPT对真实健康问题的书面回答,结果显示,由持证医疗专业人员组成的评审小组在79%的情况下更偏好ChatGPT的回答,并认为其质量更高、更富有同理心。研究团队从Reddit的AskDocs子版块随机抽取了195个医患问答,由ChatGPT生成回答,并与医生的原始回答进行盲评。ChatGPT的回答在质量上被评为“好”或“非常好”的比例是医生的3.6倍,在同理心上被评为“富有同理心”或“非常富有同理心”的比例是医生的9.8倍。虽然AI不会取代医生,但研究认为,医生与ChatGPT等人工智能工具协作,有望改善医疗护理、减轻医生负担,并推动医疗领域的变革。
AI医疗建议同理心医生患者护理医疗质量医生职业倦怠健康问题人工智能助手医疗系统
AI vs MD:ChatGPT在提供高质量、富有同理心的医疗建议方面胜过医生

《美国医学会内科杂志》的一项研究暗示,像ChatGPT这样的人工智能助手可以显著改善医疗保健。该研究利用真实世界的健康问题,发现医疗专业人员79%的情况下更偏好AI的回答而非医生的回答,认为其质量更高、更富有同理心。虽然AI不能取代医生,但将其整合到医疗系统中可以改善患者护理,可能减少医生职业倦怠,并提升整体医疗服务质量。

虽然AI不会取代你的医生,但《美国医学会内科杂志》的一篇新论文表明,医生与ChatGPT等技术协作可能会彻底改变医学。

关于人工智能助手(如ChatGPT)的进步如何应用于医学,一直存在广泛的猜测。

今天(2023年4月28日)发表在《美国医学会内科杂志》上的一项新研究,由加州大学圣地亚哥分校高通研究所的John W. Ayers博士领导,初步揭示了人工智能助手在医学中可能扮演的角色。该研究比较了医生和ChatGPT对真实健康问题的书面回答。由持证医疗专业人员组成的评审小组在79%的情况下更偏好ChatGPT的回答,并认为ChatGPT的回答质量更高、更富有同理心。

“人工智能改善医疗保健的机会是巨大的,”Ayers说,他也是加州大学圣地亚哥分校医学院传染病与全球公共卫生部门创新副主任。“AI辅助医疗是医学的未来。”

ChatGPT准备好用于医疗保健了吗?

在这项新研究中,研究团队试图回答一个问题:ChatGPT能否准确回答患者向医生提出的问题?如果可以,AI模型可以整合到医疗系统中,以改善医生对患者问题的回答,并缓解医生日益增加的负担。

“ChatGPT可能能够通过医疗执照考试,”研究合著者Davey Smith博士说,他是医生兼科学家、加州大学圣地亚哥分校Altman临床与转化研究所联合主任及加州大学圣地亚哥分校医学院教授,“但准确且富有同理心地直接回答患者问题是另一回事。”

“COVID-19大流行加速了虚拟医疗的采用,”研究合著者Eric Leas博士补充道,他是高通研究所附属机构及加州大学圣地亚哥分校Herbert Wertheim公共卫生与人类长寿科学学院助理教授。“虽然这让患者更容易获得护理,但医生被大量寻求医疗建议的电子患者信息所淹没,这导致了创纪录的医生职业倦怠水平。”

设计一项研究,在医疗环境中测试ChatGPT

为了获得大量且多样化的医疗问题和医生回答样本,且不包含可识别的个人信息,研究团队转向了社交媒体——数百万患者公开发布医疗问题并得到医生回答的Reddit AskDocs子版块。

r/AskDocs是一个拥有约45.2万名成员的子版块,他们发布医疗问题,并由经过验证的医疗专业人员提交回答。虽然任何人都可以回答问题,但版主会验证医疗专业人员的资质,并且回答会显示回答者的资质级别。结果产生了一个庞大且多样化的患者医疗问题集以及持证医疗专业人员的回答。

虽然有些人可能会质疑社交媒体上的问答交流是否是一个公平的测试,但团队成员指出,这些交流反映了他们的临床经验。

研究团队从AskDocs中随机抽取了195个经过验证的医生回答的问答。团队将原始问题提供给ChatGPT,并要求其撰写回答。由三名持证医疗专业人员组成的评审小组评估了每个问题及相应的回答,且不知道回答来自医生还是ChatGPT。他们根据信息质量和同理心进行比较,并指出他们更偏好哪一个。

医疗专业评估人员小组在79%的情况下更偏好ChatGPT的回答而非医生的回答。

“ChatGPT的回答提供了细致入微且准确的信息,通常比医生的回答更全面地覆盖了患者问题的多个方面,”Jessica Kelley说,她是圣地亚哥公司Human Longevity的执业护士,也是研究合著者。

此外,ChatGPT的回答在质量上显著高于医生的回答:ChatGPT的回答被评为“好”或“非常好”的比例是医生的3.6倍(医生22.1% vs ChatGPT 78.5%)。回答也更具同理心:ChatGPT的回答被评为“富有同理心”或“非常富有同理心”的比例是医生的9.8倍(医生4.6% vs ChatGPT 45.1%)。

“我从未想过我会这么说,”加州大学圣地亚哥分校医学院副教授、研究合著者Aaron Goodman博士补充道,“但ChatGPT是我想要给我的收件箱开的一剂处方。这个工具将改变我支持患者的方式。”

利用AI助手处理患者信息

“虽然我们的研究将ChatGPT与医生对立起来,但最终的解决方案不是完全抛弃你的医生,”布林莫尔学院计算机科学助理教授、研究合著者Adam Poliak博士说。“相反,医生利用ChatGPT才是实现更好、更富有同理心的护理的答案。”

“我们的研究是最早展示AI助手如何可能解决现实世界医疗保健交付问题的研究之一,”加州大学圣地亚哥健康中心首席医疗官兼首席数字官Christopher Longhurst博士说。“这些结果表明,像ChatGPT这样的工具可以高效地起草高质量、个性化的医疗建议,供临床医生审查,我们正在加州大学圣地亚哥健康中心开始这一过程。”

医生兼生物信息学家、加州大学圣地亚哥分校Altman临床与转化研究所联合主任、加州大学圣地亚哥医学院教授、研究合著者Mike Hogarth博士补充道:“将AI助手整合到医疗信息中,必须在随机对照试验的背景下进行,以评估AI助手的使用对医生和患者结果的影响。”

除了改善工作流程,对AI助手信息的投资还可能影响患者健康和医生表现。

约翰霍普金斯大学John C Malone计算机科学副教授、研究合著者Mark Dredze博士指出:“我们可以利用这些技术来培训医生进行以患者为中心的沟通,消除少数群体在通过信息寻求医疗时所遭受的健康差异,建立新的医疗安全系统,并通过提供更高质量、更高效的护理来协助医生。”

参考文献:“Comparing Physician and Artificial Intelligence Chatbot Responses to Patient Questions Posted to a Public Social Media Forum”,作者:John W. Ayers, PhD, MA; Adam Poliak, PhD; Mark Dredze, PhD; Eric C. Leas, PhD, MPH; Zechariah Zhu, BS; Jessica B. Kelley, MSN; Dennis J. Faix, MD; Aaron M. Goodman, MD; Christopher A. Longhurst, MD, MS; Michael Hogarth, MD; Davey M. Smith, MD, MAS,2023年4月28日,《美国医学会内科杂志》。DOI: 10.1001/jamainternmed.2023.1838

除了Ayers、Poliak、Dredze、Leas、Kelley、Goodman、Longhurst、Hogarth和Smith之外,《美国医学会内科杂志》论文“Comparing Physician and Artificial Intelligence Chatbot Responses to Patient Questions Posted to a Public Social Media Forum”的作者还包括加州大学圣地亚哥分校的Zechariah Zhu和海军健康研究中心的Dennis J. Faix博士。

【全文结束】