由人工智能驱动的聊天机器人通常会带有免责声明,表示它们不能提供医疗建议或诊断病情,但它们仍然处理了数百万用户的查询,这些用户生病了,试图解读医疗记录或了解他们的治疗选择。
根据无党派健康政策和教育组织KFF(凯撒家庭基金会)最近的一项调查,近三分之一的美国人曾向聊天机器人寻求健康信息。
人工智能公司正争相满足这一需求,包括Anthropic的Claude for Healthcare和OpenAI的ChatGPT Health,它们宣传更强大的隐私保护功能和连接医疗记录的功能,同时警告其产品不能替代医生。
"它们可能听起来很有道理、非常自信,但同时又完全错误,"西奈山伊坎医学院医学教授、ChatGPT Health独立评估的合著者Girish Nadkarni说。
Nadkarni的研究发现,在超过一半的呼吸衰竭和严重糖尿病并发症病例中,聊天机器人未能告诉用户前往急诊室,而是建议他们待在家里并监测症状。这些发现与其他研究和评论相符,这些研究和评论对人工智能健康建议给出了不及格的成绩,或至少敦促谨慎使用。
OpenAI对该研究的方法论提出了质疑,并质疑它是否恰当地反映了人们实际使用其聊天机器人的方式。该公司的一位发言人表示,ChatGPT Health模型通过医生的反馈不断训练和更新。(《华盛顿邮报》与OpenAI和Perplexity有合作关系。)
"每天都有人带着健康问题来找ChatGPT,"OpenAI发言人Drew Pusateri说。"我们希望这些互动能让他们获得更多信息,并改善他们与医疗提供者的对话。但它并不是设计用来替代医疗专业人员的,永远不应该被用作护理的替代品。"
尽管越来越多的证据表明可能存在危害,但在一个成本高昂且获取医疗服务不一致的医疗保健系统中,即时、全面和个性化的答案对许多人来说太过诱人,难以抗拒。
《邮报》此前对聊天机器人在医疗用途中的表现进行了评分,并研究了已有研究的发现。以下是六位美国人转向聊天机器人寻求健康建议的故事,以及专家对他们情况的看法:
免费的替代选择
当20岁的伊利诺伊大学厄巴纳-香槟分校大三学生Genaro Diaz在2月初经历严重的胃痛并呕吐粘液时,他想去看医疗提供者。由于他的学生健康保险计划出现中断,这意味着他将面临150美元的账单,因此他转向了ChatGPT。聊天机器人建议他服用胃药比托贝尔摩(Pepto-Bismol)和口服补液盐(Pedialyte),并在症状三天后未改善时去看医生。Diaz从未弄清楚自己为什么生病,但他后来感觉好多了。
"作为一名大学生,我真的没有收入来源,我没有工作,"Diaz说。
在KFF的民意调查中,五分之一的用户表示难以负担医疗保健是他们转向人工智能寻求健康建议的主要原因。对于18至29岁且年收入低于40,000美元的人群,这一数字上升到约三分之一。
西奈山医学教授Ashwin Ramaswamy理解为什么许多患者对医疗账单感到担忧。但他质疑ChatGPT告诉Diaz等待去看医生的建议,因为即使他康复了,他描述的症状也很严重。
"我不能排除某些事情有危险,"Ramaswamy说,他是ChatGPT Health评估的合著者。"如果我接到那个电话,我不会知道,但我肯定会知道我想要尽快见到他。"
医生难找的情况
纽约57岁的Gayle Madeira表示,她寻找治疗长期新冠的医生的过程是一场磨难。该市311热线列出的一家医生办公室告诉她,该办公室没有获得资源来运作一个长期新冠诊所。
ChatGPT和其他人工智能平台填补了这一空白。她上传了详细的医疗历史和用药情况电子表格——当她经历脑雾和疲劳时,这很有帮助。与人工智能的交流帮助她排除了追求那些在长期新冠在线社区中广泛传播的治疗方法,因为这种疾病让医学专家感到困惑。她不会在没有医生监督的情况下服用药物。
"我希望医生掌控我的护理。我不想不得不使用人工智能,"曾从事华尔街工作的艺术家和舞者Madeira说。
一些人工智能专家警告说,即使公司宣传隐私保护,上传详细的医疗信息也可能破坏隐私。
"人工智能正在收集大量关于你的信息,这些信息可以创建和影响定向信息,"麻省理工学院媒体艺术与科学助理教授Pat Pataranutaporn说,他研究人们如何使用人工智能。"如果你不是在购买服务,那么你就是产品。"
塑造知情问题
70岁的Gary Cohen相信他从2020年诊断出多发性骨髓瘤以来,一直从加利福尼亚大学旧金山分校获得"惊人的护理"。他转向Claude来准备他的预约,例如要求用简单易懂的语言解释医生提出的二线治疗或测试结果的意义。
当他在患者门户网站上发现一个令人担忧的结果时,他将其上传到Claude,不确定医生是否会在周末回复他。Claude详细解释了该结果值得监测但不必担心。他的医生基本上也说了同样的话。
"你只是不觉得无助,"曾在奥巴马总统政府工作、帮助实施《平价医疗法案》的Cohen说。"你感觉自己参与了关于做决定的对话,而且有很多决定要做。"
研究人工智能的斯坦福大学医学院副教授Jonathan Chen表示,聊天机器人在预约前起草问题和总结医疗记录方面可以很有效。患者应该询问不同的观点,以及不同医疗选择的风险和益处。
但Chen说:"当风险很高时,你必须与真人再次确认。"
他还警告不要使用机器人分析原始医疗扫描图像,而不是摘要文件,因为这些工具尚未准备好进行"有意义的医学解释"。
不准确的信息
印第安纳州67岁的Randall Seefeldt在咨询了谷歌的Gemini后前往医院,当时他有慢性胃痛,Gemini建议他去急诊室进行CT扫描。扫描结果什么也没发现。Seefeldt并没有感到恼怒,而是感激这种安心感,因为他的父亲死于一种可能遗传的罕见癌症,症状相似。
"Gemini的结果给了我一个我感到舒适的前进路径,这减轻了我的压力,"为公共卫生机构工作的软件工程师Seefeldt说。
Pataranutaporn的研究表明,人们更信任聊天机器人提供的不准确信息,而不是人类医生提供的准确信息,这与已确立的研究相呼应,表明人们通常更信任技术而不是真人。自信但不准确的聊天机器人推理可能比准确的人类推理更具说服力。
研究人员指出,尽管人工智能对消费者健康的危险存在,但重要的是要承认在许多甚至大多数情况下,聊天机器人确实提供了合理的建议。
"它做了很多好事。它并没有完全失败,"Ramaswamy在谈到他对ChatGPT Health评估的工作时说。"你不能对大型语言模型做的唯一一件事是,你不能把它拉到外面问,'你在想什么?'"他指的是为这些人工智能工具提供动力的大型语言模型。
关怀的声音
当他的妻子因严重的肺栓塞住院两周时,John Hope发现Perplexity的同理心令人印象深刻。他使用这款人工智能"答案"引擎来翻译医生使用的术语,并为她返回宾夕法尼亚州伊丽莎白镇的退休社区做准备。他有可以依靠的关心他的朋友,但在忙碌的时候,能立即获得"真诚的同情"和关于该问医生什么的建议,这很好。
"有时与非人类进行如此有意义的对话感觉有点吓人,但也很令人安心,"85岁的Hope说,他为食品药品管理局相关问题的新闻通讯撰稿。"Perplexity尤其似乎能为我做到这一点:我理解你正在经历什么,如果你能告诉我医生说了什么,我就在这里帮助你。"
技术专家警告说,聊天机器人的善意是一种可能滑向危险谄媚的幻觉。ChatGPT Health的研究发现,当用户表示他们不太担心症状时,聊天机器人更可能给出错误的建议,这与其他研究相呼应。
"关怀是一项人类事业,"埃默里大学生物医学信息学和全球健康助理教授Azra Ismail说,她研究了聊天机器人在应对生殖和性健康方面的使用。"它可能提供一定程度的信息支持,一定程度的表演性同理心,但它真的不是一个能够提供关怀的系统。"
Perplexity在一份声明中表示,它优先考虑准确性并积极消除谄媚。该公司表示,它成立了Perplexity健康咨询委员会,以帮助建立人们应从人工智能中期待的安全措施、标准和产品体验。
"我们从一些用户那里听说,Perplexity的中立语气和清晰的来源在压力决策过程中提供了舒适感,但我们不相信人工智能应该被拟人化,"该公司表示。
快速答案的吸引力
Christina Squitieri不得不等待三周才能与胃肠病学家预约,讨论结肠镜检查期间采集的活检结果中用红色标记的部分。ChatGPT告诉她,报告中指出的白细胞增加表明存在显微镜下结肠炎——一种炎症性肠病——并提供了有关药物及其副作用的信息。但当她终于见到医生时,医生驳回了这一发现,认为它无关紧要,并向她保证报告显示她没有这种疾病的结论性证据。
但如果纽约37岁的Squitieri再次发现自己处于同样的情况——令人担忧的检测结果,难以联系医生——她可能会再次转向ChatGPT,即使她会持怀疑态度接受答案。当她的女儿在20个月大时生病,花了10个月才见到专家并被诊断出需要药物治疗的慢性疾病。
"我们不应该寻求一个不会思考的聊天机器人,因为看医生太难了,"这位曾在美容教育公司工作的Squitieri说。
KFF民意调查发现,渴望快速和即时建议是人们使用聊天机器人寻求健康建议的最主要原因,三分之二的用户将其视为主要原因。约五分之一的人表示没有医疗保健提供者或无法预约是主要原因。
"这些聊天机器人有其存在的理由:获取医疗服务困难,可能需要数周甚至数月才能预约,"Mount Sinai研究员Nadkarni说。"如果人们要大规模使用这些工具,它们应该比我们用于写电子邮件的聊天机器人具有更高的严谨性和安全性标准。"
【全文结束】

