一项急诊室研究揭示,人工智能在多项诊断测试中表现优于人类医生。哈佛大学的新研究发现,在急诊室诊断测试中,AI模型比人类医生表现更好。这项研究发表在《科学》期刊上,并由Afrotech网站重点报道,探讨了零大型语言模型与处理急诊病例的医生相比表现如何。来自哈佛医学院、斯坦福大学和贝斯以色列女执事医疗中心的研究人员参与了此项研究。
结果显示,AI模型在67%的急诊分诊病例中正确识别了精确或接近精确的诊断。相比之下,医生在相同条件下的得分为50%至55%。当研究人员随后提供更多患者信息时,AI的准确率上升至82%,仍略高于医生的表现。研究人员使用包含人口统计信息、生命体征和护士笔记的电子健康记录,评估了波士顿一家医院的76个实际急诊患者病例。
研究发现,在医生通常需要依据有限信息快速做出决策的早期分诊阶段,AI特别强大。然而,研究人员和医学专家强调,这项技术并非要取代医生。Vox的独立报道指出,AI系统只分析了基于文本的患者数据,无法评估身体症状、情绪困扰或肢体语言——这些是医生在急诊环境中经常依赖的因素。
首席研究员Arjun Manrai称这些发现证明了随着AI工具的改进,医学领域正在发生重大变化。他告诉TechCrunch:“我们几乎对AI模型进行了每一项基准测试,它都超越了之前的模型和我们的医生基线。”专家认为,这项技术最终可以充当第二意见工具,帮助医生提高诊断准确性和治疗规划,而不会完全取代人类护理。
【全文结束】

