医生身边的AI抄写员无处不在。以下是研究结论AI Scribes For Doctors Are Everywhere. Here’s What The Research Says

环球医讯 / AI与医疗健康来源:www.forbes.com美国 - 英文2026-09-12 16:25:27 - 阅读时长5分钟 - 2442字
本文综合多项最新研究,探讨了AI抄写员在医疗领域应用的现状。研究显示,这些工具能有效提升医生工作效率,减少职业倦怠,并提高临床记录的完整性。然而,研究也揭示了显著的风险,尤其是在记录中的遗漏错误,以及可能对非英语患者和复杂病例造成照护差异。文章强调,AI抄写员并非完美解决方案,需要医者保持审慎监督,选择可靠供应商,并设计公平透明的应用流程,以确保其成为安全、公平的辅助工具。
AI抄写员临床笔记医生倦怠准确性患者安全医疗公平文档负担
医生身边的AI抄写员无处不在。以下是研究结论

如果你还没有注意到,你的医生诊室里可能来了一位新“客人”——那就是他们的人工智能抄写员。

AI抄写员是一种工具,它可以听取临床医生与患者的对话,并自动生成临床笔记的草稿。这对医生们的承诺是巨大的:同时解决两大问题,即文书工作倦怠和行政负担过重。对于患者来说,好处很简单:医生能更专注于问诊,而不再被键盘牢牢束缚。

许多AI抄写公司正被医院采用,其名称包括DAX(微软)、Ambience和Abridge。一些公司专注于特定专科的抄写,例如Cleo,它主要用于急诊科等急症护理环境。

在我们匆忙迈向一个更多临床对话被软件记录和总结的未来之际,理解这些工具的表现、它们能帮助谁以及在哪些方面存在不足,变得至关重要。

近期发表在一些文献中的关于AI抄写员的研究,描绘了一幅存在一致收益的图景。然而,它们也揭示了准确性方面的挑战和一些显著风险。以下是当前的研究状况。

AI抄写员可以提高效率

AI抄写员的核心价值主张是为临床医生节省时间。一项发表在《美国医学会杂志网络开放版》上的大规模倾向评分匹配研究发现,使用AI抄写员的临床医生在电子健康记录上花费的总时间减少了9%,大约每次就诊节省2.4分钟,撰写笔记的时间减少了16%。这些节省的时间在整个门诊日中累加起来,可以转化为认知负荷的显著减轻。

然而,至少在那一项特定研究中,该技术尚未完全消除下班后的工作。同一篇论文发现,下班后的文书工作记录时间或就诊记录的完成速度没有显著变化。

这表明,虽然AI抄写员可能简化了笔记创建过程,但它们可能还未能解决更广泛的问题,如管理收件箱以及其他那些让临床医生在患者离开后仍长时间守在电脑前的任务。

关于AI抄写员与倦怠的复杂故事

如果AI抄写员能节省时间,它们也应该能减少职业倦怠。大部分证据支持这一点,但存在重要的前提条件。一项多中心质量改进研究显示,263名临床医生在使用AI抄写员仅30天后,倦怠率从52%下降到39%。

但这种好处并非普遍一致。一项研究发现,虽然医生报告称倦怠感和离职意愿有所降低,但高级执业医师并未表现出相同的改善。这一差距值得进一步调查。这可能反映了工作流程、就诊类型、患者复杂性或不同角色与技术交互方式的差异。

这些早期研究的结论正在浮现:仅仅实施一个工具是不够的。医疗系统还需要了解它如何融入护理团队中的多元角色。

此外,研究表明医生的采用率各不相同,有些研究发现,在提供该程序后,最终只有十分之一的医生会采用。其他研究则发现采用率要高得多,超过50%。

AI抄写员是准确的,但有时会遗漏关键患者信息

当谈到AI抄写员的准确性时,情况变得复杂。在将AI的文档记录与人工记录进行比较的受控模拟中,最好的AI抄写员有时甚至超过临床医生,包括在全科诊疗风格研究的咨询中。

但当研究人员检查错误类型时,一个重大的安全隐患浮现出来:遗漏。在各个平台和研究中,遗漏错误约占所有错误的71%到83%。许多遗漏在临床上不严重,但相当数量的遗漏并非如此。

一项研究发现,45%的遗漏具有中等临床意义。另一项对医院出院小结的分析发现,AI生成的叙述比医生生成的叙述包含的遗漏明显更多,平均遗漏数为1.75比0.86。

这造成了一个悖论。AI抄写员可以产生一份比医生匆忙写就的版本更详尽、组织更有序的笔记。然而,它可能会悄然遗漏关于疾病严重程度、合并症或是鉴别诊断或管理计划中细微之处的关键细节。

不同供应商之间的表现也存在差异。一项对四个商业平台的比较分析发现了巨大差异。一家供应商的总体错误率较低,约为12%,而另一家供应商的遗漏率高达25%。有些生成过于冗长且包含虚构细节的笔记,而其他一些则过于简短。

一个关键问题是,并非所有AI抄写员都生而平等。

AI抄写员在特定患者群体中面临挑战

研究提出的一个迫切问题是AI抄写员可能扩大医疗保健差距。该技术最适用于常规或方案驱动的就诊。但对于复杂患者、非英语母语者或认知障碍患者呢?

这方面的证据令人担忧。许多AI抄写员对非英语患者的功能有限,这是采用的主要障碍。在带口音语音的准确性方面也存在担忧。虽然AI有潜力弥合语言差距,但目前的实施方式可能会无意中使英语水平有限的患者处于不利地位。

基于非多样性数据集训练的AI模型中的偏见也可能延续并放大现有的差距。女性、来自代表性不足的种族和族裔群体的人以及社会经济背景较低的人通常在训练数据中代表性不足。这可能导致分类错误、上下文缺失或未能捕捉关键的健康社会决定因素。

还存在自动化偏差的风险,即临床医生因为笔记看起来完整而变得不那么警惕。一项研究发现,虽然AI抄写员增加了神经精神症状的文档记录,但这也与更少的精神干预措施相关。

最后,信任和透明度也很重要。研究发现,虽然当临床医生审核输出结果时,许多患者对AI抄写员感到满意,但很大比例的患者不愿意在未来的就诊中使用AI抄写员。关键的担忧包括隐私问题以及根本不知道这项技术正在被使用。

安全且公平的AI抄写员部署可能是什么样子

AI抄写员是一项变革性技术,也是医疗AI领域早期成功案例之一。它们具有明确的潜力来减轻文档负担和改善临床医生福祉。然而,它们还不是即插即用的解决方案。

证据指出了安全、公平部署的几个必要条件。首先,对每份笔记而言,让临床医生参与审核至关重要。AI生成的笔记需要警惕的人工监督,特别是为了发现遗漏错误。

其次,供应商选择是决定笔记质量的主要因素。医疗系统评估抄写员时,不仅应基于整体质量评分,还应考虑其错误的性质和临床意义,重点关注遗漏问题。

第三,公平性必须从一开始就设计进去,而不是事后添加。项目应验证在不同语言、口音和多样化患者群体中的表现。它们应测试在复杂就诊中的性能。

最后,对患者透明至关重要。应告知患者AI正在监听,理解录音如何处理,并能够提出隐私担忧。

归根结底,AI抄写员将在此扎根。采用的下一阶段,评判标准不应过多地以节省了多少时间为准,而应关注笔记是否准确、公平和值得信赖。

【全文结束】