高价AI血液检测服务承诺提供答案,它们真的能做到吗?Pricey AI blood test services promise answers. Do they deliver? | Mashable

环球医讯 / AI与医疗健康来源:mashable.com美国 - 英语2026-10-10 21:16:17 - 阅读时长8分钟 - 3503字
随着大型语言模型如ChatGPT、Claude和Gemini的普及,越来越多的患者开始使用AI聊天机器人解读血液检测报告,多家公司如健康品牌Whoop和Levels也借此推出付费AI解读服务,但医学专家警告目前缺乏严谨研究证明AI能准确解读血液结果并提供个性化健康建议,这些服务的准确性和价值仍存疑,消费者应谨慎对待此类"黑科技",在获得确切科学证据前,AI更适合用于帮助患者理解检测结果而非替代专业医疗意见。
AI血液检测健康血液检测解读个性化建议医疗准确性医生监督生物标志物订阅服务健康风险生活方式建议
高价AI血液检测服务承诺提供答案,它们真的能做到吗?

血液检测与获取结果之间的等待期对患者来说可能充满压力。在医生能够审阅并翻译检测结果前,充满专业术语的血液检测报告就已经送达。如果患者未发现明显异常,他们可能永远不会跟进。这时,人工智能驱动的聊天机器人登场了。自ChatGPT、Claude和Gemini等大型语言模型问世几年来,越来越多的患者开始分享他们的检测结果——或将结果上传至——他们选择的聊天机器人,寻求指导。

包括健康生活方式品牌Whoop和Levels在内的公司看到了这一信息缺口中的商机,并提出了一个极具吸引力的建议:借助AI为消费者提供礼宾级别的检测报告解读服务。通常,这些AI产品是一份用通俗易懂语言撰写的解释性报告,提供包含饮食调整、生活方式改变和咨询医生等下一步行动的个性化计划。这项通常以订阅形式提供的服务,年费可达数百美元甚至更高。

美国医学会首席执行官约翰·怀特博士理解这种服务的吸引力,尤其是当患者发现检测结果令人困惑时。"医生[并非总是]最好的沟通者,"怀特表示,"我希望我们是,并且有更多时间。"

然而,他表示,目前没有严谨的研究或证据表明AI能够有效准确地解读血液检测结果,并提供个性化的生活方式建议以改善或优化健康状况。换句话说,提供AI解读血液检测的公司尚不清楚其产品是否比免费咨询聊天机器人更好,或比医生的意见更准确。"我认为你必须对某些说法保持怀疑态度,"怀特说。

人工智能用于血液检测结果的解读仍有很长的路要走。根据其制造商谷歌和OpenAI的说法,包括Gemini和ChatGPT在内的AI模型并未针对血液解读工作进行验证或基准测试。

当谷歌最近与Quest诊断公司合作,为这家全国性实验室公司的客户推出AI工具时,该工具专注于解释医学术语、识别个人数据中的趋势并建议患者向医生提出的问题。它不提供医疗指导或生活方式建议。公司发言人表示,尽管谷歌经常发布有关Gemini医疗基准的研究,但Quest合作旨在"解决患者在实际世界中的识字率和数据导航挑战"。

据公司发言人称,OpenAI的HealthBench测试其模型在真实健康场景中的表现,包括理解血液检测结果的示例。不过,OpenAI目前没有针对血液检测的独立基准。

BloodGPT公司联合创始人兼首席执行官乔纳森·克朗坦率承认,目前尚无广泛接受的基准来大规模全面解读血液检测。BloodGPT在2024年初期测试中发现,直接将完整检测报告上传至Claude和ChatGPT等通用聊天机器人会持续产生错误。生物标志物被完全遗漏或相互混淆。有时聊天机器人会"幻觉"出建议。

这些经历促使BloodGPT构建了一个称为"结构化流程"的系统,通过多重验证来确认其发现。虽然BloodGPT可以根据不同大型语言模型的演变优势进行切换,但该公司目前针对分类、推理、解读和一致性检查等不同任务,使用企业级Gemini、OpenAI和Anthropic模型。它还咨询特定生物标志物(如生殖激素雌激素和睾酮)的专家,以检查其AI的准确性和洞察力。

尽管BloodGPT将其主要业务定位于向临床实验室、医疗系统和LabCorp等健康诊断公司销售软件,但它也为个人消费者提供AI解读服务。其消费者计划每月收费9.99至17.99美元。

该公司表示,其算法基于既定的临床指南和验证过的医学参考数据,并由临床医生进行迭代测试。BloodGPT尚未发表同行评审研究证明其方法的成功——但克朗表示,该公司将通过与以色列医疗系统的合作,启动一项使用10万份匿名患者记录的大规模研究项目。目标是以多种方式将BloodGPT的准确性与患者医疗记录中的结果进行基准比较。"我们没有选择简单的道路,"克朗说。

为何模型准确性如此重要?纽约西奈山医院的内科医生和肾病学家吉里什·N·纳德卡尼博士认为,销售AI血液解读服务的公司需要通过将结果与匿名患者数据进行回顾性比较,并让参与者加入前瞻性研究(将AI发现与专家意见进行比较)来证明其成功。

"我认为任何事物都不需要达到100%的准确率才能成功,因为人类也不是100%准确,"作为AI健康研究员和西奈山哈索·普拉特纳数字健康研究所所长的纳德卡尼表示,"但问题变得非常棘手,因为我不知道这个模型的准确率是多少……它是如何工作的,以及在哪里会失败?"

纳德卡尼表示,当前的AI血液检测产品对大多数患者可能"还可以",但在极端情况下可能会出现问题,例如漏诊或假阳性结果,这会引起焦虑并可能导致有害的额外检测。

Levels首席执行官乔什·克莱门特是频繁血液检测的倡导者。如果成本不是问题,克莱门特会建议比典型的年度体检更频繁地进行检测,以实现主动健康监测。

专注于代谢健康的Levels将其订阅计划定位为"更健康、更长寿"的生活方式。每个层级都提供公司应用程序和专有仪表板的访问权限,以及血糖监测。但只有两个层级(年费分别为499美元和1,499美元)包含实验室检测、临床医生审核的报告和AI健康洞察。

克莱门特目前偏好Claude和Gemini用于Levels的AI产品,该产品还经过医学文章和生物标志物研究训练,以及包含代谢专家关于饮食、减肥和激素等主题的Levels博客文章和播客。

AI产品从这些信息层和保障措施中获取洞察,每位消费者收到的检测报告都由医生审核。基于应用程序的AI聊天机器人还从Levels专家内容中提取信息,推荐可能改善胆固醇和血糖等生物标志物的生活方式改变。

"我们再次将其用作临床支持工具,我认为这是当今使用这些工具的正确方式,"克莱门特表示。Levels目前没有对其AI产品的准确性进行独立研究。

纳德卡尼支持人工监督,但警告消费者不要认为这是万无一失的。相反,医生可能会无意中成为自动化偏见的受害者,即倾向于盲目批准AI输出。

AI能否真正个性化解读血液检测结果?由足球明星克里斯蒂亚诺·罗纳尔多和四分卫帕特里克·马霍姆斯等运动员而闻名的可穿戴设备公司Whoop,去年秋天才开始提供血液检测服务。每年一次的检测费用为199美元,但会员可每年检测六次,费用为899美元。该公司与Quest合作进行实验室工作,并像Levels一样,由医生审核结果。

Whoop产品副总裁亚历克西·科菲表示,该公司AI产品由OpenAI和会员个人数据驱动。她拒绝评论公司是否正在进行关于AI准确性的临床研究。

"我们从不希望过度宣称或过度暗示事物之间的关系,"科菲说,"但我们确实希望通过帮助会员理解可能相关的事项,为他们提供价值。"

科菲表示,Whoop将生理数据——包括心率、睡眠质量和运动模式——整合到血液检测报告中的能力,为客户提供独特的健康洞察。例如,如果客户在抽血前一天跑了马拉松,AI在解读炎症生物标志物时可能会考虑身体压力。(Whoop实际上建议会员在抽血前避免剧烈体力活动,因为它可能影响结果。)

尽管这听起来很有希望,但美国医学会的怀特表示,没有证据表明此类AI应用是"真正个性化的"。"我认为我们真的必须质疑数据是什么,"他说,并指出公司需要海量数据集才能做出个性化建议。如果这些公司拥有这些信息,他们尚未基于此发表同行评审研究。

怀特表示,血液检测是关键的诊断工具,但也是社交媒体炒作的焦点,后者常常将其定位为解决低能量或失眠等健康挑战的灵丹妙药。他警告消费者,一些公司测量的元素和矿物质"对任何事情都没有太大帮助"。根据操作方式的不同,激素水平检测也可能同样徒劳。

在科学研究确立AI血液检测解读的准确性和意义之前,怀特建议患者使用AI帮助简单解释结果,而不是依赖该技术为他们生成个性化洞察。"人们认为实验室检测是非黑即白的,是判断你是否患病的最终标准,"怀特说,"但事实并非总是如此。"

本文所含信息仅用于教育和 informational purposes,不作为健康或医疗建议。关于任何医疗状况或健康目标的疑问,请务必咨询医生或其他合格的健康服务提供者。

披露:Mashable的母公司Ziff Davis于2025年4月对OpenAI提起诉讼,指控其在训练和运营AI系统时侵犯了Ziff Davis的版权。

【全文结束】