
由 Dr7.ai 医疗 AI 平台提供支持
CheXagent 是 Stanford 医学与影像人工智能中心(AIMI)推出的 80 亿参数视觉-语言模型,专为解读胸部 X 光片而打造——涵盖异常发现检测、报告生成以及视觉问答。
上传一张胸部 X 光片,询问影像发现、投照体位或后续检查——本演示展示了 CheXagent 所针对的结构化胸部 X 光解读方式。
获得无限次胸部 X 光分析、更高的上传上限,以及用于放射学研究工作流的 API 访问。
CheXagent 是 Stanford AIMI 于 2024 年 1 月发布的胸部 X 光基础模型(Chen et al.,"CheXagent: Towards a Foundation Model for Chest X-Ray Interpretation")。它结合了一个临床语言模型、一个基于胸部 X 光片训练的视觉编码器,以及一个让模型能用自然语言对图像进行推理的桥接网络。
为训练该模型,团队构建了 CheXinstruct——一个汇集数十个公开胸部 X 光数据源的大型指令微调数据集——以及 CheXbench,一套评估套件,用于在图像感知任务(体位分类、疾病识别、视觉问答)和文本生成任务(影像所见与诊断印象生成、报告摘要)上为模型打分。
在 CheXbench 上,CheXagent 在大多数任务中优于通用模型和早期的医学多模态模型;作者还审查了其在不同性别、种族和年龄群体间的性能差异。它仍是一个研究模型:未获 FDA 许可,也无意取代放射科医生。
2024 年 1 月由 Stanford AIMI 发布(Chen et al., 2024)
权重和 CheXbench 评估套件可供研究使用;并非已获监管许可的医疗器械
专为胸部 X 光片构建并进行基准测试
胸部 X 光投照体位与方向分类
疾病与异常发现识别
影像所见与诊断印象(报告)生成
胸部 X 光视觉问答
放射学报告摘要
基于大型多来源指令数据集 CheXinstruct 训练
在 CheXbench 上跨感知与生成任务接受评估
针对性别、种族和年龄亚组的公平性审查
CheXbench 结果见 CheXagent 论文;Dr7.ai 未进行独立测量
体位分类、疾病识别和 VQA,与通用及医学多模态基线模型对比
影像所见、诊断印象和摘要任务,采用放射学专用指标评分
由多个公开胸部 X 光数据集(如 MIMIC-CXR、CheXpert)构建的指令数据集
视觉编码器 + 视觉-语言桥接器 + 临床 LLM
使用统一的评估套件(CheXbench)对胸部 X 光解读模型进行基准测试。
起草影像所见并标记可能的异常,供放射科医生审阅。
基于教学用胸部 X 光片的交互式问答。
来自 Stanford AIMI 的研究权重
CheXagent 的权重由 Stanford AIMI 在 Hugging Face 上发布,供研究使用;请查阅模型卡了解当前的许可条款。
输入一张胸部 X 光片和一条指令,即可获得文本输出。
在让 CheXagent 接触任何患者数据之前,请先规划好隐私保护、验证和人工监督。
CheXagent 是研究模型。在任何临床使用之前,其输出必须经合格的医疗专业人员审核。
该模型并非已获监管许可或批准的医疗器械。部署前请确保符合当地医疗法规和数据保护规定(如 HIPAA、GDPR)。
专用模型 vs 通用模型
Stanford AIMI 的胸部 X 光模型
胸部 X 光研究、报告起草原型以及放射学 AI 基准测试
对比情况
请根据模态(文本或图像)、许可证以及您实际拥有的硬件进行选择
关于 CheXagent 的常见问题
由 Stanford 医学与影像人工智能中心(AIMI)开发。它不是 Google 的模型。
针对胸部 X 光片进行体位分类、异常发现识别、视觉问答,以及生成或总结影像所见与诊断印象。
没有。它是一个研究模型,绝不能作为临床决策的唯一依据。
随 CheXagent 一同发布的评估套件:涵盖图像感知与文本生成的八项胸部 X 光任务,用于比较多模态模型。
本演示使用 Dr7.ai 的多模态医疗助手来展示胸部 X 光解读。如需使用原版模型,请使用 Stanford AIMI 发布的权重。