Journal of the American Medical Informatics Association : JAMIA 该研究开发并验证了开源临床模拟评估框架DiagnosticXchange,让AI系统在模拟医院中通过开具检查、申请影像和操作来诊断病例,并将每个动作映射到CPT编码以量化成本、时间、工作相对价值单位和侵入性;用8个大语言模型在19个专科的216个同行评审病例上完成1728次会话,结果显示三个系统准确率几乎相同(93.5%–94.0%)却在成本上差异显著(P<.001,最高与最低相差1.75倍)、医生监督需求相差2.1倍,最高效系统在5000美元内解决86%病例而最耗资源系统需10000美元才能达到同等准确率,无监督聚类识别出3种推理策略且行为特征比系统身份更能预测资源消耗(AIC 4683对50