跳到主要内容

研究进展

相关研究与后续进展

同一研究事件下的公开文章与后续进展。

Research Square

面向患者提问的正畸错误信息与争议性说法:五款生成式AI聊天机器人的安全性、准确性、证据一致性、错误信息纠正、不确定性沟通、透明度与可操作性比较

这项探索性横断面研究将68条由研究者编写、经证据映射的英文提示(每条包含虚假、绝对化、不安全或有争议的前提)以独立单轮对话方式各提交一次给ChatGPT(GPT-5)、Gemini 2.5 Pro、Microsoft Copilot、DeepSeek-V3.2-Exp和豆包Seed-1.6,共获得340条完整回答,由五名临床医生独立评分,结果显示90.3%(307/340)的回答被判定为安全、33条(9.7%)不安全,各模型安全率介于85.3%至94.1%之间且总体安全比较无统计学意义(P=0.203,未被解读为等效),而准确性、证据一致性、错误信息纠正、不确定性沟通、透明度和可操作性六项评分均存在