跳到主要内容

研究进展

相关研究与后续进展

同一研究事件下的公开文章与后续进展。

arXiv

研究团队将 LUH 不确定性头适配到波斯语医学模型,单次前向即可在声明级别检测幻觉,PR-AUC 达 0.4820 与 0.4652

该研究把 LLM 不确定性头框架适配到基于 Aya-Expanse-8B 的两个波斯语医学模型 Gaokerena-V 与 Gaokerena-R,先在 168 题伊朗医学入学考试上观察到 Gaokerena-V 的五次运行一致性明显低于 Aya-Expanse-8B 而 Gaokerena-R 与之相当,再构建每个骨干 1600 条响应的波斯语声明级幻觉数据集,在冻结骨干的注意力图与词元概率上训练轻量声明级头,留出测试集上 PR-AUC 为 0.4820 与 0.4652(分别为随机基线的 2.30 与 2.66 倍),ROC-AUC 为 0.7852 与 0.7810,推理时无需检索或重复采样。