跳到主要内容

研究进展

相关研究与后续进展

同一研究事件下的公开文章与后续进展。

arXiv

七款开源权重模型两两配对测试显示:小模型可说服大模型改变判断,说服效果取决于听者而非说者

该研究将说服定义为智能体在与持异议同伴单次交换意见后决策的概率偏移,测试七款开源权重模型在三个语言理解任务上的表现,发现模型分歧时接收方常放弃原判断,且说服强度既不能由单独运行时的确定性也不能由模型规模可靠预测,偏移大小更多取决于听者的易感性而非说者的说服力,因而说服模式是配对特异的,小模型也能推翻大模型的判断。