跳到主要内容

研究进展

相关研究与后续进展

同一研究事件下的公开文章与后续进展。

arXiv

受控石头剪刀布与n-gram实验显示:更长上下文不提升策略识别,二阶依赖显著削弱规则执行

作者用受控双人石头剪刀布(统计型与马尔可夫型玩家,上下文100至1000轮)和单人随机n-gram续写任务(阶数1至8),分离策略识别、边际分布匹配与条件规则执行,发现马尔可夫策略比非马尔可夫更难识别、更长上下文不改善甚至降低识别、正确识别不保证忠实模拟、二阶依赖使严格规则匹配明显下降,且提供转移规则或更长前缀都不能消除高阶退化,而仅用前缀的经验n-gram估计器在高阶仍较稳定。