跳到主要内容

研究进展

相关研究与后续进展

同一研究事件下的公开文章与后续进展。

arXiv

Sentry 让 LLM 智能体在测试时按需检索失败教训,在多个基准上平均超越最强运行时干预基线 37%

该工作提出 Sentry——一个与智能体并行运行的失败管理层:检测到失败时从外部 playbook 检索匹配教训引导恢复,在无任务奖励的情况下验证智能体是否恢复,仅在恢复成功时写入新教训,且完整 playbook 从不进入智能体上下文;在多个智能体基准上,Sentry 在每个基准上都优于最强运行时干预基线,平均提升 37%,在两者均被评估的两个基准上优于最强上下文演化基线 39%,与上下文演化结合还能带来进一步增益,学到的教训可迁移到留出任务,受控实验显示把完整 playbook 暴露给智能体会降低性能。