跳到主要内容

研究进展

相关研究与后续进展

同一研究事件下的公开文章与后续进展。

arXiv

TomasuLLM 让 LLM 智能体乱序投机执行工具调用,在 SWE-bench Verified 上取得 1.31 倍加速且 4,010 条提交校验记录零误接受

TomasuLLM 是一个在保持任务执行正确性的前提下乱序执行智能体工具调用的运行时,它先草拟未来动作、在隔离的写时复制沙箱中运行、追踪依赖与副作用,并在对已提交状态校验通过后按轨迹顺序提交结果;在三个覆盖亚秒级到分钟级工具调用的基准上,它报告了 100 个 SWE-bench Verified 任务 1.31 倍、28 个 Terminal-Bench 2.0 任务 1.35 倍、18 个 SWE-Marathon 会话 1.27 倍匹配进度的提升,并在 4,010 条审计过的提交校验记录中产生零误接受。