arXiv 2026年10月5日作者提出视觉网页智能体 WebFovea,在 WebRetriever 挑战赛 2026 的 Protocol III 端到端评测中以 57.0 分(满分 100)获得第二名;由于四次提交使用同一模型,官方隐藏集得分从 31.0 升至 57.0 被归因于执行框架的改动,并指出真实网站上的许多失败发生在解析、执行、回报、信息呈现这四个环节而非模型推理本身。作者提出视觉网页智能体 WebFovea,在 WebRetriever 挑战赛 2026 的 Protocol III 端到端评测中以 57.0 分(满分 100)获得第二名;由于四次提交使用同一模型,官方隐藏集得分从 31.0 升至 57.0 被归因于执行框架的改动,并指出真实网站上的许多失败发生在解析、执行、回报、信息呈现这四个环节而非模型推理本身。WebFovea 在 WebRetriever 挑战赛以 57.0 分获第二名,同一模型下通过改造模型与页面之间的执行框架把隐藏集得分从 31.0 提升到 57.0作者提出视觉网页智能体 WebFovea,在 WebRetriever 挑战赛 2026 的 Protocol III 端到端评测中以 57.0 分(满分 100)获得第二名;由于四次提交使用同一模型,官方隐藏集得分从 31.0 升至 57.0 被归因于执行框架的改动,并指出真实网站上的许多失败发生在解析、执行、回报、信息呈现这四个环节而非模型推理本身。作者提出视觉网页智能体 WebFovea,在 WebRetriever 挑战赛 2026 的 Protocol III 端到端评测中以 57.0 分(满分 100)获得第二名;由于四次提交使用同一模型,官方隐藏集得分从 31.0 升至 57.0 被归因于执行框架的改动,并指出真实网站上的许多失败发生在解析、执行、回报、信息呈现这四个环节而非模型推理本身。