SWE-Pruner Pro: The Coder LLM Already Knows What to Prune 精读
编码 Agent 在多轮交互中累积大量冗余工具输出,现有剪枝方法依赖外部评分模型。SWE-Pruner Pro 提出一个关键发现:Agent backbone 在读取工具输出时,其内部隐藏状态已经编码了行级重要性信号。通过一个轻量级 head 直接从 backbone 内部表示读取剪枝决策,在四个多轮基准上节省高达 39% 的 token,同时在部分基准上甚至提升了任务质量。本文精读其动机发现、方法设计、工程实现与通用性启示。