Recursive Harness Self-Improvement 精读

Sakana AI 与 UC Berkeley 提出 RHI(递归式框架自改进):把多智能体框架当作提示词级对象,仅用当前与上一版本的自我比较来迭代优化,少数几轮就能让低推理强度的 Agent 超越同族最高推理强度设置,同时把推理成本降低最高 60%。本文从 Harness 是什么、模型-框架协同进化讲起,拆解 RHI 的轨迹局部目标、算法流程、信息论隐式目标,并提炼可推广的通用性灵感。

July 23, 2026 · 6 min

SWE-Pruner Pro: The Coder LLM Already Knows What to Prune 精读

编码 Agent 在多轮交互中累积大量冗余工具输出,现有剪枝方法依赖外部评分模型。SWE-Pruner Pro 提出一个关键发现:Agent backbone 在读取工具输出时,其内部隐藏状态已经编码了行级重要性信号。通过一个轻量级 head 直接从 backbone 内部表示读取剪枝决策,在四个多轮基准上节省高达 39% 的 token,同时在部分基准上甚至提升了任务质量。本文精读其动机发现、方法设计、工程实现与通用性启示。

July 22, 2026 · 7 min

2026-06 arXiv 智能体/工具智能体领域综述:916 篇分主题精读

工具智能体领域综述。LLM_Agents 桶 1001 篇扣除记忆子领域后按 13 主题分桶精读,提炼工具量质失衡、agent RL 信用分配、长程可靠性与上下文管理、过程级评测、工具环境不可靠、多智能体幻觉优势、治理权限可审计性等 7 大共识问题,并识别 strained coherence、agentic abstention、world-model collapse 等原创问题。

July 17, 2026 · 7 min

2026-06 arXiv 智能体记忆系统(Agent Memory)领域综述:113 篇全文精读

智能体记忆子领域纵深综述。从 11930 篇 6 月 arXiv 预印本中筛定 113 篇核心集,全部下载 PDF 抽全文逐篇精读,提炼 7 大共识性问题(检索不等于使用、固化的保留与遗忘决策、上下文成本爆炸、一致性/矛盾解决、评测混淆变量、记忆即新攻击面、遗忘治理)与多项原创问题定义,关键新框架已联网交叉验证。

July 17, 2026 · 5 min

2026-06 LLM 代码生成领域综述:357 篇全文通读

代码生成领域综述。从 B23 软件工程桶 770 篇筛出 358 篇逐篇下载全文 PDF 通读(非仅摘要),聚焦 pass@k 失效、仓库级定位与探索、代码幻觉、AI 代码的审查信任与组织影响、评测有效性、形式化验证等议题,识别出隐形彩票、验证地平线、substrate collapse 等 12 个新颖问题与研究范式转移。

July 17, 2026 · 3 min

智能体技能演化(Skill Evolution 与 Self-Evolving Agents)综述:53 篇核心论文精读

技能演化与自演化智能体综述。从 116 篇候选中筛定 53 篇 CORE 论文下载全文精读,提炼技能库选择退化、技能创建与部署脱节、自演化缺乏可靠接受准则、上下文无界膨胀等共性问题,以及 16 个范式级新转变(PACE、Bayesian-Agent、Red Queen Godel、Trellis、MMG2Skill 等 5 个已联网验证)。

July 17, 2026 · 4 min

Why Supervised Fine-Tuning Fails to Learn: A Systematic Study of Incomplete Learning in Large Language Models 精读

这篇 ACL 2026 Main 论文首次系统性地揭示了「不完全学习现象」(ILP):即使训练损失收敛,LLM 仍有约15%的训练样本无法被正确复现。论文将这一现象归因为五个可诊断的来源,并提出了一个「先诊断、再对症下药」的框架,证明了SFT失败的异质性——不同原因需要不同解法。

July 13, 2026 · 4 min

ResearchStudio-Idea: An Evidence-Grounded Research-Ideation Skill Suite from ML Conference Outcomes 精读

大语言模型让研究构思变得容易,但有效的创意开发远不止生成候选方向。本文精读微软研究院与南洋理工合作的 ResearchStudio-Idea,一个面向研究构思’第一公里’的可复用技能套件。论文从 1,947 篇 ICLR/ICML/NeurIPS 论文中归纳出 15 个可复用的研究构思模式,将成功条件与失败模式配对成操作性卡片,并打包为端到端的 IdeaSpark 技能——在盲法自动评审中,IdeaSpark 在 88/100 个种子问题上质量排名第一,同时保持竞争性新颖性。

July 9, 2026 · 5 min

ResearchStudio-Reel: Automate the Last Mile of Research from Paper to Poster, Video, and Blog 精读

微软研究院的 ResearchStudio-Reel 把论文传播的"最后一公里"——海报、演讲视频、双语博客——重构为五个可组合技能。它用一次共享提取替代三次重复读论文,用硬性渲染门控替代软性美学打分,用可编辑的 PowerPoint/Word 替代只读 PDF。在 100 篇论文基准上,它生成的海报美学评分甚至超过了作者本人手绘的海报,在 84%-93% 的论文上获胜,并且是目前唯一同时交付三种可编辑传播产物的流水线。

July 9, 2026 · 3 min

Harness Engineering for Self-Improvement 精读

Lilian Weng(Thinking Machines Lab 联合创始人、前 OpenAI 研究副总裁)在这篇万字综述中系统梳理了「Harness 工程」——围绕基础模型的运行时系统——作为通往递归自我改进(RSI)现实路径的核心命题。文章从 RSI 的思想起源讲起,把 Harness 定义为决定模型如何思考、规划、调用工具、管理上下文、评估结果的系统层,并梳理了三大设计模式(工作流自动化、文件系统持久记忆、子代理并行)、四大优化方向(上下文工程、工作流设计、自我改进、进化搜索)以及与模型权重的联合优化,最后坦诚列出七大瓶颈。本精读将这篇综述放在 RSI→Harness 的研究脉络中定位,提炼其方法论骨架与可迁移的普适灵感。

July 7, 2026 · 8 min