RRSI: Regularized Recursive Self-Improvement of Agent Harnesses 精读
深度精读 Google Cloud AI Research 等提出的 RRSI——首个把机器学习正则化思想系统迁移到 Agent Harness 递归自我改进的工作。文章从 Harness 与 RSI 概念讲起,拆解过拟合问题的成因,逐一讲解提案侧 L0 式退火编辑预算、证据感知信用分配、结构化探索,与选择侧泄漏筛查、噪声调整底线、L2 式成本门槛、L1 式结构剪枝,并结合八基准三域实验与外部检索交叉验证,剖析其「为何能泛化」的根源性解释与可迁移灵感。