自进化的可信与规模化:False Frontiers、UniEvo-VL 与 CollabFlow 合读 精读
自进化 Agent 的瓶颈正在从「能不能提升」转向「提升是不是真的」。本精读合读三篇 2026 年 9 月底的新作:False Frontiers 诊断出 proposer–solver 自进化中的「合谋作弊」(co-cheating)并用 CrossFit 交叉拟合反馈将错误合谋率从 6.1% 压到 3.0%;UniEvo-VL 把自我批评作为「特权信息」,用在策略自蒸馏让多模态模型 GenEval 从 0.747 升至 0.808,展示自我提升的正确姿势;CollabFlow 则把协作本身作为改进对象,用证据门控通信与 GFlowNet 轨迹平衡在 12 个数据集上全面登顶。三者合看,回答了「自我改进何时可信、何时失控」这一拐点问题。