Proof-Carrying Cognition: Closing the Verification Gap with Reality-Settled Reward 精读
这篇论文提出一个普适论题:生成能力已规模化而验证没有——验证瓶颈是 AI 能力提升的普适约束,数据、算力、对齐等其它瓶颈最终都归约为它。理论上证明 verifier correlation 是’算力-能力汇率’(ρ=0.5 的验证器只实现可靠验证器 50.2% 的增益,与命题精确吻合);实证上展示 asymmetric verification 攻击使不可靠验证器在优化压力下失效(hacking gap 0.27→~0),并提出 reality-settled reward——标签由现实执行结算而非 proxy 判分:GRPO 训练中冻结 RM 的 proxy 攀升而真实奖励崩溃 90%,RM 以 10% 结算流重训后执行奖励保持为冻结组 6×、on-policy 结算比随机标注标签效率高 10×。