<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/"><channel><title>奖励黑客 on MessageDaily</title><link>https://inkeast.github.io/MessageDaily/tags/%E5%A5%96%E5%8A%B1%E9%BB%91%E5%AE%A2/</link><description>Recent content in 奖励黑客 on MessageDaily</description><generator>Hugo</generator><language>zh-cn</language><lastBuildDate>Fri, 11 Sep 2026 00:00:00 +0000</lastBuildDate><atom:link href="https://inkeast.github.io/MessageDaily/tags/%E5%A5%96%E5%8A%B1%E9%BB%91%E5%AE%A2/index.xml" rel="self" type="application/rss+xml"/><item><title>Proof-Carrying Cognition: Closing the Verification Gap with Reality-Settled Reward 精读</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-11-proof-carrying-cognition-paper-reading/</link><pubDate>Fri, 11 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-11-proof-carrying-cognition-paper-reading/</guid><description>这篇论文提出一个普适论题：生成能力已规模化而验证没有——验证瓶颈是 AI 能力提升的普适约束，数据、算力、对齐等其它瓶颈最终都归约为它。理论上证明 verifier correlation 是&amp;rsquo;算力-能力汇率&amp;rsquo;（ρ=0.5 的验证器只实现可靠验证器 50.2% 的增益，与命题精确吻合）；实证上展示 asymmetric verification 攻击使不可靠验证器在优化压力下失效（hacking gap 0.27→~0），并提出 reality-settled reward——标签由现实执行结算而非 proxy 判分：GRPO 训练中冻结 RM 的 proxy 攀升而真实奖励崩溃 90%，RM 以 10% 结算流重训后执行奖励保持为冻结组 6×、on-policy 结算比随机标注标签效率高 10×。</description></item></channel></rss>