FastContext: Training Efficient Repository Explorer for Coding Agents 精读

深度精读微软 FastContext 论文——把代码仓库探索从主 Agent 中剥离、交给一个专门训练的小模型来干。用 4B-30B 的专用探索模型替代昂贵的探索过程,端到端解决率最高提升 5.5%,主模型 token 消耗最高降低 60%。从编码 Agent 瓶颈分析、模型分工解构、SFT+RL 训练配方,到必要知识反推与通用性灵感,全面拆解这项将仓库探索’模块化、可训练化’的工作。

June 17, 2026 · 5 min

From AGI to ASI 精读

深度精读 Google DeepMind 重磅报告《From AGI to ASI》——由 DeepMind 联合创始人 Shane Legg 领衔、AIXI 理论发明人 Marcus Hutter 等 14 位顶尖研究者合著。报告系统性地探讨了 AGI 实现之后 AI 如何继续向人工通用超级智能(ASI)演进:从 Universal AI(AIXI)的理论框架出发,定义了 AGI 和 ASI 的清晰边界,提出四条可能并行的技术路径(算力扩展、范式转变、递归自我改进、多智能体集体涌现),并诚实地分析了六大瓶颈与高度不确定性。核心洞见是:AI 进展不太可能在人类水平附近停滞,我们面对的可能是连续的变革而非单一拐点。

June 17, 2026 · 5 min

【每日AI前沿追踪】2026年06月16日 核心技术与产业动态速递

6月16日AI前沿速递:SpaceX 600亿美元全股票收购Cursor重塑编程Agent版图;阿里Qwen-Robot具身智能三件套发布、蚂蚁Ling&Ring 2.6万亿参数技术报告、字节Seedance 2.0 Mini成本砍半;FastContext(微软)让编码Agent token消耗降60%、LoopCoder-v2(人大×北航×企业)循环架构SWE-bench飙升21分、MIT可变宽度Transformer砍22%算力;Anthropic Fable 5出口管制升级致五角大楼全面转移工作流。

June 16, 2026 · 4 min

【每日AI前沿追踪】2026年06月15日 核心技术与产业动态速递

6月15日AI前沿速递:Anthropic Fable 5出口管制持续发酵,GPT-5.6传闻6月23日发布成本仅1/3;Kimi K2.7 Code高速版6倍加速;智谱ZCode客户端免费提供GLM-5.2;纳德拉提出’Token资本’理念重新定义企业AI护城河;Loop Engineering取代Prompt Engineering成为新范式;Google DeepMind发布AGI到ASI理论报告;HarnessX将Agent harness变为可进化工程系统。

June 15, 2026 · 3 min

Do Language Models Need Sleep? Offline Recurrence for Improved Online Inference 精读

深度精读马里兰大学与卡内基梅隆大学合著的「语言模型需要睡眠吗?」论文——受人类睡眠记忆巩固机制启发,提出离线循环(Offline Recurrence)机制:模型在’睡眠’阶段对累积上下文执行 N 轮离线反复遍历,将信息蒸馏为持久化快速权重(Fast Weights),然后清空 KV 缓存。在不增加在线推理延迟的前提下,成功解决常规 Transformer 和 SSM-Attention 混合模型均失败的多跳推理和数学推理任务。增加睡眠轮数 N 可以持续提升性能,且推理越深的样本获益越大(相关系数 r=0.92)。

June 15, 2026 · 5 min

【每日AI前沿追踪】2026年06月14日 核心技术与产业动态速递

6月14日AI前沿速递:亚马逊CEO Andy Jassy向白宫举报Anthropic Fable 5安全漏洞,美国政府随即实施出口管制,Fable 5/Mythos 5全面下线;智谱GLM-5.2全量开放1M上下文+下周开源,国产最强编码引擎;MiniMax M3开源109B参数块级稀疏注意力实现28.4倍计算削减;Databricks开源Omnigent多智能体元编排框架;OpenRouter Fusion API半价达Fable级智能;EvoArena揭示Agent在动态环境准确率仅39.6%。

June 14, 2026 · 3 min

【每日AI前沿追踪】2026年06月13日 核心技术与产业动态速递

6月13日AI前沿速递:亚马逊CEO与美官员会谈触发Anthropic Fable 5/Mythos 5全球封禁,Karpathy等非美籍用户被限制访问;Meta开始撤销20亿美元收购Manus交易;智谱GLM-5.2全量开放支持1M上下文并下周开源,ZCode 3.0搭载自研Agent内核;EvoArena以118票登顶HF日榜揭示Agent动态环境准确率仅39.6%;清华KEG×智谱AI EurekAgent以11美元发现26圆填充最优解;浙大×清华×MSRA WeaveBench揭示混合接口Agent能力严重不足。

June 13, 2026 · 2 min

【每日AI前沿追踪】2026年06月12日 核心技术与产业动态速递

6月12日AI前沿速递:美国政府以国家安全为由暂停Anthropic Claude Fable 5与Mythos 5对所有外国国民的访问;MiniMax开源M3模型109B参数支持1M上下文,提出块级稀疏注意力MSA实现28.4倍注意力计算削减;华为鸿蒙HarmonyOS 7正式发布,全面迈向Agent时代;Kimi开源K2.7-Code编码模型,推理token使用量降低30%;EvoArena提出Agent记忆演化基准,揭示当前Agent在动态环境中准确率仅39.6%。

June 12, 2026 · 2 min

Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference 精读

深度精读香港城市大学 × 微软亚洲研究院 RHO 论文——首个仅利用无标签历史轨迹实现 Agent Harness 全链路自监督优化的工作。从 Harness 工程概念补全、六项前序工作定位、自偏好估计的问题抽象、三阶段核心方法详解、必要知识反推到七条通用性灵感,全面拆解这项在 SWE-Bench Pro 上将通过率从 59% 提升至 78% 的开创性研究。

June 12, 2026 · 3 min

Role-Agent: 通过双角色自举实现 LLM 智能体-环境协同进化 精读

深度精读中科大 × 阿里AMAP团队 Role-Agent 论文——首个利用单一 LLM 同时扮演智能体与环境双角色,实现自举式协同进化的工作。从 Agent 强化学习背景补全、智能体-环境协同优化的研究脉络定位、双角色自举的问题抽象、WIA(世界内化于智能体)+ AIW(智能体内化于世界)双模块方法详解、必要知识反推到六条通用性灵感,全面拆解这项在 ALFWorld、WebShop、搜索增强QA 三大场景平均提升超 4% 的开创性研究。

June 12, 2026 · 5 min