ResearchStudio-Idea: An Evidence-Grounded Research-Ideation Skill Suite from ML Conference Outcomes 精读

大语言模型让研究构思变得容易,但有效的创意开发远不止生成候选方向。本文精读微软研究院与南洋理工合作的 ResearchStudio-Idea,一个面向研究构思’第一公里’的可复用技能套件。论文从 1,947 篇 ICLR/ICML/NeurIPS 论文中归纳出 15 个可复用的研究构思模式,将成功条件与失败模式配对成操作性卡片,并打包为端到端的 IdeaSpark 技能——在盲法自动评审中,IdeaSpark 在 88/100 个种子问题上质量排名第一,同时保持竞争性新颖性。

July 9, 2026 · 5 min

Harness Engineering for Self-Improvement 精读

Lilian Weng(Thinking Machines Lab 联合创始人、前 OpenAI 研究副总裁)在这篇万字综述中系统梳理了「Harness 工程」——围绕基础模型的运行时系统——作为通往递归自我改进(RSI)现实路径的核心命题。文章从 RSI 的思想起源讲起,把 Harness 定义为决定模型如何思考、规划、调用工具、管理上下文、评估结果的系统层,并梳理了三大设计模式(工作流自动化、文件系统持久记忆、子代理并行)、四大优化方向(上下文工程、工作流设计、自我改进、进化搜索)以及与模型权重的联合优化,最后坦诚列出七大瓶颈。本精读将这篇综述放在 RSI→Harness 的研究脉络中定位,提炼其方法论骨架与可迁移的普适灵感。

July 7, 2026 · 8 min

AI自进化的临界点:最快半年跑通一环闭环——与AppleX首席科学家谈RSI、验证、品味与发现模型

硅谷101两位主持人对话AppleX(陈天桥创立、公司名源自希腊语’证明与论证’)两位首席科学家Simon杜少雷与李贝兵。当Anthropic宣布约80%代码已由模型自己写、模型能完成的任务按人类时间每7个月翻一倍,‘递归自我提升(RSI)‘成了硅谷模型今年的必争之地。本文按主题整理,每主题含’新的变化’与’嘉宾观点与解释’,覆盖RSI为何今年爆发、长程任务的技术底座、递归漂移、验证与Agent Team、发现模型、品味为何是人类最后的不可替代性、自进化时间表与跑偏担忧,以及陈天桥与马斯克的风格差异,力求让未看视频的读者快速理解每个判断背后的推理。

July 6, 2026 · 2 min

当AI开始进化AI:递归自我改进的技术路线、关键瓶颈与终局图景

2026年,AI自进化(Recursive Self-Improvement)已从理论概念进入工业实践阶段。机器之心联合广大联查苏举办的主题沙龙’当AI开始进化AI’邀请了四位代表性技术专家,从具身智能的物理世界GPT时刻、大语言环境下的强化学习、脑启发的持续学习机制、到RSI的产业前沿,系统性呈现了AI如何自我超越的技术路线。本文从完整转写文本中提取所有关键信息,涵盖Anthropic内部80%代码已由Claude生成、从知易行难到知行合一的五维世界模型、灾难性遗忘的根本解法、以及全球RSI公司版图等核心议题。

June 26, 2026 · 2 min