ResearchStudio-Reel: Automate the Last Mile of Research from Paper to Poster, Video, and Blog 精读

微软研究院的 ResearchStudio-Reel 把论文传播的"最后一公里"——海报、演讲视频、双语博客——重构为五个可组合技能。它用一次共享提取替代三次重复读论文,用硬性渲染门控替代软性美学打分,用可编辑的 PowerPoint/Word 替代只读 PDF。在 100 篇论文基准上,它生成的海报美学评分甚至超过了作者本人手绘的海报,在 84%-93% 的论文上获胜,并且是目前唯一同时交付三种可编辑传播产物的流水线。

July 9, 2026 · 3 min

Harness Engineering for Self-Improvement 精读

Lilian Weng(Thinking Machines Lab 联合创始人、前 OpenAI 研究副总裁)在这篇万字综述中系统梳理了「Harness 工程」——围绕基础模型的运行时系统——作为通往递归自我改进(RSI)现实路径的核心命题。文章从 RSI 的思想起源讲起,把 Harness 定义为决定模型如何思考、规划、调用工具、管理上下文、评估结果的系统层,并梳理了三大设计模式(工作流自动化、文件系统持久记忆、子代理并行)、四大优化方向(上下文工程、工作流设计、自我改进、进化搜索)以及与模型权重的联合优化,最后坦诚列出七大瓶颈。本精读将这篇综述放在 RSI→Harness 的研究脉络中定位,提炼其方法论骨架与可迁移的普适灵感。

July 7, 2026 · 8 min

Token Maxing退潮,Agent开始干活——亚马逊云科技中国峰会探展复盘

2026年过半,AI产业从年初"Token Maxing"的狂热转向"Token Minimizing"的理智。本期《硅谷101》走进亚马逊云科技中国峰会,实地探访AI在短剧出海、金融量化、药物研发、游戏开发、端侧硬件与安全攻防等领域的真实落地——不再是PPT,而是已经在产生价值的业务。

July 7, 2026 · 1 min

Verbalizable Representations Form a Global Workspace in Language Models 精读

Anthropic团队在Claude模型内部发现了一个类似人脑全局工作空间的特权表示子空间——J-space。它由一小撮不断演变的’未说出的词语’组成,仅占激活方差不到10%,却承担着言语报告、内部推理、灵活泛化和自我监控的核心功能。本文深度解析Jacobian Lens技术、J-space的五个功能属性、以及反事实反思训练这一全新对齐范式。

July 7, 2026 · 4 min

AI自进化的临界点:最快半年跑通一环闭环——与AppleX首席科学家谈RSI、验证、品味与发现模型

硅谷101两位主持人对话AppleX(陈天桥创立、公司名源自希腊语’证明与论证’)两位首席科学家Simon杜少雷与李贝兵。当Anthropic宣布约80%代码已由模型自己写、模型能完成的任务按人类时间每7个月翻一倍,‘递归自我提升(RSI)‘成了硅谷模型今年的必争之地。本文按主题整理,每主题含’新的变化’与’嘉宾观点与解释’,覆盖RSI为何今年爆发、长程任务的技术底座、递归漂移、验证与Agent Team、发现模型、品味为何是人类最后的不可替代性、自进化时间表与跑偏担忧,以及陈天桥与马斯克的风格差异,力求让未看视频的读者快速理解每个判断背后的推理。

July 6, 2026 · 2 min

走进中国AI实验室:Nathan Lambert的中美AI观察——开源领导权转移、算力困局与人才文化差异

美国AI2实验室大模型负责人、开源AI领域最具影响力的研究者之一Nathan Lambert,2026年4月专程赴中国考察北京、杭州的AI实验室——阿里巴巴、智谱、月之暗面、清华、小米、美团、蚂蚁、零一万物等。回到美国后他写下了引发广泛讨论的文章。这期硅谷101播客中,Nathan分享了第一手观察:中国为何在大公司AI战略上走出了与美国截然不同的路线?开源模型领导权是否已经从美国转移到中国?华为芯片能否替代NVIDIA?中美AI人才和文化差异如何影响模型构建?本文从8大主题完整梳理,每个主题以"新的变化"+“嘉宾观点与解释"双维度展开,让没看过原视频的读者也能快速理解背后的推理逻辑。

July 3, 2026 · 1 min

Agent元年前500天:Headless软件、CLI开放与Skill经济的全面爆发

整理自「此话当真×十字路口」联合节目,真格基金投资总监天杰(Jack)与归藏(张师傅)回顾Agent元年前500天的六大关键词:Headless无头软件、CLI命令行接口、Skill技能经济、Agent Economy智能体经济、OpenClaw共识塑造、Token Grant创业赞助。两人从投资人、创作者和重度用户的三个视角,深入讨论了GUI思维软件为何不再值得投资、消费级产品为何竞相开放CLI、Skill的商业价值被严重低估,以及下一个"抖音"可能是十倍产能的抖音而非全新形态。

July 2, 2026 · 1 min

Agent新范式圆桌:从Prompt到Loop的演进逻辑、潜空间通信与验证之困

整理自机器之心AI技术活动的圆桌对话。嘉宾包括中国人民大学张少林、清华大学李佳、西湖大学张弛、华为诺亚方舟实验室Agent专家开国。四位嘉宾围绕"Agent是否出现了新范式"展开讨论,梳理了从Prompt→Context→Harness→Loop的概念演进逻辑——这并非范式革命,而是模型能力与任务复杂度之间"不对等关系"持续再平衡的结果。讨论还深入了Agent核心工作单元的变化、多Agent通信从语言走向潜空间的学术前沿及其黑箱化风险、自进化Agent的火与限界,以及Loop模式下验证困难度急剧上升的现实挑战——尤其是在代码生产场景中,AI凌晨提交万行commit时人类是否敢于直接合入的核心困境。

July 2, 2026 · 2 min

Agent进化的四个层级:从知识更新到工作流自我设计——西湖大学张驰解读智能体动态架构

整理自西湖大学张驰在「即兴之星」活动上的学术报告。张驰将Agent的"进化"拆解为四个递进层级——知识进化(Text-to-SQL的探索-部署范式)、经验进化(App Agent的自动生成说明书)、动作进化(App Agent X的高维Action涌现)、架构进化(Learning to Be a Doctor的Agent自优化工作流)。核心主张:真正的进化不是模型参数变大,而是让Agent像人一样,通过积累知识、形成肌肉记忆、涌现高维动作、最终自我设计工作流来不断迭代。报告还分享了GUI Agent不应靠微调实现泛化、RPA与Agent的融合思路、以及"用Agent优化Agent"这一神经架构搜索思想在Agent时代的回归。

July 2, 2026 · 2 min

拆解Claude Code源码泄露:Agent Harness三层架构、记忆机制与零人公司的未来

Claude Code源代码泄露后,Agent Harness的关键模块被完整呈现出来,成为最好的教学样本。本期「十字路口」邀请到Learn Claude Code教程(GitHub超5万星)作者、CLAI创始人来新璐,从Harness的三层架构(执行能力层、上下文环境层、治理编排层)到底层设计哲学,深入拆解Claude Code的沙箱环境、记忆「做梦」机制、上下文压缩策略,以及从LangChain到Agent Runtime的范式迁移。来新璐还分享了他对CLI vs MCP之争的判断、Agent Harness赛道的创业格局,以及一个令人兴奋又有些可怕的未来图景——零人公司。

July 1, 2026 · 2 min