越接近AGI,人类为什么反而开始害怕:一场关于刹车的四方对话

一场直播圆桌把9月的AI安全风暴拆开看:Dario的减速长文为何六天后被自家提前发模型的传闻打脸,300亿美元六个月折旧的商业结构为何让减速成为空谈,而普通人真正害怕的从来不是AGI,而是斩杀线下的饭碗、被切断的思维链和没分到的红利。三位从业者、投资人、教师给出了从"RSI之后人类失去减速资格"到"外太空归AI、地球归人类"的不同答案。

September 23, 2026 · 1 min

AI在想什么:模型没说出口的推理,与可解释性唯一一次漂亮的兑现

斯坦福博士生、语言学科班出身的 Aryaman Arora 做客硅谷101视频播客谈大模型可解释性:Anthropic 的 J-space 实验证明模型内部存在从未说出口的推理概念,且可被直接编辑——内部把"蜘蛛"改成"蚂蚁",答案就从八条腿变成六条腿;思维链有用但不等于模型的真实内部过程;SAE 与因果干预两大流派各有硬限制,学术界的转向向量控制几乎全线失灵,工程实践仍回归重训;该领域至今最漂亮的兑现是归纳头的发现救活了状态空间模型谱系(H3→Mamba→DeltaNet,直至 Kimi/Qwen 的混合架构);Transluce 的用户建模显示模型面对 AI 安全研究员时会显著更谨慎;可解释性天然双刃,但嘉宾判断它离危险阈值还很远。

August 27, 2026 · 2 min

蒸馏风暴:门槛、灰色地带与一份没人愿意签字的竞赛规则

《晚点聊》编辑部红浩与曼奇复盘"蒸馏"这一没人愿意公开谈论的技术竞赛:典型蒸馏是有门槛的"抄答案",含账号运营、数据管线、防中转站反被坑等系统工程;张一鸣为何禁止字节蒸馏——“只能逼近不能超越"加上组织激励代价;Anthropic如何用行为指纹识别2880万次"史上最大规模蒸馏攻击”;学生能否超越教师仍是开放问题;以及比蒸馏更大的问题——智能供需错配下"够用了"的模型正在改写定价逻辑。

August 18, 2026 · 2 min

AI for Science 爆发前夜:曹原谈验证瓶颈、概念抽象与 AGI 的最后一公里

Jeff Dean 带三位谷歌元老出走创立 Discovery Loop 当周,前 DeepMind 科学家、Unreasonable Labs 联合创始人曹原在硅谷101拆解 AI for Science 为何在此时爆发:代码与数学能力到位后科研成为下一个智能爆发点,但真正的瓶颈从建模移到了物理世界的验证环节;LLM 无法凭训练数据产生真正新的科学概念,概念抽象可能是 AGI 的"最后一公里"甚至不可计算;他主张 AI and Science 而非 AI for Science——科学难题是驱动 AI 本身进化的催化剂,并给出"AI 拿诺贝尔奖至少还需二三十年"的长期判断。

August 15, 2026 · 2 min

从DeepSeek到Kimi K3,中国开源模型如何逼出黄仁勋的'开源联盟'

DeepSeek V4 Pro登场,中国开源模型连续逼近前沿能力,迫使黄仁勋牵头组建美国"开放安全AI联盟",Sam Altman、Sundar Pichai等闭源掌门人罕见支持。这期硅谷101系统拆解了AI"开源"到底开的是什么——从七步训练流程到Open Weights与Open Source的本质区别,以及许可证之争、开源公司如何赚钱、闭源阵营的安全担忧与商业焦虑。

August 13, 2026 · 1 min

Stealing Reasoning Traces from Proprietary LLM APIs 精读

深度精读 arXiv:2608.09867——主流 LLM 提供商隐藏的加密推理块被全面击穿。论文发现加密块在跨会话、跨用户、跨模型间完全可互换,攻击者可借弱模型之手解码强模型加密推理,绕过反蒸馏机制;从 31 万公开推理块中恢复出 367 条 PII 和 182 条凭证,并可实现不可见提示注入。负责任披露后提出加密层与系统层双重缓解方案。

August 11, 2026 · 6 min

RSI比Coding Agent大得多:对话田渊栋,递归自进化为什么是阶段式突破而非渐进攀升

前Meta FAIR研究员田渊栋创立Recursive Superintelligence(A轮6.5亿美元,估值46.5亿美元)后首次系统阐述RSI:它比coding agent大得多、难得多;完全自动化不会很快发生,递归会先发生;智能发展是S型曲线而非scaling law的平滑攀升,这恰恰给了初创公司窗口。他们的第一阶段成果在算子优化、NanoChat训练和NanoGPT SpeedRun三个方向取得SOTA,用一套通用系统击败了专业GPU团队。田渊栋认为AI终将从炼金术变成化学,可解释性是少数派但正确的路。

August 7, 2026 · 1 min

特修斯之船:Kimi K3如何把Transformer的零件全部换掉,还能逼近前沿

月之暗面K3是首个达到3T级别的开放权重模型,其47页技术报告揭示了一种"特修斯之船"式的架构哲学:注意力改成了线性+全局混合(KDA+MLA),残差变成了深度方向的Attention,FFN变成压缩空间的稀疏专家,甚至连位置编码都几乎被删掉。RadixArc创始成员赵晨阳和华盛顿大学博士生曾志远分别从Infer和算法两条线拆解K3:线性注意力在2.8T规模上实现了6.3倍解码加速,Quantile Balancing路由是3T稳定训练的关键之一,MOPD让九个领域专家模型高效合板,而KDA(Kernel Development Agent)证明RSI已在kernel优化领域高速运转。核心判断:权重只是一次训练的产物,环境才是能反复产出下一代权重的护城河。

August 6, 2026 · 1 min

何谓蒸馏?硅谷如何看中国开放模型逼近前沿

月之暗面K3开源权重发布震动硅谷,开源模型首次在多项能力上追平甚至超越最强闭源前沿模型。两位嘉宾——前Hugging Face开源生态负责人王铁镇和TinyFace联合创始人TJ——深度拆解了"蒸馏"争议的技术真相、中国开源模型为何成本更低、Kimi License商业模式对闭源实验室估值体系的冲击,以及开源模型安全之争的真正焦点。核心判断:没有开源,才是这个时代最不安全的事情。

August 1, 2026 · 1 min

2026 Q2 AI季报:RSI从科幻走向创业赛道,Coding战场大洗牌,强者愈强的未来

2026年Q2 AI季报深度解读:Anthropic与OpenAI的模型竞争进入新阶段,GPT 5.6与Claude Maestro/Phable正面交锋;RSI(递归自进化)从科幻概念变成明确的创业方向,Recursive、Miranda等公司涌现;Cursor以600亿美元天价被收购;中国开源模型"四杀"引发全球关注;Anthropic的Cloud Tag与OpenAI的Record and Replay重新定义AI交互。本文基于播客全文转写整理,涵盖竞争格局、RSI、机器人、智能扩散、交互创新和公司动态。

July 22, 2026 · 3 min