富二代为小六做Steam游戏:一场古典闹剧,与独立游戏开发者的真实生存图鉴

基于独立游戏开发者炒饭(橘子班)8月8日直播整理。一位北方富三代为了取悦被包养的’五太太’——一位有’明星梦’的前小主播——专程飞到武汉请炒饭策划一款Steam恋爱模拟器,复刻了’煤老板投资影视剧塞小三’的古典套路。炒饭婉拒深度参与,只提供策划建议,并预言项目八成做不出来。这场闹剧之外,直播还触及了独立游戏圈的几条真实生存逻辑:旧作免费更新以规避粉丝期待落差、国产Galgame因个体户属性反而不怕节奏攻击、AI做游戏前期有用但debug是地狱、矿卡逆势涨价折射的硬件市场畸形。

August 10, 2026 · 1 min

730会议与二季度4.3%:地方躺平,中央催钱,存量即增量

2026年二季度GDP仅4.3%,730政治局会议通稿删除了"跨周期"表述、回归"逆周期",并首次提出"加快财政支出和债券资金使用进度"。这并非简单的政策微调——它暴露了中央与地方之间激励传导断裂的结构问题:上半年存量资金大量闲置,下半年可用资金同比多出约两万亿,存量政策本身就成了最强的"增量"。但反腐、政绩观学习、地方换届等因素能否在下半年打通堵点,仍是最大悬念。

August 7, 2026 · 1 min

RSI比Coding Agent大得多:对话田渊栋,递归自进化为什么是阶段式突破而非渐进攀升

前Meta FAIR研究员田渊栋创立Recursive Superintelligence(A轮6.5亿美元,估值46.5亿美元)后首次系统阐述RSI:它比coding agent大得多、难得多;完全自动化不会很快发生,递归会先发生;智能发展是S型曲线而非scaling law的平滑攀升,这恰恰给了初创公司窗口。他们的第一阶段成果在算子优化、NanoChat训练和NanoGPT SpeedRun三个方向取得SOTA,用一套通用系统击败了专业GPU团队。田渊栋认为AI终将从炼金术变成化学,可解释性是少数派但正确的路。

August 7, 2026 · 1 min

一片晶圆的赌局:Cerebras如何从 Scaling Law 的实验室走向千亿推理市场

硅谷101专访Cerebras早期投资人周南、前百度研究员Greg Diamos及产品高管Angela,复盘这家"晶圆级引擎"公司十年史。从百度三亿参数模型发现Scaling Law、2016年赌注式投资、良率工程突破,到G42订单、OpenAI两百亿美元推理合同、千亿市值IPO,文章梳理了Cerebras如何从一个物理学的疯狂赌注,变成推理时代绕开HBM与CoWoS瓶颈的差异化基础设施,以及上市后毛利率、供应链和客户自研芯片带来的真实风险。

August 7, 2026 · 1 min

高盛2026亚太展望:中国经济为何仍在「失衡」——出口撑增长、房地产未见底、养儿防老逻辑逆转

高盛亚太首席经济学家Andrew Tilton团队发布2026年经济展望,核心判断是中国经济「仍将失衡」:外需强内需弱、供强需弱延续,出口仍是GDP核心驱动力,房地产快速下行阶段已过但未触底,政策「托而不举」,居民从「养儿防老」转向「预防性储蓄」。本文基于老厉害对研报图表的逐张拆解,梳理供需分叉的成因、出口韧性的来源、房地产去库存的困境,以及人口与储蓄行为范式转变的深层含义。

August 7, 2026 · 1 min

特修斯之船:Kimi K3如何把Transformer的零件全部换掉,还能逼近前沿

月之暗面K3是首个达到3T级别的开放权重模型,其47页技术报告揭示了一种"特修斯之船"式的架构哲学:注意力改成了线性+全局混合(KDA+MLA),残差变成了深度方向的Attention,FFN变成压缩空间的稀疏专家,甚至连位置编码都几乎被删掉。RadixArc创始成员赵晨阳和华盛顿大学博士生曾志远分别从Infer和算法两条线拆解K3:线性注意力在2.8T规模上实现了6.3倍解码加速,Quantile Balancing路由是3T稳定训练的关键之一,MOPD让九个领域专家模型高效合板,而KDA(Kernel Development Agent)证明RSI已在kernel优化领域高速运转。核心判断:权重只是一次训练的产物,环境才是能反复产出下一代权重的护城河。

August 6, 2026 · 1 min

Infra 的浪漫与 AI 平权:盛颖从 SGLang 到 RadixArk

SGLang 发起人、前 xAI 推理负责人盛颖在 101 视频播客中讲述了从斯坦福形式化验证到 xAI 推理系统、再到创立 RadixArk(1 亿美元种子轮)的完整路径。她提出 Infra 不应是 support 角色,而应成为产品本身;RadixArk 的使命不止于推理引擎,而是让所有人拥有制造 AI 的能力。文章梳理了推理引擎的竞争格局、开源社区的商业化困境,以及一位女性研究者在技术圈中的真实体验。

August 3, 2026 · 2 min

29岁空降改造腾讯混元:信任换来的不是模型,而是一支新军队

晚点记者高宏浩详述姚顺雨加入腾讯混元300天:这位29岁的OpenAI前研究员没有亲自下场做技术,而是用老板最信任的窗口期迅速换血关键岗位、重建infra、推动模型与产品深度绑定。但腾讯的联邦制基因、微信与混元的数据孤岛、以及算力硬约束,让这场改革的真实考验还在后面——当信任周期的红利耗尽,能否拿出第一梯队的模型才是生死线。

August 2, 2026 · 1 min

何谓蒸馏?硅谷如何看中国开放模型逼近前沿

月之暗面K3开源权重发布震动硅谷,开源模型首次在多项能力上追平甚至超越最强闭源前沿模型。两位嘉宾——前Hugging Face开源生态负责人王铁镇和TinyFace联合创始人TJ——深度拆解了"蒸馏"争议的技术真相、中国开源模型为何成本更低、Kimi License商业模式对闭源实验室估值体系的冲击,以及开源模型安全之争的真正焦点。核心判断:没有开源,才是这个时代最不安全的事情。

August 1, 2026 · 1 min

GPU其实很闲:AI Infra四层架构与榨干硅极限的效率革命

当AI行业的重心从训练转向推理,一个被忽视的事实浮出水面:GPU大多数时间其实很"闲"。Azure推理负载高达65%的能耗消耗在空转等待上,OpenAI的Chat类请求也达到52%。本文基于硅谷101播客,系统梳理AI Infra四层架构,拆解SGLang/vLLM等开源推理引擎如何通过KV Cache复用、连续批处理、PD分离、投机采样、强化学习训练框架MegaScale等技术,把GPU利用率从50%推向90%+——软件层的每一次优化都变成直接的商业问题。

July 31, 2026 · 1 min