真武是系统,不只是芯片:平头哥算力峰会上的超节点方法论

整理2026云栖大会平头哥算力峰会「云模之芯,共筑非凡」全场内容。平头哥副总裁李伟良梳理真武810E→M890→V900→J900的年度迭代节奏;阿里云王超给出「系统语义不在物理边界断裂」的真超节点判据;Kimi许欣然拆解100毫秒decode里的访存经济学;元戎启行曹通易与无界动力夏中谱讲物理AI的数据量级与快慢脑;圆桌与倚天CPU、磐脉920网卡两场把Agent时代的关键路径补完整。芯片竞争已从单卡指标转向系统协同。

September 24, 2026 · 1 min

RoboDawn:让通用 VLM 零训练接管机器人控制,以及 GPT-6 Astra 的零样本佐证 精读

以清华大学胡事民团队 RoboDawn 为主线精读:它用一套人类直觉的「语义原语接口」(离散平移/旋转/夹爪命令)把机器人控制暴露给 agentic VLM,配合无需参数更新的 in-context learning 与闭环决策,在 RoboTwin 2.0 上单样本 73.6% 成功率,超 HarnessVLA 的 58.4%。同日 RoboProbe 等发布的 GPT-6 Astra 在 RoboDojo 零样本 22.48% SR 登顶,却能力两极化(Precision 仅 4.00 vs DM0.5 16.75),为「通用大模型已具备机器人控制潜质、但精度是短板」提供独立佐证。

September 23, 2026 · 3 min

WorldCrafter:用隐式 3D 感知记忆打造可一致探索的视频世界模型 精读

深度精读腾讯 IEG ARC Lab 与北京大学联合提出的 WorldCrafter。它用一个「隐式 3D 感知记忆」模块让视频世界模型在长时间、可自由探索的交互中保持场景一致性:以 LagerNVS 初始化记忆编码器、用姿态引导读出、与视频 DiT 联合训练,配合最大覆盖历史检索与少步蒸馏,在 4 卡上达到 16fps 实时。重访一致性 LPIPS 从 Lyra 2.0 的 0.487 降到 0.255,相机控制旋转误差 13.536 为全场最低。

September 23, 2026 · 3 min

机器人 Scaling Law 出现了吗?——徐梦迪的答案:有信号,但真正的分水岭是 in-context learning

清华叉院助理教授徐梦迪在「十字路口」提出:具身领域已出现预训练数据从十万到百万小时、held-out loss 随规模下降的 scaling 信号(如 Dyna-2 百万小时人类视频预训练),但 loss 与真机成功率脱钩,真正有意义的是『未见任务成功率随规模上升』的 scaling law;她判断当前主流 VLA 的『预训练+微调』范式对应 GPT-1 时刻,期待的是通过 prompting 适应个体偏好的 GPT-3 时刻。本文拆解她论证中的证据链、与世界模型路线的关系,以及数据定义由模型能力反推的行业机制。

September 21, 2026 · 2 min

JEPA-Anything: Learning Predictive Models across Different Worlds 精读

世界模型至今一域一模型:视觉用 V-JEPA、细胞用 Cell-JEPA、控制用 Dreamer——能否用一个学习原理统治所有’世界’?PhAI Labs 联合八机构的 JEPA-Anything 提出正交预测因子分解(OPF):把 JEPA 的单一目标嵌入拆成 K 个正交子空间各配专属预测头,再用伪逆合成完整潜状态。同一核心横跨视觉、单细胞、临床、控制、分子动力学、PDE、天气七域,10 项动力学任务全胜匹配 JEPA 基线,Interventional Pong 单干预误差降 34.8%,四分子系统 100 步 rollout 全部最低误差;因子坐标提名的 IL-18+CD73 联合干预在类器官与小鼠实验中获得验证,轨道潜模式恢复开普勒指数 -1.4991。

September 20, 2026 · 3 min

ActionPiece 精读:用『物理秩一致性』拯救动作 tokenization 的关系保真

华中科大×DeepCybo 等七机构联合提出 ActionPiece:自回归 VLA 模型的动作 tokenizer 传统上只用 MSE 评估重建精度,但点态误差小不等于关系保真——压缩后『不同情境所需的差异化动作』可能被压缩、扭曲甚至反转。论文提出 Physical Rank Consistency(PRC)度量局部物理距离排序的保持,并通过对表示学习与量化的联合监督(物理秩保持+量化正则)让离散 token 保留连续动作空间的局部序结构。同一 Qwen3-VL-4B 策略训练设置下:LIBERO 94.8%、未见 LIBERO-Plus 68.8%、SimplerEnv 71.9%。

September 18, 2026 · 2 min

大脑归基模,小脑归自己:24 岁首席科学家王家伟的具身下注

GPT-6 Astra 直接驱动机械臂刷屏、‘基模降维打击具身’之说盛行的当口,深朴智能首席科学家王家伟(24 岁,少年班—MSRA—DeepSeek—Seed 路径)给出分层答案:大脑已收敛给基模,实时可控的动作模型与场景数据闭环仍是创业公司的自留地。本文梳理他的数据性价比账、zero-shot 泛化信号与具身评估真空里的噪音辨别,并给出可迁移的判断框架。

September 17, 2026 · 2 min

具身智能的四条路线分歧:数据、Astra 与商业化的真问题

2026 外滩大会圆桌实录:苏度韩铮、蚂蚁灵波沈宇军、自变量王潜、破壳许华哲四位一线创业者正面回答具身智能三场路线之争——仿真还是真机、GPT-6 Astra 是否构成降维打击、跨过泡沫的指标是什么。共识是具身不会复刻语言模型路径,分歧在数据从哪来、智能住在哪里、钱从哪来。

September 14, 2026 · 1 min

Memory as Plans 精读:把记忆从执行期条件重构为规划期证据,机器人非马尔可夫任务 SOTA

哈工大×NTU×山大提出 MaP-WAM:将记忆依赖的世界-动作建模拆解为记忆锚定规划与计划条件执行两层——情景区段记忆作为规划期证据,因果世界模型(WAN-2.2-5B 微调)生成视觉计划,World-Action-Progress 模型把任务进度升级为一等模态。RMBench 83.3% SOTA、真机 78.0%,执行器延迟随历史增长恒定;Swap T/Press Button 达 96%。

September 13, 2026 · 1 min

Recursive Code World Models 精读:global-local-global 递归构造可执行 3D 世界

佐治亚理工提出 RCWM:从单张参考图重建复杂 3D 世界为可执行场景代码。核心是递归场景程序(RSP)表示 + 自递归构造求解器——每次调用遵循建立整体→递归重建未解部分→回访整体精炼组合的 global-local-global 循环,参考对齐视图跨层级传播共享相机投影,父级回访修正局部精炼后浮现的边界错误。三级递归较固定二级 whole-frame PSNR 16.8→19.0、local SSIM 0.52→0.60,全面超越 image-to-scene-program 基线。

September 13, 2026 · 1 min