SimpleMemVLA:不做记忆模块的具身记忆——原生视频上下文的范式反转 精读

HUST×清华×面壁智能等推出 SimpleMemVLA:去掉检索/压缩/循环等专门记忆模块,把完整采样历史以时间戳视频格式直接喂给 VLM 主干,子任务隐藏状态作为唯一记忆通道。四个记忆基准全部 SOTA(RoboMME 88.3% vs 检索 31.5%/压缩 22.6%/循环 20.6%,真值感知上限也仅 84.1%),通用控制无损(LIBERO 97.5%),因果干预证实策略真实读取历史。

September 9, 2026 · 2 min

Random Attention 精读:KV 缓存驱逐的选择信号几乎买不到任何东西

Salesforce AI Research×UIUC 的 Random Attention 证明:长推理场景下 KV 缓存驱逐的’重要性打分’几乎无用——在每个注意力头内均匀随机驱逐、完全不计算分数,即可在 4 个模型×6 个推理任务上匹配最强选择器,且在 vLLM 分页 serving 下因省去打分 pass 快 32–43%。本文基于全文阅读拆解其三层机制解释与实验设计。

September 5, 2026 · 2 min