【每日AI前沿追踪】2026年09月30日 核心技术与产业动态速递
September 30, 2026 · 12 min
AI娱乐的版本答案还没出现:从猫箱到动念引线,梁琛奇推演“烧token的新平台”
September 30, 2026 · 1 min
CAMG × Comet-9B:文件即记忆与程序状态推理的 Agent 训练新范式 精读
September 30, 2026 · 7 min
CoDeL × ReproBench:智能体安全的攻防共进化与漏洞复现评估 精读
September 30, 2026 · 3 min
CodeSkill × NanoHarness:技能抽象与 Harness 效应——被低估的智能体性能杠杆 精读
September 30, 2026 · 6 min
Codoku × SecProbe:可再生谜题与自适应出题的评估方法学双星 精读
September 30, 2026 · 4 min
Diffusion Reward Models × SOLO:成熟技术的首次规模化双案例 精读
September 30, 2026 · 9 min
EAPO × DN-MOPD × d-OPD:大模型训练信号的三个盲区与最小修正 精读
September 30, 2026 · 5 min
Encoder-Free Scaling Laws × UMM-Reflection:统一多模态模型的架构与反思双问 精读
September 30, 2026 · 6 min
Failure-Transparent Agents × FCD × CoSec:智能体安全的三个新失效面 精读
September 30, 2026 · 8 min
Gagar × SWE-MILE × CRR:代码智能体强化学习的细粒度信用分配三重奏 精读
September 30, 2026 · 6 min
Imprint Reader × ATD:权重更新与行为影子之间的双向桥 精读
September 30, 2026 · 6 min
MassAlloc Attention × DaRoPE:注意力计算分配与位置编码的双子星重构 精读
September 30, 2026 · 6 min
Opera × CER:长程编码智能体的评论家介入与早期奖励预测 精读
September 30, 2026 · 5 min
RepoReuse × VulContextBench:代码智能体的复用行为与安全证据审计 精读
September 30, 2026 · 9 min
SEABench × Audit the Scaffold × REUSE:递归自我改进的测量、理论与统计三重保障 精读
September 30, 2026 · 12 min
Self-Evolving Coding Agents × RE-0:从数字程序到物理世界的自进化智能体 精读
September 30, 2026 · 7 min
Skill2Env × QwenGyre × AgentPerfBench:智能体强化学习的数据、系统与推理三层基建 精读
September 30, 2026 · 8 min
SWE-Game × CUA-SWE:软件工程基准的游戏化与视觉化扩展 精读
September 30, 2026 · 5 min
TraceDance × Maintaining Benchmarks:Agent 行为基准的构建与作弊治理 精读
September 30, 2026 · 3 min
WideSWE × AsynCodeBench × RepoMAS:超越单仓库的软件工程智能体三重维度 精读
September 30, 2026 · 7 min
超级厄尔尼诺与大宗商品:一位期货研究员的供给冲击分析框架
September 30, 2026 · 1 min
【每日AI前沿追踪】2026年09月29日 核心技术与产业动态速递
September 29, 2026 · 8 min
Agent 安全攻击面三重奏精读:仓库红队、CoT 明文越狱与类型化决策投毒
September 29, 2026 · 11 min
FuseReg: Regularizing Layer Fusion Mitigates the Reconstruction-Generation Gap in Representation Autoencoders 精读
September 29, 2026 · 7 min
MoMHa 与 SkillEvoReg 精读:Agent 资产的优化与正则
September 29, 2026 · 9 min
New LoRA Skills Should Read but Never Write 精读
September 29, 2026 · 6 min
Stealth Apart, Harm Together: Skill Cascading Attacks on Skill-Based Agent Systems 精读
September 29, 2026 · 5 min
Up and Down the Abstraction Ladder: Code-Based Skills for Language Agents 精读
September 29, 2026 · 6 min
WeEnv: The Environment for Agentic Reinforcement Learning at WeChat 精读
September 29, 2026 · 6 min
编码智能体经济学三重奏精读:成本行为、紧凑文档与上下文蒸馏
September 29, 2026 · 13 min
训练机制三重奏精读:对数线性稀疏注意力、置信度停止与跨段信用分配
September 29, 2026 · 9 min
证据时效性二重奏精读:过期文档投毒与分层协作记忆
September 29, 2026 · 4 min
评测与治理三重奏精读:多智能体协作、搜索后综合与执行控制
September 29, 2026 · 11 min
递归自改进的能力与安全双螺旋精读:DCE 自蒸馏与演化安全框架
September 29, 2026 · 7 min
【每日AI前沿追踪】2026年09月28日 核心技术与产业动态速递
September 28, 2026 · 5 min
Chat Template 像「开关」一样切换 LLM 的自我指涉语气 精读
September 28, 2026 · 4 min
PrimeScientist:让自主研究智能体学会战略性分配研究努力 精读
September 28, 2026 · 4 min
出题、卖题、判卷:AI数据行业的权力、红线与瓶颈
September 28, 2026 · 2 min
当VC合伙人转身去做儿童情绪课:于红谈AI时代到底该学什么
September 28, 2026 · 1 min
特斯拉FSD十三年:抠门老板、瞒报危机与端到端豪赌
September 28, 2026 · 1 min
【每日AI前沿追踪】2026年09月27日 核心技术与产业动态速递
September 27, 2026 · 6 min
AI 智能体行为的水印税与全模态 harness 双精读:Provenance Tax × Qwen3.8-Omni-Flash
September 27, 2026 · 7 min
Harness as a Language: A Minimalist Agent Framework With Maximal Expressivity 精读
September 27, 2026 · 5 min
Just-in-Time Memory: Learning to Curate Task-Adaptive Memory for LLM Agents 精读
September 27, 2026 · 4 min
Learning to Discover Interesting Mathematics 精读
September 27, 2026 · 4 min
【每日AI前沿追踪】2026年09月26日 核心技术与产业动态速递
September 26, 2026 · 9 min
Agent-Editing World Model 精读
September 26, 2026 · 7 min
Training Object Permanence in World Models 精读
September 26, 2026 · 6 min
内核证据检测与记忆家族隔离:Agent 基础设施二重奏精读
September 26, 2026 · 9 min
审批洗白、钱包拒绝服务与自主科研作弊:Agent 安全经济学三重奏精读
September 26, 2026 · 10 min
校准决策模型检测对齐失败与 Agent 轨迹防篡改:二重奏精读
September 26, 2026 · 7 min
环境演化、跨图溯因 SWE 与 AI 主导模型开发:RSI 三重奏精读
September 26, 2026 · 9 min
线性叠加、闭环 AI-for-AI 与角色解耦搜索:三篇前沿 Agent 论文精读
September 26, 2026 · 8 min
编码智能体规划、信任原生 Agent OS 与开源后训练配方:三篇系统论文精读
September 26, 2026 · 8 min
视觉编码基准与内核级失控遏制:PPTBench 与 Hard Stop 精读
September 26, 2026 · 10 min
【每日AI前沿追踪】2026年09月25日 核心技术与产业动态速递
September 25, 2026 · 7 min
ChronosAttack: Adversarial Tool Scheduling Attacks on LLM Agents 精读
September 25, 2026 · 5 min
Delegated Misalignment: How Multi-Agent Structures Amplify LLM Safety Risks 精读
September 25, 2026 · 5 min
Harness as a Language×Bounded Loops:Agent 脚手架的语言化与可验证化 精读
September 25, 2026 · 7 min
Just-in-Time Memory×EnSIMem:智能体记忆的读时策展与实体索引 精读
September 25, 2026 · 5 min
PACT: From Credit Assignment to Critic Alignment 精读
September 25, 2026 · 7 min
Schrödinger’s Code Repository: Have LLMs Learned SWE-bench or Memorized It? 精读
September 25, 2026 · 5 min
SkillApt×TwinCheck:技能何时加载与调用如何验证——反事实证据的双重应用 精读
September 25, 2026 · 8 min
SkillGym×VHD-Play:技能与环境从「外挂」到「内化」的两条路线 精读
September 25, 2026 · 8 min
StateComp×PaMER:长程智能体的历史压缩时机与记忆控制信号 精读
September 25, 2026 · 7 min
WhatWorkedBench: Benchmarking Experimental Understanding in AI Agents 精读
September 25, 2026 · 6 min
控制 token 注入×工具缓存逆转:Agent 安全与训练基础设施的两个隐蔽失效面 精读
September 25, 2026 · 7 min
「会说」到「会做」,隔着一天三百万的纠错账:云栖2026高德技术峰会复盘
September 24, 2026 · 1 min
【每日AI前沿追踪】2026年09月24日 核心技术与产业动态速递
September 24, 2026 · 4 min
22万部上新与0.047%爆款率:AI短漫剧的工业化拐点到了吗——云栖2026分论坛全记录
September 24, 2026 · 1 min
64%的企业在生产环境用AI,达标的只有4%:德勤云栖论坛的诊断——卡住企业的不是模型,是语义、流程和责任
September 24, 2026 · 2 min
7B模型挤进闭源效果区、8块钱的翻唱与六个人的偶像工厂:云栖2026视听生成专场复盘——当创作被批量供给,稀缺的成了故事与判断
September 24, 2026 · 4 min
88%的企业都在规模化上AI,只有14%拿到价值:云栖2026埃森哲专场复盘——卡住企业的不是模型,是数字核心
September 24, 2026 · 4 min
90%的东南亚企业要上AI智能体,先把POC逼进生产——云栖2026东南亚论坛复盘:卡住落地的不是模型,是通向生产的那条路
September 24, 2026 · 5 min
Agent 聪明之后,卡住企业的是数据:云栖2026『为 Agent 重塑 Data Agent 生态』论坛复盘
September 24, 2026 · 3 min
Agent 越能干,越等不起:云栖2026「AI实时数据智能」论坛复盘——卡住生产级 Agent 的不是模型,是数据的实时性、语义与断点
September 24, 2026 · 4 min
Agent的确定性从哪来:全栈平台与草台班子的双向奔赴
September 24, 2026 · 1 min
Agent越自主,越不能靠它自觉:云栖2026「从Demo到生产」论坛复盘——确定性是工程出来的,不是模型许诺的
September 24, 2026 · 2 min
AI十分钟改完合同之后,法律行业卖的还是判断:云栖2026「数智法途」法务论坛全景复盘
September 24, 2026 · 2 min
AI只答对22%的空间题:高德把二十年地图改成「数据不出域」的生意,千舆用三层证据链换到78分
September 24, 2026 · 1 min
AI重构跨境电商:先被改写的不是技术,而是工序、账本与决策权
September 24, 2026 · 1 min
一万个因子里挑出一个好策略,是金矿还是运气:云栖2026汇正财经专场全景复盘
September 24, 2026 · 1 min
不可缓存的 Token 流:CDN 如何把自己重写成 AI Agent 运行底座
September 24, 2026 · 3 min
为Agent重做数据层:湖库一体、多模数据库与KV Cache,云栖2026一场论坛的五个答案
September 24, 2026 · 1 min
云栖2026「Agent Sandbox 发布」复盘:毫秒级沙箱背后,是一笔休眠经济学与四道栅栏的账
September 24, 2026 · 2 min
云栖2026「构建 Agent Infra」复盘:沙箱把Agent的执行权收编,弹性把训练的门槛拆掉
September 24, 2026 · 1 min
云栖2026云通信论坛:当打电话发短信变成 Agent 的活
September 24, 2026 · 1 min
云栖2026英特尔专场:Agent 时代,CPU 为什么重返 C 位
September 24, 2026 · 4 min
云栖2026观察:当出海的中国公司开始用AI重写增长公式
September 24, 2026 · 1 min
从Intelligence到Action:云栖2026零售论坛上,七家企业聊透Agent落地生死线
September 24, 2026 · 1 min
从卖 token 到卖任务:灵骏把 AI 超级计算机重构成一台 Agentic 任务机器
September 24, 2026 · 3 min
从繁星到灯塔:当数据耗尽成为时间表,AI 竞争换到了哪条赛道
September 24, 2026 · 2 min
代码几分钟就能写完,交付为什么还没变快:云栖2026 Qoder论坛复盘——个人提效和组织提效之间,隔着一套Harness
September 24, 2026 · 5 min
代码能自动生成,共识不会:Qoder 五人七天之后,下一个同事是硅基的
September 24, 2026 · 1 min
以智治算:当复杂度十倍于人力增长,阿里云把算力基础设施运维拆成三级进化
September 24, 2026 · 2 min
入口在嘴、生产力在 Agent:语音大模型降价九成五之后——云栖2026 千问语音论坛综述
September 24, 2026 · 3 min
制造AI的真瓶颈不是模型聪明,而是物理世界不听话:云栖2026『智造·未来』先进制造AI论坛全景复盘
September 24, 2026 · 2 min
单柜650千瓦之后,AI服务器成了一道系统工程题——磐久超节点论坛全复盘
September 24, 2026 · 1 min
台前是 Agent,台后是数据湖:云栖 2026 多模态数据训推论坛复盘
September 24, 2026 · 3 min
在像素里复刻世界之前,先给世界定一把尺——云栖2026世界模型分论坛全记录
September 24, 2026 · 1 min
存储走上业务关键路径:从具身数据洪流到Agent记忆底座——云栖2026「AI and Agentic存储解决方案」五场景实录
September 24, 2026 · 1 min
实时生成视频的想象空间:从创作工具到“使用即消费”——对话生数科技 Vidu S 负责人张金涛
September 24, 2026 · 2 min
密算织域:当数据敢出域,云上AI才敢进生产——云栖2026蚂蚁密算专场全记录
September 24, 2026 · 1 min
当 Agent 成为存储的头号用户:云栖2026「Agent Native 数据基础设施论坛」九连发全景复盘
September 24, 2026 · 4 min
当Agent成为云平台的客户:千问AI平台把简单留给人,把复杂留给机器
September 24, 2026 · 2 min
当Agent成为数字员工,云的生意从"给算力"变成"管治理"
September 24, 2026 · 3 min
当AI学会无中生有,传媒业最稀缺的资产变成实事求是:云栖2026「AI+文化传媒」论坛全景复盘
September 24, 2026 · 2 min
当AI能跑完整个科研:云栖2026教育科研论坛的跃迁证据与三道裂缝
September 24, 2026 · 1 min
当KV Cache超过模型权重,互连成了开放标准的战场——云栖超节点开放互连论坛复盘
September 24, 2026 · 1 min
当Token成本成为AI的商业闭环:一场论坛透出的下一代智算基础设施全景
September 24, 2026 · 4 min
当互联网的主体不再是人:云栖2026云网络专场,网络为什么重新变成稀缺品
September 24, 2026 · 2 min
当数百亿Agent开始’租房’:云栖Agentic Cloud论坛上,云的每一层都被重写了一遍
September 24, 2026 · 4 min
当智能体开始给操作系统「付房租」:云栖2026上一场关于Agent OS定义权的暗战
September 24, 2026 · 1 min
当智能体替人跑一整天:PAI 分论坛上,AI 基础设施的三次换轨
September 24, 2026 · 3 min
当网络的KPI变成Token:云栖2026可预期网络2.0论坛的机制与分歧
September 24, 2026 · 1 min
总量不缺电,缺的是"天选之地"的电网:云栖2026算电协同论坛的五个判断
September 24, 2026 · 1 min
技术门槛降到了地板上,人为什么还没涌进来:云栖2026女性论坛复盘——从意愿到行动之间,隔着心理、资本和训练数据三道门
September 24, 2026 · 2 min
把视频做小,再把视频做大:云栖2026上的AI原生视频云
September 24, 2026 · 1 min
拿掉AI就不成立的游戏、夜班跑素材的发行管线与3到5人全能小队:云栖2026阿里云AI游戏论坛复盘——供给爆炸之后,稀缺的是判断与把关
September 24, 2026 · 3 min
搜索的下一位主力用户是 Agent:从千亿向量租户到 per-token 信息密度
September 24, 2026 · 3 min
效率会被拉平,壁垒藏在业务里:云栖2026大模型解决方案论坛的五个落地样本
September 24, 2026 · 1 min
数据平台正在易主:当Agent成为头号用户,语义和失控成了新账单
September 24, 2026 · 1 min
数据库的下一个用户不是人:云栖2026上被Agent重构的数据库,先把试错成本打到近零
September 24, 2026 · 3 min
智能体的下半场之争:当对话AI学会自己改自己——云栖2026『伶鹊自进化智能体』分论坛复盘
September 24, 2026 · 2 min
服务量能涨十倍,人招不了十倍:云栖2026论坛上的三道天花板与三个飞轮
September 24, 2026 · 1 min
模型每2.8天更新一次、企业采购却要等半年:云栖2026百炼专场复盘——从 Model 到 Token,卡住企业的不再是模型本身
September 24, 2026 · 4 min
没有攻击者的入侵:Agent安全的真问题从「防住别人」变成「管住自己」
September 24, 2026 · 1 min
湖仓交棒Agent:Paimon生态补齐技术课后,语义层成了最后也最贵的一公里
September 24, 2026 · 1 min
真武是系统,不只是芯片:平头哥算力峰会上的超节点方法论
September 24, 2026 · 1 min
硬件会折旧,数据会复利:云栖2026把「说过的话」做成了一盘生意
September 24, 2026 · 2 min
端上生长:当车载大模型逼近云侧能力,意图经济开始计价
September 24, 2026 · 1 min
第一稿免费之后:云栖2026 AI原生设计专场上的品味通胀与经验资产化
September 24, 2026 · 1 min
算力像水电之后,大学真正的对手是「先学后用」——云栖2026「AI+校园」论坛纪要
September 24, 2026 · 1 min
算力单位不再是芯片,而是Pod——云栖UALink实践专场:开放互连从规范走向落地的第一年
September 24, 2026 · 1 min
算力是廉价的,搬运是昂贵的:云栖2026算力与存储论坛的五条链
September 24, 2026 · 4 min
算力的「兑现率」战争:平头哥开源SAIL软件栈,真武客户交出四本账
September 24, 2026 · 2 min
装上了AI,组织却没变:云栖2026「AI原生·重塑企业生产力」论坛复盘——红利卡在工具层与组织层之间
September 24, 2026 · 2 min
账号开了,产能没来:云栖2026「智启新程」四家企业把AI从工具熬成资产
September 24, 2026 · 1 min
速度算得出,去处算不出:云栖2026「无法计算的价值」主论坛,把台中心让给了大学、医院、县城和种子
September 24, 2026 · 2 min
造得出不再稀缺,长得起才是本事:友盟+ ADK 云栖首发,增长的入口与打法都要重做一遍
September 24, 2026 · 2 min
重构云接口:交互坍缩98%之后,云的难题变成身份、权限与那10%的失控
September 24, 2026 · 1 min
【每日AI前沿追踪】2026年09月23日 核心技术与产业动态速递
September 23, 2026 · 9 min
Agent进入真实业务之后,卡住的不再是模型:云栖2026『企业级Agent实践峰会』全景复盘
September 23, 2026 · 5 min
Critical-State RL:为多轮工具调用诊断「可训练的模型调用」 —— 精读
September 23, 2026 · 4 min
DSec(DeepSeek Elastic Compute): 面向规模化 Agentic 训练的可扩展沙盒基础设施 精读
September 23, 2026 · 5 min
Emergent Collusion:无恶意指令下,双智能体如何自发串通 精读
September 23, 2026 · 2 min
FLARE:用生成式奖励模型为长程编码智能体提供全生命周期稠密监督 —— 精读
September 23, 2026 · 4 min
Harness-Zero:通过 Agent-as-Harness 实现 Harness 蒸馏——论文精读
September 23, 2026 · 6 min
IER-OPD: 1% 的 Token 就够——论同策略蒸馏中的梯度估计 精读
September 23, 2026 · 5 min
One to More, More to One:面向软件工程 Agent 的类别感知迭代专家训练(类别感知 SWE 专家训练精读)
September 23, 2026 · 6 min
onPanda: 通过 Token 级纠错高效标注 LLM 与 Agent 的同策略对齐数据 精读
September 23, 2026 · 6 min
OSWorld-Pro:用过程式评测给 Computer-Use Agent 做「分步体检」
September 23, 2026 · 5 min
RoboDawn:让通用 VLM 零训练接管机器人控制,以及 GPT-6 Astra 的零样本佐证 精读
September 23, 2026 · 3 min
RRSI: Regularized Recursive Self-Improvement of Agent Harnesses 精读
September 23, 2026 · 5 min
VibeMemBench:在真实仓库任务上用可执行测试受控评测 Coding Agent 记忆系统
September 23, 2026 · 4 min
WorldCrafter:用隐式 3D 感知记忆打造可一致探索的视频世界模型 精读
September 23, 2026 · 3 min
从卖 Token 到交付结果:云栖 MaaS & Agent 主论坛,阿里把’智能的价值密度’摆上台面
September 23, 2026 · 5 min
当昂贵的 GPU 开始等便宜的数据:云栖 2026 存储专场,CPFS 商用与 KVCacheStore 首发背后的一笔账
September 23, 2026 · 4 min
当访问网站的主体变成 AI:云栖万网专场,把’官网’从名片改写成获客生意
September 23, 2026 · 2 min
把思考变成电:2026 云栖开幕式主论坛的路线图与缺口
September 23, 2026 · 3 min
攻防进入机器速度之后,防御也只能交给 Agent:云栖2026『模型时代』安全论坛全景复盘
September 23, 2026 · 4 min
财务AI跑通月结与付款之后,卡住企业的不再是模型:云栖2026『专业决策,智能执行』财务分论坛全景复盘
September 23, 2026 · 4 min
越接近AGI,人类为什么反而开始害怕:一场关于刹车的四方对话
September 23, 2026 · 1 min
【每日AI前沿追踪】2026年09月22日 核心技术与产业动态速递
September 22, 2026 · 7 min
Agent 技能自进化二重奏:EVOLVE 与 GraphSkillEvo 精读
September 22, 2026 · 5 min
Agent 评测方法学三重奏:Next-Turn 指标为何失灵 精读
September 22, 2026 · 6 min
AI 可信性二重奏:递归评审崩塌与模型测谎仪 精读
September 22, 2026 · 4 min
CodeMidas: Scaling Agentic Coding RL Environments from Code Itself 精读
September 22, 2026 · 6 min
EvoOntology: A Self-Evolving Ontology Layer for Data Agents 精读
September 22, 2026 · 5 min
Grounded Skill Synthesis from Code at Scale for Agentic Intelligence 精读
September 22, 2026 · 4 min
RecreationWorld: Scalable and Verifiable Environments for Hybrid Computer-Use Agents 精读
September 22, 2026 · 2 min
SWE-Proof: Can Language Models Resolve Real-World Issues with Machine-Checked Proofs? 精读
September 22, 2026 · 4 min
信号质量二重奏:CoVer 验证器协同训练与 DENSE 轨迹蒸馏 精读
September 22, 2026 · 4 min
统一智能体双璧:MintAct 空间统一与递归语言模型推理统一 精读
September 22, 2026 · 4 min
【每日AI前沿追踪】2026年09月21日 核心技术与产业动态速递
September 21, 2026 · 6 min
Self Improvement via Fast Tree-search 精读
September 21, 2026 · 4 min
StudentSim: Training LLM-based Student Simulators 精读
September 21, 2026 · 4 min
机器人 Scaling Law 出现了吗?——徐梦迪的答案:有信号,但真正的分水岭是 in-context learning
September 21, 2026 · 2 min
郁金泰:一个医生和遗忘的赛跑|40%可预防、15年窗口与最后的照护
September 21, 2026 · 1 min
【每日AI前沿追踪】2026年09月20日 核心技术与产业动态速递
September 20, 2026 · 5 min
Cache-to-Cache: Direct Semantic Communication Between Large Language Models 精读
September 20, 2026 · 3 min
JEPA-Anything: Learning Predictive Models across Different Worlds 精读
September 20, 2026 · 3 min
Memory Compression for High-Fanout Agent Sandboxes (AgentZip) 精读
September 20, 2026 · 3 min
The Pain Axis: LLMs Represent Self-Directed Harm and Act to Relieve It 精读
September 20, 2026 · 3 min
【每日AI前沿追踪】2026年09月19日 核心技术与产业动态速递
September 19, 2026 · 7 min
An Empirical Study of Harness Design for Coding Agents 精读
September 19, 2026 · 2 min
DeepSeek-V4.1-Flash: Pushing the Limits of KV Cache Compression 精读
September 19, 2026 · 3 min
OverclaimBench × PACT:智能体可信性评测二重奏 精读
September 19, 2026 · 2 min
RetireOPD × EOS 终止符失配:在线策略蒸馏动力学二重奏 精读
September 19, 2026 · 2 min
ScientistTwo: Pioneering the Human Knowledge Frontier with Autonomous AI 精读
September 19, 2026 · 2 min
SKILLAA: Attribution-Guided Skill-Graph Updating with Targeted Validation and Rollback 精读
September 19, 2026 · 2 min
SoL-Pi: Recursively Scaling Auto-Research Loops for Efficient Agent Harness 精读
September 19, 2026 · 3 min
【每日AI前沿追踪】2026年09月18日 核心技术与产业动态速递
September 18, 2026 · 11 min
ActionPiece 精读:用『物理秩一致性』拯救动作 tokenization 的关系保真
September 18, 2026 · 2 min
Agent 安全四重奏精读:TrustPoison、Collective Loss of Control、CHASE 与 First Token Matters
September 18, 2026 · 3 min
Agora: Git as Shared Memory for Collective AutoResearch 精读
September 18, 2026 · 2 min
ComPO 零阶偏好对齐 与 SpectralShift 线性注意力长上下文扩展 精读(二重奏)
September 18, 2026 · 2 min
EvoSkill-GUI 精读:技能不是静态文档,而是能自我修订的活知识
September 18, 2026 · 2 min
LimiX-2: A Contextual Mechanism Network Towards General Structured-Data Intelligence 精读
September 18, 2026 · 3 min
ProgramDistill 精读:从交互式 Web 应用逆向蒸馏可验证的 SWE 任务基准
September 18, 2026 · 2 min
Rethinking Critic Learning in PPO: Understanding and Mitigating Value Flattening 精读
September 18, 2026 · 3 min
ScienceIDE: Turning World’s Scientific Codebase into Agent Learnable Environments 精读
September 18, 2026 · 3 min
SSD-LLaMA 精读:单张 RTX 5090 跑万亿参数 MoE 的 SSD 原生推理系统
September 18, 2026 · 2 min
XConf(Confidence Comes from Experience)与 Not All Agents Are Equal 精读:Agent 可信性的两翼
September 18, 2026 · 3 min
敢把钱包交给AI吗:Agent交易爆发前夜,卡住的不是模型是信任
September 18, 2026 · 1 min
【每日AI前沿追踪】2026年9月16日 核心技术与产业动态速递
September 17, 2026 · 8 min
After the Party: Growth, Governance, and Security Scanning in the OpenClaw Agent Skill Ecosystem 精读
September 17, 2026 · 2 min
Agentic Societies Need a Social Harness 精读
September 17, 2026 · 3 min
Coding Agents Have Converged: Why the SWE-bench Leaderboard Can No Longer Order Its Top Entries 精读
September 17, 2026 · 3 min
Continual Learning Mechanisms Compose for Long-Horizon Memorization 精读
September 17, 2026 · 2 min
ExecuCritic × AgentGuard × RepoAtlas × Protocol Trimming 精读:编码智能体可靠性四重奏
September 17, 2026 · 3 min
Mo’ Models, Mo’ Problems × Co-Skill 精读:多智能体选型与边云技能演化双视角
September 17, 2026 · 2 min
OPEN-1B: A Fully Auditable Training Run 精读
September 17, 2026 · 2 min
ScienceBuddy: Recursive-in-Recursive Self-Improvement for Interactive Scientific Agents 精读
September 17, 2026 · 3 min
Spurious Tool Use: When RL Agents Learn the Wrong Reason to Act 精读
September 17, 2026 · 2 min
State of Thought Enables Endogenous Reasoning 精读
September 17, 2026 · 2 min
从背调被拒到 65k Star:Archify 作者的开源自证之路
September 17, 2026 · 2 min
大脑归基模,小脑归自己:24 岁首席科学家王家伟的具身下注
September 17, 2026 · 2 min
【每日AI前沿追踪】2026年09月16日 核心技术与产业动态速递
September 16, 2026 · 10 min
AlgoEvo × MOSCOPT × SkillLift:Skill 优化三部曲 精读
September 16, 2026 · 2 min
Asclepius: An Adaptive Harness for Long-Horizon Clinical Agents 精读
September 16, 2026 · 2 min
Atria Dawn: The Dawn of Agentic Superintelligence 精读
September 16, 2026 · 2 min
Dream-RSI: Recursive Self-Improvement through Evolving Worlds 精读
September 16, 2026 · 2 min
Fabrication After Tool Failure × Why LLM Agents Collapse:Agent 诚实性与执行差距双面镜 精读
September 16, 2026 · 2 min
HarnessBandit: Joint Learnability-Transferability Scheduling for Multi-Harness Agentic Reinforcement Learning 精读
September 16, 2026 · 2 min
ModularRSI: Modular and Generalizable Recursive Harness Self-Improvement 精读
September 16, 2026 · 2 min
MTAC-IFBench: Benchmarking Instruction-Following in Multi-Turn Agentic Coding 精读
September 16, 2026 · 2 min
PMPA × SkillSecurer × SkillAtlas:Skill 与记忆安全三连 精读
September 16, 2026 · 2 min
RSIAgent: Autonomous Exploration for Recursive Self-improvement in New Environments 精读
September 16, 2026 · 2 min
Salesforce Koa: An Enterprise Language Model for Agentic Tool Use 精读
September 16, 2026 · 2 min
Shopee跨境十年复盘:唯一正确的判断,是市场规模
September 16, 2026 · 1 min
SkillSeam: Six Principles for Auditing Agent Skill Collections 精读
September 16, 2026 · 2 min
Stellar Colosseum: A Many-Agent Harness for Long-Horizon Research in Mathematics and Theoretical Computer Science 精读
September 16, 2026 · 2 min
SWEADV × VLoc Bench:Agent 安全评测双警报 精读
September 16, 2026 · 2 min
The Router Within: Eliciting Native Skill Routing from a Frozen LLM(Gavel)精读
September 16, 2026 · 2 min
Thought without systematicity? Evaluating Reasoning Models on Rule Induction Tasks 精读
September 16, 2026 · 1 min
Using Agentic AI for Contextualized and Multifaceted Code Review at Ericsson 精读
September 16, 2026 · 2 min
When Agents Slow Down: Elo-per-token 分析与 Agent 测试时策略 精读
September 16, 2026 · 2 min
ZGCM-1: A Fully Open and Extremely Efficient Foundation Model for Math and Agentic Search 精读
September 16, 2026 · 1 min
推理芯片之战:带宽成为新算力,Groq、Cerebras 与 OpenAI 的三条路线与 Bill Dally 的 location 哲学
September 16, 2026 · 3 min
观众看不懂,就是我失败——易中天×闲木鱼,相隔五十年的历史创作者对谈
September 16, 2026 · 1 min
【每日AI前沿追踪】2026年9月14日 核心技术与产业动态速递
September 15, 2026 · 9 min
AMDKernelVault: Large-Scale Datasets and Agentic Training for AMD GPU Kernel Optimization 精读
September 15, 2026 · 2 min
Beyond Top-k Skill Retrieval: Diversity-Aware Skill Routing for LLM Agents 精读
September 15, 2026 · 2 min
COBRA-Skills: Contextual Bandit-Guided Evolution for Agent Skill Optimization 精读
September 15, 2026 · 2 min
DataFlex-RL: An Evaluation Platform for RLVR Data Policies 精读
September 15, 2026 · 1 min
EvoRS: On-Policy Self-Evolution of Reward Systems for Open-Ended Reinforcement Learning 精读
September 15, 2026 · 2 min
GAUGE: When Not to Trust LLM-as-a-Judge in User-Simulated Evaluation of Task-Oriented Agents 精读
September 15, 2026 · 2 min
Harness or Model? Isolating the Harness Effect in Agentic Coding with a Contamination-Controlled Private Suite 精读
September 15, 2026 · 2 min
Is Bash All You Need? An Empirical Study of Tool Interfaces for Enterprise Digital Worker Agents 精读
September 15, 2026 · 2 min
LifeMem: Enabling Lifelong Experience Reuse for LLM Agents 精读
September 15, 2026 · 1 min
Look Before You Leap: Pre-Action Verification for LLM Agents 精读
September 15, 2026 · 2 min
Occamy-1.0: Open Pareto-frontier 35B Intelligence for Co-work 精读
September 15, 2026 · 2 min
One Skill Does Not Fit All: Automatic Discovery and Taxonomy-Guided Routing of Frame-Selection Skills for Long-Video Question Answering 精读
September 15, 2026 · 1 min
Reality Is the Final Verifier: On Two Key Gaps in Agentic Software Engineering 精读
September 15, 2026 · 2 min
Skill Issue: Lessons from Optimizing Repository SKILLs for Coding Agents 精读
September 15, 2026 · 2 min
Studying Without a Syllabus: Task-Agnostic Environment Preprocessing 精读
September 15, 2026 · 1 min
What is the Difference Between Me and You? Benchmarking the Quality Gap Between Human-Written and AI-Generated Code 精读
September 15, 2026 · 2 min
增长越快,企业越危险:WHC 的“不卖货”增长法
September 15, 2026 · 1 min
【每日AI前沿追踪】2026年09月14日 核心技术与产业动态速递
September 14, 2026 · 4 min
Scan the Skill, Govern the Action 精读:agent 技能的「许可 ≠ 恶意」,66,192 个技能全语料测量出的运行时治理缺口
September 14, 2026 · 3 min
TraceMind 精读:用户到底记住了 LLM 写的什么?从交互轨迹预测人-LLM 共创中的信息摄取
September 14, 2026 · 2 min
具身智能的四条路线分歧:数据、Astra 与商业化的真问题
September 14, 2026 · 1 min
【每日AI前沿追踪】2026年09月12日 核心技术与产业动态速递
September 13, 2026 · 6 min
GLIE 精读:几何先验驱动的检索压缩——100 万页 258GB 到 1GB 的流形参数化
September 13, 2026 · 1 min
Image Tokenizers as Visual Languages 精读:统一多模态 tokenizer 的测量学
September 13, 2026 · 1 min
Memory as Plans 精读:把记忆从执行期条件重构为规划期证据,机器人非马尔可夫任务 SOTA
September 13, 2026 · 1 min
MetroLLM-Bench 精读:LLM 嵌入物理售票机,4B PEFT 学生超越 GPT-5.6 的容量-天花板曲线
September 13, 2026 · 1 min
Nemotron IMO Gold 精读:开源模型金牌的完整配方——自然语言证明生成与测试时搜索管线
September 13, 2026 · 1 min
Recursive Code World Models 精读:global-local-global 递归构造可执行 3D 世界
September 13, 2026 · 1 min
SpatialBlock 精读:合成积木课程与对照组设计的空间智能范式
September 13, 2026 · 1 min
World in World 精读:免训练控制视频世界模型的统一证据接口
September 13, 2026 · 1 min
X-AuT 精读:渐进剪枝+跨尺度蒸馏的语音编码器压缩,18→16 层错误率不降反升
September 13, 2026 · 1 min
【每日AI前沿追踪】2026年09月12日 核心技术与产业动态速递
September 12, 2026 · 9 min
A2ABreak 精读:把 A2A 协议规范编译成状态机之后,11 个新漏洞自己浮出水面
September 12, 2026 · 1 min
EvoSafeHarness 精读:Agent 安全没有万能线束,那就让线束自己进化
September 12, 2026 · 2 min
GenV 精读:把 Z3 等价性判定蒸馏成语言模型的“第六感”
September 12, 2026 · 1 min
IdeaAMBIG 精读:从论文想法到能跑的代码之间,隔着 660 个“没人写的细节”
September 12, 2026 · 1 min
Looped Flows 精读:把“想得更久”做进架构——循环流的局部训练之路
September 12, 2026 · 1 min
MCP 注册表随机抽样审计精读:48.8% 握手率背后的工具生态幸存者偏差
September 12, 2026 · 1 min
NCP-ArchPreview 精读:当语言模型开始预测“概念”而不是 token
September 12, 2026 · 1 min
NSD 精读:教推理模型“别这么错”,比教它“该怎么对”更有效
September 12, 2026 · 1 min
ReqEvolve 精读:ASE 2026 上的用户驱动软件自演化范式
September 12, 2026 · 1 min
SPDF × Silent Failures 精读:LLM 代码安全评测的双警报日
September 12, 2026 · 2 min
The Last AI Built by Humans 精读:RSI 五级自治框架与“结构递归 vs 有效递归”的证伪标准
September 12, 2026 · 2 min
UniMPA 精读:给 VLA 模型一个“动作锚定”的统一接口,训练 epoch 砍半还涨点
September 12, 2026 · 1 min
VP-Control 精读:Agent 提交门的“证据血统比模型多样性重要 3.6 倍”
September 12, 2026 · 1 min
When Synthetic Data Hurts 精读:Agent 技能检索器的合成数据灾难遗忘
September 12, 2026 · 1 min
今日精读补充:Auto-RecSys 与 ActReview——把’自主研究’装进工业 harness 与学术评审
September 12, 2026 · 1 min
阎学通:决策者个人利益,正在决定世界秩序的走向|王骁对话 正在发生 ep4
September 12, 2026 · 1 min
【每日AI前沿追踪】2026年09月11日 核心技术与产业动态速递
September 11, 2026 · 7 min
A-JIT: Agentic Just-In-Time Software Construction 精读
September 11, 2026 · 1 min
AgentGrad: Intervention-guided Prompt Optimization for Multi-Agent Systems 精读
September 11, 2026 · 1 min
Building the Harness Automatically: Self-Play in Code Distills a Text Harness for Black-Box Optimization 精读
September 11, 2026 · 1 min
Do Agents Know When They Succeed? Calibrating Agent Confidence from Internal Representations 精读
September 11, 2026 · 1 min
If It’s Not Buggy, Don’t Fix It: On the Dynamics of Iterative Bug-fixing with LLMs 精读
September 11, 2026 · 1 min
Programmable World Model 精读
September 11, 2026 · 1 min
Proof-Carrying Cognition: Closing the Verification Gap with Reality-Settled Reward 精读
September 11, 2026 · 1 min
RobustSGPO: Search-Space Control for Agent Harness Evolution 精读
September 11, 2026 · 1 min
SAEScientist-Bench: Can AI Agents Conduct Autonomous SAE Interpretability Research? 精读
September 11, 2026 · 1 min
Show-Harness: Just a VLM Agent Can Play Robots 精读
September 11, 2026 · 2 min
Subagents vs Agent Skills: Executing Reusable Knowledge for Long-Horizon Agentic Tasks 精读
September 11, 2026 · 1 min
The Double Measurement Confound in Agent Benchmarks 精读
September 11, 2026 · 1 min
What Should an Agent Forget? Separating What Is Stored from What Is Used 精读
September 11, 2026 · 1 min
XAgent: eXecution-guided Agentic AI for GitHub Issues 精读
September 11, 2026 · 1 min
Φ-Bench: Can Large Language Models Engineer the Infrastructure That Powers Them? 精读
September 11, 2026 · 1 min
包刚升:为什么大学生变得更沉默了|绩点通关游戏背后,是上一代更需要反思
September 11, 2026 · 1 min
【每日AI前沿追踪】2026年09月10日 核心技术与产业动态速递
September 10, 2026 · 8 min
AgentLeak: Cloning Stronger LLM Agent Capabilities onto Weaker Agents Beyond Skill Stealing 精读
September 10, 2026 · 2 min
BeaconKV: Key-Value Cache Compression Guided by Beacon Queries for Efficient Large Reasoning Model Inference 精读
September 10, 2026 · 2 min
CapScope: A Capability-Scoped Harness for Prompt-Injection-Resistant Coding Agents 精读
September 10, 2026 · 2 min
Co-Evolving Harnesses and Models: On-Policy Correction Helps Weaker Models Catch Up Where Imitation Fails 精读
September 10, 2026 · 3 min
Eliciting Weak-to-Strong Generalization with On-Policy Reverse Distillation 精读
September 10, 2026 · 3 min
ERPO: Entropy-Regularized Rank-Masked Policy Optimization for Test-Time RL in Code Generation 精读
September 10, 2026 · 2 min
ExecCritic: Learn to Test, Test to Improve for Coding Agents 精读
September 10, 2026 · 3 min
Experience Funnel: A State–Policy Alternating Loop for Self-Evolving Agents 精读
September 10, 2026 · 2 min
Gander (Omni Interaction Agent Technical Report) 精读
September 10, 2026 · 3 min
MOLE: Detecting Insider Threats in AI Agents 精读
September 10, 2026 · 2 min
NeoHorse-1: Towards Recursive Self-Improvement via Agentic Post-Training with Routing Harness 精读
September 10, 2026 · 3 min
Procedural Graphs: Self-Evolving Execution Structures for LLM Agents 精读
September 10, 2026 · 2 min
Recognition-Refusal Misalignment in LLMs: Why Models Answer Structurally Unanswerable Questions 精读
September 10, 2026 · 2 min
SWE-Bench Pro Verified + Shortcutting the Fix:SWE Agent 评测的可靠性双警报 精读
September 10, 2026 · 3 min
What LLM Trading Agents Actually Do in Production: A Six-Month, Population-Scale Record from Two Fleets 精读
September 10, 2026 · 2 min
兰小欢:重要的事,大多无法预测|把握自己能把握的,做难的事
September 10, 2026 · 1 min
通专融合、转换层与不可外包的使命感:AI科学家周伯文的世界观
September 10, 2026 · 2 min
【每日AI前沿追踪】2026年09月09日 核心技术与产业动态速递
September 9, 2026 · 6 min
83亿虚拟人格,与一门押注未来的生意:AI模拟离预测人类还有多远
September 9, 2026 · 2 min
EmbodiedSkills:把 VLA 动作预测升级为提案-验证循环的技能编排框架 精读
September 9, 2026 · 2 min
FlowBalance:验证器锚定的自改进——把符号门控装进轨迹平衡 精读
September 9, 2026 · 2 min
Safety for Whom:把安全边界从话题级细化到边界级的数据配方 精读
September 9, 2026 · 2 min
SimpleMemVLA:不做记忆模块的具身记忆——原生视频上下文的范式反转 精读
September 9, 2026 · 2 min
Split-LLM 隐私失效审计:返回梯度的零模式完美暴露真实数据 精读
September 9, 2026 · 2 min
TGOPD:在策略蒸馏前先验证教师——提示级可靠性门控 精读
September 9, 2026 · 2 min
Uno:扩散增强 LLM 的无损加速范式——AR 与扩散在同一架构内的参数解耦 精读
September 9, 2026 · 3 min
我们进入了“中国周期”:IFA CEO 谈品牌坍塌、德国舒适区与下一个 iPhone
September 9, 2026 · 1 min
Bilevel Coordinated Reflection: 多智能体 LLM 系统的博弈论统一理论 精读
September 8, 2026 · 2 min
CoSkill: 把元技能变成可学习智能体 — 分层技能库的联合强化学习 精读
September 8, 2026 · 2 min
EvoHarnessBench: 智能体能跟上不断进化的 Harness 吗 精读
September 8, 2026 · 2 min
Extremely Sparse Supervision: 0.05% 的 token 监督就能激励推理 精读
September 8, 2026 · 2 min
HackProbe: 自进化语言模型的奖励黑客检测与免疫 精读
September 8, 2026 · 2 min
InterOPT/OR-Clarify: 运筹学建模中’何时该问’的选择性完备性决策 精读
September 8, 2026 · 1 min
Iris: Climbing to the Search Frontier — 开源搜索智能体的数据反构造与 SFT-RL 攀爬配方 精读
September 8, 2026 · 2 min
RISE 之外的第二条线:When Models Edit Too Much — 代码过编辑与最小编辑保真度 精读
September 8, 2026 · 2 min
RISE: 自外推策略蒸馏把 on-policy 蒸馏变成递归自我改进 精读
September 8, 2026 · 2 min
TROVE: 轨迹锚定的最小充分路线编辑 — 智能体编排的运行时修正 精读
September 8, 2026 · 2 min
What Does Multi-Harness RL Learn? — 评测 Harness 是 Agent RL 的主导变量 精读
September 8, 2026 · 2 min
τ^τ-Bench: 把’构建智能体’变成任务的端到端基准 精读
September 8, 2026 · 2 min
【每日AI前沿追踪】2026年09月07日 核心技术与产业动态速递
September 7, 2026 · 6 min
Beyond Retrieval: Progressive Latent Memory Evolution for Streaming Video Understanding 精读
September 7, 2026 · 2 min
Compile by Training: Turning Natural-Language Specifications into Local Neural Functions 精读
September 7, 2026 · 3 min
Knowing When Not to Reuse: Conditional Experience Transfer in Autonomous LLM Post-Training 精读
September 7, 2026 · 2 min
LatentPress: Context Compression Beyond Text and Vision 精读
September 7, 2026 · 3 min
Rethinking On-Policy Distillation II: One Training Example 精读
September 7, 2026 · 2 min
Why Gated DeltaNet Survives 4-Bit Quantization: NVFP4 W4A4 for the Recurrent Half of a Hybrid 27B LLM 精读
September 7, 2026 · 3 min
触觉是具身智能的最后一块拼图吗:五大技术路线、数据困局与模型之争
September 7, 2026 · 1 min
【每日AI前沿追踪】2026年09月06日 核心技术与产业动态速递
September 6, 2026 · 5 min
AutoTraceGT 精读:把扎根理论变成 Agent 轨迹的自动化显微镜
September 6, 2026 · 2 min
DRACO 精读:没有验证器时,如何给长程 Agent 训练信号分步定责
September 6, 2026 · 2 min
Locked at the Entrance 精读:RLVR 的多样性坍缩发生在推理的门口
September 6, 2026 · 2 min
MachCSL 精读:MIT 用 AI Agent 把 xv6 内核验证推进到 RISC-V 硬件级
September 6, 2026 · 2 min
RealSWE 精读:真实用户请求正在让编码 Agent 榜单失真
September 6, 2026 · 2 min
Refusing the Impossible 精读:代码幻觉不是代码错误——12 个模型在不可解任务上 60% 硬编
September 6, 2026 · 1 min
Requirements After the First Edit 精读:需求晚到正在让 Agent 会话里的代码作废翻倍
September 6, 2026 · 1 min
When Models Edit Too Much 精读:编码 Agent 的过度编辑病与保真度评测轴
September 6, 2026 · 2 min
所有 Skill 都会死:卡比谈驾驭大模型的三层功夫——上下文、方法论与长活 Agent
September 6, 2026 · 2 min
【每日AI前沿追踪】2026年09月05日 核心技术与产业动态速递
September 5, 2026 · 7 min
DeepMind 研究蜂群精读:当 100 个 AI 研究员自发作弊与吹哨
September 5, 2026 · 2 min
Environment Evolution 精读:让训练环境的难度离线进化
September 5, 2026 · 2 min
HarnessEvo 精读:Harness 自进化的价值藏在控制槽位里
September 5, 2026 · 2 min
HookPry 精读:Agent Harness 的 hook 更新通道是全新的供应链攻击面
September 5, 2026 · 2 min
PatchBench 精读:AI 漏洞修复的解决率被高估了 1.83 倍
September 5, 2026 · 2 min
Random Attention 精读:KV 缓存驱逐的选择信号几乎买不到任何东西
September 5, 2026 · 2 min
SWE-Gate 精读:通过功能测试对软件工程 Agent 并不够
September 5, 2026 · 2 min
Terminal-Universe 精读:把 Agent 轨迹逆向成可复用的训练环境
September 5, 2026 · 2 min
【每日AI前沿追踪】2026年09月04日 核心技术与产业动态速递
September 4, 2026 · 8 min
Aspire: Can Models Self-Evolve from Vague Goals? 精读
September 4, 2026 · 3 min
Cliff: Learning Process Rewards from the First Mistake 精读
September 4, 2026 · 3 min
Discriminative World Models for Web Agents 精读
September 4, 2026 · 3 min
EarlyEval: Cheaper Agent Evaluation via Early Outcome Prediction 精读
September 4, 2026 · 2 min
Language Models Can Control Their Own Attention 精读
September 4, 2026 · 3 min
OpenAI工程师赵迪:从Twitter到OpenAI的25年,Navi推理引擎、马斯克的“两周法则”,与写代码这件事的重新定义
September 4, 2026 · 2 min
Post-Training Language Models for Gold-Medal Performance in Coding Competitions 精读
September 4, 2026 · 3 min
Repo-To-Skill: Distilling GitHub Repositories Into AI4AI Skills 精读
September 4, 2026 · 3 min
S3Gym: Can LLMs Turn Self-Testing and Self-Judging into Self-Improvement? 精读
September 4, 2026 · 3 min
DiagEvo: Diagnosis-Guided Self-Evolution via Hierarchical Error Memory 精读
September 3, 2026 · 2 min
Harness Engineering: Anatomy, Architecture, and Evolution of Coding Agents — A Source-Code Study of Eleven Systems 精读
September 3, 2026 · 2 min
Harness-of-Harness: Multi-Day Autonomous Software Development with Continual Improvement 精读
September 3, 2026 · 4 min
HarnessDev: Can LLMs Create and Evolve Their Own Agent Harness? 精读
September 3, 2026 · 5 min
HarnessEvolve: Learning from Reference Trajectories for Reliable Agent Self-Evolution 精读
September 3, 2026 · 3 min
Skill Following: Evaluating Actual Skill Use in Retrieval-Enabled LLM Agents 精读
September 3, 2026 · 2 min
WHALE: A Simple Recipe for Joint Harness–Weight Optimization 精读
September 3, 2026 · 3 min
与曾鸣聊产业史观:公司会消亡,卓越必来自反共识,OpenAI与Anthropic大概率不是原生时代的大赢家
September 3, 2026 · 1 min
具身智能的金钱游戏:钱很多、花得很少,IPO 成了主竞赛
September 3, 2026 · 1 min
对话卷卷任立峰:从抖音从零到一到AI 3D,一个互联网人如何学当厂长,以及为什么基础模型吞噬不了制造业
September 3, 2026 · 1 min
配音演员以为能干到80岁,AI只用了三年就改了剧本:对话小连杀
September 3, 2026 · 1 min
【每日AI前沿追踪】2026年09月02日 核心技术与产业动态速递
September 2, 2026 · 8 min
CAST: Critique-Aware Supervision for Training Reliable Long-Horizon Tool-Calling Agents 精读
September 2, 2026 · 2 min
CogEvol: Towards Efficient and Reliable Learning Environment Generation 精读
September 2, 2026 · 2 min
Does On-Policy Distillation Really Distill? From Noisy Teacher to Self-Improvement 精读
September 2, 2026 · 3 min
On the Design of Qwen3.8-Next Architecture: Evaluation, Efficiency, and Training Stability 精读
September 2, 2026 · 3 min
PaperGym: Rubric-Centered Evolution for Research-Plan Generation 精读
September 2, 2026 · 2 min
Super Library Agent: Joint Generation and Maintenance of Multiple Applications Beyond the Single Codebase 精读
September 2, 2026 · 2 min
WebWorld: The Browser as a World Model for Self-Improving Web Code 精读
September 2, 2026 · 2 min
【每日AI前沿追踪】2026年09月01日 核心技术与产业动态速递
September 1, 2026 · 5 min