<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/"><channel><title>AI基础设施 on MessageDaily</title><link>https://inkeast.github.io/MessageDaily/tags/ai%E5%9F%BA%E7%A1%80%E8%AE%BE%E6%96%BD/</link><description>Recent content in AI基础设施 on MessageDaily</description><generator>Hugo</generator><language>zh-cn</language><lastBuildDate>Wed, 30 Sep 2026 00:00:00 +0000</lastBuildDate><atom:link href="https://inkeast.github.io/MessageDaily/tags/ai%E5%9F%BA%E7%A1%80%E8%AE%BE%E6%96%BD/index.xml" rel="self" type="application/rss+xml"/><item><title>Skill2Env × QwenGyre × AgentPerfBench：智能体强化学习的数据、系统与推理三层基建 精读</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-30-agent-rl-infra-trio-paper-reading/</link><pubDate>Wed, 30 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-30-agent-rl-infra-trio-paper-reading/</guid><description>同日挂出的三篇 arXiv 论文恰好拼出 Agent 强化学习的三层基础设施：数据层（AllSpark 的 Skill2Env 把「环境合成」从扩展覆盖升级为能力参数化——100 个带控制旋钮的难度模式+基于 solver 执行证据的迭代加难，1.5K 轨迹 SFT 换 7 基准 +8.4pt）；系统层（阿里 Token Hub 牵头的 QwenGyre 用 cell 级弹性调度+轨迹树处理让 2.4T 旗舰模型的百万 token rollout 在线 RL 提速 1.78×，pass rate 52.48%→58.54%）；推理层（帝国理工+剑桥+牛津的 AgentPerfBench 用 22 个负载画像+饱和扫描+NCU roofline 证明 chat→coding 的 TTFT 差 4.8×、操作强度差 46×，agentic 负载在并发爬升时吞吐崩塌 43–76% 而 chat 仍在扩张）。本文按九部分结构合并精读，并给出「Agent RL 全栈工程」的公共图景。</description></item><item><title>Agent的确定性从哪来：全栈平台与草台班子的双向奔赴</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-enterprise-agent-infrastructure/</link><pubDate>Thu, 24 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-enterprise-agent-infrastructure/</guid><description>云栖2026「企业级Agent基础设施」论坛全记录：阿里云发布Agent Studio全栈服务平台与硬件版，把开发、运行、评测、进化收进一条链路；千问端侧模型、高通异构计算、英伟达边缘推理引擎三方把Agent送往手机、座舱与机器人；友邦、阿里云产品博士、三棵小草给出「从答得准到办得成」的客户账本；OPC圆桌则揭示确定性最终由真实场景构建者反推。含转写校正、七项外部核验与四条机制-影响-启发链。</description></item><item><title>不可缓存的 Token 流：CDN 如何把自己重写成 AI Agent 运行底座</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-esa-edge-agent-runtime/</link><pubDate>Thu, 24 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-esa-edge-agent-runtime/</guid><description>云栖2026边缘论坛上，阿里云ESA把自己从CDN升级款改讲成AI Agent的全球运行底座。核心矛盾在于：CDN为可缓存流量而生，AI推理的token恰恰不可缓存且按量付费，网络质量从体验问题变成成本问题。本文梳理AI加速网关、VPC私网回源、Agent运行时、百T骨干网四层升级，并用乾垚、QwenWork、阿迪达斯三个客户案例交叉验证，标注哪些数字可信、哪些仍是厂商口径。</description></item><item><title>为Agent重做数据层：湖库一体、多模数据库与KV Cache，云栖2026一场论坛的五个答案</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-agent-native-lakebase/</link><pubDate>Thu, 24 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-agent-native-lakebase/</guid><description>2026云栖大会数据库论坛《为Agent重做数据层》全链路复盘：Apsara LakeBase以湖库一体与秒级弹性重做Agent成本曲线，PolarDB多模引擎、ADB具身数据闭环、SelectDB/ClickHouse/Lindorm各守一环，Tair语义缓存把QReCC命中率13%提到80%、KV Cache让百炼命中率90%→96%。当Agent成为数据的主要生产者与消费者，数据层正从容器变成工作底座。</description></item><item><title>云栖2026「Agent Sandbox 发布」复盘：毫秒级沙箱背后，是一笔休眠经济学与四道栅栏的账</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-agent-sandbox-architecture/</link><pubDate>Thu, 24 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-agent-sandbox-architecture/</guid><description>云栖2026「构建 Agent Infra——Agent Sandbox 重磅发布与技术架构揭秘」论坛（9月23日上午，六场环节完整复盘）：阿里云把沙箱做成与 VM、容器并列的新算力形态——每分钟创建10万沙箱、冷启动P99小于180毫秒、深休眠唤醒600毫秒、TCO 降七成（嘉宾口径）。拆开看是三笔账：预热池把冷创建变成申领、休眠唤醒把闲置算力退回、四道栅栏把不可信代码关进可治理的笼子；前程无忧与金山办公给出两份生产账本。圆桌共识：Agent 落地的瓶颈不在模型，在运行环境的隔离、弹性与成本。</description></item><item><title>云栖2026「构建 Agent Infra」复盘：沙箱把Agent的执行权收编，弹性把训练的门槛拆掉</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-agent-infra-llm-training-inference/</link><pubDate>Thu, 24 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-agent-infra-llm-training-inference/</guid><description>云栖2026「构建 Agent Infra」论坛（9月23日，十场演讲完整复盘）：从去年底OpenClaw『养虾』出圈到Harness工程上云，Agent的执行环境正在从容器变成沙箱算力——千万级在线、单region百万并发、深休眠600毫秒唤醒。另一头，Agentic RL把训练变成『训得了、训得起、训得好』的公有服务，千问办公、生数、朗新、小红书给出四份生产账本。核心矛盾：Agent落地的瓶颈已不是模型，而是隔离、弹性与成本三本账。</description></item><item><title>从卖 token 到卖任务：灵骏把 AI 超级计算机重构成一台 Agentic 任务机器</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-lingjun-ai-supercomputer/</link><pubDate>Thu, 24 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-lingjun-ai-supercomputer/</guid><description>2026 云栖大会灵骏专场，13 位讲者围绕&amp;quot;Agentic 时代的 AI 超级计算机&amp;quot;给出同一场升级：负载从训练、推理走向多轮工具调用的 agent 长事务，衡量标尺从 GPU 利用率和 token 单价转向单位成功任务成本；架构从固定资源池走向可组合的异构系统，KV Cache 与状态成为调度核心；产品面补上 REIN 控制器、真武 M890 超节点、RuntimeKit 资源引擎与稳定性体系。国产算力首次以 40 天百余家客户的生产化数据回应&amp;quot;能不能用&amp;quot;，而真正的胜负手正在从芯片规格转向任务账单与控制面软件。</description></item><item><title>以智治算：当复杂度十倍于人力增长，阿里云把算力基础设施运维拆成三级进化</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-ops-agent-self-evolution/</link><pubDate>Thu, 24 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-ops-agent-self-evolution/</guid><description>云栖2026「以智治算」论坛复盘：数据中心资本开支2025年首超石油、机柜功率密度十倍跃升，运维压力百倍增长而人力无法同步扩张。阿里云给出认知—行动—自我进化三级路线：物理规律做验证skill、运维本体降方差、三层门禁控尾部风险、全局诊断大模型天晓把时序推理成本降90%，直到数字员工持KPI上岗、Agent自主创造Agent。人退到目标与边界的定义者。</description></item><item><title>单柜650千瓦之后，AI服务器成了一道系统工程题——磐久超节点论坛全复盘</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-panjiu-supernode-hardware/</link><pubDate>Thu, 24 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-panjiu-supernode-hardware/</guid><description>2026云栖「AI Native磐久超节点服务器与硬件工程创新」论坛复盘：AL144把单柜推到650千瓦、144卡一个互联域，互联/散热供电/内存/部署四道墙只能用系统工程一起答。铜光边界、全栈液冷、800V HVDC、稳定性AI治理与Agentic AI研发五线并进，核心判断是——下一代超节点的竞争不在单点参数，而在工程深度与标准开放度。关键规格经官方通稿交叉核验，自报口径已标注。</description></item><item><title>台前是 Agent，台后是数据湖：云栖 2026 多模态数据训推论坛复盘</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-multimodal-data-training-inference/</link><pubDate>Thu, 24 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-multimodal-data-training-inference/</guid><description>云栖 2026「多模态数据处理与模型训推论坛」八场演讲复盘：预训练红利见顶后，数据生产成本与模态复杂度同步上升，竞争焦点转向数据闭环与模型闭环的双飞轮。本文梳理卓驭一湖两域、PAI 的 token 经济学、TeleAgent 六十万员工规模化、DLF agentic lake、乐享元游 Data Agent 与微财 L0-L3 特征开发自动化六条主线，拆解&amp;quot;深度用户仅约 5%&amp;ldquo;背后的语义、权限与血缘瓶颈，并给出可迁移的机制—影响—启发链条。</description></item><item><title>当Agent成为数字员工，云的生意从"给算力"变成"管治理"</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-private-cloud-trusted-ai/</link><pubDate>Thu, 24 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-private-cloud-trusted-ai/</guid><description>云栖2026「可信AI云：专有云全栈AI产品与实践论坛」上，阿里云交出双I战略一年答卷：2400万vCPU、3个万卡集群、Gartner挑战者象限、达喀尔青奥会主权云。但全场真正的主角是Agent治理——数字员工考核、token账本、工具沙箱、零信任权限。银行、石化、车企、医疗客户用真实账本证明：AI规模化的瓶颈不再是算力，而是度量、成本与审计。</description></item><item><title>当KV Cache超过模型权重，互连成了开放标准的战场——云栖超节点开放互连论坛复盘</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-scaleup-open-interconnect/</link><pubDate>Thu, 24 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-scaleup-open-interconnect/</guid><description>2026云栖「超节点Scale-Up开放互连与开源计算生态」论坛复盘：KV Cache在千问3-235B中已占57%存储、超过权重本身，内存墙把互连协议推上主战场。UALink 2.0落地与3.0路线、CXL从&amp;rsquo;已死&amp;rsquo;论调中复活、磐久UMX分层介质以存代算、Beluga用CXL内存池把命中场景TTFT砍掉九成，圆桌上AMD与三星直言协议百花齐放不可持续。核心判断：超节点的竞争单位正从芯片变成&amp;rsquo;协议+介质+软件&amp;rsquo;的开放生态位。讲者与讲题已按议程页校正，关键产品规格经外部核验。</description></item><item><title>当Token成本成为AI的商业闭环：一场论坛透出的下一代智算基础设施全景</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-h3c-token-cost-performance-computing/</link><pubDate>Thu, 24 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-h3c-token-cost-performance-computing/</guid><description>本文整理自云栖大会2026「新华三：打造Token极致性价比，下一代智算关键技术创新论坛」全场实录。十位来自新华三、阿里云、英特尔、平头哥、博通、清程极智、是石科技的讲者，从超节点、异构协同、智能网卡、跨域网络到KV Cache存储新架构，勾勒出同一条主线：当AI从不计成本地堆算力转向逐个Token地算成本，基础设施的每一层——芯片、网络、存储、软件——都要围绕&amp;quot;每个Token的性价比&amp;quot;重新设计。</description></item><item><title>当数百亿Agent开始'租房'：云栖Agentic Cloud论坛上，云的每一层都被重写了一遍</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-agentic-cloud-tech-forum/</link><pubDate>Thu, 24 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-agentic-cloud-tech-forum/</guid><description>2026 云栖技术主论坛 Agentic Cloud 场（转写全读）：李飞飞以模型/context/harness 三要素定调后，存储、网络、数据库、终端按 Agent 生命周期逐层重构——CPFS 百 PB 单文件、全球首款 KV Cache 存储与 Agent FS、TPN 转向 SLO 下极致成本、Agent DB 半年实例涨四倍。圆桌反向警告：框架会死，身份、标准与数据资产才是不变量。</description></item><item><title>当网络的KPI变成Token：云栖2026可预期网络2.0论坛的机制与分歧</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-predictable-network-token-performance/</link><pubDate>Thu, 24 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-predictable-network-token-performance/</guid><description>2026云栖大会「可预期网络2.0：Token Performance Network」分论坛全文梳理：阿里云发布TPN 1.0，把网络优化目标从训练集群的极致性能改为SLO约束下每个Token的成本。本文从142分钟转写中提炼KV Cache经济学、交换芯片的二次方物理约束、超节点规模之辩、深浅buffer路线之争与开放闭环终局五条机制链，区分嘉宾口径与外部证实，并给出可观察的先行指标。</description></item><item><title>总量不缺电，缺的是"天选之地"的电网：云栖2026算电协同论坛的五个判断</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-compute-electricity-synergy/</link><pubDate>Thu, 24 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-compute-electricity-synergy/</guid><description>2026云栖大会IDC专场（算电协同·智领全球）全程复盘：中国总量不缺电，但乌兰察布等少数&amp;quot;天选之地&amp;quot;两三年内将迎来十几倍负载跃升，电网余量10-15%用尽后即告刚性；AI数据中心选址逻辑从&amp;quot;找现成电网容量&amp;quot;翻转为&amp;quot;找充沛能源、自带电源&amp;quot;。论坛发布算电协同联合研发计划，王朝阳呼吁把共识做成模块化的中国产品走向全球；国网的分时分区电碳因子正被写入GHG Protocol修订，中国移动则交出宁夏中卫绿电直供降本25%的账本。本文按讲者链完整复盘并交叉核验关键主张。</description></item><item><title>把视频做小，再把视频做大：云栖2026上的AI原生视频云</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-ai-native-video-cloud/</link><pubDate>Thu, 24 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-ai-native-video-cloud/</guid><description>2026云栖大会「AI Native视频云」论坛七场分享给出同一判断：时延、质量、成本框架未变，语义却被AI重写。达摩266规模化商用带来大盘约20%带宽节省，MoQ把实时网络从会话改造成对象分发，A.O.史密斯以&amp;quot;先确认再执行&amp;quot;应对高风险家电动作，生数科技Vidu让视频流在传输中被实时改写，点众科技以&amp;quot;低档生成+超分&amp;quot;重算短剧成本账。关键主张已外部核验，存疑处已标注。</description></item><item><title>搜索的下一位主力用户是 Agent：从千亿向量租户到 per-token 信息密度</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-ai-search-agent/</link><pubDate>Thu, 24 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-ai-search-agent/</guid><description>2026 云栖「AI 搜索智能体：从检索到推理」论坛复盘：Agentic Search 把搜索终点从&amp;quot;我知道了&amp;quot;改写为&amp;quot;任务完成了&amp;quot;；ES Agent 引擎版用 OSS 存算分离与租户切片把亿级租户、千亿向量成本压掉七成；Qoder、识季、倍思给出生产数字；Exa 提出 per-token 信息密度并称 Agent 搜索请求已超全人类。核心判断：企业级 Agent 的分水岭不在模型，而在搜索与知识基础设施。</description></item><item><title>算力单位不再是芯片，而是Pod——云栖UALink实践专场：开放互连从规范走向落地的第一年</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-ualink-practice-ecosystem/</link><pubDate>Thu, 24 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-ualink-practice-ecosystem/</guid><description>云栖2026「超节点Scale-Up开放互连与开源计算生态：UALink实践」专场复盘：带宽年增1.4倍追不上算力年增3倍，互连成为成本与延迟主战场。UALink两年从8家发起长到110多家成员，2.0版发布四份规范，2027年首批交换机与加速器将至；在网计算把集合通信从GPU搬进交换机，内存语义让FPGA与内存池成为域内新公民，协议胜负手是端到端互通性。讲者名按议程校正，规格经外部核验。</description></item><item><title>算力是廉价的，搬运是昂贵的：云栖2026算力与存储论坛的五条链</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-compute-storage-server-innovation/</link><pubDate>Thu, 24 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-compute-storage-server-innovation/</guid><description>2026云栖大会「Agentic AI 时代的算力与存储服务器革新」分论坛八场演讲的完整拆解：内存墙的能耗账如何把推理改写成&amp;quot;KV 存储类问题&amp;quot;，KV Cache 如何从显存优化升格为跨五层介质的基础设施，CPU 配比为何从 1:8 走向 1:2，以及运维、算子优化和硬件选型如何被仿真器与 Agent 重构。全文基于 250 段转写逐段核对，关键主张附时间段与外部核验。</description></item><item><title>算力的「兑现率」战争：平头哥开源SAIL软件栈，真武客户交出四本账</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-t-head-sail-software-stack/</link><pubDate>Thu, 24 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-t-head-sail-software-stack/</guid><description>2026云栖平头哥算力峰会上，T-Head SAIL软件栈全面开源：GitHub主线开发、分批放出工具链与加速库、适配代码回流上游。小红书、蚂蚁、小鹏、北大四类用户分别交出算子迁移、推理29倍提升、千卡训练与全景视频生成的账本。圆桌聚焦day-0适配、超节点规模与故障半径权衡、agent写代码时代的硬件接口开放度。论坛口径整理，外部可核主张已标注。</description></item><item><title>重构云接口：交互坍缩98%之后，云的难题变成身份、权限与那10%的失控</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-agent-engineering-cloud-interface/</link><pubDate>Thu, 24 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-agent-engineering-cloud-interface/</guid><description>云栖2026「Agent工程化」分论坛：建ECS+Nginx从24次操作30分钟降到3次交互3分钟，搭Landing Zone从427次交互降到3-6次。阿里云以五层架构、Skill/MCP/CLI工具矩阵、Open Agent与Agent三A重构云接口；达能、AutoMQ、Sensor Group给出落地实践。但效率解决后，瓶颈转移到身份、权限与审计：顶尖模型仍有约10%概率不遵守约束。</description></item><item><title>把思考变成电：2026 云栖开幕式主论坛的路线图与缺口</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-23-yunqi2026-opening-main-forum/</link><pubDate>Wed, 23 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-23-yunqi2026-opening-main-forum/</guid><description>2026 云栖大会开幕式主论坛（9314 秒官方回放完整转写）上，吴泳铭给出两个判断：机器思考总量将达人类千倍以上、机器智能时代的代表性产品还没出现，阿里据此押注模型、芯片、AI 云三大基建，目标 2032 年数据中心超 20GW。平头哥发布真武 V900，千问披露 RSI 自我进化与 5–10T 参数规划，荣耀与平安分别给出终端、金融两个落地样本。本文按时间轴完整复盘，关键数字经外部多源核验，厂商自报数据与待核验口径均已标注。</description></item></channel></rss>