<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/"><channel><title>KV Cache on MessageDaily</title><link>https://inkeast.github.io/MessageDaily/tags/kv-cache/</link><description>Recent content in KV Cache on MessageDaily</description><generator>Hugo</generator><language>zh-cn</language><lastBuildDate>Thu, 24 Sep 2026 00:00:00 +0000</lastBuildDate><atom:link href="https://inkeast.github.io/MessageDaily/tags/kv-cache/index.xml" rel="self" type="application/rss+xml"/><item><title>为Agent重做数据层：湖库一体、多模数据库与KV Cache，云栖2026一场论坛的五个答案</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-agent-native-lakebase/</link><pubDate>Thu, 24 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-agent-native-lakebase/</guid><description>2026云栖大会数据库论坛《为Agent重做数据层》全链路复盘：Apsara LakeBase以湖库一体与秒级弹性重做Agent成本曲线，PolarDB多模引擎、ADB具身数据闭环、SelectDB/ClickHouse/Lindorm各守一环，Tair语义缓存把QReCC命中率13%提到80%、KV Cache让百炼命中率90%→96%。当Agent成为数据的主要生产者与消费者，数据层正从容器变成工作底座。</description></item><item><title>当KV Cache超过模型权重，互连成了开放标准的战场——云栖超节点开放互连论坛复盘</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-scaleup-open-interconnect/</link><pubDate>Thu, 24 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-scaleup-open-interconnect/</guid><description>2026云栖「超节点Scale-Up开放互连与开源计算生态」论坛复盘：KV Cache在千问3-235B中已占57%存储、超过权重本身，内存墙把互连协议推上主战场。UALink 2.0落地与3.0路线、CXL从&amp;rsquo;已死&amp;rsquo;论调中复活、磐久UMX分层介质以存代算、Beluga用CXL内存池把命中场景TTFT砍掉九成，圆桌上AMD与三星直言协议百花齐放不可持续。核心判断：超节点的竞争单位正从芯片变成&amp;rsquo;协议+介质+软件&amp;rsquo;的开放生态位。讲者与讲题已按议程页校正，关键产品规格经外部核验。</description></item><item><title>当Token成本成为AI的商业闭环：一场论坛透出的下一代智算基础设施全景</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-h3c-token-cost-performance-computing/</link><pubDate>Thu, 24 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-24-yunqi2026-h3c-token-cost-performance-computing/</guid><description>本文整理自云栖大会2026「新华三：打造Token极致性价比，下一代智算关键技术创新论坛」全场实录。十位来自新华三、阿里云、英特尔、平头哥、博通、清程极智、是石科技的讲者，从超节点、异构协同、智能网卡、跨域网络到KV Cache存储新架构，勾勒出同一条主线：当AI从不计成本地堆算力转向逐个Token地算成本，基础设施的每一层——芯片、网络、存储、软件——都要围绕&amp;quot;每个Token的性价比&amp;quot;重新设计。</description></item><item><title>当昂贵的 GPU 开始等便宜的数据：云栖 2026 存储专场，CPFS 商用与 KVCacheStore 首发背后的一笔账</title><link>https://inkeast.github.io/MessageDaily/posts/2026-09-23-yunqi2026-cpfs-data-infra-forum/</link><pubDate>Wed, 23 Sep 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-09-23-yunqi2026-cpfs-data-infra-forum/</guid><description>2026 云栖大会存储专场全程复盘（10757 秒转写）：训练迈向百万卡、推理上下文冲向百万 token，瓶颈正从算力转向数据存取。阿里云商用全栈自研 CPFS（单文件系统 100PB），首发 KVCacheStore（用 SSD 换显存，Kimi 实测 TTFT 降 54%），OSS 表格桶补齐全模态湖仓，EBS 从盘进化为池。关键数字经外部交叉核验，自报口径已标注。</description></item><item><title>GPU其实很闲：AI Infra四层架构与榨干硅极限的效率革命</title><link>https://inkeast.github.io/MessageDaily/posts/2026-07-31-ai-infra-gpu-utilization/</link><pubDate>Fri, 31 Jul 2026 00:00:00 +0000</pubDate><guid>https://inkeast.github.io/MessageDaily/posts/2026-07-31-ai-infra-gpu-utilization/</guid><description>当AI行业的重心从训练转向推理，一个被忽视的事实浮出水面：GPU大多数时间其实很&amp;quot;闲&amp;quot;。Azure推理负载高达65%的能耗消耗在空转等待上，OpenAI的Chat类请求也达到52%。本文基于硅谷101播客，系统梳理AI Infra四层架构，拆解SGLang/vLLM等开源推理引擎如何通过KV Cache复用、连续批处理、PD分离、投机采样、强化学习训练框架MegaScale等技术，把GPU利用率从50%推向90%+——软件层的每一次优化都变成直接的商业问题。</description></item></channel></rss>