为什么 CSP 开始用 QLC SSD 存储 KV Cache
TrendForce 观察到部分云服务商正在 SSD POD 中加入 QLC SSD,取代 TLC SSD 加 HDD 的默认配置。AI 推理中 Prefill 与 Decode 阶段不断读写 KV Cache,随着上下文窗口和 batch size 增长,KV Cache 容量需求成倍扩大,厂商因此将缓存从昂贵且容量有限的 HBM 下沉到成本更低的层级。
TrendForce 观察到部分云服务商正在 SSD POD 中加入 QLC SSD,取代 TLC SSD 加 HDD 的默认配置。AI 推理中 Prefill 与 Decode 阶段不断读写 KV Cache,随着上下文窗口和 batch size 增长,KV Cache 容量需求成倍扩大,厂商因此将缓存从昂贵且容量有限的 HBM 下沉到成本更低的层级。
Marvell 将在 2026 年 9 月 20–24 日西班牙马拉加的 ECOC 2026 上展示业界首批 2nm 光互连演示,包括首个 2nm 400G/lane 光 PAM4、首个 2nm 800G ZR/ZR+ 可插拔模块(含 MACsec,由 Libra 2nm 相干 DSP 驱动)以及首个 2nm 1.6T ZR 和 coherent-lite O-band 演示。
AMD 在 LEAP 2026 期间宣布,与 Cisco、HUMAIN 合作的 AI 基础设施已由 AMD Instinct MI355X GPU、EPYC CPU 和 Cisco 网络设备投入生产服务,并计划自 2027 年起追加部署最高 250 兆瓦,合资项目按计划到 2030 年达到最高 1 吉瓦。
AMD 宣称用 14 台 EPYC 9965 服务器可替代 100 台 5-7 年机龄的 Intel Xeon Platinum 8280 双路服务器,服务器数量减少 86%,性能总量不变,功耗降低 69%,三年 TCO 降低 41%。
Lam Research 在俄勒冈州 Tualatin 研发中心动工扩建新实验室,建成后洁净室空间扩大超 50%,面积 120,000 平方英尺,预计 2028 年启用。
AMD 宣布截至 2026 年中期 AI 能效提升估计达 4x,超过该阶段 3x 的预期目标,正朝 2030 年机架级 AI 训练与推理能效提升 20x(20x30)的目标推进。
AMD 发布 2025-26 企业责任报告,回顾 2020-2025 目标进展并展望 2030。2020 至 2025 年,可再生能源用电占比从 22% 升至 58%,运营温室气体排放减少 30%,AI 训练和高性能计算节点能效提升 38x,Green500 榜单上的 AMD 系统从 11 台增至 194 台;新目标为 2024-2030 年将机架级 AI 能效提升 20x。
Intel 在 Computex 2026 发布多项 AI 创新,覆盖从芯片到系统级方案。Intel 与 SambaNova、Foxconn 合作打造基于 Xeon 处理器和 SambaNova SN-50 RDU 的机架级 AI 推理基础设施。