为什么 CSP 开始用 QLC SSD 存储 KV Cache
TrendForce 观察到部分云服务商正在 SSD POD 中加入 QLC SSD,取代 TLC SSD 加 HDD 的默认配置。AI 推理中 Prefill 与 Decode 阶段不断读写 KV Cache,随着上下文窗口和 batch size 增长,KV Cache 容量需求成倍扩大,厂商因此将缓存从昂贵且容量有限的 HBM 下沉到成本更低的层级。
TrendForce 观察到部分云服务商正在 SSD POD 中加入 QLC SSD,取代 TLC SSD 加 HDD 的默认配置。AI 推理中 Prefill 与 Decode 阶段不断读写 KV Cache,随着上下文窗口和 batch size 增长,KV Cache 容量需求成倍扩大,厂商因此将缓存从昂贵且容量有限的 HBM 下沉到成本更低的层级。
Marvell 将在 2026 年 9 月 20–24 日西班牙马拉加的 ECOC 2026 上展示业界首批 2nm 光互连演示,包括首个 2nm 400G/lane 光 PAM4、首个 2nm 800G ZR/ZR+ 可插拔模块(含 MACsec,由 Libra 2nm 相干 DSP 驱动)以及首个 2nm 1.6T ZR 和 coherent-lite O-band 演示。
AMD 宣称用 14 台 EPYC 9965 服务器可替代 100 台 5-7 年机龄的 Intel Xeon Platinum 8280 双路服务器,服务器数量减少 86%,性能总量不变,功耗降低 69%,三年 TCO 降低 41%。
Lam Research 在俄勒冈州 Tualatin 研发中心动工扩建新实验室,建成后洁净室空间扩大超 50%,面积 120,000 平方英尺,预计 2028 年启用。
AMD 宣布截至 2026 年中期 AI 能效提升估计达 4x,超过该阶段 3x 的预期目标,正朝 2030 年机架级 AI 训练与推理能效提升 20x(20x30)的目标推进。
Intel 在 Computex 2026 发布多项 AI 创新,覆盖从芯片到系统级方案。Intel 与 SambaNova、Foxconn 合作打造基于 Xeon 处理器和 SambaNova SN-50 RDU 的机架级 AI 推理基础设施。