跳到正文

全部动态

今日 95 条
9月24日周四
  1. TrendForce Insights 半导体产业洞察43

    为什么 CSP 开始用 QLC SSD 存储 KV Cache

    TrendForce 观察到部分云服务商正在 SSD POD 中加入 QLC SSD,取代 TLC SSD 加 HDD 的默认配置。AI 推理中 Prefill 与 Decode 阶段不断读写 KV Cache,随着上下文窗口和 batch size 增长,KV Cache 容量需求成倍扩大,厂商因此将缓存从昂贵且容量有限的 HBM 下沉到成本更低的层级。

  2. GitHub Blog · AI & ML60

    GitHub Copilot app 如何渲染 2200 个文件、超百万行变更的超大 Pull Request

    GitHub Copilot app 团队重建了 Pull Request 视图,使其能流畅打开一个含 2,200 个文件、超过一百万变更行和 400 多条行内评论的开源 PR。

    推荐理由:作者以第一手视角拆解了超大 PR 渲染的双几何架构和自动化测量方法,思路对处理大规模动态内容界面有借鉴意义。

9月23日周三
  1. Google DeepMind64

    Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音生成模型

    Google DeepMind 于 9 月 23 日发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持用自然语言提示词在超过 100 种语言中自定义角色声音、从 30 秒音频样本复刻声音、逐行指导表演节奏与方言变化,并原生支持双说话人场景生成。

    推荐理由:官方公告给出了两款 TTS 模型的能力细节、基准成绩和开放渠道,读者可以据此判断语音创作工作流的变化。

  2. NVIDIA Blog19

    Sakeena Fiza 如何为 NVIDIA 硬件的大规模成功保驾护航

    NVIDIA 验证工程师 Sakeena Fiza 负责在大规模量产前测试数据中心硬件,她的团队曾见证 Rubin GPU 首次在系统层面点亮。验证工作覆盖从托盘到机架再到 AI 工厂的整个链路,单块板卡含数万个组件,一个机架可接近 50 万个组件,目标是抢在客户之前发现问题。

  3. Latent Space84

    Anthropic 发布 Claude Opus 5.5,OpenAI 同日跟进降价 50% 的 GPT-6 Sol 和 Luna

    Anthropic 发布 Claude 5.5 家族首个模型 Claude Opus 5.5,称多数任务达到 Fable 5.1 水平、比 Opus 5 快约 30% 且每任务便宜 40%,token 定价从 $5/$25 降至 $4/$20,并成为 Claude Code 与 Claude 应用的默认模型。

    推荐理由:原文汇总了 Opus 5.5 的定价、评测与争议细节,包括第三方拆解显示 40% 降价在 max effort 下并不成立。

  4. Simon Willison22

    Simon Willison 将于 10 月 14 日在旧金山主持智能体工程 Birds of a Feather 交流夜

    Simon Willison 与 Jesse Vincent 将于 10 月 14 日(周三)在旧金山合办一场面向编程智能体开发者的 Birds of a Feather 交流活动,以非正式的 agentic show-and-tell 形式交流实验心得。活动鼓励但不强制分享,明确排除产品推销,欢迎未公开的工作、古怪实验和没有明显市场的未完成项目。

  5. OpenAI News73

    OpenAI 发布 GPT-6 Sol 和 Luna 两款模型

    OpenAI 发布 GPT-6 Sol 和 Luna 两款模型,将前沿智能带入日常工作,两款模型在能力与成本之间提供不同平衡。

    推荐理由:官方发布两条产品线定位信息,读者可据此了解两个新模型在能力与成本上的不同取舍。

9月22日周二