跳到正文

全部动态

今日 29 条
9月24日周四
  1. GitHub Blog · AI & ML60

    GitHub Copilot app 如何渲染 2200 个文件、超百万行变更的超大 Pull Request

    GitHub Copilot app 团队重建了 Pull Request 视图,使其能流畅打开一个含 2,200 个文件、超过一百万变更行和 400 多条行内评论的开源 PR。

    推荐理由:作者以第一手视角拆解了超大 PR 渲染的双几何架构和自动化测量方法,思路对处理大规模动态内容界面有借鉴意义。

9月23日周三
  1. Google DeepMind64

    Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音生成模型

    Google DeepMind 于 9 月 23 日发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持用自然语言提示词在超过 100 种语言中自定义角色声音、从 30 秒音频样本复刻声音、逐行指导表演节奏与方言变化,并原生支持双说话人场景生成。

    推荐理由:官方公告给出了两款 TTS 模型的能力细节、基准成绩和开放渠道,读者可以据此判断语音创作工作流的变化。

  2. NVIDIA Blog19

    Sakeena Fiza 如何为 NVIDIA 硬件的大规模成功保驾护航

    NVIDIA 验证工程师 Sakeena Fiza 负责在大规模量产前测试数据中心硬件,她的团队曾见证 Rubin GPU 首次在系统层面点亮。验证工作覆盖从托盘到机架再到 AI 工厂的整个链路,单块板卡含数万个组件,一个机架可接近 50 万个组件,目标是抢在客户之前发现问题。

  3. OpenAI News73

    OpenAI 发布 GPT-6 Sol 和 Luna 两款模型

    OpenAI 发布 GPT-6 Sol 和 Luna 两款模型,将前沿智能带入日常工作,两款模型在能力与成本之间提供不同平衡。

    推荐理由:官方发布两条产品线定位信息,读者可据此了解两个新模型在能力与成本上的不同取舍。

9月22日周二
9月21日周一
  1. Hugging Face Blog64

    Hugging Face 发布 tokenizers v1 候选版,单线程编码最快提升至 v0.23 的 30 倍

    Hugging Face 发布 tokenizers v1 候选版,在 Apple M4 Max 上单线程编码比 v0.23 快 3 到 30 倍,八线程扩展达线性的 76%,且输出 token ID 完全一致。

    推荐理由:官方详述 tokenizers v1 的性能优化手段和可复现基准,读者可以据此评估升级对训练与推理数据供给的实际收益。

9月18日周五
  1. GitHub Blog · AI & ML42

    该不该读 AI 生成代码、RAG 死了吗、Skills 会取代 MCP 吗?——GitHub Podcast 逐条拆解热门 AI 观点

    GitHub Podcast 逐条拆解五个常见 AI 热门观点。核心结论:AI 生成代码仍需按风险分级审查;Skills 与 MCP 解决不同问题,MCP 提供工具与数据访问标准,Skills 以 Markdown 打包团队流程与最佳实践,两者互补;RAG 未死,检索让模型更接近答案,可与 agent、MCP、Skills 同一工作流共存。

  2. Google Research47

    Google Research 用生成式 UI(GenUI)让教师创建交互式学习模拟

    Google Research 推出新的研究实验,教师可借助生成式 UI(GenUI)按自己的教学目标与课程动态生成定制化、引导式的交互学习模拟。研究基于 LearnLM 系列教育模型的主动学习原则,并发布了 30 多个由 AI 生成、经教师审核的英文 STEM 学习交互示例,覆盖物理、化学、生物和数学,面向初高中。