跳到正文

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

38条精选相关主题模型发布行业动态AI 编码

最新精选

第 1–20 条 · 共 38 条
10月2日周五
  1. NVIDIA Blog66

    OpenAI GPT-6 Astra Ultrafast 上线,基于 NVIDIA Blackwell GPU 实现 8x token 生成提速

    GPT-6 Astra Ultrafast 已在 OpenAI API 开放,并向符合条件的 ChatGPT Work 和 Codex 用户提供,运行在 NVIDIA Blackwell GPU 上,token 生成速度最高达 Astra Standard 模式的 8 倍。

    推荐理由:原文给出了 8x 提速的量化依据和适用场景,开发者可以据此评估是否将编码智能体工作流切换到 Ultrafast 模式。

9月30日周三
  1. Hugging Face Blog63

    Hugging Face 发布 Open TTS Leaderboard:用客观指标评测多语言 TTS 与声音克隆

    Hugging Face 推出 Open TTS Leaderboard,用 Qwen3 ASR 的 WER/CER、H200 上的 RTFx 和 TTFA 以及 WavLM 说话人相似度等客观指标评估开源 TTS 模型,把单模型评测时间从约两周缩短到数小时。

    推荐理由:原文说明了用客观指标将 TTS 评测从数周缩到数小时的做法,以及主流竞技场对开源模型覆盖不足的结构性原因。

  2. AWS Machine Learning Blog69

    OpenAI GPT-6.1 Sol 在 Amazon Bedrock 正式上线

    GPT-6.1 Sol 在 Amazon Bedrock 正式可用,聚焦智能体编码、计算机操作和专业工作负载的更强推理能力。据 OpenAI 称,其 DeepSWE v1.1 成绩与 GPT-6 Astra 相当且每任务成本约为五分之一,超过 GPT-6 Sol 最佳成绩 6.4 个百分点;在透明度、用户意图和显式限制评估中也优于 GPT-6 Sol。

    推荐理由:官方公告给出了与 GPT-6 Sol 和 GPT-6 Astra 的具体对比数据,可帮助读者评估其智能体工作场景的性价比。

9月29日周二
  1. Microsoft Research62

    Microsoft Research 发布面向生物学的 AI 研究系统 Quine

    Microsoft Research 推出 Quine,一个包含生物学多模态世界模型和连接科学工具、文献与科研人员的交互框架的研究系统。它与 Broad Institute 合作将其用于胰腺导管腺癌(PDAC)研究,预测并排序可驱动肿瘤细胞状态转变的化合物,湿实验验证了排名靠前的候选化合物,从缩小化合物范围到确定待验证候选只需一个周末。

    推荐理由:微软官方介绍 Quine 的架构与 PDAC 癌症研究实测结果,读者可以了解 AI 世界模型如何压缩湿实验迭代周期。

9月24日周四
  1. Hugging Face Blog60

    Liquid AI 发布 LFM2.5-VL-3B 的 DSpark 草稿模型,加速视觉语言推理

    Liquid AI 发布面向视觉语言模型 LFM2.5-VL-3B 的实验性 DSpark 草稿模型,通过投机解码在不改变输出质量的前提下换取更快推理,解码在设备端最高加速 3.13x、H100 上最高 2.66x,端到端分别为最高 2.62x 和 2.27x。

    推荐理由:原文给出视觉语言模型的投机解码加速方案、具体倍数与内存开销,并覆盖 llama.cpp、MLX-VLM、SGLang 的接入方法。

9月23日周三
  1. Google DeepMind64

    Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音生成模型

    Google DeepMind 于 9 月 23 日发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持用自然语言提示词在超过 100 种语言中自定义角色声音、从 30 秒音频样本复刻声音、逐行指导表演节奏与方言变化,并原生支持双说话人场景生成。

    推荐理由:官方公告给出了两款 TTS 模型的能力细节、基准成绩和开放渠道,读者可以据此判断语音创作工作流的变化。

9月22日周二
9月10日周四
  1. OpenAI News67

    OpenAI 发布 Agents API,用于构建云端智能体

    OpenAI 发布 Agents API,这是一个托管服务,用于构建和上线云端智能体。该 API 由 Codex harness 驱动,提供编排、长时间运行会话和工具使用能力。

    推荐理由:原文点出该 API 由 Codex harness 驱动,支持长时间会话和工具调用,可据此了解 OpenAI 托管智能体的产品形态。

9月8日周二
  1. Google DeepMind66

    Google DeepMind 发布 AlphaGenome Atlas,预测人类基因组约 90 亿种单碱基变异的分子影响

    Google DeepMind 发布 AlphaGenome Atlas 平台,包含人类基因组中约 90 亿种单核苷酸变异的分子效应预测,数据集达 1 PB,超过 AlphaFold 数据库 30 倍以上,向学术研究免费开放。

    推荐理由:平台覆盖全部约 90 亿种单碱基变异并附 AVI 评分,读者可以据此了解它在罕见病和数量性状研究中的实际用法。

9月5日周六
  1. GitHub Blog · AI & ML70

    GitHub 发布 Project HydraFusion 研究预览,用多模型编排降低 Copilot 编码成本

    GitHub 在 GitHub Copilot CLI 推出 Project HydraFusion 研究预览,通过运行时多模型编排,按任务在 Single、Cascade、Critique 三种执行模式中选择,并调用跨供应商模型完成起草、审查、修订或升级。

    推荐理由:原文给出三套执行模式、具体基准对比和开放步骤,读者可以据此评估多模型编排对自己编码工作流的成本与质量影响。

9月3日周四
  1. Hugging Face Blog73

    Hugging Face 开源 funes,为 Claude Code 和 Codex 等编码智能体添加本地记忆层

    Hugging Face 发布开源工具 funes,把本机已有的智能体会话记录建为可检索记忆,支持 Claude Code、Codex、pi 和 Hermes。它本地完成嵌入和重排,无需账号即可使用,也可绑定到私有的 Hugging Face 数据集跨机器同步。在 handoff-vs-recall 基准上,recall 比写交接文档分别便宜 8x 和 4x。

    推荐理由:Hugging Face 官方开源的记忆层工具,给出了安装方式和基准对比,读者可以评估它能否复用现有编码智能体的会话记录。

9月2日周三
  1. Google DeepMind70

    Google DeepMind 为 Gemini 3.7 Flash 等 Flash 模型推出 agentic 视频理解功能

    Google DeepMind 发布 agentic video understanding,覆盖 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite,通过动态搜索和检查视频片段替代固定 1 FPS 的静态处理,官方基准显示成本最多降 66%、token 消耗最多降 88%、准确率最多提升 7%。

    推荐理由:官方给出成本、token 和准确率的具体变化数字与开启方式,开发者可直接评估是否切换现有视频处理流程。

9月1日周二
8月28日周五
  1. Google DeepMind60

    Google DeepMind 发布 Gemini Omni 1.1 Flash,强化生成视频创作控制

    Google DeepMind 于 8 月 27 日发布 Gemini Omni 1.1 Flash,带来面向开发者的生成视频创意控制套件,可通过 Gemini API 在 Google AI Studio 中使用。

    推荐理由:官方发布给出了场景延展、关键帧插值、4K 放大等新能力的具体参数和开放渠道,开发者可据此评估是否接入生成视频工作流。

8月25日周二
  1. Hugging Face Blog66

    Gradio 发布 gr.Workflow:用类型化节点图搭建可部署的 AI 流水线

    Hugging Face 在 Gradio 中推出 gr.Workflow,把 AI 应用流水线直接做成界面:用类型化节点描述步骤,提供拖拽画布,每个节点可运行、每个中间结果可见。

    推荐理由:原文给出 gr.Workflow 的节点类型、REST API 与部署方式,并附多个可打开复制的 Space 示例,便于直接上手搭建 AI 流水线。

8月20日周四
  1. Mistral AI65

    Mistral 发布 Agentic Search,多步检索在 FinanceBench 上将准确率从 26.7% 提至 86%

    Mistral 发布 Agentic Search,一个让模型在复杂文档中搜索、导航、读取并验证信息的多步检索层,通过 Mistral Search Toolkit 及 Studio 和 Vibe 中的 Libraries 提供。

    推荐理由:官方给出了在 FinanceBench 和 OfficeQA Pro 上的具体提升数字与工具设计,读者可据此评估其对企业文档检索工作流的适用性。

7月23日周四
  1. Hugging Face Blog70

    Diffusers 原生支持 Nunchaku 4-bit 扩散模型推理,新增 Nunchaku Lite 集成路径

    Hugging Face 宣布 Diffusers 原生支持 Nunchaku 的 SVDQuant 4-bit 扩散模型推理,通过新的 Nunchaku Lite 路径即可用 from_pretrained() 加载预量化 checkpoint,无需本地 CUDA 编译。

    推荐理由:原文给出 W4A4 量化在 Diffusers 中原生加载后的实测延迟与显存数据,读者可据此评估消费级 GPU 跑大模型的可行路径。