Ai2 发布开源训练框架 Olmo-core 3,面向大规模 MoE 训练
Ai2 发布 Olmo-core 3,重新设计开源 MoE 训练系统,支持扩展到万亿参数规模。它从 FSDP 改为基于 DDP 的方案,47B 参数 MoE 在 8 块 NVIDIA B300 上吞吐达 52。
Ai2 发布 Olmo-core 3,重新设计开源 MoE 训练系统,支持扩展到万亿参数规模。它从 FSDP 改为基于 DDP 的方案,47B 参数 MoE 在 8 块 NVIDIA B300 上吞吐达 52。
听力科技初创公司 Legato 周四宣布,其 AI 听力眼镜 Legato Frames 开售,售价 999 美元起,面向轻中度听损成人。产品通过 AI 区分人声与背景噪声并放大语音,双扬声器系统可在耳旁几英寸处将漏音降低 99%,全部处理在眼镜本地完成,无摄像头或录音。
Condé Nast 与 AWS Generative AI Innovation Center 合作,基于 Amazon Bedrock 和 Amazon OpenSearch Service 构建了多模态视频发现方案,采用 TwelveLabs Marengo 嵌入模型联合编码视觉、音频和转录信号。
OpenAI 在 Dev Day 上将 ChatGPT 打造成应用发现与使用入口,推出对话内应用推荐、插件扩展面板和 Sign in with ChatGPT 身份层,允许用户在第三方应用中使用已有 AI 额度,已有 16 个发布伙伴。
美国政府推出由 Google 与 SpaceXAI 协助搭建的公共聊天机器人 America.gov,目前较难被越狱,并确认拜登赢得 2020 年大选。
Airbnb 在秋季产品更新中推出 AI 搜索,用户可通过开关用文字或语音提示搜索房源,界面会根据偏好显示动态筛选条件,例如输入 baby 会自动出现婴儿床、游乐场等筛选。
AI 创业公司 Instinct 推出新功能 Instinct Selections,主动向用户推送餐饮、旅行、购物等个性化产品推荐,并宣称将与当地厨师、设计师、旅行向导等合作提供"人工品味"的精选建议。
SpaceXAI 的 Grokipedia 发布 v0.3 更新,带来新 logo 以及首页、实时编辑页面的重新设计。新版首页新增精选文章、最多阅读榜单和最新编辑追踪,精选列表采用可旋转的书籍化设计;文章页面也优化了顶部关键信息表格样式并缩小行距。此前该网站曾一度停止更新超过三个月。
OpenAI 在 Dev Day 上发布 Decisions API 的有限预览版,让 Luna 模型从预定义选项中快速低成本地做出分类或智能体行为选择,功能与 TypeSafe AI 本月发布的 Jev 类似。Jev 这类"System One"决策模型可为每次智能体操作做审查,监控同类 Hugging Face 事件,用 Jev 成本约 $2.94,而前沿 LLM 需 $372。
Google 在 Gemini 聊天中全球推出 Skills,用于保存和调用特定任务的详细提示词,输入“/”加名称即可调用,并取代对标 OpenAI Custom GPTs 的 Gems。
DoorDash 于周三宣布推出可通过 Apple Messages 发短信下单的 AI 智能体,支持“order my usual”等指令、指定菜品、本地推荐,并能处理混合饮食偏好和不同份数的团体订单。美国用户可加入 waitlist 试用,同时 DoorDash 将在北加州与部分餐厅测试配送无人机,以对抗 Uber Eats 和 Grubhub。
Microsoft Research 开发了一套机器学习系统,为美国大陆 66,935 座变电站提供位置级电网空间天气风险预测,可提前 30-60 分钟预警。
Meta 推出 Muse AI 智能体,宣称可帮忙发邮件和在线购物,实际效果取决于用户愿把数据和信用卡交给 Meta。此后 Meta 还宣布了类似 Tamagotchi 的 Muse Charm 配件、面向中小企业的 Muse Enterprise Platform、Mac 应用、智能眼镜支持,并修复了一个可让攻击者控制该智能体的漏洞,而 Amazon 已屏蔽 Muse AI 智能体。
Google DeepMind 推出 SynthID Bio,将水印技术引入合成生物学,把可检测信号直接嵌入生物代码,可在合成的物理蛋白上验证。
推荐理由:原文给出水印在湿实验中不影响蛋白功能的验证细节,读者可据此了解生物安全防线的实际可行性。
CoreWeave 宣布其云平台正式提供 NVIDIA Vera Rubin NVL72 系统与 Spectrum-X 102.4T 以太网组网,Cognition 成为首家在其上运行生产负载的客户,实测 SWE-2 推理总 token 吞吐较 GB200 NVL72 提升最高 4.8x。
Instagram 宣布其独立 Edits 应用新增 AI 创意助手,可结合账号的点赞、观看、留存和分享等数据,回答趋势、内容表现和选题、脚本、字幕、音频等开放性问题。该功能对创作者免费,重度用户需购买 Meta One 订阅获得更多用量;作者指出 YouTube 也刚更新了类似的 AI 创作者数据面板,并提问当所有人都在优化内容时,平台生态会走向何方。
Anthropic 的 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5 现已通过 Amazon Bedrock 在印度区域开放。
Amazon Bedrock 现已通过 bedrock-runtime 端点支持 Claude 模型的区域内推理:首尔区域提供 Claude Opus 5 和 Claude Sonnet 5,新加坡区域提供 Claude Sonnet 5。
AMD 推出面向嵌入式开发全流程的智能体 AI 助手 AMD Ross™,覆盖架构设计、优化、调试、PCB 设计、原理图审查、软件与部署。它通过 MCP 服务器连接 AMD Embedded 工具,并内置 AMD Knowledge Base、专家编写的 agent skills 和可运行设计示例,支持自然语言查询文档、执行命令和自动化工作流。
Hugging Face 推出 Open TTS Leaderboard,用 Qwen3 ASR 的 WER/CER、H200 上的 RTFx 和 TTFA 以及 WavLM 说话人相似度等客观指标评估开源 TTS 模型,把单模型评测时间从约两周缩短到数小时。
推荐理由:原文说明了用客观指标将 TTS 评测从数周缩到数小时的做法,以及主流竞技场对开源模型覆盖不足的结构性原因。
GPT-6.1 Sol 在 Amazon Bedrock 正式可用,聚焦智能体编码、计算机操作和专业工作负载的更强推理能力。据 OpenAI 称,其 DeepSWE v1.1 成绩与 GPT-6 Astra 相当且每任务成本约为五分之一,超过 GPT-6 Sol 最佳成绩 6.4 个百分点;在透明度、用户意图和显式限制评估中也优于 GPT-6 Sol。
推荐理由:官方公告给出了与 GPT-6 Sol 和 GPT-6 Astra 的具体对比数据,可帮助读者评估其智能体工作场景的性价比。
Simon Willison 在旧金山 Fort Mason 现场 live blog OpenAI DevDay 2026 主题演讲。
推荐理由:作者在现场逐条记录了 DevDay 的发布与演示翻车细节,读者可以借此了解各新品的第一手使用情况。
Microsoft Research 推出 Quine,一个包含生物学多模态世界模型和连接科学工具、文献与科研人员的交互框架的研究系统。它与 Broad Institute 合作将其用于胰腺导管腺癌(PDAC)研究,预测并排序可驱动肿瘤细胞状态转变的化合物,湿实验验证了排名靠前的候选化合物,从缩小化合物范围到确定待验证候选只需一个周末。
推荐理由:微软官方介绍 Quine 的架构与 PDAC 癌症研究实测结果,读者可以了解 AI 世界模型如何压缩湿实验迭代周期。
OpenAI DevDay 2026 发布超过 20 项公告,涵盖 GPT-6 Astra、ChatGPT、Codex、API、安全以及面向开发者的新工具。GPT-6 Astra 是本次大会的核心发布之一。这些更新面向构建者生态,通过 API 与工具形式提供。
OpenAI 发布 Dots,定位为可在复杂项目和日常任务中持续主动工作的智能助理。官方表示 Dots 能在工作推进的同时帮助用户保持掌控。
llm-anthropic 0.30 发布,除支持 Claude Sonnet 5.5 外,新增 `llm anthropic refresh` 命令,可直接从 Anthropic API 刷新模型列表,无需发布新版本即可支持新模型。同时新增 `llm anthropic count` 命令,借助免费的 token counting API 在发送提示词前统计其 token 数量。
Hugging Face 宣布 Hub 新增 RL Environments 支持,环境以带 rl-environment 标签的数据集仓库形式存在,无新仓库类型、注册表或注册流程。
OpenAI 正在征集使用 Codex 的开发者、研究者与创作者的真实故事,寻找下一批 Codex Originals 计划的参与者。用户可提交自己的故事和项目,入选者将展示用 Codex 完成的创造性成果。
Basis 实测中,GPT-6 Astra 完成 50 个标签页的税务工作簿的速度是 GPT-5.6 Sol 的 2 倍。其更强的用户意图理解能力让 Basis 在实际使用中更有信心。
Simon Willison 于 2026 年 9 月 24 日发布 commit-rewriter 0.2。原文为一条简短的动态(beat),与 git 相关,未提供更多功能细节。
Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,将近乎实时的视频生成与语音结合,为 Gemini 的对话式 AI 提供动态视觉形象,具备精确唇形同步、自然表情和流畅轮次切换。
Liquid AI 发布面向视觉语言模型 LFM2.5-VL-3B 的实验性 DSpark 草稿模型,通过投机解码在不改变输出质量的前提下换取更快推理,解码在设备端最高加速 3.13x、H100 上最高 2.66x,端到端分别为最高 2.62x 和 2.27x。
推荐理由:原文给出视觉语言模型的投机解码加速方案、具体倍数与内存开销,并覆盖 llama.cpp、MLX-VLM、SGLang 的接入方法。
Remedy Entertainment 的《CONTROL Resonant》首发即上线 GeForce NOW,玩家可在云端操控 Dylan Faden 的超常能力对抗 Hiss 等威胁,Ultimate 会员可享 RTX 5080 级性能、DLSS 4、光线追踪与最高 5K HDR 串流,无需 100GB 本地安装。
Perplexity 搭载 AMD Ryzen AI Max 系列处理器,推出便携式 Agentic PC。页面正文主要为 AMD 品牌素材下载的条款与条件说明,未提供该产品的更多技术细节。
Google 今日发布两款 Gemini 文本转语音模型 gemini-3.8-flash-tts 和 gemini-3.8-flash-lite-tts,提供超过 2,000 个声音,并支持用 30 秒音频样本创建自定义声音。
Google Private AI Compute 团队宣布为该平台加入私密的服务端持久记忆,使 AI 助手获得跨设备长期记忆,同时保持端侧处理级别的隐私标准。
OpenAI Academy 迎来两周年。OpenAI 表示将继续把 AI 技能带给更多社区。
Google DeepMind 于 9 月 23 日发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持用自然语言提示词在超过 100 种语言中自定义角色声音、从 30 秒音频样本复刻声音、逐行指导表演节奏与方言变化,并原生支持双说话人场景生成。
推荐理由:官方公告给出了两款 TTS 模型的能力细节、基准成绩和开放渠道,读者可以据此判断语音创作工作流的变化。
invideo 使用 GPT-6 Astra 提升视频编辑能力:剪辑规划更精准,色彩校正与调色效率提升 3 倍,并可在一天内制作 50 个自定义特效。
Ringg 使用 GPT-5.6 构建支持语音、聊天、WhatsApp 和网页渠道的多语言 AI 智能体,可解决多达 65% 的客户来电。相比 GPT-4.1,成本降低 90%。