OpenAI 在 ChatGPT 推出新广告格式并扩展衡量工具
OpenAI 宣布在 ChatGPT 中推出新的视觉广告格式,面向广告主扩展衡量工具、归因合作与品牌适配度(brand suitability)能力,构建适配 AI 使用方式的广告体系。
OpenAI 宣布在 ChatGPT 中推出新的视觉广告格式,面向广告主扩展衡量工具、归因合作与品牌适配度(brand suitability)能力,构建适配 AI 使用方式的广告体系。
OpenAI 与 Ironclad 正在复杂的合同工作流上训练和评测 AI 智能体,以推进面向专业工作的 computer use 能力。该合作聚焦真实合同场景中的智能体表现,帮助提升 AI 在专业软件操作中的可靠性。
Google Research 将 Earth AI 的 Population Dynamics Foundation Model(PDFM)位置嵌入作为即插即用输入,与五家机构在五类公共卫生挑战上完成独立验证,覆盖 MMR 疫苗接种、心血管疾病、登革热、产后抑郁和霍乱。
Amazon Quick 资源(chat agent、action connector、知识库、flow、space)从开发账户晋升到生产账户此前只能手工重建。
Amazon SageMaker AI 优化生成式 AI 推理推出 aws-ai-ml 技能,通过 Agent Toolkit for AWS 提供,可为 Kiro、Claude Code、Codex 等编码智能体注入推理优化与基准测试专长。
Z.ai(智谱)的 GLM 5.3 现已登陆 Amazon Bedrock,这是一个 753B 参数的 MoE 模型,面向编码和长程智能体任务,Z.ai 报告其在 CyberGym 基准上取得 84.5 的领先分数,并在内部编码基准上较 GLM 5.2 提升 50%。
AWS 推出在 SageMaker Studio UI 中直接创建和管理 HyperPod EKS 集群上 SageMaker Spaces 的功能,数据科学家无需命令行工具即可通过几次点击启动 JupyterLab 或 Code Editor 环境。
Amazon SageMaker AI 推出多轮强化学习(MTRL)微调能力,可将 Qwen3.6-27B 训练成自主调用 BM25 词法检索与向量搜索工具的搜索智能体。
Google 宣布推出基于可信执行环境(TEE)的下一代联邦学习系统,为数据匿名化提供可远程验证与审计的保障。访问策略发布到公开透明日志 Rekor,KMS 和数据处理二进制可由开源代码复现构建;加密训练数据仅在 TEE 内解密处理,工作负载操作者只能看到指标和差分隐私模型权重。
NVIDIA 宣布 DGX Spark 新增 64GB 统一内存配置,10 月 23 日起由 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 发售,起售价 $4,999。
GPT-6 Astra Ultrafast 已在 OpenAI API 开放,并向符合条件的 ChatGPT Work 和 Codex 用户提供,运行在 NVIDIA Blackwell GPU 上,token 生成速度最高达 Astra Standard 模式的 8 倍。
推荐理由:原文给出了 8x 提速的量化依据和适用场景,开发者可以据此评估是否将编码智能体工作流切换到 Ultrafast 模式。
Chatham Financial 使用 Codex 和 GPT-5.6 构建技术并重新设计工作流程,将交易验证时间从 30 分钟缩短到 4 分钟以内,以此扩展其资本市场专业能力。
Amazon Quick 推出 Live Data in Apps,让 AI 构建的 Quick 应用在用户每次打开时实时查询受治理的 Quick Sight 数据集,取代发布时冻结的静态快照。
社交俱乐部 The Den 使用 ChatGPT Work 后每周节省 10-15 小时。在开设新址期间,其补助金申请材料从 3 天缩短至 2 小时完成,酒类执照材料从 4 天缩短至 3 小时完成。
美国连锁超市集团 Albertsons Cos. 正在使用 ChatGPT Enterprise 和 OpenAI API,帮助内部团队提升工作效率,并为数百万顾客简化买菜购物体验。
台湾统一集团旗下数位平台 uniopen 通过监督微调(Amazon SageMaker AI)和提示词级输出优化,将 Amazon Nova 2 Lite 适配到其业务专属的零售内容审核策略。
Ai2 发布 Olmo-core 3,重新设计开源 MoE 训练系统,支持扩展到万亿参数规模。它从 FSDP 改为基于 DDP 的方案,47B 参数 MoE 在 8 块 NVIDIA B300 上吞吐达 52。
Condé Nast 与 AWS Generative AI Innovation Center 合作,基于 Amazon Bedrock 和 Amazon OpenSearch Service 构建了多模态视频发现方案,采用 TwelveLabs Marengo 嵌入模型联合编码视觉、音频和转录信号。
Microsoft Research 开发了一套机器学习系统,为美国大陆 66,935 座变电站提供位置级电网空间天气风险预测,可提前 30-60 分钟预警。
Google DeepMind 推出 SynthID Bio,将水印技术引入合成生物学,把可检测信号直接嵌入生物代码,可在合成的物理蛋白上验证。
推荐理由:原文给出水印在湿实验中不影响蛋白功能的验证细节,读者可据此了解生物安全防线的实际可行性。
CoreWeave 宣布其云平台正式提供 NVIDIA Vera Rubin NVL72 系统与 Spectrum-X 102.4T 以太网组网,Cognition 成为首家在其上运行生产负载的客户,实测 SWE-2 推理总 token 吞吐较 GB200 NVL72 提升最高 4.8x。
Anthropic 的 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5 现已通过 Amazon Bedrock 在印度区域开放。
Amazon Bedrock 现已通过 bedrock-runtime 端点支持 Claude 模型的区域内推理:首尔区域提供 Claude Opus 5 和 Claude Sonnet 5,新加坡区域提供 Claude Sonnet 5。
AMD 推出面向嵌入式开发全流程的智能体 AI 助手 AMD Ross™,覆盖架构设计、优化、调试、PCB 设计、原理图审查、软件与部署。它通过 MCP 服务器连接 AMD Embedded 工具,并内置 AMD Knowledge Base、专家编写的 agent skills 和可运行设计示例,支持自然语言查询文档、执行命令和自动化工作流。
Hugging Face 推出 Open TTS Leaderboard,用 Qwen3 ASR 的 WER/CER、H200 上的 RTFx 和 TTFA 以及 WavLM 说话人相似度等客观指标评估开源 TTS 模型,把单模型评测时间从约两周缩短到数小时。
推荐理由:原文说明了用客观指标将 TTS 评测从数周缩到数小时的做法,以及主流竞技场对开源模型覆盖不足的结构性原因。
GPT-6.1 Sol 在 Amazon Bedrock 正式可用,聚焦智能体编码、计算机操作和专业工作负载的更强推理能力。据 OpenAI 称,其 DeepSWE v1.1 成绩与 GPT-6 Astra 相当且每任务成本约为五分之一,超过 GPT-6 Sol 最佳成绩 6.4 个百分点;在透明度、用户意图和显式限制评估中也优于 GPT-6 Sol。
推荐理由:官方公告给出了与 GPT-6 Sol 和 GPT-6 Astra 的具体对比数据,可帮助读者评估其智能体工作场景的性价比。
Microsoft Research 推出 Quine,一个包含生物学多模态世界模型和连接科学工具、文献与科研人员的交互框架的研究系统。它与 Broad Institute 合作将其用于胰腺导管腺癌(PDAC)研究,预测并排序可驱动肿瘤细胞状态转变的化合物,湿实验验证了排名靠前的候选化合物,从缩小化合物范围到确定待验证候选只需一个周末。
推荐理由:微软官方介绍 Quine 的架构与 PDAC 癌症研究实测结果,读者可以了解 AI 世界模型如何压缩湿实验迭代周期。
OpenAI DevDay 2026 发布超过 20 项公告,涵盖 GPT-6 Astra、ChatGPT、Codex、API、安全以及面向开发者的新工具。GPT-6 Astra 是本次大会的核心发布之一。这些更新面向构建者生态,通过 API 与工具形式提供。
OpenAI 发布 Dots,定位为可在复杂项目和日常任务中持续主动工作的智能助理。官方表示 Dots 能在工作推进的同时帮助用户保持掌控。
Hugging Face 宣布 Hub 新增 RL Environments 支持,环境以带 rl-environment 标签的数据集仓库形式存在,无新仓库类型、注册表或注册流程。
OpenAI 正在征集使用 Codex 的开发者、研究者与创作者的真实故事,寻找下一批 Codex Originals 计划的参与者。用户可提交自己的故事和项目,入选者将展示用 Codex 完成的创造性成果。
Basis 实测中,GPT-6 Astra 完成 50 个标签页的税务工作簿的速度是 GPT-5.6 Sol 的 2 倍。其更强的用户意图理解能力让 Basis 在实际使用中更有信心。
Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,将近乎实时的视频生成与语音结合,为 Gemini 的对话式 AI 提供动态视觉形象,具备精确唇形同步、自然表情和流畅轮次切换。
Liquid AI 发布面向视觉语言模型 LFM2.5-VL-3B 的实验性 DSpark 草稿模型,通过投机解码在不改变输出质量的前提下换取更快推理,解码在设备端最高加速 3.13x、H100 上最高 2.66x,端到端分别为最高 2.62x 和 2.27x。
推荐理由:原文给出视觉语言模型的投机解码加速方案、具体倍数与内存开销,并覆盖 llama.cpp、MLX-VLM、SGLang 的接入方法。
Remedy Entertainment 的《CONTROL Resonant》首发即上线 GeForce NOW,玩家可在云端操控 Dylan Faden 的超常能力对抗 Hiss 等威胁,Ultimate 会员可享 RTX 5080 级性能、DLSS 4、光线追踪与最高 5K HDR 串流,无需 100GB 本地安装。
Perplexity 搭载 AMD Ryzen AI Max 系列处理器,推出便携式 Agentic PC。页面正文主要为 AMD 品牌素材下载的条款与条件说明,未提供该产品的更多技术细节。
Google Private AI Compute 团队宣布为该平台加入私密的服务端持久记忆,使 AI 助手获得跨设备长期记忆,同时保持端侧处理级别的隐私标准。
OpenAI Academy 迎来两周年。OpenAI 表示将继续把 AI 技能带给更多社区。
Google DeepMind 于 9 月 23 日发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持用自然语言提示词在超过 100 种语言中自定义角色声音、从 30 秒音频样本复刻声音、逐行指导表演节奏与方言变化,并原生支持双说话人场景生成。
推荐理由:官方公告给出了两款 TTS 模型的能力细节、基准成绩和开放渠道,读者可以据此判断语音创作工作流的变化。
invideo 使用 GPT-6 Astra 提升视频编辑能力:剪辑规划更精准,色彩校正与调色效率提升 3 倍,并可在一天内制作 50 个自定义特效。