Ringg 的 AI 智能体借助 OpenAI 解决多达 65% 的客户来电
Ringg 使用 GPT-5.6 构建支持语音、聊天、WhatsApp 和网页渠道的多语言 AI 智能体,可解决多达 65% 的客户来电。相比 GPT-4.1,成本降低 90%。
Ringg 使用 GPT-5.6 构建支持语音、聊天、WhatsApp 和网页渠道的多语言 AI 智能体,可解决多达 65% 的客户来电。相比 GPT-4.1,成本降低 90%。
法律科技公司 Harvey 使用 GPT-6 Astra 生成更具结构性、更贴合语境的法律文件。该模型帮助律师从文书起草中解放出来,将精力集中在法律策略上。
OpenAI 将 ChatGPT Ads 扩展至东南亚和台湾地区,符合条件的广告主可通过该服务覆盖 60 多个国家/地区的用户。
OpenAI 介绍 GPT-6 在提示词缓存方面的改进,包括更高的缓存命中率、新的诊断工具、显式断点以及相关控制选项,用于降低延迟和成本。
NVIDIA 于加拿大多伦多 ROSCon 大会发布 Isaac ROS 5.0,这是一套基于 ROS 的 GPU 加速开源软件包,新增智能体工作流以帮助开发者和 AI 智能体协同构建机器人应用。
OpenAI 的 GPT‑6 Astra 帮助 Parallel 的智能体研究和综合劳动力市场数据,相比此前模型将时间和成本各缩短一半。
Hugging Face 宣布 transformers 支持加载 GGUF 模型,通过 from_pretrained 传入 gguf_file 即可在本机运行 Hub 上的量化检查点。
推荐理由:Hugging Face 官方给出 GGUF 在 transformers 中的用法和与 llama.cpp 的实测对比,读者可据此判断本地推理的可行路径。
NVIDIA 阐述 Physical AI(自动驾驶汽车、人形机器人与工业机器人)规模化部署必须覆盖硬件、软件、AI 行为与运行环境各层的安全体系。ABI Research 预计到 2035 年 L3-L5 自动驾驶汽车保有量达 4900 万辆,Omdia 估计 2026-2035 年将部署约 6000 万台工业机器人。
OpenAI 扩展 OpenAI Academy,新增面向员工、开发者、管理者、教育者和学生的多条学习路径。学员可通过这些路径学习并展示实用的 AI 技能。
Google Research 推出新的研究实验,教师可借助生成式 UI(GenUI)按自己的教学目标与课程动态生成定制化、引导式的交互学习模拟。研究基于 LearnLM 系列教育模型的主动学习原则,并发布了 30 多个由 AI 生成、经教师审核的英文 STEM 学习交互示例,覆盖物理、化学、生物和数学,面向初高中。
Pawprint Studio 的免费开放世界捉宠 RPG《Aniimo》随首发同步上线 GeForce NOW,玩家可跨设备云端游玩,无需等待 45GB 下载。
律所 Cooley 基于 ChatGPT Work 构建了 GO Public,将 AI 能力引入 IPO 流程。该工具帮助律师更早发现问题,把专业判断集中在最关键之处。
OpenAI 推出面向法律行业的 Astra for Law。它提供前沿智能、定制化律所工作流、可连接的法律数据源,以及针对机密客户工作的高等级安全管控。
OpenAI 推出 AI 驱动的广告体验,包括 Sponsored Agents、面向营销人员的工具,以及与 HubSpot 和 Shopify 的集成。
Hex 的数据智能体借助 GPT-6 Astra,将分析结果转化为员工乐于分享的交互式可视化报告,让复杂分析以可视化形式呈现。
Mistral 宣布与 Mozilla 合作,Firefox Smart Window(beta)AI 浏览助手现已由 Mistral 模型驱动,将服务法国和北美用户,英国和德国预计今年晚些时候跟进。该功能可帮助理解复杂搜索、找回点击离开的重要内容,并基于浏览器标签页整理信息。对话默认不保存在 Mozilla 服务器上,Mistral 承诺零数据保留。
ChatGPT Work 和 Codex 的 analytics 功能可帮助团队了解 AI 使用与支出情况,识别培训需求,并将 AI 采用度与业务成果关联起来。通过这些分析工具,企业能更清晰地衡量 AI 投入带来的实际业务价值。
曼彻斯特大学与 NVIDIA Earth-2 团队合作,将 Earth-2 CorrDiff 生成式降尺度模型改用于空气污染预测,并加装了可直接利用空气质量观测数据的 Earth-2 StormCast。
Fyxer 基于 OpenAI 模型,结合微调、记忆和真实用户反馈,打造 AI 高管助理。它能整理收件箱,并以每位用户的语气起草邮件,从而赢得用户信任。
Cognition 的 Devin 引入 GPT-6 Astra 来改进软件测试并验证其可用性。该组合旨在帮助工程师减少代码审查量、交付更多成果。
OpenAI 推出 ChatGPT Work 中的 Data agent,支持用自然语言连接公司数据、挖掘洞察并构建交互式仪表盘。该功能以 AI 方式帮助用户将数据投入实际使用。
OpenAI 推出 ChatGPT for Financial Services,内置金融数据并集成 GPT-6 Astra,面向研究、建模和客户材料制作场景。该产品面向金融服务行业,将金融数据能力与 GPT-6 Astra 结合于一体。
Hugging Face 发布 Workflow1111,将 AUTOMATIC1111 的主要功能重建为单个 Gradio Workflow 画布,包含 11 条媒体管线、73 个节点,覆盖文生图、hi-res fix、图生图、prompt 矩阵、VLM 反推、检测生成 inpaint 蒙版、ControlNet 风格预处理器、背景去除、PNG Info 和图生视频。
OpenAI 发布 Agents API,这是一个托管服务,用于构建和上线云端智能体。该 API 由 Codex harness 驱动,提供编排、长时间运行会话和工具使用能力。
推荐理由:原文点出该 API 由 Codex harness 驱动,支持长时间会话和工具调用,可据此了解 OpenAI 托管智能体的产品形态。
Google DeepMind 发布 AlphaGenome Atlas 平台,包含人类基因组中约 90 亿种单核苷酸变异的分子效应预测,数据集达 1 PB,超过 AlphaFold 数据库 30 倍以上,向学术研究免费开放。
推荐理由:平台覆盖全部约 90 亿种单碱基变异并附 AVI 评分,读者可以据此了解它在罕见病和数量性状研究中的实际用法。
OpenAI 发布 ChatGPT Images 2.5,可将想法、草图和参考照片转化为更具个性化、更精致且更贴合创意的图像。
OpenAI 宣布扩大对新闻业的支持,通过工具、培训和合作计划,服务学生、教育工作者、记者及新闻机构,覆盖从课堂到编辑部的多个场景。
1Password 的工程师使用 OpenAI 的 Codex 快速构建新功能和内部工具,在保持严格安全策略的同时达到生产可用水平,工程效率提升 21%。
GitHub 在 GitHub Copilot CLI 推出 Project HydraFusion 研究预览,通过运行时多模型编排,按任务在 Single、Cascade、Critique 三种执行模式中选择,并调用跨供应商模型完成起草、审查、修订或升级。
推荐理由:原文给出三套执行模式、具体基准对比和开放步骤,读者可以据此评估多模型编排对自己编码工作流的成本与质量影响。
Hugging Face 发布开源工具 funes,把本机已有的智能体会话记录建为可检索记忆,支持 Claude Code、Codex、pi 和 Hermes。它本地完成嵌入和重排,无需账号即可使用,也可绑定到私有的 Hugging Face 数据集跨机器同步。在 handoff-vs-recall 基准上,recall 比写交接文档分别便宜 8x 和 4x。
推荐理由:Hugging Face 官方开源的记忆层工具,给出了安装方式和基准对比,读者可以评估它能否复用现有编码智能体的会话记录。
Google 发布 Fairwind Program,面向政府机构、Google Cloud 客户和网络安全伙伴提供主动网络防御能力,首批接入 Gemini 3.8 Flash Cyber 模型与 CodeMender 工具,可自主查找、验证并修复漏洞,在数分钟内生成可部署补丁。
Google DeepMind 发布 agentic video understanding,覆盖 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite,通过动态搜索和检查视频片段替代固定 1 FPS 的静态处理,官方基准显示成本最多降 66%、token 消耗最多降 88%、准确率最多提升 7%。
推荐理由:官方给出成本、token 和准确率的具体变化数字与开启方式,开发者可直接评估是否切换现有视频处理流程。
Hugging Face WebAI 团队发布 @huggingface/kernels 库,从 Hub 加载并运行 207 个经优化的 WebGPU 内核,采用 Apache-2.0 许可。
推荐理由:官方发布了 207 个 WebGPU 内核、JS 加载器和众测工具 Fleet,并给出与 ORT WebGPU 的实测对比数据。
Voice Arena 与 Hugging Face 为 Open ASR Leaderboard 发布 Monsoon 四个评测集,覆盖印度英语与印地语,印地语是该多语言榜单首个非欧洲语言。
推荐理由:原文给出 Monsoon 评测集的划分结构、说话人覆盖与区域分析示例,读者可借此理解聚合 WER 之外的模型差异来源。
Google DeepMind 于 8 月 27 日发布 Gemini Omni 1.1 Flash,带来面向开发者的生成视频创意控制套件,可通过 Gemini API 在 Google AI Studio 中使用。
推荐理由:官方发布给出了场景延展、关键帧插值、4K 放大等新能力的具体参数和开放渠道,开发者可据此评估是否接入生成视频工作流。
Hugging Face 在 Gradio 中推出 gr.Workflow,把 AI 应用流水线直接做成界面:用类型化节点描述步骤,提供拖拽画布,每个节点可运行、每个中间结果可见。
推荐理由:原文给出 gr.Workflow 的节点类型、REST API 与部署方式,并附多个可打开复制的 Space 示例,便于直接上手搭建 AI 流水线。
Google DeepMind 回顾其以游戏驱动的 AI 研究历程:DQN 玩 Atari 49 款游戏、AlphaGo 2016 年击败李世石、AlphaStar 在 StarCraft II 达到 Grandmaster 水平,相关基础延伸至 AlphaFold 并获 2024 年诺贝尔化学奖认可。
Mistral 发布 Agentic Search,一个让模型在复杂文档中搜索、导航、读取并验证信息的多步检索层,通过 Mistral Search Toolkit 及 Studio 和 Vibe 中的 Libraries 提供。
推荐理由:官方给出了在 FinanceBench 和 OfficeQA Pro 上的具体提升数字与工具设计,读者可据此评估其对企业文档检索工作流的适用性。
Hugging Face 的 OlmoEarth Studio 现在支持计算并导出开源 OlmoEarth 基础模型的嵌入向量,以 Cloud-Optimized GeoTIFF(COG)格式输出。
Mistral 推出三项举措强化 AI 主权:Mistral Regional Endpoints 正式可用,可让推理在欧洲或美国进行;Mistral Priority Tier 公开预览,提供自定义速率限制和由 uptime SLA 保障的关键工作负载服务等级。