OpenAI 阐述前沿模型第三方安全评估的优先事项与原则
OpenAI 提出针对前沿模型及其安全防护措施开展严格、安全、独立第三方评估的优先事项与原则,旨在规范第三方 AI 安全评估的实践方式。
OpenAI 提出针对前沿模型及其安全防护措施开展严格、安全、独立第三方评估的优先事项与原则,旨在规范第三方 AI 安全评估的实践方式。
Hugging Face 宣布 transformers 支持加载 GGUF 模型,通过 from_pretrained 传入 gguf_file 即可在本机运行 Hub 上的量化检查点。
推荐理由:Hugging Face 官方给出 GGUF 在 transformers 中的用法和与 llama.cpp 的实测对比,读者可据此判断本地推理的可行路径。
oMLX 创造者与维护者 Jun Kim 加入 Hugging Face。oMLX 将从副业项目转变为获得全职维护和资金支持的项目,但继续保持 Apache 2.0 开源协议,仍由 Jun 领导。团队的重点之一是简化从 transformers 模型定义到参考 MLX 实现的转换流程,让新 transformers 模型更快在 MLX 上运行。
英国 AI 安全研究所(AISI)开始使用 EvalEval 的基础设施公开分享评测结果,包括 HealthBench、FrontierMath、Humanity's Last Exam、SWE-Bench Pro、Terminal-Bench 2.0 五个基准及 Cyber CTFs、The Last Ones 两项网络评测的验证结果。
TypeSafe AI 上周发布新类别模型 Jev,称为 System One 模型,接受文本输入但输出浮点数形式的分类、是/否判断、评分和置信度。Jev 只对输入收费,价格为 $0.042 per million tokens,低于 GPT-5 Nano 的 $0.05/million,支持并行评估多个问题,适合分类、排序和搜索重排等任务。
Cloudflare 宣布 Python Workers 正式全量可用,Python 成为 Cloudflare Developer Platform 的一等支持语言。
Latent Space 播客对话 TypeSafe AI CEO Diogo Almeida,讨论其新发布的 Jev 模型及发布视频约 38M 次观看的热度。
NVIDIA 推出 DSX Ready 认证计划,对符合 NVIDIA DSX AI 工厂参考设计要求的合作伙伴产品进行资格认证,首批涵盖电池储能系统(BESS)和冷却液分配单元(CDU)两个类别。
NVIDIA 阐述 Physical AI(自动驾驶汽车、人形机器人与工业机器人)规模化部署必须覆盖硬件、软件、AI 行为与运行环境各层的安全体系。ABI Research 预计到 2035 年 L3-L5 自动驾驶汽车保有量达 4900 万辆,Omdia 估计 2026-2035 年将部署约 6000 万台工业机器人。
埃及在 Grand Egyptian Museum 举行 AI 生态活动,NVIDIA 高管出席,埃及 NVIDIA Deep Learning Institute 学习者一年内增长逾十倍;Hassan Allam Utilities 与 A15 计划投资约 $400 million 建设新数据中心。
Microsoft Research 的逆合成模型 RetroChimera 在期刊 Nature 发表,并开源了实现与权重。该模型组合基于 Transformer 的 R-SMILES 2 与基于 GNN 的 NeuralLoc 两个子模型,用学习到的重排序策略融合各自预测,覆盖常见与罕见反应类型。
NVIDIA 发文提出 AI 安全应作为工程问题对待,需要明确的安全需求、可强制执行的控制、指定负责人和防护有效的证据。
RAND 发布长篇报告,认为美国在通往超级智能的未知路径上应采取“行动自由(Freedom of Action)”战略,即现在投入资金保留所有选项。报告归纳出三大类七种原型战略(共存、拒止、加速),并列出危险临近度、共存可行性、克制可行性、决定性战略优势、压制可行性五大不确定性。作者评论称美国当前策略接近“加速”选项,只顾提速而无安全措施。
MIT Technology Review 调查发现,有人穿过美墨边境 AI 监控塔覆盖区域未被察觉后死亡,遗体数周或数月才被发现,统计到超过 1050 人在塔附近死亡且为低估。
MIT Technology Review 详述其15个月调查的方法论,构建了首个覆盖边境监控塔附近死亡案例的综合地图,共分析近4000个案例。
Higgsfield AI 使用 GPT-6 Astra,在一天内上线了新的视频功能。该组合让小微企业更轻松地制作视频广告,并更快地将新创意工具推向市场。
OpenAI 与一个独立的数学与人工智能咨询小组合作,以指导对新兴 AI 成果的评审与沟通。原文信息有限,该小组旨在帮助审查和传达相关研究进展,具体成员名单与工作机制尚未公布。
NVIDIA 在纽约气候周展示了五家将 AI 融入清洁能源项目的公司。ThinkLabs AI 用数字孪生把 Southern California Edison 的电网互联评估时间从 30-45 天缩短到两分钟。
OpenAI 提出建立全球共享 AI 标准的路径,呼吁通过协调一致的评估、报告与治理来提升 AI 安全性。
OpenAI 扩展 OpenAI Academy,新增面向员工、开发者、管理者、教育者和学生的多条学习路径。学员可通过这些路径学习并展示实用的 AI 技能。
Marvell 将在 2026 年 9 月 20–24 日西班牙马拉加的 ECOC 2026 上展示业界首批 2nm 光互连演示,包括首个 2nm 400G/lane 光 PAM4、首个 2nm 800G ZR/ZR+ 可插拔模块(含 MACsec,由 Libra 2nm 相干 DSP 驱动)以及首个 2nm 1.6T ZR 和 coherent-lite O-band 演示。
Hugging Face 发布 tokenizers v1 候选版,在 Apple M4 Max 上单线程编码比 v0.23 快 3 到 30 倍,八线程扩展达线性的 76%,且输出 token ID 完全一致。
推荐理由:官方详述 tokenizers v1 的性能优化手段和可复现基准,读者可以据此评估升级对训练与推理数据供给的实际收益。
V7 使用 GPT-5.6 Luna 后成本降低 78%,同时准确率得到提升。它还能将企业分散的文件转化为智能体可用的上下文,用于完成带来源链接的复杂工作。
网友 voxium 自述入职某大公司半月,发现规格、代码、测试、PRD、工单等一切产出均由 Claude Code 生成,团队成员从 L1 到 L7 工程师都在被迫尽力快速交付。管理层认为推代码不是瓶颈、质问为何慢,员工每天工作 12 到 13 小时只为按回车,几乎无人真正阅读内容。
Latent Space AINews 盘点 Jev 决策模型发布两天的生态:其发布视频获 36M 观看,因其未开源而迅速出现 Laya、Bespoke Nimble。
GitHub Podcast 逐条拆解五个常见 AI 热门观点。核心结论:AI 生成代码仍需按风险分级审查;Skills 与 MCP 解决不同问题,MCP 提供工具与数据访问标准,Skills 以 Markdown 打包团队流程与最佳实践,两者互补;RAG 未死,检索让模型更接近答案,可与 agent、MCP、Skills 同一工作流共存。
OpenAI 发布澳大利亚青少年安全蓝图,这是一份保护并赋能年轻人的 AI 安全路线图,包含六大支柱。该蓝图旨在为青少年打造更安全的 AI 使用体验。
Anthropic 在 Claude Code 推出 Projects,单次对话可生成并行云线程并在用户离开后继续运行;Google 更新 Gemini 托管智能体,新增 Credentials API 和 Files API,宣称成本降低 30%、缓存命中提升 22%。
AMD 发布白皮书,评测 6th Gen AMD EPYC 9006 "Venice" 服务器 CPU 在通用、企业、云原生、AI 和 HPC 负载下的表现。
Google Research 推出新的研究实验,教师可借助生成式 UI(GenUI)按自己的教学目标与课程动态生成定制化、引导式的交互学习模拟。研究基于 LearnLM 系列教育模型的主动学习原则,并发布了 30 多个由 AI 生成、经教师审核的英文 STEM 学习交互示例,覆盖物理、化学、生物和数学,面向初高中。
Pawprint Studio 的免费开放世界捉宠 RPG《Aniimo》随首发同步上线 GeForce NOW,玩家可跨设备云端游玩,无需等待 45GB 下载。
律所 Cooley 基于 ChatGPT Work 构建了 GO Public,将 AI 能力引入 IPO 流程。该工具帮助律师更早发现问题,把专业判断集中在最关键之处。
Steve Yegge 在每月花费数千美元订阅编码智能体后,宣布关停 Gas Town,承认其是唯一的产出成果。Databricks 向约 3500 名工程师推出 GPT-6 Astra,其在复杂长程任务上明确优于 Opus 5 / Sol 5.6,但使编码总支出增加约 60%,为此设立了专项子预算。OpenAI 发布了模型 misalignment 事件披露框架及六份近半年案例报告。
SK hynix 参加于 9 月 15-17 日在美国圣克拉拉举办的 AI Infra Summit 2026,以“New Spectrum”为主题展示下一代 AI 内存方案,参会人数约 6,000 人、较上年翻倍。
GitHub 作者 Stephen Toub 撰文介绍团队借助 GitHub Copilot 应用与 CLI,把 Copilot agent runtime 从 TypeScript/Node.js 完全重写为 832,378 行生产 Rust,AI 智能体完成了大部分代码,共落成 128 个 pull request,原需一两人年的项目仅由一名开发者在数月内完成。
推荐理由:作者亲历整场迁移,给出代码量、发布节奏与缓存命中率等一手数据,读者可以借此评估智能体主导大型重写的可行路径。
AMD 在 AI Infra Summit 上提出,AI 基础设施设计核心不应是芯片或网络,而是系统适应需求变化的能力。文章指出 agentic AI 将单次请求变为检索、调用工具、执行代码、协调子智能体的多步链条,应以“每完成任务成本”而非“每 token 成本”衡量,并给出可适应、经济、开放三条可审计原则。
OpenAI 推出面向法律行业的 Astra for Law。它提供前沿智能、定制化律所工作流、可连接的法律数据源,以及针对机密客户工作的高等级安全管控。
Latent Space 专访 AIUC 联合创始人 Rune Kvist,宣布 $40M A 轮融资,由 Ribbit Capital 和 First Harmonic 领投,Cursor、Harvey、Lovable、ElevenLabs 等已是客户。
OpenAI 发布用于跟踪、调查和披露模型对齐偏差的报告框架,同时公开六份意外或异常模型行为报告。框架明确了从发现到披露的处理流程,配套报告提供了具体行为案例。
OpenAI 与 AARP 将在美国 10 个城市为 1,000 名老年人提供免费 ChatGPT 实操工作坊,帮助他们安全地学习实用的 AI 技能。