OpenAI 阐述前沿模型第三方安全评估的优先事项与原则
OpenAI 提出针对前沿模型及其安全防护措施开展严格、安全、独立第三方评估的优先事项与原则,旨在规范第三方 AI 安全评估的实践方式。
OpenAI 提出针对前沿模型及其安全防护措施开展严格、安全、独立第三方评估的优先事项与原则,旨在规范第三方 AI 安全评估的实践方式。
Higgsfield AI 使用 GPT-6 Astra,在一天内上线了新的视频功能。该组合让小微企业更轻松地制作视频广告,并更快地将新创意工具推向市场。
OpenAI 与一个独立的数学与人工智能咨询小组合作,以指导对新兴 AI 成果的评审与沟通。原文信息有限,该小组旨在帮助审查和传达相关研究进展,具体成员名单与工作机制尚未公布。
OpenAI 提出建立全球共享 AI 标准的路径,呼吁通过协调一致的评估、报告与治理来提升 AI 安全性。
OpenAI 扩展 OpenAI Academy,新增面向员工、开发者、管理者、教育者和学生的多条学习路径。学员可通过这些路径学习并展示实用的 AI 技能。
V7 使用 GPT-5.6 Luna 后成本降低 78%,同时准确率得到提升。它还能将企业分散的文件转化为智能体可用的上下文,用于完成带来源链接的复杂工作。
OpenAI 发布澳大利亚青少年安全蓝图,这是一份保护并赋能年轻人的 AI 安全路线图,包含六大支柱。该蓝图旨在为青少年打造更安全的 AI 使用体验。
律所 Cooley 基于 ChatGPT Work 构建了 GO Public,将 AI 能力引入 IPO 流程。该工具帮助律师更早发现问题,把专业判断集中在最关键之处。
OpenAI 推出面向法律行业的 Astra for Law。它提供前沿智能、定制化律所工作流、可连接的法律数据源,以及针对机密客户工作的高等级安全管控。
OpenAI 发布用于跟踪、调查和披露模型对齐偏差的报告框架,同时公开六份意外或异常模型行为报告。框架明确了从发现到披露的处理流程,配套报告提供了具体行为案例。
OpenAI 与 AARP 将在美国 10 个城市为 1,000 名老年人提供免费 ChatGPT 实操工作坊,帮助他们安全地学习实用的 AI 技能。
OpenAI 推出 AI 驱动的广告体验,包括 Sponsored Agents、面向营销人员的工具,以及与 HubSpot 和 Shopify 的集成。
Hex 的数据智能体借助 GPT-6 Astra,将分析结果转化为员工乐于分享的交互式可视化报告,让复杂分析以可视化形式呈现。
ChatGPT Work 和 Codex 的 analytics 功能可帮助团队了解 AI 使用与支出情况,识别培训需求,并将 AI 采用度与业务成果关联起来。通过这些分析工具,企业能更清晰地衡量 AI 投入带来的实际业务价值。
OpenAI 经济研究新报告分析了劳动者如何超越传统职业角色使用 AI,以及哪些新的活动成为其工作中的常规部分。报告揭示了 AI 在实际工作中的使用模式。
IBM Research 在 ALTK-Evolve 中推出 Consistency Analyzer 和一致性指南,针对 Agent 同一任务多次运行结果不稳定的问题。
推荐理由:原文给出可复用的 Pass^k 指标和一致性诊断方法,读者可据此评估并改善自己 Agent 的复现稳定性。
Fyxer 基于 OpenAI 模型,结合微调、记忆和真实用户反馈,打造 AI 高管助理。它能整理收件箱,并以每位用户的语气起草邮件,从而赢得用户信任。
Perplexity 已信任 GPT-6 Astra 处理端到端系统,包括撰写沟通内容、修改软件和监控生产系统。相比使用早期模型时,Perplexity 现在的人工检查频率大幅降低。
Cognition 的 Devin 引入 GPT-6 Astra 来改进软件测试并验证其可用性。该组合旨在帮助工程师减少代码审查量、交付更多成果。
OpenAI 将 Habitat 从一个 Python 库演进为全球分布式存储平台,支撑超过 10 亿 ChatGPT 用户和每秒 22M 请求的在线存储需求。
César de la Fuente 实验室使用 Codex 和 ChatGPT 在现存与已灭绝物种的基因组中搜索抗菌候选分子,以对抗耐药性感染。
OpenAI 推出 ChatGPT Work 中的 Data agent,支持用自然语言连接公司数据、挖掘洞察并构建交互式仪表盘。该功能以 AI 方式帮助用户将数据投入实际使用。
OpenAI 与 GSA 宣布面向符合条件的联邦、州、地方和部落政府提供 AI 访问:许可费为 $0,用量费用打五折,并扩大网络防御支持。
推荐理由:原文给出了政府侧采购的具体折扣结构,读者可以据此比较公共部门 AI 供应条款的变化。
OpenAI 推出 ChatGPT for Financial Services,内置金融数据并集成 GPT-6 Astra,面向研究、建模和客户材料制作场景。该产品面向金融服务行业,将金融数据能力与 GPT-6 Astra 结合于一体。
OpenAI 在 API 中推出 GPT-Live-1,带来自然的全双工语音对话能力。该模型还提供更强的指令遵循、自定义音色和电话(telephony)支持。
推荐理由:官方公告列出全双工语音、自定义音色和电话支持等能力,读者可据此评估语音应用的接入选项。
OpenAI 发布 Agents API,这是一个托管服务,用于构建和上线云端智能体。该 API 由 Codex harness 驱动,提供编排、长时间运行会话和工具使用能力。
推荐理由:原文点出该 API 由 Codex harness 驱动,支持长时间会话和工具调用,可据此了解 OpenAI 托管智能体的产品形态。
OpenAI 宣布 Paul Christiano 加入 OpenAI 基金会董事会及其安全与安保委员会。公告称他将带来在 AI 对齐、安全与标准方面的经验。
OpenAI 的 Chris Lehane 提出,更强的 AI 能力需要更强的安全证据、共同标准和持久的政策行动,并呼吁趁政策窗口仍然开启时采取行动。
OpenAI 发布 GPT-6 Astra,定位为面向商业的最强模型,具备高级推理和计算机使用能力,写作与设计判断也更强。
推荐理由:官方发布了面向商业场景的新模型,提到推理、计算机操作和写作设计判断,读者可据此评估其在工作流中的定位。
一位 MIT 研究者使用 GPT-5.6 Sol 搭配 Codex,自主运行量子计算实验、分析结果并校准 qubit。
OpenAI 发文探讨更强能力、更可负担的 AI 如何拓展个人和企业能完成的工作,并让增长更具经济性。文章指出 AI 能力提升与成本下降结合,可扩大人们与企业的可达成工作范围。
OpenAI 发布 ChatGPT Images 2.5,可将想法、草图和参考照片转化为更具个性化、更精致且更贴合创意的图像。
OpenAI 宣布扩大对新闻业的支持,通过工具、培训和合作计划,服务学生、教育工作者、记者及新闻机构,覆盖从课堂到编辑部的多个场景。
OpenAI 分享了一个针对 Navier–Stokes 千禧年大奖难题的 AI 生成解法,内容包括一份解题文章和一个 Lean 形式化证明。材料来自 OpenAI 官方公告,feed 未提供完整正文,具体证明内容和方法细节以原文链接为准。
推荐理由:官方公开了 AI 生成的 Navier–Stokes 千禧年难题解法,并附带 Lean 形式化证明,读者可以据此关注 AI 在数学证明方向的实际产出。
OpenAI 推出一项总额 500 万美元的资助计划,支持关于生成式 AI 如何影响青少年发展、心理健康与安全的独立研究,现已开放申请。
1Password 的工程师使用 OpenAI 的 Codex 快速构建新功能和内部工具,在保持严格安全策略的同时达到生产可用水平,工程效率提升 21%。
OpenAI 与 AIRPPU、WAN-IFRA 联合推出 AI 项目,帮助乌克兰新闻机构强化创新能力、抗压能力与独立新闻事业。
GitHub 在 GitHub Copilot CLI 推出 Project HydraFusion 研究预览,通过运行时多模型编排,按任务在 Single、Cascade、Critique 三种执行模式中选择,并调用跨供应商模型完成起草、审查、修订或升级。
推荐理由:原文给出三套执行模式、具体基准对比和开放步骤,读者可以据此评估多模型编排对自己编码工作流的成本与质量影响。
Hugging Face 提出 Quantization-Aware Healing(QAH),将 GPT-OSS 120B 结构压缩至 60B 参数并量化为 MXFP4 后,直接从压缩前的原始模型蒸馏,而非从恢复后的 bfloat16 检查点蒸馏。
IBM Research 团队基于 ALTK-Evolve 在 AppWorld 的 585 个多步任务上测试八种模型后发现,智能体记忆该给多少取决于模型能力。