跳到正文

全部动态

今日 10 条
今天10月7日周三
  1. Microsoft Research48

    Microsoft Research 播客:AI 会出什么错,失败教会我们什么

    Microsoft Research 播客中,partner research manager Jennifer Neville 与应用科学家 Chad Atalla 对谈,探讨评测如何推动 AI 系统突破性能边界以满足用户需求,以及模型在传统 benchmark 之外测试时出现的“意外失败”。她分享了使用现有 AI 系统的实用建议,并强调当结果不符合预期时仔细检查数据的重要性。

  2. MIT Technology Review · AI21

    MIT Technology Review:将预测分析带入 Agentic AI 时代

    企业 AI 的前沿正从预测转向自主决策,2026 年的核心问题是如何让预测系统自主执行结论而不偏离业务意图。深度学习与生成式 AI 支持的实时训练让模型持续进化,预测引擎的数据也扩展到非结构化交互来源。Everest Group 合伙人 Vishal Gupta 表示,企业不再满足于回顾式视角,“analytics 一词正在让位于 AI,一切都在变成 AI”。

  3. Simon Willison41

    Scrimshaw Jukebox:用 Claude Opus 5.5 创作游戏音乐

    Simon Willison 测试 Claude Opus 5.5 能否作曲:先让它设计一个简单的文本音乐格式,再构建一个可发声播放的 artifact,并参考《Secret of Monkey Island》原声水准生成示例曲目。结果质量出乎意料地好,但风格偏向 Monkey Island 主题。作者推测作曲可能是文本模型近几个月涌现的新能力,需用其他新旧模型做实验验证。

  4. The Verge · AI39

    AI 接管数学引发的种种争议

    过去一年,OpenAI、Anthropic 等 AI 实验室在多个长期悬而未决的数学问题上宣布突破,甚至包括一个著名的千禧年大奖难题。这些本该受到庆祝的成果却在数学界引发强烈反弹,OpenAI 表示将咨询顶尖数学家以避免重蹈覆辙,但能否兑现仍有待观察。

10月4日周日
  1. Simon Willison15

    Simon Willison 九月赞助者专属通讯发布

    Simon Willison 发出九月赞助者专属月度通讯,仅赞助者可立即阅读,内容涵盖 Fable 级模型、价格战、LLM 进军数学、误操作网络攻击及 Datasette 漏洞风波等。免费版会延后公开,付费 $10/月可提前一个月看到。

10月2日周五
  1. MIT Technology Review · AI25

    MIT Technology Review 报告:用自主智能体重塑企业智能

    MIT Technology Review Insights 发布报告,提出企业正经历从 AI 工具到 AI 运营模式的"agentic shift"。2026 年全球 AI 投资将达 2.5 万亿美元,同比增长 44%,但多数企业尚未通过 AI 实现收入增长。报告指出企业需重建面向可访问性的数据基础设施、采用可组合架构,并解决 AI 主权问题。

  2. SK hynix 内存技术37

    重塑基础设施:为什么架构决定性能——苏黎世联邦理工学院 Onur Mutlu 教授谈 AI 生态(SK hynix AI 生态系列)

    AI 工作负载转向推理与智能体 AI 后,系统瓶颈正从算力转向数据移动。文章指出处理器中心架构下,从 DRAM 取一次数据的能耗可达一次简单算术运算的 150 至 2,000 倍,大型机器学习模型超过 90% 的系统能耗可能消耗在内存访问与数据移动上。文章引出 SK hynix 打造下一代 AI 内存生态的愿景,主张 GPU/NPU/TPU、内存、存储与网络作为整体系统协同设计。

10月1日周四
  1. The Verge · AI67

    Sam Altman 称 OpenAI 在模型安全承诺到位前不会 IPO

    OpenAI CEO Sam Altman 在 DevDay 问答中表示,公司短期内不会 IPO,除非能对模型安全做出更有把握的承诺,且没有明确时间表。他说等太久上市也“对世界不好”,并担心上市后可能“以安全等名义让华尔街支持者失望”;他还称“pacing the frontier”意味着把安全与对齐放在能力之前。

  2. Ars Technica · AI68

    RFK Jr. 称 AI 支持其反疫苗观点,Ars Technica 实测 Gemini 和 ChatGPT 并不支持

    美国卫生部长 RFK Jr. 在 MAHA 活动上称 AI 比任何医生都更了解情况,将帮助美国人摆脱医学专家的“医疗专制”,并验证其在口罩、社交距离和疫苗问题上的观点。Ars Technica 实测发现,Gemini 和 ChatGPT 对口罩和社交距离有效性的回答均与主流医学共识一致,并未支持其说法。

9月29日周二
  1. MIT Technology Review · AI23

    让 AI 成为资产而非开支

    当 AI 从试点走向生产化,仅按 token 消耗付费可能使开支难以预测。企业应根据工作负载逐项评估自有容量与消费式采购的经济平衡点,在持续需求达到足够利用率时投资可控容量,并通过运营管理让容量保持高产,从而把 AI 从开支变为资产。

  2. MIT Technology Review · AI67

    MIT Technology Review 调查:美国“虚拟边境墙”监控塔未能阻止上千人死亡

    MIT Technology Review 发布对美墨边境“虚拟墙”的调查与圆桌讨论。过去 25 年美国投入数十亿美元在南部边境建造监控塔,但调查记录了超过一千人经过这些塔的监控区域却未被送达援助或拘捕并最终死亡,其中一些人正处于新装的可自动发现人员的 AI 监控塔监控之下。

  3. MIT Technology Review · AI64

    MIT Technology Review 分析何时才能说 AI 做出了科学发现

    Anthropic 宣布其由 950 个 Claude 智能体组成、运行 21 小时的分子生物学实验室取得首个发现,即围绕一种已知酶标记出此前未被记录的重复模式;这一说法遭到部分生物学家质疑,哥本哈根大学的 Mario Rodríguez Mestre 称其团队早已发现该模式,Anthropic 否认从其与 Claude 的对话中学习。

9月28日周一
  1. Import AI46

    Import AI 474:柏拉图心智空间;太空中的 TPU;智谱启动外部递归自我改进循环

    Import AI 第 474 期报道三则内容:Michael Levin 发表论文,提出心智与大脑的关系如同数学模式与物理结果,心智是来自“柏拉图空间”的非物理模式,身体只是其进入物理世界的接口,并以 xenobots、anthrobots 等实验为佐证。此外本期还讨论了机器人学正在准备迎来类似 LLM 的时刻但仍缺一个通用算法,以及智谱启动外部 RSI(递归自我改进)循环的进展。

  2. Simon Willison42

    Simon Willison 引用 Muse AI Agent 代办事务的消息

    Simon Willison 展示了 Muse AI Agent 以 @matt.j.robb 名义发出的一条消息:AI 智能体代为处理 MX Keys Mini 取货失败,上门者在 9:15 等待、9:38 离开并留下差评,而智能体的自动回复曾在 9:27 误称用户在家。智能体已代发道歉并提出更改取货回复,不再承诺用户在场。

9月26日周六
9月25日周五
9月24日周四
9月23日周三
  1. NVIDIA Blog19

    Sakeena Fiza 如何为 NVIDIA 硬件的大规模成功保驾护航

    NVIDIA 验证工程师 Sakeena Fiza 负责在大规模量产前测试数据中心硬件,她的团队曾见证 Rubin GPU 首次在系统层面点亮。验证工作覆盖从托盘到机架再到 AI 工厂的整个链路,单块板卡含数万个组件,一个机架可接近 50 万个组件,目标是抢在客户之前发现问题。