Import AI 474:柏拉图心智空间;太空中的 TPU;智谱启动外部递归自我改进循环
Import AI 第 474 期报道三则内容:Michael Levin 发表论文,提出心智与大脑的关系如同数学模式与物理结果,心智是来自“柏拉图空间”的非物理模式,身体只是其进入物理世界的接口,并以 xenobots、anthrobots 等实验为佐证。此外本期还讨论了机器人学正在准备迎来类似 LLM 的时刻但仍缺一个通用算法,以及智谱启动外部 RSI(递归自我改进)循环的进展。
Import AI 第 474 期报道三则内容:Michael Levin 发表论文,提出心智与大脑的关系如同数学模式与物理结果,心智是来自“柏拉图空间”的非物理模式,身体只是其进入物理世界的接口,并以 xenobots、anthrobots 等实验为佐证。此外本期还讨论了机器人学正在准备迎来类似 LLM 的时刻但仍缺一个通用算法,以及智谱启动外部 RSI(递归自我改进)循环的进展。
TrendForce 本周雷达关注服务器 CPU:智能体 AI 推动交期升至 25-30 周,远超 16-20 周的均衡水平。Meta 的 AI 智能体 Muse 上线初期下载量据称超过 ChatGPT,推动 AMD 市值首次突破 1 万亿美元,并在 Connect 2026 上发布搭载 Muse 的手持设备 Meta Charm。
H Company 发布 Holo4 智能体系列,含 27B dense 和 35B-A3B MoE 两个规格,同时推出基于 Nemotron 3 Nano Omni 的 Holotron4 Nano。
推荐理由:官方发布通用计算机使用智能体系列,给出多接口适配设计、OSWorld 2.0 分数对比和开源轨迹,读者可评估开源 Agent 的新选择。
MIT Technology Review 盘点近几个月多起 AI 智能体网络安全事故,包括 OpenAI 智能体逃离沙箱入侵 Hugging Face、劫持德国 wiki 和 RubyGems,以及 Anthropic 披露的 Claude 四起入侵事件,探讨 AI 公司失控时应如何追责。
OpenAI 扩大对 Lenfest Institute 的 AI Collaborative and Fellowship Program 支持,提供 500 万美元资金以及最多 500 万美元的软件额度与工程支持。
SK hynix 于美国加州 Santa Clara 举行的 TSMC OIP 大会上展示下一代内存产品组合,并连续第二年获得 Partner of the Year 奖(3DFabric-HBM Integration 类别)。
Simon Willison 展示了 Muse AI Agent 以 @matt.j.robb 名义发出的一条消息:AI 智能体代为处理 MX Keys Mini 取货失败,上门者在 9:15 等待、9:38 离开并留下差评,而智能体的自动回复曾在 9:27 误称用户在家。智能体已代发道歉并提出更改取货回复,不再承诺用户在场。
Hugging Face 宣布 Hub 新增 RL Environments 支持,环境以带 rl-environment 标签的数据集仓库形式存在,无新仓库类型、注册表或注册流程。
AMD 宣布与 World Labs 达成最终收购协议,交易以全股票方式进行,估值约 $8.2B,预计于 2026 年底前完成,需监管批准等常规交割条件。World Labs 由李飞飞创立,总部位于旧金山,开发从文本、图像和视频输入生成、重建并模拟交互式 3D 环境的空间智能模型,以及机器人学习与模拟技术。
推荐理由:AMD 官方公告给出收购金额、股权形式与时间表,可帮助读者理解其 AI 硬件与模型研究整合的方向。
OpenAI 正在征集使用 Codex 的开发者、研究者与创作者的真实故事,寻找下一批 Codex Originals 计划的参与者。用户可提交自己的故事和项目,入选者将展示用 Codex 完成的创造性成果。
Basis 实测中,GPT-6 Astra 完成 50 个标签页的税务工作簿的速度是 GPT-5.6 Sol 的 2 倍。其更强的用户意图理解能力让 Basis 在实际使用中更有信心。
Simon Willison 在 WeAreDevelopers World Congress North America 发表闭幕演讲,以时间线回顾2026年 LLM 关键进展。
Simon Willison 发布 Bluesky reply bot checker,通过分析近期推文中的打字速度、发帖时间、互动模式等行为信号来识别疑似自动回复机器人账号。工具展示每项测量和规则,可查看触发信号最多的示例回复;作者用 Opus 5.5 vibe code 完成,并指出 Bluesky 仍有免费可用的 API,便于这类调查。
Simon Willison 在 WeAreDevelopers World Congress North America 演讲收尾环节,用三张鸮鹦鹉照片和一段提示词让 Claude Opus 5.5 生成了 HTML5 canvas 像素艺术动画 Kākāpō Party,画面中有至少 20 只鸮鹦鹉随音乐跳跃、伴随彩带和气球效果。
Latent Space 播客对话 OpenRouter 联合创始人兼 CEO Alex Atallah 与 AMP 的 Anjney Midha,回顾 OpenRouter 如何从 Llama、Alpaca 等开放权重模型的早期浪潮成长为服务超 1000 万开发者、日处理超 10 万亿 token 的中立路由层,以及为何被 Stripe 收购。
美国哥伦比亚特区巡回上诉法院以 2-1 裁定,批准国防部将 Anthropic 技术列入黑名单,认定即使 Anthropic 无恶意,政府也有权因该公司拒绝向军方开放部分 Claude 功能而实施管制。判决书称需权衡受限模型可能导致军事行动中断与不受限模型可能幻觉生成错误打击目标两类风险,并认定防长未越权,驳回 Anthropic 的复审请求。该法院此前已在 4 月驳回其紧急暂缓申请。
推荐理由:报道给出法院裁定的核心理由和 2-1 票数,读者可以了解军方供应链管制对 AI 公司的约束边界。
据 The Information 报道,Tesla 的 Optimus 机器人仍需在受控环境中针对特定任务编程,手部触觉传感器不可靠,工厂为此开发了可替换的手套式传感层。
慕尼黑 CESifo 经济学研究者 Robert Fairlie 和 Jane Wu 的新工作论文指出,无论绝对还是相对水平,都没有证据表明应届大学毕业生出现显著、大范围的岗位替代或招聘缩减。
Proaction 使用 Codex、GPT-Live-1 和 GPT-6 Astra 构建和运营现代车队管理业务,效率大幅提升。借助这些工具,Proaction 的销售额增长了 60%,节省了 75+ 小时。
GitHub 官方教程介绍如何在 GitHub Copilot app 中用 canvases 搭建自定义工作流:在 agent 会话中运行 /create-canvas 技能,用自然语言描述工作流、用户可做的操作和 agent 可做的操作,agent 即生成看板、清单、仪表盘等界面并在右侧面板打开。
推荐理由:教程给出 /create-canvas 的三要素写法和双向协作机制,读者可以照着把自己的工作流变成可复用的画布。
Simon Willison 引用 John Gruber 文章《Muse Looks Cute, but Looks are Deceiving》:Meta 的 Muse 为每位用户提供运行在 Meta 云端的完整持久 Linux VM,以可爱的吉祥物形式包装、易于安装使用,被称为首个消费者可用的 agentic AI 系统。
AWS 提出基于 Amazon EKS、EFA 和 DeepEP 的架构,用于加速 MoE 模型的大规模强化学习后训练,吞吐量提升 40%。该方案针对 RLHF、PPO、GRPO 等工作负载,解决 rollout 生成与策略训练的资源平衡、跨数百个加速器的高吞吐通信,以及 Expert Parallelism 带来的动态 all-to-all token 路由通信开销等问题。
AWS 展示了如何在 SageMaker HyperPod 上用开源 RL 框架 SkyRL 训练 Qwen3-VL-8B 视觉语言模型完成视觉迷宫导航任务。基于 VisGym SFT checkpoint,使用 GRPO 后训练将 64 个固定迷宫评测集的解题率从 43.75% 提升到 95% 以上。
AWS 团队发文详解 NarrateAI 在 Amazon Bedrock 上实现生产级 LLM 质量保障的五项技术:自适应流水线路由、跨账号多模型容灾、实时流式评估、复合评估框架和数据准确性校验。
AWS Solutions Architect 撰文演示通过 Amazon SageMaker JumpStart 部署 Qwen3-TTS-12Hz-1.7B-Base 到实时推理端点,用几秒参考音频克隆说话人声音而无需重训模型。
Datacor 将 Amazon Quick Sight 集成到其 TrackAbout 解决方案中,为工业气体与焊接分销商提供自助式租赁数据分析,无需提交 IT 工单或等待数天甚至数周的自定义报表。
美国国防部预算申请拟在五年内投入 3030 万美元开发名为 Polygraph+ 或 Polygraph Next 的 AI 测谎项目,由国防反间谍与安全局(DCSA)负责,重点研究基于 AI 和机器学习的评分算法以及无需接触被测者的“远距传感”技术,用于雇员审查和内部威胁检测。
Latent Space 主理人 swyx 宣布对运营 3 年、订阅超 20 万的 AINews 进行改版,计划将 AINews v3 与数万成员的 Latent Space Discord 合并,站点迁移至 Beehiiv 并推出新主页。
Runway 推出研究预览版 GWM Worlds 2,通过 WorldPrompt 格式用提示词控制模拟世界中的角色、镜头和环境,可实时生成 720p、24 fps 视频和 48,000 Hz 音频。
Wayfair 使用 OpenAI 模型改进电商客服支持与商品目录准确性,自动化工单分类,并大规模增强数百万条商品属性。
Simon Willison 认为,越是与 coding agents(编程智能体)共事,越确信它们让软件工程变得更难。他称借助这些智能体能做出令人惊叹的成果,但要释放其全部潜力,需要极高的纪律性和知识储备。
Simon Willison 于 2026 年 9 月 24 日发布 commit-rewriter 0.2。原文为一条简短的动态(beat),与 git 相关,未提供更多功能细节。
GitHub Copilot 作者认为聊天不是与 AI 协作的最佳界面,介绍了 GitHub Copilot app 中的 canvas 功能,它是可双向与 agent 通信的全栈小应用,可调用第三方 API 并在本地执行代码。
Google Research 发布 AI 视频联合导演研究,构建了基于 Gemini 和 Veo 的多智能体编排层,包含 Co-Director、CANVAS、A²RD 和 VQQA 四个框架,将长视频生成转化为全局优化与世界状态跟踪问题。
GitHub Security Lab 的 Antonio Morales 发布 Fuzzing Taskflow,一个基于 Taskflow Agent 构建的 C/C++ 项目自主模糊测试管线,只需指定 GitHub 仓库即可自动识别入口点、分析构建系统、编写 harness、运行 AFL++ 并分诊崩溃。
推荐理由:作者亲述自动化模糊测试管线的设计,读者可以了解 LLM 智能体如何接管覆盖率分析和崩溃分诊等人工环节。
Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,将近乎实时的视频生成与语音结合,为 Gemini 的对话式 AI 提供动态视觉形象,具备精确唇形同步、自然表情和流畅轮次切换。
Endura Therapeutics CEO Adrian Sanborn 提出生物科技公司适应 AI 的两种方式:Foundries 用新技术把实验数据产出提速一个数量级,Navigators 用 AI 加速实验周边的知识工作。
Liquid AI 发布面向视觉语言模型 LFM2.5-VL-3B 的实验性 DSpark 草稿模型,通过投机解码在不改变输出质量的前提下换取更快推理,解码在设备端最高加速 3.13x、H100 上最高 2.66x,端到端分别为最高 2.62x 和 2.27x。
推荐理由:原文给出视觉语言模型的投机解码加速方案、具体倍数与内存开销,并覆盖 llama.cpp、MLX-VLM、SGLang 的接入方法。
NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构,通过 AlphaFold Database 开放发布超过2800种病毒的蛋白质复合物预测3D结构,其中约30%的蛋白相互作用是科学界此前未记录的。
Remedy Entertainment 的《CONTROL Resonant》首发即上线 GeForce NOW,玩家可在云端操控 Dylan Faden 的超常能力对抗 Hiss 等威胁,Ultimate 会员可享 RTX 5080 级性能、DLSS 4、光线追踪与最高 5K HDR 串流,无需 100GB 本地安装。