跳到正文

全部动态

今日 95 条
9月28日周一
  1. Import AI46

    Import AI 474:柏拉图心智空间;太空中的 TPU;智谱启动外部递归自我改进循环

    Import AI 第 474 期报道三则内容:Michael Levin 发表论文,提出心智与大脑的关系如同数学模式与物理结果,心智是来自“柏拉图空间”的非物理模式,身体只是其进入物理世界的接口,并以 xenobots、anthrobots 等实验为佐证。此外本期还讨论了机器人学正在准备迎来类似 LLM 的时刻但仍缺一个通用算法,以及智谱启动外部 RSI(递归自我改进)循环的进展。

  2. Simon Willison42

    Simon Willison 引用 Muse AI Agent 代办事务的消息

    Simon Willison 展示了 Muse AI Agent 以 @matt.j.robb 名义发出的一条消息:AI 智能体代为处理 MX Keys Mini 取货失败,上门者在 9:15 等待、9:38 离开并留下差评,而智能体的自动回复曾在 9:27 误称用户在家。智能体已代发道歉并提出更改取货回复,不再承诺用户在场。

  3. AMD 芯片与算力78

    AMD 以约 $8.2B 全股票收购李飞飞创立的 World Labs

    AMD 宣布与 World Labs 达成最终收购协议,交易以全股票方式进行,估值约 $8.2B,预计于 2026 年底前完成,需监管批准等常规交割条件。World Labs 由李飞飞创立,总部位于旧金山,开发从文本、图像和视频输入生成、重建并模拟交互式 3D 环境的空间智能模型,以及机器人学习与模拟技术。

    推荐理由:AMD 官方公告给出收购金额、股权形式与时间表,可帮助读者理解其 AI 硬件与模型研究整合的方向。

  4. Simon Willison51

    Simon Willison 发布 Bluesky 回复机器人检测工具

    Simon Willison 发布 Bluesky reply bot checker,通过分析近期推文中的打字速度、发帖时间、互动模式等行为信号来识别疑似自动回复机器人账号。工具展示每项测量和规则,可查看触发信号最多的示例回复;作者用 Opus 5.5 vibe code 完成,并指出 Bluesky 仍有免费可用的 API,便于这类调查。

9月27日周日
9月26日周六
  1. Ars Technica · AI82

    法院裁定五角大楼可将 Anthropic 列入黑名单

    美国哥伦比亚特区巡回上诉法院以 2-1 裁定,批准国防部将 Anthropic 技术列入黑名单,认定即使 Anthropic 无恶意,政府也有权因该公司拒绝向军方开放部分 Claude 功能而实施管制。判决书称需权衡受限模型可能导致军事行动中断与不受限模型可能幻觉生成错误打击目标两类风险,并认定防长未越权,驳回 Anthropic 的复审请求。该法院此前已在 4 月驳回其紧急暂缓申请。

    推荐理由:报道给出法院裁定的核心理由和 2-1 票数,读者可以了解军方供应链管制对 AI 公司的约束边界。

  2. GitHub Blog · AI & ML64

    GitHub Copilot app 教程:如何用 canvases 构建自定义工作流

    GitHub 官方教程介绍如何在 GitHub Copilot app 中用 canvases 搭建自定义工作流:在 agent 会话中运行 /create-canvas 技能,用自然语言描述工作流、用户可做的操作和 agent 可做的操作,agent 即生成看板、清单、仪表盘等界面并在右侧面板打开。

    推荐理由:教程给出 /create-canvas 的三要素写法和双向协作机制,读者可以照着把自己的工作流变成可复用的画布。

  3. AWS Machine Learning Blog31

    AWS 如何基于 Amazon EKS、EFA 与 DeepEP 扩展 MoE 强化学习,吞吐提升 40%

    AWS 提出基于 Amazon EKS、EFA 和 DeepEP 的架构,用于加速 MoE 模型的大规模强化学习后训练,吞吐量提升 40%。该方案针对 RLHF、PPO、GRPO 等工作负载,解决 rollout 生成与策略训练的资源平衡、跨数百个加速器的高吞吐通信,以及 Expert Parallelism 带来的动态 all-to-all token 路由通信开销等问题。

9月25日周五
  1. GitHub Blog · AI & ML68

    GitHub Security Lab 发布 Fuzzing Taskflow,用 LLM 智能体自动化 C/C++ 项目模糊测试

    GitHub Security Lab 的 Antonio Morales 发布 Fuzzing Taskflow,一个基于 Taskflow Agent 构建的 C/C++ 项目自主模糊测试管线,只需指定 GitHub 仓库即可自动识别入口点、分析构建系统、编写 harness、运行 AFL++ 并分诊崩溃。

    推荐理由:作者亲述自动化模糊测试管线的设计,读者可以了解 LLM 智能体如何接管覆盖率分析和崩溃分诊等人工环节。

9月24日周四
  1. Hugging Face Blog60

    Liquid AI 发布 LFM2.5-VL-3B 的 DSpark 草稿模型,加速视觉语言推理

    Liquid AI 发布面向视觉语言模型 LFM2.5-VL-3B 的实验性 DSpark 草稿模型,通过投机解码在不改变输出质量的前提下换取更快推理,解码在设备端最高加速 3.13x、H100 上最高 2.66x,端到端分别为最高 2.62x 和 2.27x。

    推荐理由:原文给出视觉语言模型的投机解码加速方案、具体倍数与内存开销,并覆盖 llama.cpp、MLX-VLM、SGLang 的接入方法。