用 Amazon Bedrock AgentCore Evaluations 评估多智能体系统的可解释性与实用性
AWS 演示了基于 Strands Agents SDK 与 Amazon Bedrock AgentCore 的多智能体供应链决策系统评估方案,包含一个编排智能体和优化、配送、路径、分析四个专用子智能体。
AWS 演示了基于 Strands Agents SDK 与 Amazon Bedrock AgentCore 的多智能体供应链决策系统评估方案,包含一个编排智能体和优化、配送、路径、分析四个专用子智能体。
Amazon Quick 的控制台和 update-user API 不支持直接从 Admin 或 Author 降级到 Reader,会报 “You cannot downgrade a user role” 错误。
OpenAI 宣布为欧盟地区的 ChatGPT 和 Codex 生成文本添加隐形水印,以符合 8 月 2 日生效的 EU AI Act 透明度规则,未来数周向欧盟所有套餐用户推出;全球开发者即日起可在 API 中为部分模型开启,默认关闭。
AWS 在 Amazon Bedrock Managed Knowledge Bases 上用 LangChain 演示标准检索与 agentic 检索的对比:一个包含六个意图的多部分问题,单向量检索在 5 条结果时只覆盖 4 个子意图,agentic 检索则通过规划循环拆分子查询、评估证据并迭代。
Amazon Quick 资源(chat agent、action connector、知识库、flow、space)从开发账户晋升到生产账户此前只能手工重建。
Amazon SageMaker AI 优化生成式 AI 推理推出 aws-ai-ml 技能,通过 Agent Toolkit for AWS 提供,可为 Kiro、Claude Code、Codex 等编码智能体注入推理优化与基准测试专长。
Claude Opus 5.5 与 Claude Sonnet 5.5 现已在 AWS GovCloud (US) 区域的 Amazon Bedrock 上可用,可配合 Anthropic 的智能体编程工具 Claude Code 支持含 ITAR 在内的合规开发工作负载。
Simon Willison 在 TIL 中演示如何用 Parseable 存储和查询 Datasette 的 OpenTelemetry traces。Parseable 是一款新 observability 工具,提供 AGPL 开源的 Rust 实现(单个约 180MB 二进制文件)、Enterprise 版和云托管选项。
Z.ai(智谱)的 GLM 5.3 现已登陆 Amazon Bedrock,这是一个 753B 参数的 MoE 模型,面向编码和长程智能体任务,Z.ai 报告其在 CyberGym 基准上取得 84.5 的领先分数,并在内部编码基准上较 GLM 5.2 提升 50%。
Simon Willison 于 2026 年 10 月 6 日发布了 llm-mistral 0.16。原文仅简要提及此次发布,未给出具体的改动说明或功能细节。
AWS 推出在 SageMaker Studio UI 中直接创建和管理 HyperPod EKS 集群上 SageMaker Spaces 的功能,数据科学家无需命令行工具即可通过几次点击启动 JupyterLab 或 Code Editor 环境。
AWS 介绍如何通过 SageMaker Unified Studio 管理 Amazon SageMaker HyperPod 集群,在让 ML 团队从项目工作区启动训练和微调任务的同时保持治理控制。
云服务商 Lambda 正在以 145 亿美元投前估值融资至多 40 亿美元,由 Coatue Management 和 Blackstone 领投,可能是其 2027 年 IPO 前最后一轮私募。
AWS Machine Learning Blog 发布教程,演示用 OpenClaw 智能体框架和 Amazon Bedrock AgentCore runtime、memory 构建带长期记忆的园艺助手 Sprout。
Simon Willison 撰文主张按用量计费服务和 API 应默认提供硬性预算上限,超过限额即停用并报错,而非仅发警告邮件,因为编程 Agent 降低了启动可能产生账单的代码的门槛。
MIT Technology Review Insights 发布报告,提出企业正经历从 AI 工具到 AI 运营模式的"agentic shift"。2026 年全球 AI 投资将达 2.5 万亿美元,同比增长 44%,但多数企业尚未通过 AI 实现收入增长。报告指出企业需重建面向可访问性的数据基础设施、采用可组合架构,并解决 AI 主权问题。
AWS 机器学习博客介绍 Adjudicated Query 设计模式,让业务用户通过 Amazon Quick 聊天界面提问合规问题,而通过与否的判定仍由确定性规则引擎完成,模型只负责翻译问题和叙述结果。
借助 Amazon Bedrock AgentCore Gateway,可将 Claude Desktop 连接到完全托管的 Web Search——一项兼容 MCP、基于覆盖数百亿文档的 Amazon 网页索引的搜索能力,所有查询流量都留在 AWS 基础设施内,无需管理外部 API 密钥。
Amazon SageMaker AI 推出多轮强化学习(MTRL)微调能力,可将 Qwen3.6-27B 训练成自主调用 BM25 词法检索与向量搜索工具的搜索智能体。
Google 宣布推出基于可信执行环境(TEE)的下一代联邦学习系统,为数据匿名化提供可远程验证与审计的保障。访问策略发布到公开透明日志 Rekor,KMS 和数据处理二进制可由开源代码复现构建;加密训练数据仅在 TEE 内解密处理,工作负载操作者只能看到指标和差分隐私模型权重。
Airbnb CTO Ahmad Al-Dahle 接受 Latent Space 采访,阐述将 Airbnb 打造为 AI 原生公司的做法。Airbnb 目前 60% 的代码由 AI 编写,功能和改进发布量同比增长近 80%,工程师平均 pull-request 吞吐量提升约 1.6x;约一半客服工单由 AI 纯自动解决,与 Q2 财报的近 45% 一致。
NVIDIA 宣布 DGX Spark 新增 64GB 统一内存配置,10 月 23 日起由 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 发售,起售价 $4,999。
GPT-6 Astra Ultrafast 已在 OpenAI API 开放,并向符合条件的 ChatGPT Work 和 Codex 用户提供,运行在 NVIDIA Blackwell GPU 上,token 生成速度最高达 Astra Standard 模式的 8 倍。
推荐理由:原文给出了 8x 提速的量化依据和适用场景,开发者可以据此评估是否将编码智能体工作流切换到 Ultrafast 模式。
AI 工作负载转向推理与智能体 AI 后,系统瓶颈正从算力转向数据移动。文章指出处理器中心架构下,从 DRAM 取一次数据的能耗可达一次简单算术运算的 150 至 2,000 倍,大型机器学习模型超过 90% 的系统能耗可能消耗在内存访问与数据移动上。文章引出 SK hynix 打造下一代 AI 内存生态的愿景,主张 GPU/NPU/TPU、内存、存储与网络作为整体系统协同设计。
AWS Professional Services 构建了一套四智能体模式,基于 Strands Agents SDK 并运行在 Amazon Bedrock AgentCore 上,通过 AgentCore Gateway 以 MCP 工具连接迁移输入与输出系统。
Google 的 Project Suncatcher 原型卫星于 10 月 1 日搭载 SpaceX 火箭从加州发射,首次将其 TPU 送入太空,由 Planet Labs 建造,卫星将以 15 分钟 bursts 启动 TPU 验证其在轨运行。
AWS Machine Learning Blog 发布 Claude Platform on AWS(CPonAWS)多环境访问的完整实现指南:在专用 AI Services 账户中部署订阅。
AWS 在 Amazon Bedrock AgentCore 上给出环境智能体的端到端参考实现:事件(如 S3 上传)触发 AgentCore Runtime 上的智能体执行工作流,通过单一 ask_human 工具在需要审批或澄清时暂停等待人工输入,再从中断处恢复。
Amazon Payments 在 Amazon SageMaker AI 上用多目标 contextual 多臂老虎机(LinUCB)对产品获客漏斗做个性化内容选择。
AWS 博客展示了如何将 Amazon S3 Vectors 作为 NVIDIA NeMo Agent Toolkit(NAT,版本 1.6)的自定义记忆后端,并部署在 Amazon EKS 上,以多智能体投资研究为运行示例。
台湾统一集团旗下数位平台 uniopen 通过监督微调(Amazon SageMaker AI)和提示词级输出优化,将 Amazon Nova 2 Lite 适配到其业务专属的零售内容审核策略。
Ai2 发布 Olmo-core 3,重新设计开源 MoE 训练系统,支持扩展到万亿参数规模。它从 FSDP 改为基于 DDP 的方案,47B 参数 MoE 在 8 块 NVIDIA B300 上吞吐达 52。
NVIDIA AI 工厂的回报取决于三个相互关联的因素:收益能力、使用寿命和需求。据 SemiAnalysis AgentX 数据,NVIDIA Vera Rubin NVL72 比 GB300 NVL72 每兆瓦吞吐量高逾 30x,在 DeepSeek V4 Pro 模型上每百万 token 成本低至 45x。
柏林初创公司 Restate 完成 2000 万美元 A 轮融资,由 Singular 领投,Redpoint Ventures 和 Capital One Ventures 参与投资。
Cerebras Systems 联合创始人兼 CEO Andrew Feldman 将在 TechCrunch Disrupt 2026(10 月 13-15 日,旧金山 Moscone West)登台探讨 AI 扩展的算力、能源与基础设施极限。
Microsoft Research 开发了一套机器学习系统,为美国大陆 66,935 座变电站提供位置级电网空间天气风险预测,可提前 30-60 分钟预警。
AWS 在 Machine Learning Blog 发布教程,演示用 Amazon Bedrock Knowledge Bases 在 Amazon S3 索引保险理赔文档,通过 AgenticRetrieveStream API 实现自然语言提问、多轮对话、元数据过滤和引用返回。
AWS Machine Learning Blog 发布实操教程,用 AgentCore Runtime Instances 构建由作曲、交付、合规三个智能体组成的音乐制作流水线,在 g6.xlarge 上以相同 runtimeSessionId 将三个智能体协同定位到同一 GPU 实例。
推荐理由:AWS 官方教程给出三智能体共享 GPU 实例协作的完整代码和实测数据,方法可迁移到其他长时多智能体工作流。
CoreWeave 宣布其云平台正式提供 NVIDIA Vera Rubin NVL72 系统与 Spectrum-X 102.4T 以太网组网,Cognition 成为首家在其上运行生产负载的客户,实测 SWE-2 推理总 token 吞吐较 GB200 NVL72 提升最高 4.8x。
DeepSeek 与 Huawei 合作,开源面向 Ascend 芯片的编程工具,核心是比 CUDA 更易用的编程语言 TileLang,另含计算和芯片间数据搬运的库,双方还优化了 128 颗 Ascend 950 组成的 supernode。