跳到正文
AWS Machine Learning Blog· Prachi Mishra·· 3 小时前AI 评分38

AWS 2026 年 9 月 AI 开发者更新盘点:Amazon Bedrock、AgentCore 与 Strands 新动向

ICYMI: What landed for AI builders in September 2026

AI 导读

Amazon Bedrock 上线 OpenAI 驱动的 Managed Agents 公测,并开放 GPT-6 Astra、GPT-6.1 Sol、GPT-6.1 Luna、Claude Opus 5.5、Kimi K3 等新模型。

正文 · AI 翻译

2026 年 9 月 Amazon Bedrock、Amazon Bedrock AgentCore 与 Strands 更新回顾

在 AWS,我们相信企业迈向 AI 的最快路径,是在每一层——模型、运行时和工具——都为构建者提供真正的选择。这一信念决定了我们在 Amazon Bedrock、AgentCore 和 Strands 上的投入方向。Amazon Bedrock 持续扩大对领先前沿模型的访问,让你可以安全地构建和扩展 AI 应用。Amazon Bedrock AgentCore 提供托管基础设施,支持使用任何框架或模型来构建、连接和部署企业级智能体。Strands 则为你提供一套开源工具包,用于构建智能体并随处运行。

随着 AI 模型能力不断增强、模型选择日益丰富,行业讨论的焦点也在转变。模型性能已不再是唯一的问题。客户现在会针对自己的具体用例权衡成本与收益,而在生产环境中将工作委托给智能体时,这些决策至关重要。AI 智能体已经进入这样一些工作流:它们需要对企业知识进行推理、执行长周期任务,并在安全性、准确性和治理至关重要的系统中采取行动。如今,关注点正从模型本身转向围绕模型的更广泛的系统,包括智能体可访问的上下文、它们可以执行的操作,以及企业数据如何被治理和保护。

9 月,Amazon Bedrock、AgentCore 和 Strands 方面的更新进一步夯实了这些基础。新功能扩大了模型选择,让智能体运营更高效、更可衡量,并为 AI 应用与当前业务信息的连接提供了更直接的方式。

运行更快的智能体,评估真正重要的东西

构建针对 OpenAI 模型优化的智能体。由 OpenAI 提供支持的 Amazon Bedrock Managed Agents 现已推出公开预览版,帮助你在不牺牲企业安全性的情况下构建可用于生产的 AI 智能体。你现在可以使用 OpenAI 模型,同时将数据保留在 AWS 内,复用现有的 AWS Identity and Access Management (IAM) 权限,并通过 AWS CloudTrail 保持完整的可审计性。持久会话和内置的人工审批工作流有助于减少开发开销并降低风险。

智能体现在启动更快,基础设施开销更低。最新版 AgentCore runtime(Amazon Bedrock AgentCore 的一项功能)具备更高效的内存管理和更低的无服务器智能体冷启动延迟,因此你只需为实际使用量付费,而无需为峰值内存付费。借助按使用量计费且无需预置容量的方式,你可以以更低的成本更快地运行智能体。会话在空闲时可扩展至零,并在硬件隔离的环境中运行。

以前沿性能降低你的 token 成本。Strands harness 是一个新的开源智能体 harness,在准确率上可与流行的 harness 相媲美,同时少用 28% 的 token。你可以用一行 Python 或 TypeScript 代码启动一个可用于生产的智能体,其内置上下文管理、提示词缓存和内存功能,然后部署到任何地方。

让你的模型在本地安全地做出重大决策。 Strands Decider 2B 是一个小型开源的 20 亿参数决策模型,它在预定义选项之间进行选择(而不是生成文本),可在本地约 115 毫秒内给出答案。它针对工具选择、路由和护栏等智能体 AI 任务进行了优化,所有代码、数据和权重均可在 GitHub 和 Hugging Face 上获取。

为每个工作负载找到合适的模型

从更丰富的 OpenAI 模型集合中为日常工作选择模型。 OpenAI 的 Astra、Sol 和 Luna 模型现已在 Amazon Bedrock 上正式可用,提供适用于高要求项目、经常性复杂工作和高并发任务的选项。

GPT-6 Astra 是面向最宏伟工作的旗舰模型,为复杂决策、文档分析和软件开发带来更深入的推理能力,支持多达 100 万输入 token。它为复杂业务决策提供更强的推理能力和更精准的判断,可跨软件和文件操作,并输出符合组织语气、模板和标准的专业级成果。GPT-6 Astra Ultrafast 为 GPT-6 Astra 增加了高级速度层级,专为对速度要求最高的工作负载而构建。它在 API 中可提供高达 6 倍的推理速度提升,每秒输出多达 300 个 token。

Sol 在频繁运行的编程、计算机使用和专业工作负载中带来接近 Astra 的智能水平。GPT-6.1 Sol 和 GPT-6 Sol 均已在 Amazon Bedrock 上可用。GPT 6.1 Luna 专为提取、摘要、分类和路由等高并发任务而设计。它们共同帮助你在各个工作负载之间平衡智能水平、延迟和成本。

使用 Claude 处理长时间运行的编程和研究任务。Claude 的模型选择现已包含最新版本,以推进你的编程和科学工作。Claude Fable 5.1 扩展了编程、科学研究和企业工作流的选项。Claude Opus 5.5 为智能体编程、知识工作和长时间运行的任务而构建。它使用自适应思考来评估任务所需的推理量,并通过努力参数设置推理深度的上限。Claude Sonnet 5.5 是更智能、更高效的 Sonnet,适合专注的编程和知识工作,与 Claude Sonnet 5 相比,每项任务成本降低 30%,速度提升 30%。

用更广泛的模型组合应对复杂推理。 Moonshot AI 的 Kimi K3 现已在 Amazon Bedrock 上可用。据 Moonshot AI 介绍,Kimi K3 是其最强大的模型,也是首个达到 2.8 万亿参数的开源模型。凭借 100 万 token 的上下文窗口、原生视觉能力和内置提示词缓存,它帮助你以比先前版本低得多的成本,将智能应用的开发速度提升 2.5 倍。

xAI 的前沿模型 Grok 4.6 和 Grok 4.7 提供 50 万 token 的上下文窗口,并支持可配置的推理努力和自我验证,以实现更可靠的长时运行任务。

这些新增内容共同为你提供了更大的灵活性,以便根据上下文长度、延迟、吞吐量和成本等需求匹配模型。

更好地掌控你的企业级 AI 智能体

保持智能体知识最新。借助 Amazon Bedrock 托管知识库中新的自动同步调度功能,您现在可以为所有原生数据源连接器配置每日、每周和每月的刷新选项。这样,您的企业 AI 智能体即可检索最新信息。当您已拥有所需访问权限时,面向 SharePoint、OneDrive 和 Confluence 的用户托管设置可减少对管理员托管服务账户的依赖。

连接更多企业数据源,无需维护自定义摄取管道。Amazon Bedrock 托管知识库现在支持 ServiceNow、Confluence Data Center、Salesforce 和 Zendesk 作为原生连接器,自动处理数据爬取、元数据提取和增量同步。这些连接器减少了您为构建和维护支持内容、内部文档及运营知识所需编写和维护的自定义摄取代码量。

开始使用

探索 Amazon Bedrock,使用 AgentCore CLI 部署智能体,或使用 Strands Harness SDK 构建您的第一个智能体。

想了解 Amazon Bedrock 如何为您的团队提供支持?联系我们,开始对话。


关于作者

来源:AWS Machine Learning Blog · aws.amazon.com