View a markdown version of this page

使用 Amazon Bedrock AgentCore Runtime 托管代理或工具 - Amazon Bedrock AgentCore

使用 Amazon Bedrock AgentCore Runtime 托管代理或工具

Amazon Bedrock AgentCore Runtime 为部署和运行 AI 代理或工具提供了一个安全、无服务器和专门构建的托管环境。它具备下列优点:

与框架无关

AgentCore 无论底层框架如何,Runtime 都允许您使用几行代码将任何本地代理代码转换为云原生部署。与 Strands 和 Crewa LangGraph I 等流行框架无缝协作。您也可以将其用于不使用特定框架的自定义代理。

模型灵活性

AgentCore Runtime 适用于任何大型语言模型,例如亚马逊 Bedrock、Anthropic Claude、Google Gemini 和 OpenAI 提供的模型。

协议支持

AgentCore Runtime 允许代理通过模型上下文协议 (MCP) 或代理到代理 (A2A) 与其他代理和工具通信。

会话隔离

在 AgentCore Runtime 中,每个用户会话都在具有隔离的 CPU、内存和文件系统资源的专用 microVM 中运行。这有助于在用户会话之间实现完全隔离,保护有状态的代理推理过程,并有助于防止跨会话数据污染。会话完成后,整个 microVM 将被终止并清理内存,即使使用不确定的 AI 进程,也能提供确定性的安全性。

延长执行时间

AgentCore Runtime 支持实时交互和长达 8 小时的长时间运行的工作负载,支持复杂的代理推理和异步工作负载,这些工作负载可能涉及多代理协作或延长问题解决会话。

永久文件系统

Runtime 支持跨会话 stop/resume 周期保持文件系统状态。在没有外部存储空间的情况下,代理的文件、已安装的软件包和构建工件可以在会话停止后继续运行。

Consumption-based 定价模型

Runtime 采用基于消耗的定价,仅对实际消耗的资源收费。与需要预先选择资源的基于分配的模型不同,Runtime 无需调整大小即可动态配置所需的资源。该服务将 CPU 账单与实际的活跃处理保持一致,通常可以消除代理主要在等待 LLM 响应的 I/O 等待期间的费用,同时持续保持您的会话状态。

Built-in authentication

AgentCore Runtime 由 Id AgentCore entity 提供支持,可为 AI 代理分配不同的身份,并与您的企业身份提供商(例如 Okta、Microsoft Entra ID 或 Amazon Cognito)无缝集成,使您的最终用户只能向他们有权访问的代理进行身份验证。此外,Runtime 允许出站身份验证流程安全地访问第三方服务,例如 Slack、Zoom 和 GitHub ,无论是代表用户操作还是自主操作(使用 OAuth 或 API 密钥)。

Agent-specific 可观察性

AgentCore Runtime 提供了专门的内置跟踪,可以捕获代理推理步骤、工具调用和模型交互,从而清晰地了解代理决策过程,这是调试和审计 AI 代理行为的关键功能。

增强的有效载荷处理能力

AgentCore Runtime 可以处理 100MB 的负载,从而可以无缝处理包含富媒体内容或大型数据集的多种模式(文本、图像、音频、视频)。

双向直播

AgentCore Runtime 支持 HTTP API 调用和用于实时双向流式传输的持久 WebSocket 连接,从而使交互式应用程序能够即时响应反馈并维护对话上下文。

一套统一的代理特定功能

AgentCore Runtime 通过单一、全面的 SDK 交付,可简化对包括内存、工具和网关在内的全部 AgentCore 功能的访问。这种集成方法消除了使用不同组件构建等效代理基础架构时通常需要的集成工作。