View a markdown version of this page

AgentCore aproveitamento versus tempo de execução - Amazon Bedrock AgentCore

AgentCore aproveitamento versus tempo de execução

AgentCore harness e AgentCore Runtime resolvem partes diferentes do mesmo problema. Esta página explica a diferença conceitual e fornece uma comparação recurso por recurso para ajudá-lo a escolher entre eles.

Diferença conceitual

AgentCore O Runtime é um ambiente de hospedagem sem servidor. Você traz o código do agente — escrito em qualquer estrutura ou em nenhuma estrutura — o agrupa com o BedrockAgentCoreApp ponto de entrada do AgentCore SDK, o empacota em um contêiner ARM64, o envia para o Amazon ECR e implanta. O loop de orquestração é seu. Para usar qualquer outra AgentCore primitiva (memória, gateway, navegador, interpretador de código, identidade de saída), você a chama a partir do seu código, normalmente por meio do SDK. AgentCore O Runtime fornece a infraestrutura — isolamento, escalabilidade, sessões, controle de autenticação e encanamento de observabilidade — enquanto a lógica do agente é o código que você escreve.

AgentCore harness é um chicote de agentes gerenciado - o próprio loop de orquestração é fornecido, alimentado por Strands Agents. Você declara o que é o agente (modelo, prompt do sistema, ferramentas, memória, limites) como configuração e AgentCore executa o loop. A maioria dos recursos é um único campo de configuração: trocar um modelo ou adicionar uma ferramenta é uma alteração na configuração, não uma reimplantação. O chicote é uma abstração gerenciada que é executada dentro do Runtime - CloudTrail registra as operações do chicote em. AWS::BedrockAgentCore::Runtime

Para quase todos os recursos, o padrão é o mesmo:

  • Arnês - configuração, sem código.

  • Tempo de execução - você escreve código, geralmente com o AgentCore SDK mais sua estrutura.

A grade abaixo torna explícitas as exceções por recurso.

Grade de recursos

O suportado? as colunas usam a seguinte legenda:

  • ✅ - Compatível sem a necessidade de código personalizado.

  • 🔵 - Compatível, mas você deve manter sua própria implementação.

  • 🟣 - A configuração permite isso, mas é necessário código para usá-lo totalmente.

  • ❌ - Não suportado.

Característica/Capacidade Arnês: suportado? Arnês: é necessário o código do cliente? Tempo de execução: suportado? Tempo de execução: é necessário o código do cliente?

Seleção de modelos (Bedrock/OpenAI/Gemini/LiteLM)

Não

🔵

Sim

Fornecedor de modelos de switch no meio da sessão

Não

🔵

Sim

Built-in concha e file_operations ferramentas

Não

🔵

Sim

Habilidades do agente

Não

🔵

Sim

Observabilidade

Não

🔵

Sim

AgentCore Memória - curto prazo

Não

🔵

Sim

AgentCore Memória - de longo prazo (semântica, sumarização, preferência do usuário, episódica)

Não

🔵

Sim

Per-user escopo de memória (ID do ator)

Não

🔵

Sim

AgentCore Gateway

Não

🔵

Sim

AgentCore Navegador

Não

🔵

Sim

AgentCore Interpretador de código

Não

🔵

Sim

Ferramentas de servidor MCP (remotas)

Não

🔵

Sim

Ferramentas embutidas/do lado do cliente

🔵

Sim

🔵

Sim

Context-window truncagem

Não

🔵

Sim

Imagem/ambiente de contêiner personalizado

🟣

Misto

🟣

Misto

Limites de execução (maxIterationstimeoutSeconds,,maxTokens, idle/lifetime)

Não

🔵

Sim

Sistema de arquivos - armazenamento de sessão gerenciado por serviços

Não

Não

Sistema de arquivos - ponto de acesso EFS

Não

Não

Sistema de arquivos - Ponto de acesso de arquivos S3

Não

Não

Variáveis de ambiente

Não

Não

Execução direta de comandos shell (InvokeAgentRuntimeCommandAPI)

Não

Não

Autenticação de entrada - IAM (SigV4)

Não

Não

Autenticação de entrada - OAuth

Não

Não

Autenticação de saída/Cofre de tokens de identidade (chaves OAuth e API)

Não

🔵

Sim

Isolamento da sessão

Não

Não

Rede VPC

Não

Não

Respostas de streaming

Não

🔵

Sim

Controle de versão e endpoints

Não

Não

Escolha da estrutura do agente

N/A

🔵

Sim

Streaming bidirecional

N/A

🔵

Sim

Non-agent-loop padrões (gráfico, estilo de fluxo de trabalho)

N/A

🔵

Sim

Hooks

N/A

🔵

Sim