View a markdown version of this page

Compatibilidad de API por modelos - Amazon Bedrock

Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.

Compatibilidad de API por modelos

Amazon Bedrock admite cuatro familias de API en tiempo de ejecución, cada una diseñada para diferentes patrones de integración y casos de uso.

Familia Invoke: InvokeModel gestiona llamadas sincrónicas de respuesta única. InvokeModelWithResponseStreamdevuelve las respuestas en forma de flujo en tiempo real. InvokeModelWithBidirectionalStreampermite la transmisión dúplex completa para aplicaciones interactivas. AsyncInvokeenvía solicitudes de larga duración de forma asincrónica y almacena los resultados en Amazon S3.

Familia Converse: Converse proporciona una interfaz unificada e independiente del modelo para conversaciones sincrónicas de varios turnos. ConverseStreamofrece la misma experiencia con la salida de streaming.

OpenAI-compatible familia: ChatCompletions implementa la interfaz OpenAI Chat Completions, lo que permite que las OpenAI-based integraciones existentes se ejecuten en Bedrock con cambios mínimos. Responses La API implementa la interfaz OpenAI Responses, que admite interacciones entre agencias con estado y con el uso de herramientas integradas y la administración del historial de conversaciones.

Familia Messages: Messages implementa la interfaz de Anthropic Messages en el bedrock-mantle terminal, lo que permite que las SDK-based integraciones de Anthropic existentes se ejecuten en Bedrock con cambios mínimos.

Ahora veremos la lista de API compatibles con cada modelo.

AI21

Nombre de modelo Invocación Converse Finalizaciones de chat Respuestas Mensajes
Jamba 1.5 Large*
Jamba 1.5 Mini*

Amazon

Anthropic

Cohere

Nombre de modelo Invocación Converse Finalizaciones de chat Respuestas Mensajes
Command R*
Command R+*
Embed English
Embed Multilingual
Insertar v4
Rerank 3.5

DeepSeek

Nombre de modelo Invocación Converse Finalizaciones de chat Respuestas Mensajes
DeepSeek V3.2*
DeepSeek-R1*
DeepSeek-V3.1*

Google

Nombre de modelo Invocación Converse Finalizaciones de chat Respuestas Mensajes
Gemma 3 12B IT*
Gemma 3 27B PT*
Gemma 3 4B IT*

Meta

MiniMax

Nombre de modelo Invocación Converse Finalizaciones de chat Respuestas Mensajes
MiniMax M2*
MiniMax M2.1*
MiniMax M2.5*

Mistral

Moonshot

Nombre de modelo Invocación Converse Finalizaciones de chat Respuestas Mensajes
Pensando en Kimi K2*
Kimi K2.5*

NVIDIA

Nombre de modelo Invocación Converse Finalizaciones de chat Respuestas Mensajes
NVIDIA Nemotron Nano 9B v2*
NVIDIA Nemotron Nano 12B v2 VL BF16*
Nemotron Nano 3 30B*
NVIDIA Nemotron 3 Súper 120 GB*

OpenAI

Qwen

Stability

TwelveLabs

Nombre de modelo Invocación Converse Finalizaciones de chat Respuestas Mensajes
Marengo Embed 3.0
Marengo Embed v2.7
Pegasus v1.2

Escritor

Nombre de modelo Invocación Converse Finalizaciones de chat Respuestas Mensajes
Palmyra Vision 7B
Palmyra X4*
Palmyra X5*

Axi

Nombre de modelo Invocación Converse Finalizaciones de chat Respuestas Mensajes
Grok 4.3

Z.AI

Nombre de modelo Invocación Converse Finalizaciones de chat Respuestas Mensajes
GLM 4,7*
Flash GLM 4.7*
GLM 5*
nota

* Soporte de streaming: también son compatibles los modelos marcados con un asterisco (*)InvokeModelWithResponseStream, que devuelve las respuestas en tiempo real.

Modelos compatibles StartAsyncInvoke

StartAsyncInvoke es una API de Amazon Bedrock Runtime que permite a las personas que llaman enviar una solicitud de invocación del modelo y recibir inmediatamente un InvocationARN sin esperar a que el modelo termine de procesarse. El trabajo se ejecuta en segundo plano y, una vez completado, el resultado se escribe en un bucket de S3 especificado por la persona que llama. Luego, las personas que llaman pueden sondear el estado del trabajo mediante el complemento GetAsyncInvoke y las API. ListAsyncInvokes El patrón está diseñado específicamente para cargas de trabajo que implican entradas grandes o que no son sensibles a la latencia, en particular la generación de imágenes de vídeo, audio e incrustaciones masivas, en las que mantener una conexión sincrónica abierta no sería práctico.

En cuanto a los modelos que lo admiten, los siguientes modelos son compatibles: StartAsyncInvoke

  • TwelveLabs Marengo Embed 2.7 (twelvelabs.marengo-embed-2-7-v 1:0): necesario para la entrada de vídeo y audio; solo maneja texto e imagen InvokeModel

  • TwelveLabs Marengo Embed 3.0 (twelvelabs.marengo-embed-3-0-v 1:0): el mismo patrón; se requiere una sincronización asíncrona a escala video/audio

  • Amazon Nova Reel (amazon.nova-reel-v 1:0 y v 1:1): la generación de vídeo es exclusivamente asincrónica; la salida llega a S3

  • Incrustaciones multimodales de Amazon Nova (amazon.nova-2-multimodal-embeddings-v 1:0): se requiere asincronía para entradas de vídeo de más de 25 MB codificadas en base64; la sincronización está disponible para entradas de texto, imágenes y documentos

InvokeModelWithBidirectionalStream

InvokeModelWithBidirectionalStreames una API de Amazon Bedrock Runtime que establece un canal dúplex completo y persistente entre la persona que llama y la modelo, lo que permite que los datos de audio fluyan en ambas direcciones de forma simultánea y continua. A diferencia de InvokeModelWithResponseStream las API estándar InvokeModel o incluso de las API, que siguen un patrón de solicitud y respuesta, esta API mantiene la conexión abierta durante toda la sesión para que el modelo pueda procesar el audio entrante a medida que llega y transmitir la voz generada prácticamente en tiempo real, sin esperar a que termine de pronunciarse. La interacción se estructura en torno a tres fases: la inicialización de la sesión (en la que el cliente envía eventos de configuración para configurar la transmisión), la transmisión de audio (en la que el audio capturado se codifica y se envía como una secuencia de eventos continua) y la transmisión de respuestas (en la que el modelo devuelve simultáneamente las transcripciones de texto de la voz del usuario y la salida de audio sintetizada). InvokeModelWithBidirectionalStreamno se puede usar con las claves de API de Amazon Bedrock y requiere una autenticación estándar basada en credenciales de AWS, lo que refleja su ciclo de vida de sesión más complejo en comparación con otras operaciones de Bedrock Runtime.

Los siguientes modelos admiten esta API:

  • Familia Amazon Nova Sonic: Tanto amazon.nova-sonic-v 1:0 como amazon.nova-2-sonic-v 1:0 la utilizan como única ruta de invocación, ya que la arquitectura de conversión de voz a voz requiere fundamentalmente un canal bidireccional en vivo que ni Converse ni Converse pueden proporcionar. InvokeModel