Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.
Compatibilità API per modelli
Amazon Bedrock supporta quattro famiglie di API di runtime, ciascuna progettata per diversi modelli di integrazione e casi d'uso.
Famiglia Invoke: InvokeModel gestisce chiamate sincrone a risposta singola. InvokeModelWithResponseStreamrestituisce le risposte come stream in tempo reale. InvokeModelWithBidirectionalStreamconsente lo streaming full-duplex per applicazioni interattive. AsyncInvokeinvia richieste di lunga durata in modo asincrono, archiviando l'output su Amazon S3.
Famiglia Converse: Converse fornisce un'interfaccia unificata e indipendente dal modello per conversazioni sincrone a più turni. ConverseStreamoffre la stessa esperienza con l'output di streaming.
OpenAI-compatible famiglia: ChatCompletions implementa l'interfaccia OpenAI Chat Completions, consentendo l'esecuzione delle OpenAI-based integrazioni esistenti su Bedrock con modifiche minime. Responses L'API implementa l'interfaccia OpenAI Responses, supportando interazioni stateful e agentiche con l'uso degli strumenti integrati e la gestione della cronologia delle conversazioni.
Famiglia Messages: Messages implementa l'interfaccia Anthropic Messages sull'bedrock-mantleendpoint, consentendo l'esecuzione delle integrazioni Anthropic SDK-based esistenti su Bedrock con modifiche minime.
Ora esamineremo l'elenco delle API supportate da ciascun modello.
AI21
| Nome modello | Invoke | Converse | Completamenti delle chat | Risposte | Messaggi |
|---|---|---|---|---|---|
| Jamba 1.5 Large* |
|
|
|
|
|
| Jamba 1.5 Mini* |
|
|
|
|
|
Amazon
| Nome modello | Invoke | Converse | Completamenti delle chat | Risposte | Messaggi |
|---|---|---|---|---|---|
| Incorporamenti multimodali Amazon Nova |
|
|
|
|
|
| Nova 2 Lite* |
|
|
|
|
|
| Nova 2 Sonic |
|
|
|
|
|
| Nova Canvas |
|
|
|
|
|
| Nova Lite* |
|
|
|
|
|
| Nova Micro* |
|
|
|
|
|
| Nova Premier* |
|
|
|
|
|
| Nova Pro* |
|
|
|
|
|
| Nova Reel |
|
|
|
|
|
| Nova Sonic* |
|
|
|
|
|
| Titan Embeddings G1 - Text |
|
|
|
|
|
| Titan Image Generator G1 v2 |
|
|
|
|
|
| Titan Multimodal Embeddings G1 |
|
|
|
|
|
| Titan Text Embeddings V2 |
|
|
|
|
|
Anthropic
| Nome modello | Invoke | Converse | Completamenti delle chat | Risposte | Messaggi |
|---|---|---|---|---|---|
| Claude Sonnet 5 | |||||
| Claude Mythos 5 | |||||
| Tabella Claude 5 | |||||
| Anteprima di Claude Mythos |
|
|
|
|
|
| Claude 3 Haiku* |
|
|
|
|
|
| Claude 3.5 Haiku* |
|
|
|
|
|
| Claude Haiku 4.5* |
|
|
|
|
|
| Claude Opus 4.1* |
|
|
|
|
|
| Claude Opus 4.5* |
|
|
|
|
|
| Claude Opus 4.6* |
|
|
|
|
|
| Claude Opus 4.7* |
|
|
|
|
|
| Claude Opus 4.8* |
|
|
|
|
|
| Claude Sonnet 4* |
|
|
|
|
|
| Claude Sonnet 4.5* |
|
|
|
|
|
| Claude Sonnet 4.6* |
|
|
|
|
|
Cohere
| Nome modello | Invoke | Converse | Completamenti delle chat | Risposte | Messaggi |
|---|---|---|---|---|---|
| Comando R* |
|
|
|
|
|
| Comando R* |
|
|
|
|
|
| Embed English |
|
|
|
|
|
| Embed Multilingual |
|
|
|
|
|
| Incorpora v4 |
|
|
|
|
|
| Rerank 3.5 |
|
|
|
|
|
DeepSeek
| Nome modello | Invoke | Converse | Completamenti delle chat | Risposte | Messaggi |
|---|---|---|---|---|---|
| DeepSeek V3.2* |
|
|
|
|
|
| DeepSeek-R1* |
|
|
|
|
|
| DeepSeek-V3.1* |
|
|
|
|
|
| Nome modello | Invoke | Converse | Completamenti delle chat | Risposte | Messaggi |
|---|---|---|---|---|---|
| Gemma 3 12B IT* |
|
|
|
|
|
| Gemma 3 27B PT* |
|
|
|
|
|
| Gemma 3 4B IT* |
|
|
|
|
|
Meta
| Nome modello | Invoke | Converse | Completamenti delle chat | Risposte | Messaggi |
|---|---|---|---|---|---|
| Llama 3 70B Instruct* |
|
|
|
|
|
| Llama 3 8B Instruct* |
|
|
|
|
|
| Llama 3.1 405B Instruct |
|
|
|
|
|
| Llama 3.1 70B Instruct* |
|
|
|
|
|
| Llama 3.1 8B Instruct* |
|
|
|
|
|
| Llama 3.2 11B Instruct* |
|
|
|
|
|
| Llama 3.2 1B Instruct* |
|
|
|
|
|
| Llama 3.2 3B Instruct* |
|
|
|
|
|
| Llama 3.2 90B Instruct* |
|
|
|
|
|
| Llama 3.3 70B Instruct* |
|
|
|
|
|
| Llama 4 Maverick 17B Instruct* |
|
|
|
|
|
| Llama 4 Scout 17B Instruct* |
|
|
|
|
|
MiniMax
| Nome modello | Invoke | Converse | Completamenti delle chat | Risposte | Messaggi |
|---|---|---|---|---|---|
| MiniMax M2* |
|
|
|
|
|
| MiniMax M2.1* |
|
|
|
|
|
| MiniMax M2.5* |
|
|
|
|
Mistral
| Nome modello | Invoke | Converse | Completamenti delle chat | Risposte | Messaggi |
|---|---|---|---|---|---|
| Devstral 2 123B* |
|
|
|
|
|
| Magistral Small 2509* |
|
|
|
|
|
| Ministral 14B 3.0* |
|
|
|
|
|
| Ministro 3 8B* |
|
|
|
|
|
| Ministral 3B* |
|
|
|
|
|
| Mistral 7B Instruct* |
|
|
|
|
|
| Mistral Grande* |
|
|
|
|
|
| Mistral Large 3* |
|
|
|
|
|
| Mistral Piccolo* |
|
|
|
|
|
| Mixtral 8x7B Instruct* |
|
|
|
|
|
| Pixtral Large* |
|
|
|
|
|
| Voxtral Mini 3B 2507* |
|
|
|
|
|
| Voxtral Small 24V 2507* |
|
|
|
|
|
Moonshot
| Nome modello | Invoke | Converse | Completamenti delle chat | Risposte | Messaggi |
|---|---|---|---|---|---|
| Il pensiero di Kimi K2* |
|
|
|
|
|
| Kimi K2.5* |
|
|
|
|
|
NVIDIA
| Nome modello | Invoke | Converse | Completamenti delle chat | Risposte | Messaggi |
|---|---|---|---|---|---|
| NVIDIA Nemotron Nano 9B v2* |
|
|
|
|
|
| NVIDIA Nemotron Nano 12B v2 VL BF16* |
|
|
|
|
|
| Nemotron Nano 3 30B* |
|
|
|
|
|
| NVIDIA Nemotron 3 Super 120B* |
|
|
|
|
OpenAI
| Nome modello | Invoke | Converse | Completamenti delle chat | Risposte | Messaggi |
|---|---|---|---|---|---|
| GPT-5.6 Sol |
|
|
|
|
|
| Daybreak Red: Cyber GPT-5.6 |
|
|
|
|
|
| Daybreak Blue: Sol GPT-5.6 |
|
|
|
|
|
| GPT-5.6 Terra |
|
|
|
|
|
| GPT-5.6 Luna |
|
|
|
|
|
| GPT-5.5 |
|
|
|
|
|
| GPT-5.4 |
|
|
|
|
|
| GPT OSS Safeguard 120B* |
|
|
|
|
|
| Protezione GPT OSS 20B* |
|
|
|
|
|
| gpt-oss-120b* |
|
|
|
|
|
| gpt-oss-20b* |
|
|
|
|
|
Qwen
| Nome modello | Invoke | Converse | Completamenti delle chat | Risposte | Messaggi |
|---|---|---|---|---|---|
| Qwen3 235B A22B 2507* |
|
|
|
|
|
| Qwen3 32B* |
|
|
|
|
|
| Codificatore Qwen3 480B A35B Instructor* |
|
|
|
|
|
| Qwen3 Coder Prossimo* |
|
|
|
|
|
| Qwen3 Next 80B A3B* |
|
|
|
|
|
| Qwen3 VL 235B A22B* |
|
|
|
|
|
| Qwen3-Coder-30B-A3B-Instruct* |
|
|
|
|
|
Stabilità
TwelveLabs
| Nome modello | Invoke | Converse | Completamenti delle chat | Risposte | Messaggi |
|---|---|---|---|---|---|
| Marengo Embed 3.0 |
|
|
|
|
|
| Marengo Embed v2.7 |
|
|
|
|
|
| Pegasus v1.2 |
|
|
|
|
|
Istanza di scrittura
| Nome modello | Invoke | Converse | Completamenti delle chat | Risposte | Messaggi |
|---|---|---|---|---|---|
| Palmyra Vision 7B |
|
|
|
|
|
| Palmyra X4* |
|
|
|
|
|
| Palmyra X5* |
|
|
|
|
|
xAI
| Nome modello | Invoke | Converse | Completamenti delle chat | Risposte | Messaggi |
|---|---|---|---|---|---|
| Grok 4.3 |
|
|
|
|
|
Z.AI
| Nome modello | Invoke | Converse | Completamenti delle chat | Risposte | Messaggi |
|---|---|---|---|---|---|
| GLM 4.7* |
|
|
|
|
|
| GLM 4.7 Flash* |
|
|
|
|
|
| GLM 5* |
|
|
|
|
|
Nota
* Supporto per lo streaming: supporta anche i modelli contrassegnati con un asterisco (*)InvokeModelWithResponseStream, che restituisce le risposte come streaming in tempo reale.
Modelli che supportano StartAsyncInvoke
StartAsyncInvoke è un'API Amazon Bedrock Runtime che consente ai chiamanti di inviare una richiesta di richiamo del modello e ricevere immediatamente un InvocationARN senza attendere che il modello termini l'elaborazione. Il processo viene eseguito in background e l'output viene scritto in un bucket S3 specificato dal chiamante una volta completato. I chiamanti possono quindi verificare lo stato del lavoro utilizzando il compagno e le API. GetAsyncInvoke ListAsyncInvokes Lo schema è stato creato appositamente per carichi di lavoro che coinvolgono ingressi di grandi dimensioni o non sensibili alla latenza, in particolare la generazione di video, audio e incorporamento di massa, per i quali mantenere una connessione sincrona aperta non sarebbe pratico.
Per quanto riguarda i modelli che lo supportano, sono supportati i seguenti modelli: StartAsyncInvoke
-
TwelveLabs Marengo Embed 2.7 (twelvelabs.marengo-embed-2-7-v 1:0): richiesto per l'input video e audio; gestisce solo testo e immagini InvokeModel
-
TwelveLabs Marengo Embed 3.0 (twelvelabs.marengo-embed-3-0-v 1:0) — stesso modello; asincrono richiesto per at scale video/audio
-
Amazon Nova Reel (amazon.nova-reel-v 1:0 e v 1:1): la generazione di video è esclusivamente asincrona; l'output arriva in S3
-
Amazon Nova Multimodal Embeddings (amazon.nova-2-multimodal-embeddings-v 1:0): è richiesto l'asincrono per gli ingressi video di dimensioni superiori a 25 MB con codifica base64; la sincronizzazione è disponibile per gli input di testo, immagini e documenti
InvokeModelWithBidirectionalStream
InvokeModelWithBidirectionalStreamè un'API Amazon Bedrock Runtime che stabilisce un canale full duplex persistente tra il chiamante e il modello, consentendo ai dati audio di fluire in entrambe le direzioni contemporaneamente e continuamente. A differenza delle API standard InvokeModel o addirittura delle InvokeModelWithResponseStream API, che seguono uno schema di richiesta e risposta, questa API mantiene la connessione aperta per tutta la durata di una sessione in modo che il modello possa elaborare l'audio in ingresso non appena arriva e trasmettere in streaming il parlato generato quasi in tempo reale, senza attendere il completamento dell'enunciato completo. L'interazione è strutturata in tre fasi: inizializzazione della sessione (in cui il client invia eventi di configurazione per impostare lo stream), streaming audio (in cui l'audio acquisito viene codificato e inviato come flusso di eventi continuo) e streaming di risposta (in cui il modello restituisce simultaneamente trascrizioni testuali del parlato dell'utente e dell'output audio sintetizzato). InvokeModelWithBidirectionalStreamnon può essere utilizzato con le chiavi API di Amazon Bedrock e richiede l'autenticazione standard basata su credenziali AWS, che riflette il ciclo di vita della sessione più complesso rispetto ad altre operazioni di Bedrock Runtime.
I seguenti modelli supportano questa API:
-
Famiglia Amazon Nova Sonic: sia amazon.nova-sonic-v 1:0 che amazon.nova-2-sonic-v 1:0 la utilizzano come unico percorso di chiamata, poiché l'architettura speech-to-speech richiede fondamentalmente un canale bidirezionale live che né Converse sono in grado di fornire. InvokeModel