Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.
Compatibilité des API par modèle
Amazon Bedrock prend en charge quatre familles d'API d'exécution, chacune étant conçue pour des modèles d'intégration et des cas d'utilisation différents.
Famille d'appels : InvokeModel gère les appels synchrones à réponse unique. InvokeModelWithResponseStreamrenvoie les réponses sous forme de flux en temps réel. InvokeModelWithBidirectionalStreampermet le streaming en duplex intégral pour les applications interactives. AsyncInvokesoumet les demandes de longue durée de manière asynchrone, en stockant la sortie sur Amazon S3.
Famille Converse : Converse fournit une interface unifiée et indépendante du modèle pour les conversations synchrones à plusieurs tours. ConverseStreamoffre la même expérience avec la sortie en streaming.
OpenAI-compatible famille : ChatCompletions implémente l'interface OpenAI Chat Completions, permettant aux OpenAI-based intégrations existantes de s'exécuter sur Bedrock avec un minimum de modifications. Responses L'API implémente l'interface OpenAI Responses, qui prend en charge les interactions agentiques et dynamiques grâce à l'utilisation d'outils intégrés et à la gestion de l'historique des conversations.
Famille Messages : Messages implémente l'interface Anthropic Messages sur le bedrock-mantle terminal, permettant aux SDK-based intégrations Anthropic existantes de s'exécuter sur Bedrock avec un minimum de modifications.
Nous allons maintenant examiner la liste des API prises en charge par chaque modèle.
AI21
| Nom du modèle | Invocation | Converse | Achèvement du chat | Réponses | Messages |
|---|---|---|---|---|---|
| Jamba 1.5 Large* |
|
|
|
|
|
| Jamba 1.5 Mini* |
|
|
|
|
|
Amazon
| Nom du modèle | Invocation | Converse | Complétion du chat | Réponses | Messages |
|---|---|---|---|---|---|
| Intégrations multimodales Amazon Nova |
|
|
|
|
|
| Nova 2 Lite* |
|
|
|
|
|
| Nova 2 Sonic |
|
|
|
|
|
| Nova Canvas |
|
|
|
|
|
| Nova Lite* |
|
|
|
|
|
| Nova Micro* |
|
|
|
|
|
| Nova Premier* |
|
|
|
|
|
| Nova Pro* |
|
|
|
|
|
| Nova Reel |
|
|
|
|
|
| Nova Sonic* |
|
|
|
|
|
| Titan Embeddings G1 - Text |
|
|
|
|
|
| Titan Image Generator G1 v2 |
|
|
|
|
|
| Titan Multimodal Embeddings G1 |
|
|
|
|
|
| Titan Text Embeddings V2 |
|
|
|
|
|
Anthropic
| Nom du modèle | Invocation | Converse | Complétion du chat | Réponses | Messages |
|---|---|---|---|---|---|
| Claude Sonnet 5 | |||||
| Claude Mythos 5 | |||||
| Claude Fable 5 | |||||
| Aperçu de Claude Mythos |
|
|
|
|
|
| Claude 3 Haiku* |
|
|
|
|
|
| Claude 3.5 Haiku* |
|
|
|
|
|
| Claude Haiku 4.5* |
|
|
|
|
|
| Claude Opus 4.1* |
|
|
|
|
|
| Claude Opus 4.5* |
|
|
|
|
|
| Claude Opus 4.6* |
|
|
|
|
|
| Claude Opus 4.7* |
|
|
|
|
|
| Claude Opus 4.8* |
|
|
|
|
|
| Claude Sonnet 4* |
|
|
|
|
|
| Claude Sonnet 4,5* |
|
|
|
|
|
| Claude Sonnet 4,6* |
|
|
|
|
|
Cohere
| Nom du modèle | Invocation | Converse | Complétion du chat | Réponses | Messages |
|---|---|---|---|---|---|
| Command R* |
|
|
|
|
|
| Command R+* |
|
|
|
|
|
| Embed version anglaise |
|
|
|
|
|
| Embed version multilingue |
|
|
|
|
|
| Intégrer la v4 |
|
|
|
|
|
| Rerank 3.5 |
|
|
|
|
|
DeepSeek
| Nom du modèle | Invocation | Converse | Complétion du chat | Réponses | Messages |
|---|---|---|---|---|---|
| DeepSeek V3.2* |
|
|
|
|
|
| DeepSeek-R1* |
|
|
|
|
|
| DeepSeek-V3.1* |
|
|
|
|
|
| Nom du modèle | Invocation | Converse | Complétion du chat | Réponses | Messages |
|---|---|---|---|---|---|
| Gemma 3 12B IT* |
|
|
|
|
|
| Gemma 3 27B PT* |
|
|
|
|
|
| Gemma 3 4B IT* |
|
|
|
|
|
Meta
| Nom du modèle | Invocation | Converse | Complétion du chat | Réponses | Messages |
|---|---|---|---|---|---|
| Llama 3 70B Instruct* |
|
|
|
|
|
| Llama 3 8B Instruct* |
|
|
|
|
|
| Llama 3.1 405B Instruct |
|
|
|
|
|
| Llama 3.1 70B Instruct* |
|
|
|
|
|
| Llama 3.1 8B Instruct* |
|
|
|
|
|
| Llama 3.2 11B Instruct* |
|
|
|
|
|
| Llama 3.2 1B Instruct* |
|
|
|
|
|
| Llama 3.2 3B Instruct* |
|
|
|
|
|
| Llama 3.2 90B Instruct* |
|
|
|
|
|
| Llama 3.3 70B Instruct* |
|
|
|
|
|
| Llama 4 Maverick 17B Instruct* |
|
|
|
|
|
| Llama 4 Scout 17B Instruct* |
|
|
|
|
|
MiniMax
| Nom du modèle | Invocation | Converse | Complétion du chat | Réponses | Messages |
|---|---|---|---|---|---|
| MiniMax M2* |
|
|
|
|
|
| MiniMax M2.1* |
|
|
|
|
|
| MiniMax M2.5* |
|
|
|
|
Mistral
| Nom du modèle | Invocation | Converse | Complétion du chat | Réponses | Messages |
|---|---|---|---|---|---|
| Devestral 2 123V* |
|
|
|
|
|
| Magistral Small 2509* |
|
|
|
|
|
| Ministral 14B 3.0* |
|
|
|
|
|
| Ministral 3 8B* |
|
|
|
|
|
| Ministéral 3B* |
|
|
|
|
|
| Mistral 7B Instruct* |
|
|
|
|
|
| Mistral Large* |
|
|
|
|
|
| Mistral Large 3* |
|
|
|
|
|
| Mistral Small* |
|
|
|
|
|
| Mixtral 8x7B Instruct* |
|
|
|
|
|
| Pixtral Large* |
|
|
|
|
|
| Voxtral Mini 3B 2507* |
|
|
|
|
|
| Voxtral Small 24V 2507* |
|
|
|
|
|
Moonshot
| Nom du modèle | Invocation | Converse | Complétion du chat | Réponses | Messages |
|---|---|---|---|---|---|
| Kimi K2 Thinking* |
|
|
|
|
|
| Kimi K2.5* |
|
|
|
|
|
NVIDIA
| Nom du modèle | Invocation | Converse | Complétion du chat | Réponses | Messages |
|---|---|---|---|---|---|
| NVIDIA Nemotron Nano 9B v2* |
|
|
|
|
|
| NVIDIA Nemotron Nano 12B v2 VL BF16* |
|
|
|
|
|
| Nemotron Nano 3 30B* |
|
|
|
|
|
| NVIDIA Nemotron 3 Super 120B* |
|
|
|
|
IA ouverte
| Nom du modèle | Invocation | Converse | Complétion du chat | Réponses | Messages |
|---|---|---|---|---|---|
| GPT-5.6 Sol |
|
|
|
|
|
| Daybreak Red : Cyber GPT-5.6 |
|
|
|
|
|
| Daybreak Blue : Solo GPT-5.6 |
|
|
|
|
|
| GPT-5.6 Terra |
|
|
|
|
|
| GPT-5.6 Luna |
|
|
|
|
|
| GPT-5.5 |
|
|
|
|
|
| GPT-5.4 |
|
|
|
|
|
| Sauvegarde GPT OSS 120B* |
|
|
|
|
|
| GPT OSS Safeguard 20B* |
|
|
|
|
|
| gpt-oss-120b* |
|
|
|
|
|
| gpt-oss-20b* |
|
|
|
|
|
Qwen
| Nom du modèle | Invocation | Converse | Complétion du chat | Réponses | Messages |
|---|---|---|---|---|---|
| Qwen3 235B A22B 2507* |
|
|
|
|
|
| Qwen3 32 Go* |
|
|
|
|
|
| Instructions pour le codeur Qwen3 480B A35B* |
|
|
|
|
|
| Suivant le codeur Qwen3* |
|
|
|
|
|
| Qwen3 Next 80B A3B* |
|
|
|
|
|
| Qwen3 VL 235V A22B* |
|
|
|
|
|
| Qwen3-Coder-30B-A3B-Instruct* |
|
|
|
|
|
Stabilité
TwelveLabs
| Nom du modèle | Invocation | Converse | Complétion du chat | Réponses | Messages |
|---|---|---|---|---|---|
| Marengo Embed 3.0 |
|
|
|
|
|
| Marengo Embed v2.7 |
|
|
|
|
|
| Pegasus v1.2 |
|
|
|
|
|
Writer
| Nom du modèle | Invocation | Converse | Complétion du chat | Réponses | Messages |
|---|---|---|---|---|---|
| Palmyra Vision 7B |
|
|
|
|
|
| Palmyra X4* |
|
|
|
|
|
| Palmyra X5* |
|
|
|
|
|
Axe I
| Nom du modèle | Invocation | Converse | Complétion du chat | Réponses | Messages |
|---|---|---|---|---|---|
| Grok 4.3 |
|
|
|
|
|
Z.AI
| Nom du modèle | Invocation | Converse | Complétion du chat | Réponses | Messages |
|---|---|---|---|---|---|
| GLM 4,7* |
|
|
|
|
|
| Flash GLM 4.7* |
|
|
|
|
|
| GLM 5* |
|
|
|
|
|
Note
* Prise en charge du streaming : les modèles marqués d'un astérisque (*) sont également compatiblesInvokeModelWithResponseStream, ce qui renvoie les réponses sous forme de flux en temps réel.
Modèles supportant StartAsyncInvoke
StartAsyncInvoke est une API Amazon Bedrock Runtime qui permet aux appelants de soumettre une demande d'invocation de modèle et de recevoir immédiatement un InvocationArn sans attendre la fin du traitement du modèle. La tâche s'exécute en arrière-plan et la sortie est écrite dans un compartiment S3 spécifié par l'appelant une fois terminée. Les appelants peuvent ensuite interroger l'état de leur travail à l'aide du compagnon GetAsyncInvoke et des ListAsyncInvokes API. Le modèle est spécialement conçu pour les charges de travail impliquant des entrées volumineuses ou insensibles à la latence, en particulier la génération vidéo, audio et intégrée en masse, pour lesquelles le maintien d'une connexion synchrone ouverte ne serait pas pratique.
En ce qui concerne les modèles qui le prennent en charge, les modèles suivants le prennent en charge StartAsyncInvoke :
-
TwelveLabs Marengo Embed 2.7 (twelvelabs.marengo-embed-2-7-v 1:0) — requis pour les entrées vidéo et audio ; ne gère que le texte et les images InvokeModel
-
TwelveLabs Marengo Embed 3.0 (twelvelabs.marengo-embed-3-0-v 1:0) — même modèle ; async requis pour à grande échelle video/audio
-
Amazon Nova Reel (amazon.nova-reel-v 1:0 et v 1:1) : la génération vidéo est exclusivement asynchrone ; la sortie arrive dans S3
-
Amazon Nova Multimodal Embeddings (amazon.nova-2-multimodal-embeddings-v 1:0) : le mode asynchrone est requis pour les entrées vidéo de plus de 25 Mo encodées en base64 ; la synchronisation est disponible pour les entrées de texte, d'image et de document
InvokeModelWithBidirectionalStream
InvokeModelWithBidirectionalStreamest une API Amazon Bedrock Runtime qui établit un canal permanent en duplex intégral entre l'appelant et le modèle, permettant aux données audio de circuler dans les deux sens simultanément et en continu. Contrairement aux API standard InvokeModel ou même aux InvokeModelWithResponseStream API, qui suivent un modèle de demande puis de réponse, cette API maintient la connexion ouverte pendant la durée d'une session afin que le modèle puisse traiter le son entrant à son arrivée et diffuser la parole générée en temps quasi réel, sans attendre la fin de l'énoncé complet. L'interaction est structurée autour de trois phases : initialisation de session (où le client envoie des événements de configuration pour configurer le flux), diffusion audio (où le son capturé est codé et envoyé sous forme de flux d'événements continu) et diffusion de réponses (où le modèle renvoie simultanément des transcriptions textuelles de la parole de l'utilisateur et une sortie audio synthétisée). InvokeModelWithBidirectionalStreamne peut pas être utilisé avec les clés d'API Amazon Bedrock et nécessite une authentification standard basée sur les informations d'identification AWS, ce qui reflète le cycle de vie de session plus complexe que les autres opérations de Bedrock Runtime.
Les modèles suivants prennent en charge cette API :
-
Famille Amazon Nova Sonic : amazon.nova-sonic-v 1:0 et amazon.nova-2-sonic-v 1:0 l'utilisent comme unique chemin d'invocation, étant donné que l'architecture speech-to-speech nécessite fondamentalement un canal bidirectionnel en direct que ni Converse ni Converse ne peuvent fournir. InvokeModel