Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.
Points de terminaison et quotas Amazon Bedrock
Pour vous connecter par programmation à un AWS service, vous utilisez un point de terminaison. AWS les services proposent les types de terminaux suivants dans certaines ou toutes les AWS régions prises en charge par le service : points de terminaison IPv4, points de terminaison à double pile et points de terminaison FIPS. Certains services fournissent des points de terminaison mondiaux. Pour de plus amples informations, veuillez consulter AWS points de terminaison de service.
Les quotas de service, également appelés limites, sont le nombre maximum de ressources de service ou d'opérations pour votre AWS compte. Pour de plus amples informations, veuillez consulter AWS service quotas.
Voici les points de terminaison de service et les quotas de service pour ce service.
Points de terminaison du service Amazon Bedrock
API du plan de contrôle Amazon Bedrock
Le tableau suivant fournit la liste des Region-specific points de terminaison pris en charge par Amazon Bedrock pour la gestion, la formation et le déploiement de modèles. Utilisez ces points de terminaison pour les opérations d'API Amazon Bedrock.
| Nom de la région | Région | Point de terminaison | Protocole |
|---|---|---|---|
| US East (Ohio) | us-east-2 |
bedrock.us-east-2.amazonaws.com bedrock-fips.us-east-2.amazonaws.com |
HTTPS HTTPS |
| USA Est (Virginie du Nord) | us-east-1 |
bedrock.us-east-1.amazonaws.com bedrock-fips.us-east-1.amazonaws.com |
HTTPS HTTPS |
| USA Ouest (Californie du Nord) | us-west-1 |
bedrock.us-west-1.amazonaws.com bedrock-fips.us-west-1.amazonaws.com |
HTTPS HTTPS |
| USA Ouest (Oregon) | us-west-2 |
bedrock.us-west-2.amazonaws.com bedrock-fips.us-west-2.amazonaws.com |
HTTPS HTTPS |
| Afrique (Le Cap) | af-south-1 | bedrock.af-south-1.amazonaws.com | HTTPS |
| Asie-Pacifique (Hyderabad) | ap-south-2 | bedrock.ap-south-2.amazonaws.com | HTTPS |
| Asie-Pacifique (Jakarta) | ap-southeast-3 | bedrock.ap-southeast-3.amazonaws.com | HTTPS |
| Asie-Pacifique (Malaisie) | ap-southeast-5 | bedrock.ap-southeast-5.amazonaws.com | HTTPS |
| Asie-Pacifique (Melbourne) | ap-southeast-4 | bedrock.ap-southeast-4.amazonaws.com | HTTPS |
| Asia Pacific (Mumbai) | ap-south-1 | bedrock.ap-south-1.amazonaws.com | HTTPS |
| Asie-Pacifique (Nouvelle Zélande) | ap-southeast-6 | bedrock.ap-southeast-6.amazonaws.com | HTTPS |
| Asie-Pacifique (Osaka) | ap-northeast-3 | bedrock.ap-northeast-3.amazonaws.com | HTTPS |
| Asia Pacific (Seoul) | ap-northeast-2 | bedrock.ap-northeast-2.amazonaws.com | HTTPS |
| Asie-Pacifique (Singapour) | ap-southeast-1 | bedrock.ap-southeast-1.amazonaws.com | HTTPS |
| Asie-Pacifique (Sydney) | ap-southeast-2 | bedrock.ap-southeast-2.amazonaws.com | HTTPS |
| Asie-Pacifique (Taipei) | ap-east-2 | bedrock.ap-east-2.amazonaws.com | HTTPS |
| Asie-Pacifique (Thaïlande) | ap-southeast-7 | bedrock.ap-southeast-7.amazonaws.com | HTTPS |
| Asie-Pacifique (Tokyo) | ap-northeast-1 | bedrock.ap-northeast-1.amazonaws.com | HTTPS |
| Canada (Centre) | ca-central-1 |
bedrock.ca-central-1.amazonaws.com bedrock-fips.ca-central-1.amazonaws.com |
HTTPS HTTPS |
| Canada-Ouest (Calgary) | ca-west-1 |
bedrock.ca-west-1.amazonaws.com bedrock-fips.ca-west-1.amazonaws.com |
HTTPS HTTPS |
| Europe (Francfort) | eu-central-1 | bedrock.eu-central-1.amazonaws.com | HTTPS |
| Europe (Irlande) | eu-west-1 | bedrock.eu-west-1.amazonaws.com | HTTPS |
| Europe (Londres) | eu-west-2 | bedrock.eu-west-2.amazonaws.com | HTTPS |
| Europe (Milan) | eu-south-1 | bedrock.eu-south-1.amazonaws.com | HTTPS |
| Europe (Paris) | eu-west-3 | bedrock.eu-west-3.amazonaws.com | HTTPS |
| Europe (Espagne) | eu-south-2 | bedrock.eu-south-2.amazonaws.com | HTTPS |
| Europe (Stockholm) | eu-north-1 | bedrock.eu-north-1.amazonaws.com | HTTPS |
| Europe (Zurich) | eu-central-2 | bedrock.eu-central-2.amazonaws.com | HTTPS |
| Israël (Tel Aviv) | il-central-1 | bedrock.il-central-1.amazonaws.com | HTTPS |
| Mexique (Centre) | mx-central-1 | bedrock.mx-central-1.amazonaws.com | HTTPS |
| Moyen-Orient (Bahreïn) | me-south-1 | bedrock.me-south-1.amazonaws.com | HTTPS |
| Moyen-Orient (EAU) | me-central-1 | bedrock.me-central-1.amazonaws.com | HTTPS |
| Amérique du Sud (São Paulo) | sa-east-1 | bedrock.sa-east-1.amazonaws.com | HTTPS |
| AWS GovCloud (US-East) | us-gov-east-1 |
bedrock.us-gov-east-1.amazonaws.com bedrock-fips.us-gov-east-1.amazonaws.com |
HTTPS HTTPS |
| AWS GovCloud (US-West) | us-gov-west-1 |
bedrock.us-gov-west-1.amazonaws.com bedrock-fips.us-gov-west-1.amazonaws.com |
HTTPS HTTPS |
API d'exécution Amazon Bedrock
Le tableau suivant fournit la liste des Region-specific points de terminaison pris en charge par Amazon Bedrock pour effectuer des demandes d'inférence pour les modèles hébergés dans Amazon Bedrock. Utilisez ces points de terminaison pour les opérations de l'API Amazon Bedrock Runtime.
| Nom de la région | Région | Point de terminaison | Protocole |
|---|---|---|---|
| US East (Ohio) | us-east-2 |
bedrock-runtime.us-east-2.amazonaws.com bedrock-runtime-fips.us-east-2.amazonaws.com |
HTTPS HTTPS |
| USA Est (Virginie du Nord) | us-east-1 |
bedrock-runtime.us-east-1.amazonaws.com bedrock-runtime-fips.us-east-1.amazonaws.com |
HTTPS HTTPS |
| US West (Oregon) | us-west-2 |
bedrock-runtime.us-west-2.amazonaws.com bedrock-runtime-fips.us-west-2.amazonaws.com |
HTTPS HTTPS |
| Asie-Pacifique (Hyderabad) | ap-south-2 | bedrock-runtime.ap-south-2.amazonaws.com | HTTPS |
| Asia Pacific (Mumbai) | ap-south-1 | bedrock-runtime.ap-south-1.amazonaws.com | HTTPS |
| Asie-Pacifique (Osaka) | ap-northeast-3 | bedrock-runtime.ap-northeast-3.amazonaws.com | HTTPS |
| Asia Pacific (Seoul) | ap-northeast-2 | bedrock-runtime.ap-northeast-2.amazonaws.com | HTTPS |
| Asie-Pacifique (Singapour) | ap-southeast-1 | bedrock-runtime.ap-southeast-1.amazonaws.com | HTTPS |
| Asie-Pacifique (Sydney) | ap-southeast-2 | bedrock-runtime.ap-southeast-2.amazonaws.com | HTTPS |
| Asie-Pacifique (Tokyo) | ap-northeast-1 | bedrock-runtime.ap-northeast-1.amazonaws.com | HTTPS |
| Canada (Centre) | ca-central-1 |
bedrock-runtime.ca-central-1.amazonaws.com bedrock-runtime-fips.ca-central-1.amazonaws.com |
HTTPS HTTPS |
| Europe (Francfort) | eu-central-1 | bedrock-runtime.eu-central-1.amazonaws.com | HTTPS |
| Europe (Irlande) | eu-west-1 | bedrock-runtime.eu-west-1.amazonaws.com | HTTPS |
| Europe (Londres) | eu-west-2 | bedrock-runtime.eu-west-2.amazonaws.com | HTTPS |
| Europe (Milan) | eu-south-1 | bedrock-runtime.eu-south-1.amazonaws.com | HTTPS |
| Europe (Paris) | eu-west-3 | bedrock-runtime.eu-west-3.amazonaws.com | HTTPS |
| Europe (Espagne) | eu-south-2 | bedrock-runtime.eu-south-2.amazonaws.com | HTTPS |
| Europe (Stockholm) | eu-north-1 | bedrock-runtime.eu-north-1.amazonaws.com | HTTPS |
| Europe (Zurich) | eu-central-2 | bedrock-runtime.eu-central-2.amazonaws.com | HTTPS |
| Amérique du Sud (São Paulo) | sa-east-1 | bedrock-runtime.sa-east-1.amazonaws.com | HTTPS |
| AWS GovCloud (US-East) | us-gov-east-1 |
bedrock-runtime.us-gov-east-1.amazonaws.com bedrock-runtime-fips.us-gov-east-1.amazonaws.com |
HTTPS HTTPS |
| AWS GovCloud (US-West) | us-gov-west-1 |
bedrock-runtime.us-gov-west-1.amazonaws.com bedrock-runtime-fips.us-gov-west-1.amazonaws.com |
HTTPS HTTPS |
API de compilation Agents for Amazon Bedrock
Le tableau suivant répertorie les Region-specific points de terminaison pris en charge par Agents for Amazon Bedrock pour créer et gérer des agents et des bases de connaissances. Utilisez ces points de terminaison pour les agents chargés des opérations d'API Amazon Bedrock.
| Nom de la région | Région | Point de terminaison | Protocole |
|---|---|---|---|
| USA Est (Virginie du Nord) | us-east-1 | bedrock-agent.us-east-1.amazonaws.com | HTTPS |
| bedrock-agent-fips.us-east-1.amazonaws.com | HTTPS | ||
| USA Ouest (Oregon) | us-west-2 | bedrock-agent.us-west-2.amazonaws.com | HTTPS |
| bedrock-agent-fips.us-west-2.amazonaws.com | HTTPS | ||
| Asie-Pacifique (Singapour) | ap-southeast-1 | bedrock-agent.ap-southeast-1.amazonaws.com | HTTPS |
| Asie-Pacifique (Sydney) | ap-southeast-2 | bedrock-agent.ap-southeast-2.amazonaws.com | HTTPS |
| Asie-Pacifique (Tokyo) | ap-northeast-1 | bedrock-agent.ap-northeast-1.amazonaws.com | HTTPS |
| Asie-Pacifique (Séoul) | ap-northeast-2 | bedrock-agent.ap-northeast-2.amazonaws.com | HTTPS |
| Canada (Centre) | ca-central-1 | bedrock-agent.ca-central-1.amazonaws.com | HTTPS |
| Europe (Francfort) | eu-central-1 | bedrock-agent.eu-central-1.amazonaws.com | HTTPS |
| Europe (Irlande) | eu-west-1 | bedrock-agent.eu-west-1.amazonaws.com | HTTPS |
| Europe (Londres) | eu-west-2 | bedrock-agent.eu-west-2.amazonaws.com | HTTPS |
| Europe (Paris) | eu-west-3 | bedrock-agent.eu-west-3.amazonaws.com | HTTPS |
| Asie-Pacifique (Mumbai) | ap-south-1 | bedrock-agent.ap-south-1.amazonaws.com | HTTPS |
| Amérique du Sud (São Paulo) | sa-east-1 | bedrock-agent.sa-east-1.amazonaws.com | HTTPS |
API d’exécution Agents for Amazon Bedrock
Le tableau suivant fournit la liste des Region-specific points de terminaison pris en charge par Agents for Amazon Bedrock pour appeler des agents et interroger des bases de connaissances. Utilisez ces points de terminaison pour les agents chargés des opérations d'API Amazon Bedrock Runtime.
| Nom de la région | Région | Point de terminaison | Protocole |
|---|---|---|---|
| USA Est (Virginie du Nord) | us-east-1 | bedrock-agent-runtime.us-east-1.amazonaws.com | HTTPS |
| bedrock-agent-runtime-fips.us-east-1.amazonaws.com | HTTPS | ||
| USA Ouest (Oregon) | us-west-2 | bedrock-agent-runtime.us-west-2.amazonaws.com | HTTPS |
| bedrock-agent-runtime-fips.us-west-2.amazonaws.com | HTTPS | ||
| Asie-Pacifique (Singapour) | ap-southeast-1 | bedrock-agent-runtime.ap-southeast-1.amazonaws.com | HTTPS |
| Asie-Pacifique (Sydney) | ap-southeast-2 | bedrock-agent-runtime.ap-southeast-2.amazonaws.com | HTTPS |
| Asie-Pacifique (Tokyo) | ap-northeast-1 | bedrock-agent-runtime.ap-northeast-1.amazonaws.com | HTTPS |
| Asie-Pacifique (Séoul) | ap-northeast-2 | bedrock-agent-runtime.ap-northeast-2.amazonaws.com | HTTPS |
| Canada (Centre) | ca-central-1 | bedrock-agent-runtime.ca-central-1.amazonaws.com | HTTPS |
| Europe (Francfort) | eu-central-1 | bedrock-agent-runtime.eu-central-1.amazonaws.com | HTTPS |
| Europe (Paris) | eu-west-3 | bedrock-agent-runtime.eu-west-3.amazonaws.com | HTTPS |
| Europe (Irlande) | eu-west-1 | bedrock-agent-runtime.eu-west-1.amazonaws.com | HTTPS |
| Europe (Londres) | eu-west-2 | bedrock-agent-runtime.eu-west-2.amazonaws.com | HTTPS |
| Asie-Pacifique (Mumbai) | ap-south-1 | bedrock-agent-runtime.ap-south-1.amazonaws.com | HTTPS |
| Amérique du Sud (São Paulo) | sa-east-1 | bedrock-agent-runtime.sa-east-1.amazonaws.com | HTTPS |
API d'automatisation des données Amazon Bedrock
Le tableau suivant fournit la liste des Region-specific points de terminaison pris en charge par Data Automation pour Amazon Bedrock. Les points de terminaison qui utilisent le mot runtime invoquent des plans et des projets pour extraire des informations à partir de fichiers. Utilisez ces points de terminaison pour les opérations de l'API Amazon Bedrock Data Automation Runtime. Les points de terminaison runtime non utilisés sont utilisés pour créer des plans et des projets afin de fournir des conseils d'extraction. Utilisez ces points de terminaison pour les opérations Buildtime de l'API Amazon Bedrock Data Automation
| Nom de la région | Région | Point de terminaison | Protocole |
|---|---|---|---|
| US East (Ohio) | us-east-2 |
bedrock-data-automation.us-east-2.amazonaws.com bedrock-data-automation-runtime.us-east-2.amazonaws.com bedrock-data-automation-fips.us-east-2.amazonaws.com bedrock-data-automation-runtime-fips.us-east-2.amazonaws.com |
HTTPS HTTPS HTTPS HTTPS |
| USA Est (Virginie du Nord) | us-east-1 |
bedrock-data-automation.us-east-1.amazonaws.com bedrock-data-automation-runtime.us-east-1.api.aws bedrock-data-automation-runtime.us-east-1.amazonaws.com bedrock-data-automation.us-east-1.api.aws bedrock-data-automation-fips.us-east-1.amazonaws.com bedrock-data-automation-runtime-fips.us-east-1.api.aws bedrock-data-automation-runtime-fips.us-east-1.amazonaws.com bedrock-data-automation-fips.us-east-1.api.aws |
HTTPS HTTPS HTTPS HTTPS HTTPS HTTPS HTTPS HTTPS |
| USA Ouest (Oregon) | us-west-2 |
bedrock-data-automation.us-west-2.amazonaws.com bedrock-data-automation-runtime.us-west-2.api.aws bedrock-data-automation-runtime.us-west-2.amazonaws.com bedrock-data-automation.us-west-2.api.aws bedrock-data-automation-fips.us-west-2.amazonaws.com bedrock-data-automation-runtime-fips.us-west-2.api.aws bedrock-data-automation-runtime-fips.us-west-2.amazonaws.com bedrock-data-automation-fips.us-west-2.api.aws |
HTTPS HTTPS HTTPS HTTPS HTTPS HTTPS HTTPS HTTPS |
| Asia Pacific (Mumbai) | ap-south-1 |
bedrock-data-automation.ap-south-1.amazonaws.com bedrock-data-automation-runtime.ap-south-1.amazonaws.com |
HTTPS HTTPS |
| Asie-Pacifique (Sydney) | ap-southeast-2 |
bedrock-data-automation.ap-southeast-2.amazonaws.com bedrock-data-automation-runtime.ap-southeast-2.amazonaws.com |
HTTPS HTTPS |
| Asie-Pacifique (Tokyo) | ap-northeast-1 |
bedrock-data-automation.ap-northeast-1.amazonaws.com bedrock-data-automation-runtime.ap-northeast-1.amazonaws.com |
HTTPS HTTPS |
| Canada (Centre) | ca-central-1 |
bedrock-data-automation.ca-central-1.amazonaws.com bedrock-data-automation-runtime.ca-central-1.amazonaws.com bedrock-data-automation-fips.ca-central-1.amazonaws.com bedrock-data-automation-runtime-fips.ca-central-1.amazonaws.com |
HTTPS HTTPS HTTPS HTTPS |
| Europe (Francfort) | eu-central-1 |
bedrock-data-automation.eu-central-1.amazonaws.com bedrock-data-automation-runtime.eu-central-1.amazonaws.com |
HTTPS HTTPS |
| Europe (Irlande) | eu-west-1 |
bedrock-data-automation.eu-west-1.amazonaws.com bedrock-data-automation-runtime.eu-west-1.amazonaws.com |
HTTPS HTTPS |
| Europe (Londres) | eu-west-2 |
bedrock-data-automation.eu-west-2.amazonaws.com bedrock-data-automation-runtime.eu-west-2.amazonaws.com |
HTTPS HTTPS |
| Europe (Espagne) | eu-south-2 |
bedrock-data-automation.eu-south-2.amazonaws.com bedrock-data-automation-runtime.eu-south-2.amazonaws.com |
HTTPS HTTPS |
| AWS GovCloud (US-West) | us-gov-west-1 |
bedrock-data-automation.us-gov-west-1.amazonaws.com bedrock-data-automation-runtime.us-gov-west-1.amazonaws.com bedrock-data-automation-fips.us-gov-west-1.amazonaws.com bedrock-data-automation-runtime-fips.us-gov-west-1.amazonaws.com |
HTTPS HTTPS HTTPS HTTPS |
quotas de service Amazon Bedrock
Astuce
Amazon Bedrock disposant d'un grand nombre de quotas, nous vous recommandons de consulter les quotas de service à l'aide de la console au lieu d'utiliser le tableau ci-dessous. Ouvrez les quotas https://console.aws.amazon.com/servicequotas/home/services/bedrock/quotas
| Nom | Par défaut | Ajustable | Description |
|---|---|---|---|
| (Optimisation rapide avancée) Tâches actives par compte | Chaque région prise en charge : 20 | Oui |
Le nombre maximum de tâches APO (Advanced Prompt Optimization) actives par compte. |
| (Optimisation rapide avancée) Tâches inactives par compte | Chaque région prise en charge : 5 000 | Oui |
Le nombre maximum de tâches APO (Advanced Prompt Optimization) inactives par compte. |
| (Raisonnement automatique) Annotations dans les politiques | Chaque Région prise en charge : 10 | Non | Le nombre maximum d'annotations dans une politique de raisonnement automatique. |
| CancelAutomatedReasoningPolicyBuildWorkflow requêtes (raisonnement automatique) par seconde | Chaque Région prise en charge : 5 | Oui |
Le nombre maximum de demandes d' CancelAutomatedReasoningPolicyBuildWorkflow API par seconde. |
| (Raisonnement automatique) Constructions simultanées par politique | Chaque région prise en charge : 2 | Non | Le nombre maximum de versions simultanées par politique de raisonnement automatique. |
| (Raisonnement automatique) Création simultanée de politiques par compte | Chaque région prise en charge : 5 | Non | Le nombre maximum de stratégies de raisonnement automatique simultanées créées dans un seul compte. |
| CreateAutomatedReasoningPolicy requêtes (raisonnement automatique) par seconde | Chaque Région prise en charge : 5 | Oui |
Le nombre maximum de demandes d' CreateAutomatedReasoningPolicy API par seconde. |
| CreateAutomatedReasoningPolicyTestCase requêtes (raisonnement automatique) par seconde | Chaque Région prise en charge : 5 | Oui |
Le nombre maximum de demandes d' CreateAutomatedReasoningPolicyTestCase API par seconde. |
| CreateAutomatedReasoningPolicyVersion requêtes (raisonnement automatique) par seconde | Chaque Région prise en charge : 5 | Oui |
Le nombre maximum de demandes d' CreateAutomatedReasoningPolicyVersion API par seconde. |
| DeleteAutomatedReasoningPolicy requêtes (raisonnement automatique) par seconde | Chaque Région prise en charge : 5 | Oui |
Le nombre maximum de demandes d' DeleteAutomatedReasoningPolicy API par seconde. |
| DeleteAutomatedReasoningPolicyBuildWorkflow requêtes (raisonnement automatique) par seconde | Chaque Région prise en charge : 5 | Oui |
Le nombre maximum de demandes d' DeleteAutomatedReasoningPolicyBuildWorkflow API par seconde. |
| DeleteAutomatedReasoningPolicyTestCase requêtes (raisonnement automatique) par seconde | Chaque Région prise en charge : 5 | Oui |
Le nombre maximum de demandes d' DeleteAutomatedReasoningPolicyTestCase API par seconde. |
| ExportAutomatedReasoningPolicyVersion requêtes (raisonnement automatique) par seconde | Chaque Région prise en charge : 5 | Oui |
Le nombre maximum de demandes d' ExportAutomatedReasoningPolicyVersion API par seconde. |
| GetAutomatedReasoningPolicy requêtes (raisonnement automatique) par seconde | Par région prise en charge : 10 | Oui |
Le nombre maximum de demandes d' GetAutomatedReasoningPolicy API par seconde. |
| GetAutomatedReasoningPolicyAnnotations requêtes (raisonnement automatique) par seconde | Par région prise en charge : 10 | Oui |
Le nombre maximum de demandes d' GetAutomatedReasoningPolicyAnnotations API par seconde. |
| GetAutomatedReasoningPolicyBuildWorkflow requêtes (raisonnement automatique) par seconde | Par région prise en charge : 10 | Oui |
Le nombre maximum de demandes d' GetAutomatedReasoningPolicyBuildWorkflow API par seconde. |
| GetAutomatedReasoningPolicyBuildWorkflowResultAssets requêtes (raisonnement automatique) par seconde | Par région prise en charge : 10 | Oui |
Le nombre maximum de demandes d' GetAutomatedReasoningPolicyBuildWorkflowResultAssets API par seconde. |
| GetAutomatedReasoningPolicyNextScenario requêtes (raisonnement automatique) par seconde | Par région prise en charge : 10 | Oui |
Le nombre maximum de demandes d' GetAutomatedReasoningPolicyNextScenario API par seconde. |
| GetAutomatedReasoningPolicyTestCase requêtes (raisonnement automatique) par seconde | Par région prise en charge : 10 | Oui |
Le nombre maximum de demandes d' GetAutomatedReasoningPolicyTestCase API par seconde. |
| GetAutomatedReasoningPolicyTestResult requêtes (raisonnement automatique) par seconde | Par région prise en charge : 10 | Oui |
Le nombre maximum de demandes d' GetAutomatedReasoningPolicyTestResult API par seconde. |
| ListAutomatedReasoningPolicies requêtes (raisonnement automatique) par seconde | Chaque Région prise en charge : 5 | Oui |
Le nombre maximum de demandes d' ListAutomatedReasoningPolicies API par seconde. |
| ListAutomatedReasoningPolicyBuildWorkflows requêtes (raisonnement automatique) par seconde | Chaque Région prise en charge : 5 | Oui |
Le nombre maximum de demandes d' ListAutomatedReasoningPolicyBuildWorkflows API par seconde. |
| ListAutomatedReasoningPolicyTestCases requêtes (raisonnement automatique) par seconde | Chaque Région prise en charge : 5 | Oui |
Le nombre maximum de demandes d' ListAutomatedReasoningPolicyTestCases API par seconde. |
| ListAutomatedReasoningPolicyTestResults requêtes (raisonnement automatique) par seconde | Chaque Région prise en charge : 5 | Oui |
Le nombre maximum de demandes d' ListAutomatedReasoningPolicyTestResults API par seconde. |
| (Raisonnement automatique) Politiques par compte | Chaque région prise en charge : 100 | Non | Le nombre maximum de politiques de raisonnement automatique dans un compte. |
| (Raisonnement automatique) Règles en matière de politique | Chaque région prise en charge : 500 | Non | Le nombre maximum de règles dans une politique de raisonnement automatique. |
| (Raisonnement automatique) Taille du document source (Mo) | Chaque région prise en charge : 5 | Non | Taille maximale du document source (Mo) pour créer une politique de raisonnement automatique. |
| (Raisonnement automatique) Jetons de document source | Chaque région prise en charge : 122 880 | Non | Le nombre maximum de jetons autorisés dans un document source lors de la création d'une politique de raisonnement automatique. |
| StartAutomatedReasoningPolicyBuildWorkflow requêtes (raisonnement automatique) par seconde | Par région prise en charge : 1 | Oui |
Le nombre maximum de demandes d' StartAutomatedReasoningPolicyBuildWorkflow API par seconde. |
| StartAutomatedReasoningPolicyTestWorkflow requêtes (raisonnement automatique) par seconde | Par région prise en charge : 1 | Oui |
Le nombre maximum de demandes d' StartAutomatedReasoningPolicyTestWorkflow API par seconde. |
| (Raisonnement automatique) Tests par politique | Chaque région prise en charge : 100 | Non | Le nombre maximum de tests par politique de raisonnement automatique. |
| (Raisonnement automatique) Types par politique | Chaque région prise en charge : 50 | Non | Le nombre maximum de types dans une politique de raisonnement automatique. |
| UpdateAutomatedReasoningPolicy requêtes (raisonnement automatique) par seconde | Chaque Région prise en charge : 5 | Oui |
Le nombre maximum de demandes d' UpdateAutomatedReasoningPolicy API par seconde. |
| UpdateAutomatedReasoningPolicyAnnotations requêtes (raisonnement automatique) par seconde | Chaque Région prise en charge : 5 | Oui |
Le nombre maximum de demandes d' UpdateAutomatedReasoningPolicyAnnotations API par seconde. |
| UpdateAutomatedReasoningPolicyTestCase requêtes (raisonnement automatique) par seconde | Chaque Région prise en charge : 5 | Oui |
Le nombre maximum de demandes d' UpdateAutomatedReasoningPolicyTestCase API par seconde. |
| (Raisonnement automatique) Valeurs par type dans la politique | Chaque région prise en charge : 50 | Non | Le nombre maximum de valeurs par type dans une politique de raisonnement automatique. |
| (Raisonnement automatique) Variables dans les politiques | Chaque région prise en charge : 200 | Non | Le nombre maximum de variables dans une politique de raisonnement automatique. |
| (Raisonnement automatique) Versions par politique | Chaque Région prise en charge : 1 000 | Non | Le nombre maximum de versions par politique de raisonnement automatique. |
| (Automation des données) (Console) Taille maximale du fichier de document (Mo) | Chaque région prise en charge : 200 | Non | Taille de fichier maximale pour la console |
| (Automatisation des données) (Console) Nombre maximum de pages par fichier de document | Chaque Région prise en charge : 20 | Non | Le nombre maximum de pages par document dans la console |
| (Automatisation des données) CreateBlueprint - Nombre maximum de plans par compte | Chaque région prise en charge : 350 | Oui |
Le nombre maximum de plans par compte |
| (Automatisation des données) CreateBlueprintVersion - Nombre maximum de versions de Blueprint par Blueprint | Par région prise en charge : 10 | Oui |
Le nombre maximum de versions par plan |
| (Automatisation des données) CreateDataAutomationLibrary - Nombre maximum de bibliothèques d'automatisation des données par compte | Par région prise en charge : 10 | Oui |
Le nombre maximum de bibliothèques d'automatisation des données par compte |
| (Automatisation des données) Longueur de la description des champs (caractères) | Chaque région prise en charge : 300 | Non | Longueur maximale de la description des champs en caractères |
| (Automatisation des données) InvokeBlueprintOptimizationAsync - Nombre maximum de tâches simultanées d'optimisation des plans | Chaque région prise en charge : 3 | Oui |
Le nombre maximum de tâches ouvertes d'Invoke Blueprint Optimization Async |
| (Automatisation des données) InvokeBlueprintOptimizationAsync - Nombre maximum de tâches d'optimisation des plans par jour | Chaque Région prise en charge : 30 | Non | Le nombre maximum de tâches asynchrones d'Invoke Blueprint Optimization par jour |
| (Automatisation des données) InvokeDataAutomation (Synchronisation) - Document - Nombre maximum de requêtes | Chaque région prise en charge : 60 | Oui |
Le nombre maximum de InvokeDataAutomation demandes par minute pour la modalité documentaire |
| (Automatisation des données) InvokeDataAutomationAsync - Audio - Nombre maximum de tâches simultanées |
États-Unis-est-1 : 20 États-Unis-ouest-2 : 20 Chacune des autres régions prises en charge : 2 |
Oui |
Le nombre maximum de tâches ouvertes d'Invoke Data Automation Async pour les fichiers audio |
| (Automatisation des données) InvokeDataAutomationAsync - Document - Nombre maximum de tâches simultanées |
ap-sud-1 : 5 ca-central-1 : 5 UE-Sud-2 : 5 UE-Ouest-2 : 5 Chacune des autres régions prises en charge : 25 |
Oui |
Le nombre maximum de tâches ouvertes d'Invoke Data Automation Async pour les documents |
| (Automatisation des données) InvokeDataAutomationAsync - Image - Nombre maximum de tâches simultanées |
États-Unis-est-1 : 20 États-Unis-ouest-2 : 20 Chacune des autres régions prises en charge : 5 |
Oui |
Le nombre maximum de tâches ouvertes d'Invoke Data Automation Async pour les images |
| (Automatisation des données) InvokeDataAutomationAsync - Nombre maximum de postes vacants | Chaque région prise en charge : 1 800 | Non | Le nombre maximum de tâches ouvertes d'Invoke Data Automation Async pour les images |
| (Automatisation des données) InvokeDataAutomationAsync - Vidéo - Nombre maximum de tâches simultanées |
États-Unis-est-1 : 20 États-Unis-ouest-2 : 20 Chacune des autres régions prises en charge : 3 |
Oui |
Le nombre maximum de jobs ouverts par Invoke Data Automation Async pour les vidéos |
| (Automatisation des données) Nombre maximum de phrases de vocabulaire par bibliothèque | Chaque région prise en charge : 500 | Oui |
Le nombre maximum de phrases de vocabulaire personnalisées pouvant être configurées par bibliothèque |
| (Automatisation des données) Fréquence d'échantillonnage audio maximale (Hz) | Chaque région prise en charge : 48 000 | Non | Fréquence d'échantillonnage audio maximale |
| (Automatisation des données) Nombre maximal de plans par projet (Audios) | Par région prise en charge : 1 | Non | Le nombre maximum de plans par projet pour les fichiers audio |
| (Automatisation des données) Nombre maximal de plans par projet (documents) | Chaque Région prise en charge : 40 | Non | Le nombre maximum de plans par projet pour les documents |
| (Automatisation des données) Nombre maximal de plans par projet (images) | Par région prise en charge : 1 | Non | Le nombre maximum de plans par projet pour les images |
| (Automatisation des données) Nombre maximal de plans par projet (vidéos) | Par région prise en charge : 1 | Non | Le nombre maximum de plans par projet pour les vidéos |
| (Automatisation des données) Taille maximale du plan JSON (caractères) | Chaque région prise en charge : 100 000 | Non | Taille maximale du JSON en caractères |
| (Automatisation des données) Niveaux maximaux de hiérarchie des champs | Par région prise en charge : 1 | Non | Le niveau numérique maximal de la hiérarchie des champs |
| (Automatisation des données) Nombre maximum de pages par document | Chaque Région prise en charge : 3 000 | Non | Le nombre maximum de pages par document |
| (Automatisation des données) Résolution maximale | Chaque région prise en charge : 8 000 | Non | La résolution maximale pour les images |
| (Automation des données) Taille maximale du fichier audio (Mo) | Chaque région prise en charge : 2 048 | Non | Taille de fichier maximale pour l'audio |
| (Automatisation des données) Durée audio maximale (minutes) | Chaque région prise en charge : 240 | Non | Durée maximale de l'audio en minutes |
| (Automatisation des données) Taille maximale du fichier de document (Mo) | Chaque région prise en charge : 500 | Non | Taille de fichier maximale |
| (Automation des données) Taille maximale du fichier image (Mo) | Chaque région prise en charge : 5 | Non | Taille de fichier maximale pour les images |
| (Automatisation des données) Longueur maximale du champ d'instructions pour Audio Blueprint - (Caractères) | Chaque région prise en charge : 500 | Oui |
Longueur maximale du champ d'instructions pour le plan audio en caractères |
| (Automatisation des données) Nombre maximum de plans par demande d'inférence de démarrage (Audios) | Par région prise en charge : 1 | Non | Le nombre maximum de plans en ligne dans la demande d'inférence Start |
| (Automatisation des données) Nombre maximum de plans par demande d'inférence de démarrage (documents) | Chaque Région prise en charge : 10 | Non | Le nombre maximum de plans en ligne dans la demande d'inférence Start |
| (Automatisation des données) Nombre maximum de plans par demande d'inférence de démarrage (images) | Par région prise en charge : 1 | Non | Le nombre maximum de plans en ligne dans la demande d'inférence Start |
| (Automatisation des données) Nombre maximum de plans par demande d'inférence de démarrage (vidéos) | Par région prise en charge : 1 | Non | Le nombre maximum de plans en ligne dans la demande d'inférence Start |
| (Automatisation des données) Nombre maximum de champs de liste par Blueprint | Chaque région prise en charge : 15 | Non | Le nombre maximum de champs de liste par Blueprint |
| (Automation des données) Taille maximale du fichier vidéo (Mo) | Chaque région prise en charge : 10 240 | Non | Taille de fichier maximale pour les vidéos |
| (Automatisation des données) Durée maximale de la vidéo (minutes) | Chaque région prise en charge : 240 | Non | La durée maximale des vidéos en minutes |
| (Automatisation des données) Fréquence d'échantillonnage audio minimale (Hz) | Chaque région prise en charge : 8 000 | Non | Fréquence d'échantillonnage audio minimale |
| (Automatisation des données) Longueur audio minimale (millisecondes) | Chaque région prise en charge : 500 | Non | La durée minimale de l'audio en millisecondes |
| (Évaluation) Nombre de tâches simultanées d'évaluation automatique de modèles | Chaque Région prise en charge : 20 | Non | Le nombre maximum de tâches d'évaluation automatique de modèles que vous pouvez spécifier en même temps dans ce compte dans la région actuelle. |
| (Évaluation) Nombre de tâches d'évaluation de modèles simultanées qui font appel à des travailleurs humains | Chaque Région prise en charge : 10 | Non | Le nombre maximum de tâches d'évaluation de modèles qui font appel à des travailleurs humains que vous pouvez spécifier en même temps dans ce compte dans la région actuelle. |
| (Évaluation) Nombre de mesures personnalisées | Chaque Région prise en charge : 10 | Non | Le nombre maximum de mesures personnalisées que vous pouvez spécifier dans une tâche d'évaluation de modèle qui fait appel à des travailleurs humains. |
| (Évaluation) Nombre d'ensembles de données rapides personnalisés dans le cadre d'une tâche d'évaluation de modèles basés sur l'homme | Par région prise en charge : 1 | Non | Le nombre maximum de jeux de données rapides personnalisés que vous pouvez spécifier dans le cadre d'une tâche d'évaluation de modèles basés sur l'homme dans ce compte dans la région actuelle. |
| (Évaluation) Nombre de jeux de données par tâche | Chaque région prise en charge : 5 | Non | Le nombre maximum de jeux de données que vous pouvez spécifier dans le cadre d'une tâche d'évaluation automatique de modèles. Cela inclut des ensembles de données rapides personnalisés et intégrés. |
| (Évaluation) Nombre de postes d'évaluation | Chaque région prise en charge : 5 000 | Non | Le nombre maximum de tâches d'évaluation de modèles que vous pouvez créer dans ce compte dans la région actuelle. |
| (Évaluation) Nombre de mesures par jeu de données | Chaque région prise en charge : 3 | Non | Le nombre maximum de mesures que vous pouvez spécifier par jeu de données dans le cadre d'une tâche d'évaluation automatique de modèles. Cela inclut à la fois des mesures personnalisées et intégrées. |
| (Évaluation) Nombre de modèles dans un travail d'évaluation de modèles qui fait appel à des travailleurs humains | Chaque région prise en charge : 2 | Non | Le nombre maximum de modèles que vous pouvez spécifier dans une tâche d'évaluation de modèles qui fait appel à des travailleurs humains. |
| (Évaluation) Nombre de modèles dans le cadre de la tâche d'évaluation automatique des modèles | Par région prise en charge : 1 | Non | Le nombre maximum de modèles que vous pouvez spécifier dans le cadre d'une tâche d'évaluation automatique des modèles. |
| (Évaluation) Nombre d'invites dans un ensemble de données d'invites personnalisé | Chaque Région prise en charge : 1 000 | Non | Le nombre maximum d'invites qu'un jeu de données d'invites personnalisé peut contenir. |
| (Évaluation) Taille de l'invite | Chaque Région prise en charge : 4 | Non | Taille maximale (en Ko) d'une invite individuelle dans un ensemble de données d'invites personnalisé. |
| (Évaluation) Temps de travail pour les travailleurs | Chaque Région prise en charge : 30 | Non | Durée maximale (en jours) dont dispose un travailleur pour effectuer des tâches. |
| (Flux) Nœuds d'agent par flux | Chaque Région prise en charge : 20 | Non | Le nombre maximum de nœuds d'agent. |
| (Flux) Nœuds collecteurs par flux | Par région prise en charge : 1 | Non | Le nombre maximum de nœuds collecteurs. |
| (Flux) Nœuds de condition par flux | Chaque région prise en charge : 5 | Non | Le nombre maximum de nœuds de condition. |
| (Flux) Conditions par nœud de condition | Chaque région prise en charge : 5 | Non | Le nombre maximum de conditions par nœud de condition. |
| (Flux) CreateFlow demandes par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de CreateFlow requêtes par seconde. |
| (Flux) CreateFlowAlias demandes par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de CreateFlowAlias requêtes par seconde. |
| (Flux) CreateFlowVersion demandes par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de CreateFlowVersion requêtes par seconde. |
| (Flux) DeleteFlow demandes par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de DeleteFlow requêtes par seconde. |
| (Flux) DeleteFlowAlias demandes par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de DeleteFlowAlias requêtes par seconde. |
| (Flux) DeleteFlowVersion demandes par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de DeleteFlowVersion requêtes par seconde. |
| (Flux) Alias de flux par flux | Chaque Région prise en charge : 10 | Non | Le nombre maximum d'alias de flux. |
| (Flux) Exécutions de flux par compte | Chaque Région prise en charge : 1 000 | Oui |
Le nombre maximum d'exécutions de flux par compte. |
| (Flux) Versions de débit par flux | Chaque Région prise en charge : 10 | Non | Le nombre maximum de versions de flux. |
| (Flux) Flux par compte | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de flux par compte. |
| (Flux) GetFlow demandes par seconde | Chaque Région prise en charge : 10 | Non | Le nombre maximum de GetFlow requêtes par seconde. |
| (Flux) GetFlowAlias demandes par seconde | Chaque Région prise en charge : 10 | Non | Le nombre maximum de GetFlowAlias requêtes par seconde. |
| (Flux) GetFlowVersion demandes par seconde | Chaque Région prise en charge : 10 | Non | Le nombre maximum de GetFlowVersion requêtes par seconde. |
| (Flux) Nœuds de code en ligne par flux | Chaque région prise en charge : 5 | Non | Le nombre maximum de nœuds de code en ligne par flux. |
| (Flux) Nœuds d'entrée par flux | Par région prise en charge : 1 | Non | Le nombre maximum de nœuds d'entrée de flux. |
| (Flux) Nœuds itérateurs par flux | Par région prise en charge : 1 | Non | Le nombre maximum de nœuds d'itérateur. |
| (Flux) Nœuds de base de connaissances par flux | Chaque Région prise en charge : 20 | Non | Le nombre maximum de nœuds de base de connaissances. |
| (Flux) Nœuds de fonction Lambda par flux | Chaque Région prise en charge : 20 | Non | Le nombre maximum de nœuds de fonction Lambda. |
| (Flux) Nœuds Lex par flux | Chaque région prise en charge : 5 | Non | Le nombre maximum de nœuds Lex. |
| (Flux) ListFlowAliases demandes par seconde | Chaque Région prise en charge : 10 | Non | Le nombre maximum de ListFlowAliases requêtes par seconde. |
| (Flux) ListFlowVersions demandes par seconde | Chaque Région prise en charge : 10 | Non | Le nombre maximum de ListFlowVersions requêtes par seconde. |
| (Flux) ListFlows demandes par seconde | Chaque Région prise en charge : 10 | Non | Le nombre maximum de ListFlows requêtes par seconde. |
| (Flux) Nœuds de sortie par flux | Chaque Région prise en charge : 20 | Non | Le nombre maximum de nœuds de sortie de flux. |
| (Flux) PrepareFlow demandes par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de PrepareFlow requêtes par seconde. |
| (Flux) Nœuds rapides par flux | Chaque région prise en charge : 20 | Oui |
Le nombre maximum de nœuds d'invite. |
| (Flux) Nœuds de récupération S3 par flux | Chaque Région prise en charge : 10 | Non | Le nombre maximum de nœuds de récupération S3. |
| (Flux) Nœuds de stockage S3 par flux | Chaque Région prise en charge : 10 | Non | Le nombre maximum de nœuds de stockage S3. |
| (Flux) Nombre total de nœuds par flux | Chaque Région prise en charge : 40 | Non | Le nombre maximum de nœuds dans un flux. |
| (Flux) UpdateFlow demandes par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de UpdateFlow requêtes par seconde. |
| (Flux) UpdateFlowAlias demandes par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de UpdateFlowAlias requêtes par seconde. |
| (Flux) ValidateFlowDefinition demandes par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de ValidateFlowDefinition requêtes par seconde. |
| (Garde-corps) Politiques de raisonnement automatisées par garde-corps | Chaque région prise en charge : 2 | Non | Le nombre maximum de politiques de raisonnement automatique par garde-corps. |
| (Guardrails) Taille de saisie maximale de la politique de contenu en unités de texte (niveau classique) |
États-Unis-est-1 : 1 000 États-Unis-est-2 : 1 000 États-Unis-Ouest-2 : 1 000 ap-nord-est-1 : 1 000 ap-nord-est-2 : 1 000 ap-sud-1 : 1 000 ap-sud-est-1 : 1 000 ap-sud-est-2 : 1 000 eu-central-1 : 1 000 UE-Sud-1 : 25 UE-Ouest-3 : 25 mer-est-1 : 25 Chacune des autres régions prises en charge : 106 |
Oui |
Taille maximale du texte d'entrée, mesurée en unités de texte, qui peut être traitée pour les filtres de contenu. Bien que cette limite s'applique au niveau classique, nous vous recommandons de passer au niveau standard en raison de sa robustesse supérieure, de ses fonctionnalités supplémentaires et de son support multilingue. |
| (Guardrails) Taille de saisie maximale de la politique de contenu en unités de texte (niveau standard - recommandé) |
États-Unis-est-1 : 1 000 États-Unis-est-2 : 1 000 États-Unis-Ouest-2 : 1 000 ap-nord-est-1 : 500 ap-nord-est-2 : 1 000 ap-sud-1 : 500 ap-sud-est-1 : 1 000 ap-sud-est-2 : 400 eu-central-1 : 500 UE-Sud-1 : 25 UE-Ouest-1 : 1 000 UE-Ouest-3 : 25 Chacune des autres régions prises en charge : 106 |
Oui |
Taille maximale du texte d'entrée, mesurée en unités de texte, qui peut être traitée pour les filtres de contenu. Cela s'applique au niveau standard, qui est recommandé. |
| (Gardrails) Taille maximale de saisie de la politique de mise à la terre contextuelle en unités de texte | Chaque région prise en charge : 106 | Oui |
Taille maximale du texte d'entrée, mesurée en unités de texte, qui peut être traitée par les politiques de mise à la base contextuelle |
| (Guardrails) Longueur de la requête de mise à la terre contextuelle en unités de texte | Par région prise en charge : 1 | Non | Longueur maximale, en unités de texte, de la requête pour la mise à la base contextuelle |
| (Gardrails) Longueur de réponse contextuelle de mise à la terre en unités de texte | Chaque région prise en charge : 5 | Non | Longueur maximale, en unités de texte, de la réponse pour la mise à la base contextuelle |
| (Gardrails) Longueur de la source de mise à la terre contextuelle en unités de texte |
États-Unis-est-1 : 100 États-Unis-ouest-2 : 100 Chacune des autres régions prises en charge : 50 |
Non | Longueur maximale, en unités de texte, de la source de mise à la terre pour la mise à la terre contextuelle |
| (Garde-corps) Exemples de phrases par sujet | Chaque région prise en charge : 5 | Non | Le nombre maximum d'exemples de sujets pouvant être inclus par sujet |
| (Garde-corps) Barrières de sécurité par compte | Chaque région prise en charge : 100 | Non | Le nombre maximum de garde-corps dans un compte |
| (Guardrails) Taux de rafale des unités de texte de la politique de filtrage du On-demand ApplyGuardrail contenu (niveau classique) |
États-Unis-est-1 : 1 000 États-Unis-est-2 : 1 000 États-Unis-Ouest-2 : 1 000 ap-nord-est-1 : 1 000 ap-nord-est-2 : 1 000 ap-sud-1 : 1 000 ap-sud-est-1 : 1 000 ap-sud-est-2 : 1 000 eu-central-1 : 1 000 Chacune des autres régions prises en charge : 25 |
Non | Nombre maximum d'unités de texte pouvant être traitées par des filtres de contenu par rafale. Bien que cette limite s'applique au niveau classique, nous vous recommandons de passer au niveau standard en raison de sa robustesse supérieure, de ses fonctionnalités supplémentaires et de son support multilingue. |
| (Guardrails) Taux de rafale des unités de texte de la politique de filtrage du On-demand ApplyGuardrail contenu (niveau standard - recommandé) |
États-Unis-est-1 : 1 000 États-Unis-est-2 : 1 000 États-Unis-Ouest-2 : 1 000 ap-nord-est-1 : 500 ap-nord-est-2 : 1 000 ap-sud-1 : 500 ap-sud-est-1 : 1 000 ap-sud-est-2 : 400 eu-central-1 : 500 UE-Ouest-1 : 1 000 Chacune des autres régions prises en charge : 25 |
Non | Nombre maximum d'unités de texte pouvant être traitées par des filtres de contenu par rafale. Cela s'applique au niveau standard, qui est recommandé. |
| (Guardrails) Unités de texte de la politique de filtrage de On-demand ApplyGuardrail contenu par seconde (niveau classique) |
États-Unis-est-1 : 200 États-Unis-Ouest-2 : 200 Chacune des autres régions prises en charge : 25 |
Oui |
Nombre maximum d'unités de texte par seconde pouvant être traitées pour les filtres de contenu. Bien que cette limite s'applique au niveau classique, nous vous recommandons de passer au niveau standard en raison de sa robustesse supérieure, de ses fonctionnalités supplémentaires et de son support multilingue. |
| (Guardrails) Unités de texte de la politique de filtrage de On-demand ApplyGuardrail contenu par seconde (niveau standard - recommandé) |
États-Unis-est-1 : 200 États-Unis-est-2 : 200 États-Unis-ouest-1 : 200 États-Unis-Ouest-2 : 200 ap-nord-est-1 : 50 ap-nord-est-2 : 100 ap-sud-1 : 50 ap-sud-est-1 : 100 eu-central-1 : 50 UE-Ouest-1 : 200 Chacune des autres régions prises en charge : 25 |
Oui |
Nombre maximum d'unités de texte par seconde pouvant être traitées pour les filtres de contenu. Cela s'applique au niveau standard, qui est recommandé. |
| (Guardrails) Taux de rafale des unités de texte de la politique des sujets On-demand ApplyGuardrail refusés (niveau classique) |
États-Unis-est-1 : 200 États-Unis-Ouest-2 : 200 Chacune des autres régions prises en charge : 25 |
Non | Nombre maximum d'unités de texte pouvant être traitées par rafale pour les sujets refusés. Bien que cette limite s'applique au niveau classique, nous vous recommandons de passer au niveau standard en raison de sa robustesse supérieure, de ses fonctionnalités supplémentaires et de son support multilingue. |
| (Guardrails) Taux de rafale des unités de texte de la politique des sujets On-demand ApplyGuardrail refusés (niveau standard - Recommandé) |
États-Unis-est-1 : 1 000 États-Unis-est-2 : 1 000 États-Unis-Ouest-2 : 1 000 ap-nord-est-1 : 500 ap-nord-est-2 : 1 000 ap-sud-1 : 500 ap-sud-est-1 : 1 000 ap-sud-est-2 : 400 eu-central-1 : 500 UE-Ouest-1 : 1 000 Chacune des autres régions prises en charge : 25 |
Non | Nombre maximum d'unités de texte pouvant être traitées par rafale pour les sujets refusés. Cela s'applique au niveau standard, qui est recommandé. |
| (Guardrails) Unités de texte de politique thématique On-demand ApplyGuardrail refusées par seconde (niveau classique) |
États-Unis-est-1 : 50 États-Unis-ouest-2 : 50 Chacune des autres régions prises en charge : 25 |
Oui |
Nombre maximum d'unités de texte par seconde pouvant être traitées pour les sujets refusés. Bien que cette limite s'applique au niveau classique, nous vous recommandons de passer au niveau standard en raison de sa robustesse supérieure, de ses fonctionnalités supplémentaires et de son support multilingue. |
| (Guardrails) Unités de texte de politique thématique On-demand ApplyGuardrail refusées par seconde (niveau standard - recommandé) |
États-Unis-est-1 : 200 États-Unis-est-2 : 75 États-Unis-ouest-1 : 75 États-Unis-Ouest-2 : 200 UE-Ouest-1 : 200 Chacune des autres régions prises en charge : 25 |
Oui |
Nombre maximum d'unités de texte par seconde pouvant être traitées pour les sujets refusés. Cela s'applique au niveau standard, qui est recommandé. |
| (Guardrails) Politique de filtrage des informations On-demand ApplyGuardrail sensibles (unités de texte, taux de rafale) |
États-Unis-est-1 : 1 000 États-Unis-est-2 : 1 000 États-Unis-Ouest-2 : 1 000 ap-nord-est-1 : 1 000 ap-nord-est-2 : 1 000 ap-sud-1 : 1 000 ap-sud-est-1 : 1 000 ap-sud-est-2 : 1 000 eu-central-1 : 1 000 Chacune des autres régions prises en charge : 25 |
Non | Nombre maximum d'unités de texte par rafale pouvant être traitées pour les filtres d'informations sensibles. |
| (Guardrails) Unités de texte de la politique de filtrage des informations On-demand ApplyGuardrail sensibles par seconde |
États-Unis-est-1 : 1 000 États-Unis-est-2 : 100 États-Unis-ouest-1 : 50 États-Unis-ouest-2 : 500 ap-nord-est-1 : 500 ap-nord-est-2 : 100 ap-nord-est-3 : 75 ap-sud-1 : 200 ap-sud-2 : 75 ap-sud-est-1 : 100 ap-sud-est-2 : 250 ca-central-1 : 250 eu-central-1 : 500 eu-central-2 : 75 UE-Nord-1 : 75 UE-Sud-1 : 75 UE-Sud-2 : 50 UE-Ouest-1 : 500 UE-Ouest-2 : 100 UE-Ouest-3 : 250 mer-est-1 : 75 Chacune des autres régions prises en charge : 25 |
Oui |
Nombre maximum d'unités de texte par seconde pouvant être traitées pour les filtres d'informations sensibles. |
| (Guardrails) Politique de filtrage de On-demand ApplyGuardrail mots : unités de texte, taux de rafale |
États-Unis-est-1 : 1 000 États-Unis-est-2 : 1 000 États-Unis-Ouest-2 : 1 000 ap-nord-est-1 : 1 000 ap-nord-est-2 : 1 000 ap-sud-1 : 1 000 ap-sud-est-1 : 1 000 ap-sud-est-2 : 1 000 eu-central-1 : 1 000 Chacune des autres régions prises en charge : 25 |
Non | Nombre maximum d'unités de texte pouvant être traitées par des filtres de texte par rafale. |
| (Guardrails) Unités de texte de la politique de filtrage de On-demand ApplyGuardrail Word par seconde |
États-Unis-est-1 : 500 États-Unis-est-2 : 500 États-Unis-ouest-1 : 500 États-Unis-ouest-2 : 500 ap-nord-est-1 : 500 ap-nord-est-2 : 500 ap-sud-1 : 500 ap-sud-est-1 : 500 eu-central-1 : 500 Chacune des autres régions prises en charge : 25 |
Oui |
Nombre maximum d'unités de texte par seconde pouvant être traitées pour les filtres de mots. |
| (Guardrails) taux de rafale des unités de texte de la politique de mise à la terre On-demand ApplyGuardrail contextuelle | Chaque région prise en charge : 106 | Non | Le nombre maximum d'unités de texte par rafale qui peuvent être traitées à des fins de mise à la terre contextuelle. |
| (Guardrails) unités de texte de politique de mise à la terre On-demand ApplyGuardrail contextuelle par seconde | Chaque région prise en charge : 106 | Oui |
Nombre maximum d'unités de texte par seconde pouvant être traitées pour la mise à la terre contextuelle. |
| Fréquence de rafale des On-demand ApplyGuardrail demandes (Guardrails) |
États-Unis-est-1 : 100 États-Unis-est-2 : 100 États-Unis-ouest-1 : 100 États-Unis-ouest-2 : 100 ap-nord-est-1 : 100 ap-nord-est-2 : 100 ap-sud-1 : 100 ap-sud-est-1 : 100 eu-central-1 : 100 Chacune des autres régions prises en charge : 25 |
Non | Le nombre maximum d'appels d' ApplyGuardrail API que vous pouvez envoyer en une seule rafale. |
| (Guardrails) On-demand ApplyGuardrail demandes par seconde |
États-Unis-est-1 : 100 États-Unis-est-2 : 100 États-Unis-ouest-1 : 100 États-Unis-ouest-2 : 100 ap-nord-est-1 : 100 ap-nord-est-2 : 100 ap-sud-1 : 100 ap-sud-est-1 : 100 eu-central-1 : 100 Chacune des autres régions prises en charge : 25 |
Oui |
Le nombre maximum d'appels d' ApplyGuardrail API autorisés par seconde |
| Fréquence de rafale des On-demand InvokeGuardrailChecks demandes (Guardrails) | Chaque région prise en charge : 1 500 | Non | Le nombre maximum d'appels d' InvokeGuardrailChecks API que vous pouvez envoyer en une seule rafale |
| (Guardrails) On-demand InvokeGuardrailChecks demandes par minute | Chaque région prise en charge : 1 500 | Oui |
Le nombre maximum d'appels d' InvokeGuardrailChecks API autorisés par minute |
| (Guardrails) Entités Regex dans le filtre d'informations sensibles | Chaque Région prise en charge : 30 | Non | Le nombre maximum d'expressions régulières de filtre de sécurité pouvant être incluses dans une politique relative aux informations sensibles |
| (Guardrails) Longueur de Regex en caractères | Chaque région prise en charge : 500 | Non | La longueur maximale, en caractères, d'une expression régulière de filtre de sécurité |
| (Guardrails) Politique relative aux informations sensibles (taille maximale de saisie en unités de texte) |
États-Unis-est-1 : 1 000 États-Unis-est-2 : 1 000 États-Unis-Ouest-2 : 1 000 ap-nord-est-1 : 1 000 ap-nord-est-2 : 1 000 ap-sud-1 : 1 000 ap-sud-est-1 : 1 000 ap-sud-est-2 : 1 000 eu-central-1 : 1 000 Chacune des autres régions prises en charge : 106 |
Oui |
Taille maximale du texte saisi, mesurée en unités de texte, qui peut être traitée par les politiques de filtrage des informations sensibles |
| (Guardrails) Taille de saisie maximale de la politique thématique en unités de texte (niveau classique) |
États-Unis-est-1 : 200 États-Unis-Ouest-2 : 200 ap-sud-est-1 : 25 UE-Sud-1 : 25 UE-Ouest-3 : 25 mer-est-1 : 25 Chacune des autres régions prises en charge : 106 |
Oui |
Taille maximale du texte d'entrée, mesurée en unités de texte, qui peut être traitée pour les sujets refusés. Bien que cette limite s'applique au niveau classique, nous vous recommandons de passer au niveau standard en raison de sa robustesse supérieure, de ses fonctionnalités supplémentaires et de son support multilingue. |
| (Guardrails) Taille de saisie maximale de la politique thématique en unités de texte (niveau standard - recommandé) |
États-Unis-est-1 : 1 000 États-Unis-est-2 : 1 000 États-Unis-Ouest-2 : 1 000 ap-nord-est-1 : 500 ap-nord-est-2 : 1 000 ap-sud-1 : 500 ap-sud-est-1 : 1 000 ap-sud-est-2 : 400 eu-central-1 : 500 UE-Sud-1 : 25 UE-Ouest-1 : 1 000 UE-Ouest-3 : 25 Chacune des autres régions prises en charge : 106 |
Oui |
Taille maximale du texte d'entrée, mesurée en unités de texte, qui peut être traitée pour les sujets refusés. Cela s'applique au niveau standard, qui est recommandé. |
| (Garde-corps) Sujets par garde-corps | Chaque Région prise en charge : 30 | Non | Le nombre maximum de sujets pouvant être définis dans le cadre des politiques relatives aux sujets de sauvegarde |
| (Garde-corps) Versions par garde-corps | Chaque Région prise en charge : 20 | Non | Le nombre maximum de versions qu'un garde-corps peut avoir |
| (Barrières de sécurité) Longueur des mots en caractères | Chaque région prise en charge : 100 | Non | Longueur maximale d'un mot, en caractères, dans une liste de mots bloqués |
| (Guardrails) Taille de saisie maximale de la politique Word en unités de texte |
États-Unis-est-1 : 1 000 États-Unis-est-2 : 1 000 États-Unis-Ouest-2 : 1 000 ap-nord-est-1 : 1 000 ap-nord-est-2 : 1 000 ap-sud-1 : 1 000 ap-sud-est-1 : 1 000 ap-sud-est-2 : 1 000 eu-central-1 : 1 000 Chacune des autres régions prises en charge : 106 |
Oui |
Taille maximale du texte d'entrée, mesurée en unités de texte, qui peut être traitée par les politiques de filtrage de Word |
| (Garde-corps) Politique « mots par mot » | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de mots pouvant être inclus dans une liste de mots bloqués |
| (Bases de connaissances) DeleteKnowledgeBaseDocuments Demandes simultanées IngestKnowledgeBaseDocuments et par compte | Chaque Région prise en charge : 10 | Non | Le nombre maximum IngestKnowledgeBaseDocuments de DeleteKnowledgeBaseDocuments demandes pouvant être exécutées simultanément sur un compte. |
| (Bases de connaissances) Tâches d'ingestion simultanées par compte | Chaque région prise en charge : 5 | Non | Nombre maximum de tâches d'ingestion pouvant être exécutées simultanément sur un compte. |
| (Bases de connaissances) Tâches d'ingestion simultanées par source de données | Par région prise en charge : 1 | Non | Nombre maximum de tâches d'ingestion pouvant être exécutées simultanément pour une source de données. |
| (Bases de connaissances) Tâches d'ingestion simultanées par base de connaissances | Par région prise en charge : 1 | Non | Nombre maximum de tâches d'ingestion pouvant être exécutées simultanément pour une base de connaissances. |
| (Bases de connaissances) CreateDataSource requêtes par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de demandes d' CreateDataSource API par seconde. |
| (Bases de connaissances) CreateKnowledgeBase requêtes par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de demandes d' CreateKnowledgeBase API par seconde. |
| (Bases de connaissances) Sources de données par base de connaissances | Chaque région prise en charge : 5 | Non | Le nombre maximum de sources de données par base de connaissances. |
| (Bases de connaissances) DeleteDataSource requêtes par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de demandes d' DeleteDataSource API par seconde. |
| (Bases de connaissances) DeleteKnowledgeBase requêtes par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de demandes d' DeleteKnowledgeBase API par seconde. |
| (Bases de connaissances) DeleteKnowledgeBaseDocuments requêtes par seconde | Chaque région prise en charge : 5 | Non | Le nombre maximum de demandes d' DeleteKnowledgeBaseDocuments API par seconde. |
| (Bases de connaissances) Fichiers à ajouter ou à mettre à jour par tâche d'ingestion | Chaque région prise en charge : 5 000 000 | Non | Nombre maximum de fichiers nouveaux et mis à jour pouvant être ingérés par tâche d'ingestion. |
| (Bases de connaissances) Fichiers à supprimer par tâche d'ingestion | Chaque région prise en charge : 5 000 000 | Non | Le nombre maximum de fichiers pouvant être supprimés par tâche d'ingestion. |
| (Bases de connaissances) Fichiers à ingérer par IngestKnowledgeBaseDocuments tâche. | Chaque région prise en charge : 25 | Non | Le nombre maximum de documents pouvant être ingérés par IngestKnowledgeBaseDocuments demande. |
| (Bases de connaissances) GenerateQuery requêtes par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de demandes d' GenerateQuery API par seconde. |
| (Bases de connaissances) GetDataSource requêtes par seconde | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes d' GetDataSource API par seconde. |
| (Bases de connaissances) GetIngestionJob requêtes par seconde | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes d' GetIngestionJob API par seconde. |
| (Bases de connaissances) GetKnowledgeBase requêtes par seconde | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes d' GetKnowledgeBase API par seconde. |
| (Bases de connaissances) GetKnowledgeBaseDocuments requêtes par seconde | Chaque région prise en charge : 5 | Non | Le nombre maximum de demandes d' GetKnowledgeBaseDocuments API par seconde. |
| (Bases de connaissances) IngestKnowledgeBaseDocuments requêtes par seconde | Chaque région prise en charge : 5 | Non | Le nombre maximum de demandes d' IngestKnowledgeBaseDocuments API par seconde. |
| (Bases de connaissances) taille IngestKnowledgeBaseDocuments totale de la charge utile | Chaque région prise en charge : 6 | Non | Taille maximale (en Mo) de la charge utile totale d'une IngestKnowledgeBaseDocuments demande. |
| (Bases de connaissances) Taille du fichier de tâche d'ingestion avec contenu textuel | Chaque région prise en charge : 50 | Non | Taille maximale (en Mo) d'un fichier contenant du texte (tel que des fichiers .txt, .pdf ou .docx) dans une tâche d'ingestion. |
| (Bases de connaissances) Taille du poste d'ingestion | Chaque région prise en charge : 100 | Non | Taille maximale (en Go) d'une tâche d'ingestion. |
| (Bases de connaissances) Bases de connaissances par compte | Chaque région prise en charge : 100 | Non | Le nombre maximum de bases de connaissances par compte. |
| (Bases de connaissances) ListDataSources requêtes par seconde | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes d' ListDataSources API par seconde. |
| (Bases de connaissances) ListIngestionJobs requêtes par seconde | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes d' ListIngestionJobs API par seconde. |
| (Bases de connaissances) ListKnowledgeBaseDocuments requêtes par seconde | Chaque région prise en charge : 5 | Non | Le nombre maximum de demandes d' ListKnowledgeBaseDocuments API par seconde. |
| (Bases de connaissances) ListKnowledgeBases requêtes par seconde | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes d' ListKnowledgeBases API par seconde. |
| (Bases de connaissances) Nombre maximum de fichiers pour l'analyseur BDA | Chaque Région prise en charge : 1 000 | Non | Le nombre maximum de fichiers pouvant être utilisés avec Amazon Bedrock Data Automation en tant qu'analyseur. |
| (Bases de connaissances) Nombre maximum de fichiers pour Foundation Models en tant qu'analyseur | Chaque Région prise en charge : 1 000 | Non | Le nombre maximum de fichiers pouvant être utilisés avec Foundation Models en tant qu'analyseur. |
| (Bases de connaissances) Nombre de requêtes par seconde | Chaque Région prise en charge : 10 | Non | Le nombre maximum de requêtes d'API R par seconde. |
| (Bases de connaissances) Récupérer les demandes par seconde | Chaque Région prise en charge : 20 | Non | Le nombre maximum de requêtes d'API Retrieve par seconde. |
| (Bases de connaissances) RetrieveAndGenerate requêtes par seconde | Chaque Région prise en charge : 20 | Non | Le nombre maximum de demandes d' RetrieveAndGenerate API par seconde. |
| (Bases de connaissances) RetrieveAndGenerateStream requêtes par seconde | Chaque Région prise en charge : 20 | Non | Le nombre maximum de demandes d' RetrieveAndGenerateStream API par seconde. |
| (Bases de connaissances) StartIngestionJob requêtes par seconde | Chaque région prise en charge : 0,1 | Non | Le nombre maximum de demandes d' StartIngestionJob API par seconde. |
| (Bases de connaissances) UpdateDataSource requêtes par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de demandes d' UpdateDataSource API par seconde. |
| (Bases de connaissances) UpdateKnowledgeBase requêtes par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de demandes d' UpdateKnowledgeBase API par seconde. |
| (Bases de connaissances) Taille de la requête de l'utilisateur | Chaque Région prise en charge : 1 000 | Non | Taille maximale (en caractères) d'une requête utilisateur. |
| (bases de connaissances gérées) AgenticRetrieveStream demandes par seconde et par compte | Par région prise en charge : 1 | Non | Le nombre maximum de demandes d' AgenticRetrieveStream API par seconde et par compte pour Managed KB. |
| Taille des requêtes des AgenticRetrieveStream utilisateurs (bases de connaissances gérées) | Chaque région prise en charge : 10 000 | Non | Taille maximale (en caractères) d'une requête utilisateur AgenticRetrieveStream pour Managed KB. |
| (Bases de connaissances gérées) Tâches d'ingestion simultanées par base de connaissances | Chaque région prise en charge : 50 | Non | Le nombre maximum de tâches d'ingestion simultanées par Ko géré. |
| (Bases de connaissances gérées) Sources de données par base de connaissances | Chaque région prise en charge : 200 | Non | Le nombre maximum de sources de données par Ko géré. |
| (bases de connaissances gérées) DeleteKnowledgeBaseDocuments demandes par seconde | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes d' DeleteKnowledgeBaseDocuments API par seconde pour les Ko gérés. |
| (bases de connaissances gérées) DeleteResourcePolicy demandes par seconde | Chaque région prise en charge : 5 | Non | Le nombre maximum de demandes d' DeleteResourcePolicy API par seconde pour les Ko gérés. |
| (Bases de connaissances gérées) Fichiers à ingérer par IngestKnowledgeBaseDocuments demande | Chaque Région prise en charge : 10 | Non | Le nombre maximum de fichiers à ingérer par demande d' IngestKnowledgeBaseDocuments API pour Managed KB. |
| (bases de connaissances gérées) GetDocumentContent demandes par seconde et par compte | Chaque région prise en charge : 100 | Non | Le nombre maximum de demandes d' GetDocumentContent API par seconde et par compte. |
| (bases de connaissances gérées) GetDocumentContent demandes par seconde par base de connaissances | Chaque région prise en charge : 5 | Non | Le nombre maximum de demandes d' GetDocumentContent API par seconde par Ko géré. |
| (bases de connaissances gérées) GetResourcePolicy demandes par seconde | Chaque région prise en charge : 5 | Non | Le nombre maximum de demandes d' GetResourcePolicy API par seconde pour les Ko gérés. |
| (Bases de connaissances gérées) Taille du texte extrait par fichier individuel (Mo) | Chaque Région prise en charge : 30 | Non | Taille maximale (en Mo) du texte extrait d'un seul fichier pour Managed KB. |
| (bases de connaissances gérées) IngestKnowledgeBaseDocuments demandes par seconde | Chaque Région prise en charge : 20 | Non | Le nombre maximum de demandes d' IngestKnowledgeBaseDocuments API par seconde pour les Ko gérés. |
| (Bases de connaissances gérées) Bases de connaissances par compte | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de Ko gérés par compte. |
| (bases de connaissances gérées) ListKnowledgeBaseDocuments demandes par seconde | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes d' ListKnowledgeBaseDocuments API par seconde pour les Ko gérés. |
| (bases de connaissances gérées) PutResourcePolicy demandes par seconde | Chaque région prise en charge : 5 | Non | Le nombre maximum de demandes d' PutResourcePolicy API par seconde pour les Ko gérés. |
| (Bases de connaissances gérées) Récupérez les demandes par seconde et par compte | Chaque région prise en charge : 100 | Non | Le nombre maximum de requêtes d'API Retrieve par seconde et par compte pour Managed KB. |
| (Bases de connaissances gérées) Récupérez les demandes par seconde par base de connaissances | Chaque région prise en charge : 5 | Non | Le nombre maximum de requêtes d'API Retrieve par seconde par Ko géré. |
| (Bases de connaissances gérées) Récupérer la taille des requêtes des utilisateurs | Chaque région prise en charge : 10 000 | Non | Taille maximale (en caractères) d'une requête utilisateur pour Retrieve for Managed KBs. |
| (Bases de connaissances gérées) Taille de stockage totale par base de connaissances (To) | Chaque Région prise en charge : 10 | Non | Taille de stockage totale maximale (en To) par Ko géré. |
| (Personnalisation du modèle) Modèles personnalisés par compte | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de modèles personnalisés dans un compte. |
| (Personnalisation du modèle) déploiements de modèles In-progress personnalisés | Chaque région prise en charge : 2 | Oui |
Le nombre maximum de déploiements de modèles personnalisés en cours |
| (Personnalisation du modèle) Taille maximale du fichier d'entrée pour les tâches de personnalisation de la distillation | Chaque région prise en charge : 2 gigaoctets | Non | Taille maximale du fichier d'entrée pour les tâches de personnalisation de la distillation. |
| (Personnalisation du modèle) Longueur de ligne maximale pour les tâches de personnalisation de la distillation | Chaque région prise en charge : 16 kilo-octets | Non | Longueur de ligne maximale dans le fichier d'entrée pour les tâches de personnalisation de la distillation. |
| (Personnalisation du modèle) Nombre maximum d'instructions pour les tâches de personnalisation de la distillation | Chaque région prise en charge : 15 000 | Non | Le nombre maximum d'instructions requises pour les tâches de personnalisation de la distillation. |
| (Personnalisation du modèle) Nombre maximum d'enregistrements de formation pour une Fine-tuning tâche Amazon Nova Canvas | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum d'enregistrements autorisés pour une Fine-tuning tâche Amazon Nova Canvas. |
| (Personnalisation du modèle) Longueur maximale du contexte de réglage du modèle de l'étudiant pour les tâches de personnalisation de la distillation Amazon Nova Micro V1 | Chaque région prise en charge : 32 000 | Non | Longueur maximale du contexte de réglage fin du modèle étudiant pour les tâches de personnalisation de la distillation Amazon Nova Micro V1. |
| (Personnalisation du modèle) Longueur maximale du contexte de réglage du modèle de l'étudiant pour les tâches de personnalisation de la distillation Amazon Nova V1 | Chaque région prise en charge : 32 000 | Non | Longueur maximale du contexte de réglage fin du modèle étudiant pour les tâches de personnalisation de la distillation Amazon Nova V1. |
| (Personnalisation du modèle) Longueur maximale du contexte de réglage du modèle de l'étudiant pour les tâches de personnalisation de la distillation du haïku 20240307 V1 d'Anthropic Claude 3 | Chaque région prise en charge : 32 000 | Non | La longueur maximale du contexte de réglage fin du modèle étudiant pour les tâches de personnalisation de la distillation du haïku 20240307 V1 d'Anthropic Claude 3. |
| (Personnalisation du modèle) Longueur maximale du contexte de réglage fin du modèle de l'étudiant pour les tâches de personnalisation de la distillation Llama 3.1 70B Instrut V1 | Chaque région prise en charge : 16 000 | Non | La longueur maximale du contexte de réglage fin du modèle étudiant pour les tâches de personnalisation de la distillation Llama 3.1 70B Instruct V1. |
| (Personnalisation du modèle) Longueur maximale du contexte de réglage fin du modèle de l'étudiant pour les tâches de personnalisation de la distillation Llama 3.1 8B Instrut V1 | Chaque région prise en charge : 32 000 | Non | La longueur maximale du contexte de réglage fin du modèle étudiant pour les tâches de personnalisation de la distillation Llama 3.1 8B Instruct V1. |
| (Personnalisation du modèle) Nombre minimum d'instructions pour les tâches de personnalisation de la distillation | Chaque région prise en charge : 100 | Non | Le nombre minimum d'instructions requises pour les tâches de personnalisation de la distillation. |
| (Personnalisation du modèle) Tâches de personnalisation planifiées | Chaque Région prise en charge : 10 | Non | Le nombre maximum de tâches de personnalisation planifiées. |
| (Personnalisation du modèle) Somme des demandes de déploiement de modèles personnalisés à la demande par minute pour Amazon Nova 2 Lite | Chaque Région prise en charge : 2 000 | Non | Somme des demandes de déploiement de modèles personnalisés en entrée et en sortie à la demande par minute soumises à Converse ConverseStream, InvokeModel, et InvokeModelWithResponseStream des actions pour Amazon Nova 2 Lite |
| (Personnalisation du modèle) Somme des demandes de déploiement de modèles personnalisés à la demande par minute pour Amazon Nova Lite | Chaque Région prise en charge : 2 000 | Non | Somme des demandes de déploiement de modèles personnalisés en entrée et en sortie à la demande par minute soumises à Converse, ConverseStream InvokeModel, et InvokeModelWithResponseStream des actions pour Amazon Nova Lite |
| (Personnalisation du modèle) Somme des demandes de déploiement de modèles personnalisés à la demande par minute pour Amazon Nova Micro | Chaque Région prise en charge : 2 000 | Non | Somme des demandes de déploiement de modèles personnalisés en entrée et en sortie à la demande par minute soumises à Converse, ConverseStream InvokeModel, et InvokeModelWithResponseStream des actions pour Amazon Nova Micro |
| (Personnalisation du modèle) Somme des demandes de déploiement de modèles personnalisés à la demande par minute pour Amazon Nova Pro | Chaque région prise en charge : 200 | Non | Somme des demandes de déploiement de modèles personnalisés en entrée et en sortie à la demande par minute soumises à Converse, ConverseStream InvokeModel, et InvokeModelWithResponseStream des actions pour Amazon Nova Pro |
| (Personnalisation du modèle) Somme des demandes de déploiement de modèles personnalisés à la demande par minute pour Meta Llama 3.3 70B Instruct | Chaque région prise en charge : 400 | Non | La somme des demandes de déploiement de modèles personnalisés en entrée et en sortie à la demande par minute soumises au Converse, ConverseStream InvokeModel, et des InvokeModelWithResponseStream actions pour Meta Llama 3.3 70B Instruct |
| (Personnalisation du modèle) Somme des jetons de déploiement de modèles personnalisés à la demande par jour pour Amazon Nova 2 Lite | Chaque région prise en charge : 5 760 000 000 | Non | Somme des jetons de déploiement de modèles personnalisés en entrée et en sortie à la demande par jour soumis à Converse ConverseStream, InvokeModel, et InvokeModelWithResponseStream des actions pour Amazon Nova 2 Lite |
| (Personnalisation du modèle) Somme des jetons de déploiement de modèles personnalisés à la demande par jour pour Amazon Nova Lite | Chaque région prise en charge : 5 760 000 000 | Non | Somme des jetons de déploiement de modèles personnalisés en entrée et en sortie à la demande par jour soumis à Converse, ConverseStream InvokeModel, et InvokeModelWithResponseStream des actions pour Amazon Nova Lite |
| (Personnalisation du modèle) Somme des jetons de déploiement de modèles personnalisés à la demande par jour pour Amazon Nova Micro | Chaque région prise en charge : 5 760 000 000 | Non | Somme des jetons de déploiement de modèles personnalisés en entrée et en sortie à la demande par jour soumis à Converse, ConverseStream InvokeModel, et InvokeModelWithResponseStream des actions pour Amazon Nova Micro |
| (Personnalisation du modèle) Somme des jetons de déploiement de modèles personnalisés à la demande par jour pour Amazon Nova Pro | Chaque région prise en charge : 1 152 000 000 | Non | Somme des jetons de déploiement de modèles personnalisés en entrée et en sortie à la demande par jour soumis à Converse, ConverseStream InvokeModel, et InvokeModelWithResponseStream des actions pour Amazon Nova Pro |
| (Personnalisation du modèle) Somme des jetons de déploiement de modèles personnalisés à la demande par jour pour Meta Llama 3.3 70B Instruct | Chaque région prise en charge : 432 000 000 | Non | La somme des jetons de déploiement de modèles personnalisés en entrée et en sortie à la demande par jour soumis au Converse, ConverseStream InvokeModel, et des InvokeModelWithResponseStream actions pour Meta Llama 3.3 70B Instruct |
| (Personnalisation du modèle) Somme des jetons de déploiement de modèles personnalisés à la demande par minute pour Amazon Nova 2 Lite | Chaque région prise en charge : 4 000 000 | Non | Somme des jetons de déploiement de modèles personnalisés en entrée et en sortie à la demande par minute soumis à Converse ConverseStream, InvokeModel, et InvokeModelWithResponseStream des actions pour Amazon Nova 2 Lite |
| (Personnalisation du modèle) Somme des jetons de déploiement de modèles personnalisés à la demande par minute pour Amazon Nova Lite | Chaque région prise en charge : 4 000 000 | Non | Somme des jetons de déploiement de modèles personnalisés en entrée et en sortie à la demande par minute soumis à Converse, ConverseStream InvokeModel, et InvokeModelWithResponseStream des actions pour Amazon Nova Lite |
| (Personnalisation du modèle) Somme des jetons de déploiement de modèles personnalisés à la demande par minute pour Amazon Nova Micro | Chaque région prise en charge : 4 000 000 | Non | Somme des jetons de déploiement de modèles personnalisés en entrée et en sortie à la demande par minute soumis à Converse, ConverseStream InvokeModel, et InvokeModelWithResponseStream des actions pour Amazon Nova Micro |
| (Personnalisation du modèle) Somme des jetons de déploiement de modèles personnalisés à la demande par minute pour Amazon Nova Pro | Chaque région prise en charge : 800 000 | Non | Somme des jetons de déploiement de modèles personnalisés en entrée et en sortie à la demande par minute soumis à Converse, ConverseStream InvokeModel, et InvokeModelWithResponseStream des actions pour Amazon Nova Pro |
| (Personnalisation du modèle) Somme des jetons de déploiement de modèles personnalisés à la demande par minute pour Meta Llama 3.3 70B Instruct | Chaque région prise en charge : 300 000 | Non | La somme des jetons de déploiement de modèles personnalisés en entrée et en sortie à la demande par minute soumis au Converse, ConverseStream InvokeModel, et des InvokeModelWithResponseStream actions pour Meta Llama 3.3 70B Instruct |
| (Personnalisation du modèle) Somme des enregistrements d'entraînement et de validation pour une Fine-tuning tâche Amazon Nova 2 Lite | Chaque Région prise en charge : 20 000 | Oui |
Nombre maximum combiné d'enregistrements de formation et de validation autorisés pour une Fine-tuning tâche Amazon Nova 2 Lite. |
| (Personnalisation du modèle) Somme des enregistrements de formation et de validation pour une Fine-tuning tâche Amazon Nova Lite | Chaque Région prise en charge : 20 000 | Oui |
Nombre maximum combiné d'enregistrements de formation et de validation autorisés pour une Fine-tuning tâche Amazon Nova Lite. |
| (Personnalisation du modèle) Somme des enregistrements de formation et de validation pour une Fine-tuning tâche Amazon Nova Micro | Chaque Région prise en charge : 20 000 | Oui |
Nombre maximum combiné d'enregistrements de formation et de validation autorisés pour une Fine-tuning tâche Amazon Nova Micro. |
| (Personnalisation du modèle) Somme des enregistrements de formation et de validation pour une Fine-tuning tâche Amazon Nova Pro | Chaque Région prise en charge : 20 000 | Oui |
Nombre maximum combiné d'enregistrements de formation et de validation autorisés pour une Fine-tuning tâche Amazon Nova Pro. |
| (Personnalisation du modèle) Somme des enregistrements d'entraînement et de validation pour un job Claude 3 Haiku v1 Fine-tuning | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum combiné d'enregistrements de formation et de validation autorisés pour un Fine-tuning job Claude 3 Haiku. |
| (Personnalisation du modèle) Somme des enregistrements d'entraînement et de validation pour un job Claude 3-5-Haiku v1 Fine-tuning | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum combiné d'enregistrements de formation et de validation autorisés pour un poste Claude 3-5-Haiku Fine-tuning . |
| (Personnalisation du modèle) Somme des enregistrements d'entraînement et de validation pour un job Meta Llama 2 13B v1 Fine-tuning | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum combiné d'enregistrements de formation et de validation autorisés pour un job Meta Llama 2 13B Fine-tuning . |
| (Personnalisation du modèle) Somme des enregistrements d'entraînement et de validation pour un job Meta Llama 2 70B v1 Fine-tuning | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum combiné d'enregistrements de formation et de validation autorisés pour un emploi dans Meta Llama 2 70B Fine-tuning . |
| (Personnalisation du modèle) Somme des enregistrements d'entraînement et de validation pour une tâche Meta Llama 3.1 70B Instruct v1 Fine-tuning | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum combiné d'enregistrements de formation et de validation autorisés pour une tâche Meta Llama 3.1 70B Fine-tuning Instruct. |
| (Personnalisation du modèle) Somme des enregistrements d'entraînement et de validation pour une tâche Meta Llama 3.1 8B Instruct v1 Fine-tuning | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum combiné d'enregistrements de formation et de validation autorisés pour une tâche Meta Llama 3.1 8B Fine-tuning Instruct. |
| (Personnalisation du modèle) Somme des enregistrements d'entraînement et de validation pour une tâche Meta Llama 3.2 11B Instruct v1 Fine-tuning | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum combiné d'enregistrements de formation et de validation autorisés pour une tâche Meta Llama 3.2 11B Fine-tuning Instruct. |
| (Personnalisation du modèle) Somme des enregistrements d'entraînement et de validation pour une tâche Meta Llama 3.2 1B Instruct v1 Fine-tuning | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum combiné d'enregistrements de formation et de validation autorisés pour une tâche Meta Llama 3.2 1B Instruct. Fine-tuning |
| (Personnalisation du modèle) Somme des enregistrements d'entraînement et de validation pour une tâche Meta Llama 3.2 3B Instruct v1 Fine-tuning | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum combiné d'enregistrements de formation et de validation autorisés pour une tâche Meta Llama 3.2 3B Instruct. Fine-tuning |
| (Personnalisation du modèle) Somme des enregistrements d'entraînement et de validation pour une tâche Meta Llama 3.2 90B Instruct v1 Fine-tuning | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum combiné d'enregistrements de formation et de validation autorisés pour une tâche Meta Llama 3.2 90B Fine-tuning Instruct. |
| (Personnalisation du modèle) Somme des enregistrements d'entraînement et de validation pour une tâche Meta Llama 3.3 70B Instruct v1 Fine-tuning | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum combiné d'enregistrements de formation et de validation autorisés pour une tâche Meta Llama 3.3 70B Fine-tuning Instruct. |
| (Personnalisation du modèle) Somme des enregistrements d'entraînement et de validation pour une tâche Titan Image Generator G1 Fine-tuning V1 | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum combiné d'enregistrements de formation et de validation autorisés pour une Fine-tuning tâche Titan Image Generator. |
| (Personnalisation du modèle) Somme des enregistrements d'entraînement et de validation pour une tâche Titan Image Generator G1 V2 Fine-tuning | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum combiné d'enregistrements de formation et de validation autorisés pour une Fine-tuning tâche Titan Image Generator V2. |
| (Personnalisation du modèle) Somme des enregistrements d'entraînement et de validation pour une tâche Titan Multimodal Embeddings G1 v1 Fine-tuning | Chaque région prise en charge : 50 000 | Oui |
Le nombre maximum combiné d'enregistrements de formation et de validation autorisés pour un travail sur Titan Multimodal Embeddings Fine-tuning . |
| (Personnalisation du modèle) Somme des enregistrements d'entraînement et de validation pour un Titan Text G1 - Express v1 Travail continu Pre-Training | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum combiné d'enregistrements de formation et de validation autorisés pour une Pre-Training tâche Titan Text Express Continued. |
| (Personnalisation du modèle) Somme des enregistrements d'entraînement et de validation pour une tâche Titan Text G1 - Express v1 Fine-tuning | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum combiné d'enregistrements de formation et de validation autorisés pour une Fine-tuning tâche Titan Text Express. |
| (Personnalisation du modèle) Somme des enregistrements d'entraînement et de validation pour un Titan Text G1 - Lite v1 Travail continu Pre-Training | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum combiné d'enregistrements de formation et de validation autorisés pour une Pre-Training tâche Titan Text Lite Continued. |
| (Personnalisation du modèle) Somme des enregistrements d'entraînement et de validation pour une tâche Titan Text G1 - Lite v1 Fine-tuning | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum combiné d'enregistrements de formation et de validation autorisés pour une Fine-tuning tâche Titan Text Lite. |
| (Personnalisation du modèle) Somme des enregistrements d'entraînement et de validation pour un job Titan Text G1 - Premier v1 Fine-tuning | Chaque Région prise en charge : 20 000 | Oui |
Le nombre maximum combiné d'enregistrements de formation et de validation autorisés pour une Fine-tuning tâche sur Titan Text Premier. |
| (Personnalisation du modèle) Nombre total de déploiements de modèles personnalisés | Par région prise en charge : 10 | Oui |
Nombre total de déploiements de modèles personnalisés |
| CreatePrompt Demandes (gestion rapide) par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de CreatePrompt requêtes par seconde. |
| CreatePromptVersion Demandes (gestion rapide) par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de CreatePromptVersion requêtes par seconde. |
| DeletePrompt Demandes (gestion rapide) par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de DeletePrompt requêtes par seconde. |
| GetPrompt Demandes (gestion rapide) par seconde | Chaque Région prise en charge : 10 | Non | Le nombre maximum de GetPrompt requêtes par seconde. |
| ListPrompts Demandes (gestion rapide) par seconde | Chaque Région prise en charge : 10 | Non | Le nombre maximum de ListPrompts requêtes par seconde. |
| (Gestion rapide) Invites par compte | Chaque région prise en charge : 500 | Oui |
Le nombre maximum d'invites. |
| UpdatePrompt Demandes (gestion rapide) par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de UpdatePrompt requêtes par seconde. |
| (Gestion des demandes) Versions par invite | Chaque Région prise en charge : 10 | Non | Le nombre maximum de versions par invite. |
| API par agent | Chaque région prise en charge : 11 | Oui |
Le nombre maximum d'API que vous pouvez ajouter à un agent. |
| Groupes d’actions par agent | Chaque région prise en charge : 20 | Oui |
Le nombre maximum de groupes d'actions que vous pouvez ajouter à un agent. |
| Agents collaborateurs par agent | Chaque Région prise en charge : 1 000 | Oui |
Le nombre maximum d'agents collaborateurs que vous pouvez ajouter à un agent. |
| Agents par compte | Chaque Région prise en charge : 1 000 | Oui |
Le nombre maximum d'agents par compte. |
| AssociateAgentKnowledgeBase demandes par seconde | Chaque région prise en charge : 6 | Non | Le nombre maximum de demandes d' AssociateAgentKnowledgeBase API par seconde. |
| Alias associés par agent | Chaque Région prise en charge : 10 | Non | Le nombre maximum d'alias que vous pouvez associer à un agent. |
| Bases de connaissances associées par agent | Chaque région prise en charge : 2 | Oui |
Le nombre maximum de bases de connaissances que vous pouvez associer à un agent. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Amazon Nova 2 Multimodal Embeddings V1 | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Amazon Nova 2 Multimodal Embeddings V1. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Amazon Nova Premier | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Amazon Nova Premier. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Claude 3 Haiku | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Claude 3 Haiku. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Claude 3 Opus | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Claude 3 Opus. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Claude 3 Sonnet | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Claude 3 Sonnet. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Claude 3.5 Haiku | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Claude 3.5 Haiku. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Claude 3.5 Sonnet | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Claude 3.5 Sonnet. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Claude 3.5 Sonnet v2 | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Claude 3.5 Sonnet v2. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Claude 3.7 Sonnet | Par région prise en charge : 1 | Oui |
Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Claude 3.7 Sonnet. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Claude Haiku 4.5 | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Claude Haiku 4.5. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Claude Opus 4.5 | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Claude Opus 4.5. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Claude Opus 4.6 | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Claude Opus 4.6. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Claude Opus 5 | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Claude Opus 5. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Claude Sonnet 4 | Par région prise en charge : 1 | Oui |
Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Claude Sonnet 4. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Claude Sonnet 4.5 | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Claude Sonnet 4.5. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Claude Sonnet 4.6 | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Claude Sonnet 4.6. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour DeepSeek V3.2 | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour DeepSeek V3.2. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour la v3 DeepSeek | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour la DeepSeek v3. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Devstral 2 123B | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Devstral 2 123B. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour GLM 4.7 | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour GLM 4.7. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour GLM 4.7 Flash | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour GLM 4.7 Flash. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour GLM 5 | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour GLM 5. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Gemma 3 12B | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Gemma 3 12B. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Gemma 3 27B | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Gemma 3 27B. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Gemma 3 4B | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Gemma 3 4B. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Kimi K2 Thinking | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Kimi K2 Thinking. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Kimi K2.5 | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Kimi K2.5. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Llama 3.1 405B Instruct | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Llama 3.1 405B Instruct. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Llama 3.1 70B Instruct | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Llama 3.1 70B Instruct. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Llama 3.1 8B Instruct | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Llama 3.1 8B Instruct. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Llama 3.2 11B Instruct | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Llama 3.2 11B Instruct. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Llama 3.2 1B Instruct | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots Llama 3.2 1B Instruct. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Llama 3.2 3B Instruct | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Llama 3.2 3B Instruct. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Llama 3.2 90B Instruct | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Llama 3.2 90B Instruct. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Llama 3.3 70B Instruct | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Llama 3.3 70B Instruct. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Llama 4 Maverick | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Llama 4 Maverick. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Llama 4 Scout | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Llama 4 Scout. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Magistral Small 2509 | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Magistral Small 2509. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour M2 MiniMax | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour MiniMax M2. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour MiniMax M2.1 | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour MiniMax M2.1. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour MiniMax M2.5 | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour MiniMax M2.5. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Ministral 3 14B | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Ministral 3 14B. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Ministral 3 8B | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Ministral 3 8B. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Ministral 3B | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Ministral 3B. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Mistral Large 2 (24.07) | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Mistral Large 2 (24.07). |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Mistral Large 3 | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Mistral Large 3. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Mistral Small | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Mistral Small. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour NVIDIA Nemotron 3 Super 120B A12B | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour NVIDIA Nemotron 3 Super 120B A12B. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour NVIDIA Nemotron Nano 12B | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour NVIDIA Nemotron Nano 12B. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour NVIDIA Nemotron Nano 3 30B | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour NVIDIA Nemotron Nano 3 30B. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour NVIDIA Nemotron Nano 9B | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour NVIDIA Nemotron Nano 9B. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Nova 2 Lite | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Nova 2 Lite. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Nova Lite V1 | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Nova Lite V1. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Nova Micro V1 | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Nova Micro V1. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Nova Pro V1 | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Nova Pro V1. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour OpenAI GPT OSS 120b | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour OpenAI GPT OSS 120b. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour OpenAI GPT OSS 20b | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour OpenAI GPT OSS 20b. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour OpenAI GPT OSS Safeguard 120b | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour OpenAI GPT OSS Safeguard 120b. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour OpenAI GPT OSS Safeguard 20b | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour OpenAI GPT OSS Safeguard 20b. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Qwen3 235B | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Qwen3 235B. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Qwen3 32B | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Qwen3 32B. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Qwen3 Coder 30B | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Qwen3 Coder 30B. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Qwen3 Coder 480B | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Qwen3 Coder 480B. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Qwen3 Coder Next | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Qwen3 Coder Next. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Qwen3 Next 80B | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Qwen3 Next 80B. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Qwen3 VL 235B | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Qwen3 VL 235B. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Titan Multimodal Embeddings G1 | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Titan Multimodal Embeddings G1. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Titan Text Embeddings V2 | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Titan Text Embeddings V2. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Voxtral Mini 3B 2507 | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Voxtral Mini 3B 2507. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Voxtral Small 24B 2507 | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour l'inférence par lots pour Voxtral Small 24B 2507. |
| Taille du fichier d'entrée par inférence par lots (en Go) pour Writer Palmyra Vision 7B | Par région prise en charge : 1 | Non | Taille maximale d'un seul fichier (en Go) soumis pour inférence par lots pour Writer Palmyra Vision 7B. |
| Taille de la tâche d'inférence par lots (en Go) pour Qwen3 Next 80B | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Qwen3 Next 80B. |
| Taille de la tâche d'inférence par lots (en Go) pour Amazon Nova 2 Multimodal Embeddings V1 | Chaque région prise en charge : 100 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Amazon Nova 2 Multimodal Embeddings V1. |
| Taille de la tâche d'inférence par lots (en Go) pour Amazon Nova Premier | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Amazon Nova Premier. |
| Taille de la tâche d'inférence par lots (en Go) pour Claude 3 Haiku | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Claude 3 Haiku. |
| Taille de la tâche d'inférence par lots (en Go) pour Claude 3 Opus | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Claude 3 Opus. |
| Taille de la tâche d'inférence par lots (en Go) pour Claude 3 Sonnet | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Claude 3 Sonnet. |
| Taille de la tâche d'inférence par lots (en Go) pour Claude 3.5 Haiku | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Claude 3.5 Haiku. |
| Taille de la tâche d'inférence par lots (en Go) pour Claude 3.5 Sonnet | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Claude 3.5 Sonnet. |
| Taille de la tâche d'inférence par lots (en Go) pour Claude 3.5 Sonnet v2 | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Claude 3.5 Sonnet v2. |
| Taille de la tâche d'inférence par lots (en Go) pour Claude 3.7 Sonnet | Chaque Région prise en charge : 5 | Oui |
Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Claude 3.7 Sonnet. |
| Taille de la tâche d'inférence par lots (en Go) pour Claude Haiku 4.5 | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Claude Haiku 4.5. |
| Taille de la tâche d'inférence par lots (en Go) pour Claude Opus 4.5 | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Claude Opus 4.5. |
| Taille de la tâche d'inférence par lots (en Go) pour Claude Opus 4.6 | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Claude Opus 4.6. |
| Taille de la tâche d'inférence par lots (en Go) pour Claude Opus 5 | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Claude Opus 5. |
| Taille de la tâche d'inférence par lots (en Go) pour Claude Sonnet 4 | Chaque Région prise en charge : 5 | Oui |
Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Claude Sonnet 4. |
| Taille de la tâche d'inférence par lots (en Go) pour Claude Sonnet 4.5 | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Claude Sonnet 4.5. |
| Taille de la tâche d'inférence par lots (en Go) pour Claude Sonnet 4.6 | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Claude Sonnet 4.6. |
| Taille de la tâche d'inférence par lots (en Go) pour DeepSeek V3.2 | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour DeepSeek V3.2. |
| Taille de la tâche d'inférence par lots (en Go) pour la v3 DeepSeek | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour la DeepSeek version 3. |
| Taille de la tâche d'inférence par lots (en Go) pour Devstral 2 123B | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Devstral 2 123B. |
| Taille de la tâche d'inférence par lots (en Go) pour GLM 4.7 | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour GLM 4.7. |
| Taille de la tâche d'inférence par lots (en Go) pour GLM 4.7 Flash | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour GLM 4.7 Flash. |
| Taille de la tâche d'inférence par lots (en Go) pour GLM 5 | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour GLM 5. |
| Taille de la tâche d'inférence par lots (en Go) pour Gemma 3 12B | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Gemma 3 12B. |
| Taille de la tâche d'inférence par lots (en Go) pour Gemma 3 27B | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Gemma 3 27B. |
| Taille de la tâche d'inférence par lots (en Go) pour Gemma 3 4B | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Gemma 3 4B. |
| Taille de la tâche d'inférence par lots (en Go) pour Kimi K2 Thinking | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Kimi K2 Thinking. |
| Taille de la tâche d'inférence par lots (en Go) pour Kimi K2.5 | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Kimi K2.5. |
| Taille de la tâche d'inférence par lots (en Go) pour Llama 3.1 405B Instruct | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Llama 3.1 405B Instruct. |
| Taille de la tâche d'inférence par lots (en Go) pour Llama 3.1 70B Instruct | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Llama 3.1 70B Instruct. |
| Taille de la tâche d'inférence par lots (en Go) pour Llama 3.1 8B Instruct | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Llama 3.1 8B Instruct. |
| Taille de la tâche d'inférence par lots (en Go) pour Llama 3.2 11B Instruct | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Llama 3.2 11B Instruct. |
| Taille de la tâche d'inférence par lots (en Go) pour Llama 3.2 1B Instruct | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Llama 3.2 1B Instruct. |
| Taille de la tâche d'inférence par lots (en Go) pour Llama 3.2 3B Instruct | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Llama 3.2 3B Instruct. |
| Taille de la tâche d'inférence par lots (en Go) pour Llama 3.2 90B Instruct | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Llama 3.2 90B Instruct. |
| Taille de la tâche d'inférence par lots (en Go) pour Llama 3.3 70B Instruct | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Llama 3.3 70B Instruct. |
| Taille de la tâche d'inférence par lots (en Go) pour Llama 4 Maverick | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Llama 4 Maverick. |
| Taille de la tâche d'inférence par lots (en Go) pour Llama 4 Scout | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Llama 4 Scout. |
| Taille de la tâche par inférence par lots (en Go) pour Magistral Small 2509 | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Magistral Small 2509. |
| Taille de la tâche d'inférence par lots (en Go) pour M2 MiniMax | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour MiniMax M2. |
| Taille de la tâche d'inférence par lots (en Go) pour MiniMax M2.1 | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour MiniMax M2.1. |
| Taille de la tâche d'inférence par lots (en Go) pour MiniMax M2.5 | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour MiniMax M2.5. |
| Taille de la tâche d'inférence par lots (en Go) pour Ministral 3 14B | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Ministral 3 14B. |
| Taille de la tâche d'inférence par lots (en Go) pour Ministral 3 8B | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Ministral 3 8B. |
| Taille de la tâche par inférence par lots (en Go) pour Ministral 3B | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Ministral 3B. |
| Taille de la tâche d'inférence par lots (en Go) pour Mistral Large 2 (24,07) | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Mistral Large 2 (24.07). |
| Taille de la tâche d'inférence par lots (en Go) pour Mistral Large 3 | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Mistral Large 3. |
| Taille de la tâche d'inférence par lots (en Go) pour Mistral Small | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Mistral Small. |
| Taille de la tâche d'inférence par lots (en Go) pour NVIDIA Nemotron 3 Super 120B A12B | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour NVIDIA Nemotron 3 Super 120B A12B. |
| Taille de la tâche d'inférence par lots (en Go) pour NVIDIA Nemotron Nano 12B | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour NVIDIA Nemotron Nano 12B. |
| Taille de la tâche d'inférence par lots (en Go) pour NVIDIA Nemotron Nano 3 30B | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour NVIDIA Nemotron Nano 3 30B. |
| Taille de la tâche d'inférence par lots (en Go) pour NVIDIA Nemotron Nano 9B | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour NVIDIA Nemotron Nano 9B. |
| Taille de la tâche d'inférence par lots (en Go) pour Nova Lite V1 | Chaque région prise en charge : 100 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Nova Lite V1. |
| Taille de la tâche d'inférence par lots (en Go) pour Nova Micro V1 | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Nova Micro V1. |
| Taille de la tâche d'inférence par lots (en Go) pour Nova Pro V1 | Chaque région prise en charge : 100 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Nova Pro V1. |
| Taille de la tâche d'inférence par lots (en Go) pour OpenAI GPT OSS 120b | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour OpenAI GPT OSS 120b. |
| Taille de la tâche d'inférence par lots (en Go) pour OpenAI GPT OSS 20b | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour OpenAI GPT OSS 20b. |
| Taille de la tâche d'inférence par lots (en Go) pour OpenAI GPT OSS Safeguard 120b | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour OpenAI GPT OSS Safeguard 120b. |
| Taille de la tâche d'inférence par lots (en Go) pour OpenAI GPT OSS Safeguard 20b | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour OpenAI GPT OSS Safeguard 20b. |
| Taille de la tâche d'inférence par lots (en Go) pour Qwen3 235B | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Qwen3 235B. |
| Taille de la tâche d'inférence par lots (en Go) pour Qwen3 32B | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Qwen3 32B. |
| Taille de la tâche d'inférence par lots (en Go) pour Qwen3 Coder 30B | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Qwen3 Coder 30B. |
| Taille de la tâche d'inférence par lots (en Go) pour Qwen3 Coder 480B | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Qwen3 Coder 480B. |
| Taille de la tâche d'inférence par lots (en Go) pour Qwen3 Coder Next | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Qwen3 Coder Next. |
| Taille de la tâche d'inférence par lots (en Go) pour Qwen3 VL 235B | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Qwen3 VL 235B. |
| Taille de la tâche d'inférence par lots (en Go) pour Titan Multimodal Embeddings G1 | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Titan Multimodal Embeddings G1. |
| Taille de la tâche d'inférence par lots (en Go) pour Titan Text Embeddings V2 | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Titan Text Embeddings V2. |
| Taille de la tâche d'inférence par lots (en Go) pour Voxtral Mini 3B 2507 | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Voxtral Mini 3B 2507. |
| Taille de la tâche d'inférence par lots (en Go) pour Voxtral Small 24B 2507 | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Voxtral Small 24B 2507. |
| Taille de la tâche d'inférence par lots (en Go) pour Writer Palmyra Vision 7B | Chaque région prise en charge : 5 | Non | Taille cumulée maximale de tous les fichiers d'entrée (en Go) inclus dans la tâche d'inférence par lots pour Writer Palmyra Vision 7B. |
| Caractères dans les instructions des agents | Chaque Région prise en charge : 20 000 | Non | Nombre maximum de caractères dans les instructions destinées à un agent. |
| Tâches d'importation de modèles simultanées | Par région prise en charge : 1 | Non | Le nombre maximum de tâches d'importation de modèles qui sont en cours simultanément. |
| CreateAgent demandes par seconde | Chaque région prise en charge : 6 | Non | Le nombre maximum de demandes d' CreateAgent API par seconde. |
| CreateAgentActionGroup demandes par seconde | Chaque région prise en charge : 12 | Non | Le nombre maximum de demandes d' CreateAgentActionGroup API par seconde. |
| CreateAgentAlias demandes par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de demandes d' CreateAgentAlias API par seconde. |
| Cross-Region demandes d'inférence de modèles par minute pour Anthropic Claude 3.5 Haiku | Chaque Région prise en charge : 2 000 | Non | Le nombre maximum de fois que vous pouvez appeler InvokeModel InvokeModelWithResponseStream en une minute. Le quota prend en compte la somme combinée de InvokeModel et de InvokeModelWithResponseStream jetons pour Anthropic Claude 3.5 Haiku. |
| Cross-Region demandes d'inférence de modèle par minute pour Anthropic Claude 3.5 Sonnet V2 |
États-Unis-ouest-2 : 500 Chacune des autres régions prises en charge : 100 |
Non | Le nombre maximum de fois que vous pouvez appeler l'inférence de modèle en une minute pour Anthropic Claude 3.5 Sonnet V2. Le quota prend en compte la somme combinée de Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-Region modèle de jetons d'inférence par minute pour Anthropic Claude 3.5 Haiku | Chaque région prise en charge : 4 000 000 | Oui |
Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse InvokeModel et InvokeModelWithResponseStream pour Anthropic Claude 3.5 Haiku. ConverseStream |
| Cross-Region jetons d'inférence du modèle par minute pour Anthropic Claude 3.5 Sonnet V2 |
États-Unis-Ouest-2 : 4 000 000 Chacune des autres régions prises en charge : 800 000 |
Oui |
Le nombre maximum de jetons que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude 3.5 Sonnet V2. Le quota prend en compte la somme combinée de Converse, ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region demandes d'inférence de modèle par minute pour Amazon Nova 2 Lite | Chaque Région prise en charge : 2 000 | Non | Le nombre maximum de demandes interrégionales que vous pouvez envoyer pour l'inférence de modèle en une minute pour Amazon Nova 2 Lite. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Amazon Nova 2 Omni | Chaque Région prise en charge : 2 000 | Non | Le nombre maximum de demandes interrégionales que vous pouvez envoyer pour l'inférence de modèles en une minute pour Amazon Nova 2 Omni. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Amazon Nova 2 Pro Preview | Chaque région prise en charge : 100 | Non | Le nombre maximum de demandes interrégionales que vous pouvez envoyer pour l'inférence de modèle en une minute pour Amazon Nova 2 Pro Preview. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèles par minute pour Amazon Nova Lite |
États-Unis-est-1 : 4 000 États-Unis-est-2 : 4 000 États-Unis-Ouest-1 : 4 000 États-Unis-Ouest-2 : 4 000 Chacune des autres régions prises en charge : 400 |
Non | Le nombre maximum de demandes interrégionales que vous pouvez envoyer pour l'inférence de modèle en une minute pour Amazon Nova Lite. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Amazon Nova Micro |
États-Unis-est-1 : 4 000 États-Unis-est-2 : 4 000 États-Unis-Ouest-2 : 4 000 Chacune des autres régions prises en charge : 400 |
Non | Le nombre maximum de demandes interrégionales que vous pouvez envoyer pour l'inférence de modèle en une minute pour Amazon Nova Micro. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Amazon Nova Premier V1 | Chaque région prise en charge : 500 | Non | Le nombre maximum de demandes interrégionales que vous pouvez envoyer pour l'inférence de modèles en une minute pour Amazon Nova Premier V1. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèles par minute pour Amazon Nova Pro | Chaque région prise en charge : 500 | Non | Le nombre maximum de demandes interrégionales que vous pouvez envoyer pour l'inférence de modèles en une minute pour Amazon Nova Pro. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèles par minute pour Anthropic Claude 3 Haiku |
États-Unis-est-1 : 2 000 États-Unis-Ouest-2 : 2 000 ap-nord-est-1 : 400 ap-sud-est-1 : 400 Chacune des autres régions prises en charge : 800 |
Non | Le nombre maximum de fois que vous pouvez appeler l'inférence de modèle en une minute. Le quota prend en compte la somme combinée de Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream pour Anthropic Claude 3 Haiku. |
| Cross-region demandes d'inférence de modèles par minute pour Anthropic Claude 3 Opus | Chaque région prise en charge : 100 | Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèles en une minute pour Anthropic Claude 3 Opus. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèles par minute pour Anthropic Claude 3 Sonnet |
États-Unis-est-1 : 1 000 États-Unis-Ouest-2 : 1 000 Chacune des autres régions prises en charge : 200 |
Non | Le nombre maximum de fois que vous pouvez appeler l'inférence de modèle en une minute. Le quota prend en compte la somme combinée de Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream pour Anthropic Claude 3 Sonnet. |
| Cross-region demandes d'inférence de modèles par minute pour Anthropic Claude 3.5 Sonnet |
États-Unis-ouest-2 : 500 ap-nord-est-1 : 40 ap-sud-est-1 : 40 eu-central-1 : 40 UE-Ouest-1 : 40 UE-Ouest-3 : 40 Chacune des autres régions prises en charge : 100 |
Non | Le nombre maximum de fois que vous pouvez appeler inférence de modèle en une minute pour Anthropic Claude 3.5 Sonnet. Le quota prend en compte la somme combinée de Converse, ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region demandes d'inférence de modèle par minute pour Anthropic Claude 3.7 Sonnet V1 |
États-Unis-est-1 : 250 États-Unis-est-2 : 250 États-Unis-ouest-2 : 250 eu-central-1 : 100 UE-Nord-1 : 100 UE-Ouest-1 : 100 UE-Ouest-3 : 100 Chacune des autres régions prises en charge : 50 |
Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèles en une minute pour Anthropic Claude 3.7 Sonnet V1. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèles par minute pour Anthropic Claude Haiku 4.5 | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèles en une minute pour Anthropic Claude Haiku 4.5. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèles par minute pour Anthropic Claude Opus 4 V1 | Chaque région prise en charge : 200 | Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèles en une minute pour Anthropic Claude Opus 4 V1. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèles par minute pour Anthropic Claude Opus 4.1 | Chaque région prise en charge : 50 | Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèles en une minute pour Anthropic Claude Opus 4.1. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèles par minute pour Anthropic Claude Opus 4.5 | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèles en une minute pour Anthropic Claude Opus 4.5. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèles par minute pour Anthropic Claude Opus 4.6 V1 | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèles en une minute pour Anthropic Claude Opus 4.6 V1. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Anthropic Claude Sonnet 4 V1 | Chaque région prise en charge : 200 | Oui |
Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèles en une minute pour Anthropic Claude Sonnet 4 V1. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Anthropic Claude Sonnet 4 V1 1M Context Length | Chaque Région prise en charge : 5 | Oui |
Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèles en une minute pour Anthropic Claude Sonnet 4 V1 1M Context Length. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Anthropic Claude Sonnet 4.5 V1 | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèles en une minute pour Anthropic Claude Sonnet 4.5 V1. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Anthropic Claude Sonnet 4.5 V1 1M Context Length | Chaque Région prise en charge : 1 000 | Oui |
Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèles en une minute pour Anthropic Claude Sonnet 4.5 V1 1M Context Length. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèles par minute pour Anthropic Claude Sonnet 4.6 | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèles en une minute pour Anthropic Claude Sonnet 4.6. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Cohere Embed V4 | Chaque Région prise en charge : 2 000 | Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèles en une minute pour Cohere Embed V4. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour DeepSeek R1 V1 | Chaque région prise en charge : 200 | Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèle en une minute pour DeepSeek R1 V1. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Meta Llama 3.1 405B Instruct | Chaque région prise en charge : 400 | Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèle en une minute pour Meta Llama 3.1 405B Instruct. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Meta Llama 3.1 70B Instruct | Chaque région prise en charge : 800 | Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèle en une minute pour Meta Llama 3.1 70B Instruct. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Meta Llama 3.1 8B Instruct | Chaque région prise en charge : 1 600 | Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèle en une minute pour Meta Llama 3.1 8B Instruct. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Meta Llama 3.2 1B Instruct | Chaque région prise en charge : 1 600 | Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèle en une minute pour Meta Llama 3.2 1B Instruct. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Meta Llama 3.2 3B Instruct | Chaque région prise en charge : 1 600 | Non | Le nombre maximum de fois que vous pouvez appeler l'inférence de modèle en une minute pour Meta Llama 3.2 3B Instruct. Le quota prend en compte la somme combinée des demandes pour InvokeModel InvokeModelWithResponseStream,, Converse et ConverseStream. |
| Cross-region demandes d'inférence de modèle par minute pour Meta Llama 3.3 70B Instruct | Chaque région prise en charge : 800 | Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèle en une minute pour Meta Llama 3.3 70B Instruct. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Meta Llama 4 Maverick V1 | Chaque région prise en charge : 800 | Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèle en une minute pour Meta Llama 4 Maverick V1. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Meta Llama 4 Scout V1 | Chaque région prise en charge : 800 | Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèle en une minute pour Meta Llama 4 Scout V1. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Mistral Pixtral Large 25.02 V1 | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèles en une minute pour Mistral Pixtral Large 25.02 V1. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Stable Image Conservative Upscale | Chaque Région prise en charge : 4 | Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèle en une minute pour Stable Image Conservative Upscale. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Stable Image Control Sketch | Chaque Région prise en charge : 20 | Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèle en une minute pour Stable Image Control Sketch. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour une structure de contrôle d'image stable | Chaque Région prise en charge : 20 | Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèle en une minute pour une structure de contrôle d'image stable. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Stable Image Creative Upscale | Chaque Région prise en charge : 4 | Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèle en une minute pour Stable Image Creative Upscale. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour un objet d'effacement d'image stable | Chaque Région prise en charge : 20 | Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèle en une minute pour un objet d'effacement d'image stable. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Stable Image Fast Upscale | Chaque Région prise en charge : 20 | Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèle en une minute pour Stable Image Fast Upscale. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Stable Image Inpaint | Chaque Région prise en charge : 20 | Non | Le nombre maximum de demandes interrégionales que vous pouvez envoyer pour l'inférence de modèle en une minute pour Stable Image Inpaint. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Stable Image Outpaint | Chaque Région prise en charge : 4 | Non | Le nombre maximum de demandes interrégionales que vous pouvez envoyer pour l'inférence de modèle en une minute pour Stable Image Outpaint. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour une image stable Supprimer l'arrière-plan | Chaque Région prise en charge : 20 | Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèle en une minute pour Stable Image Remove Background. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour la recherche et la recoloration d'images stables | Chaque Région prise en charge : 20 | Non | Nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèle en une minute pour la recherche et la recolorisation d'images stables. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour la recherche et le remplacement d'images stables | Chaque Région prise en charge : 20 | Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèle en une minute pour la recherche et le remplacement d'images stables. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Stable Image Style Guide | Chaque Région prise en charge : 20 | Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèle en une minute pour Stable Image Style Guide. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour un transfert de style d'image stable | Chaque Région prise en charge : 20 | Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèle en une minute pour le transfert de style d'image stable. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèles par minute pour Twelve Labs Marengo | Chaque région prise en charge : 200 | Non | Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèles en une minute pour Twelve Labs Marengo. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèles par minute pour Twelve Labs Pegasus | Chaque région prise en charge : 120 | Oui |
Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèles en une minute pour Twelve Labs Pegasus. Le quota prend en compte la somme combinée de Converse, ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region requêtes d'inférence de modèle par minute pour TwelveLabs Marengo Embed 3.0 | Chaque Région prise en charge : 1 000 | Oui |
Le nombre maximum de demandes interrégionales que vous pouvez soumettre pour l'inférence de modèles en une minute pour TwelveLabs Marengo Embed 3.0. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Writer AI Palmyra X4 V1 | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes interrégionales que vous pouvez envoyer pour l'inférence de modèles en une minute pour Writer AI Palmyra X4 V1. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region demandes d'inférence de modèle par minute pour Writer AI Palmyra X5 V1 | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes interrégionales que vous pouvez envoyer pour l'inférence de modèles en une minute pour Writer AI Palmyra X5 V1. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Cross-region jetons d'inférence de modèles par minute pour Amazon Nova 2 Lite | Chaque région prise en charge : 8 000 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Amazon Nova 2 Lite. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region jetons d'inférence de modèle par minute pour Amazon Nova 2 Omni | Chaque région prise en charge : 8 000 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Amazon Nova 2 Omni. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region jetons d'inférence de modèles par minute pour Amazon Nova 2 Pro Preview | Chaque Région prise en charge : 1 000 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Amazon Nova 2 Pro Preview. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region jetons d'inférence de modèles par minute pour Amazon Nova Lite |
États-Unis-est-1 : 8 000 000 États-Unis-est-2 : 8 000 000 États-Unis-Ouest-1 : 8 000 000 États-Unis-Ouest-2 : 8 000 000 Chacune des autres régions prises en charge : 400 000 |
Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Amazon Nova Lite. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region jetons d'inférence de modèles par minute pour Amazon Nova Micro |
États-Unis-est-1 : 8 000 000 États-Unis-est-2 : 8 000 000 États-Unis-Ouest-2 : 8 000 000 Chacune des autres régions prises en charge : 400 000 |
Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Amazon Nova Micro. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region jetons d'inférence de modèle par minute pour Amazon Nova Premier V1 | Chaque région prise en charge : 2 000 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Amazon Nova Premier V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region jetons d'inférence de modèles par minute pour Amazon Nova Pro | Chaque région prise en charge : 2 000 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Amazon Nova Pro. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region modèle de jetons d'inférence par minute pour Anthropic Claude 3 Haiku |
États-Unis-est-1 : 4 000 000 États-Unis-Ouest-2 : 4 000 000 ap-nord-est-1 : 400 000 ap-sud-est 1 : 400 000 Chacune des autres régions prises en charge : 600 000 |
Oui |
Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse InvokeModel et InvokeModelWithResponseStream pour Anthropic Claude 3 Haiku. ConverseStream |
| Cross-region modèle de jetons d'inférence par minute pour Anthropic Claude 3 Opus | Chaque région prise en charge : 800 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude 3 Opus. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region modèle de jetons d'inférence par minute pour Anthropic Claude 3 Sonnet |
États-Unis-est-1 : 2 000 000 États-Unis-Ouest-2 : 2 000 000 Chacune des autres régions prises en charge : 400 000 |
Oui |
Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse InvokeModel et InvokeModelWithResponseStream pour Anthropic Claude 3 Sonnet. ConverseStream |
| Cross-region modèle de jetons d'inférence par minute pour Anthropic Claude 3.5 Sonnet |
États-Unis-Ouest-2 : 4 000 000 ap-nord-est-1 : 400 000 ap-sud-est 1 : 400 000 eu-central-1 : 400 000 UE-Ouest-1 : 400 000 UE-Ouest-3 : 400 000 Chacune des autres régions prises en charge : 800 000 |
Oui |
Le nombre maximum de jetons que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude 3.5 Sonnet. Le quota prend en compte la somme combinée de Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region jetons d'inférence du modèle par minute pour Anthropic Claude 3.7 Sonnet V1 |
États-Unis-est-1 : 1 000 000 États-Unis-est-2 : 1 000 000 États-Unis-Ouest-2 : 1 000 000 eu-central-1 : 100 000 UE-Nord-1 : 100 000 UE-Ouest-1 : 100 000 UE-Ouest-3 : 100 000 Chacune des autres régions prises en charge : 50 000 |
Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude 3.7 Sonnet V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region modèle de jetons d'inférence par minute pour Anthropic Claude Fable 5 | Chaque région prise en charge : 4 000 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Fable 5. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region modèle de jetons d'inférence par minute pour Anthropic Claude Haiku 4.5 | Chaque région prise en charge : 5 000 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Haiku 4.5. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region modèle de jetons d'inférence par minute pour Anthropic Claude Opus 4 V1 | Chaque région prise en charge : 200 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Opus 4 V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region modèle de jetons d'inférence par minute pour Anthropic Claude Opus 4.1 | Chaque région prise en charge : 500 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Opus 4.1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region modèle de jetons d'inférence par minute pour Anthropic Claude Opus 4.5 | Chaque région prise en charge : 2 000 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Opus 4.5. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region jetons d'inférence du modèle par minute pour Anthropic Claude Opus 4.6 V1 | Chaque région prise en charge : 3 000 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Opus 4.6 V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region modèle de jetons d'inférence par minute pour Anthropic Claude Opus 4.7 | Chaque région prise en charge : 10 000 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Opus 4.7. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region modèle de jetons d'inférence par minute pour Anthropic Claude Opus 4.8 | Chaque région prise en charge : 30 000 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Opus 4.8. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region modèle de jetons d'inférence par minute pour Anthropic Claude Opus 5 | Chaque région prise en charge : 30 000 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Opus 5. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region jetons d'inférence du modèle par minute pour Anthropic Claude Sonnet 4 V1 | Chaque région prise en charge : 200 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Sonnet 4 V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region jetons d'inférence de modèle par minute pour Anthropic Claude Sonnet 4 V1 1M Context Length | Chaque Région prise en charge : 1 000 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Sonnet 4 V1 1M Context Length. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region jetons d'inférence du modèle par minute pour Anthropic Claude Sonnet 4.5 V1 | Chaque région prise en charge : 5 000 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Sonnet 4.5 V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region jetons d'inférence de modèle par minute pour Anthropic Claude Sonnet 4.5 V1 1M Context Length | Chaque Région prise en charge : 1 000 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Sonnet 4.5 V1 1M Context Length. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region modèle de jetons d'inférence par minute pour Anthropic Claude Sonnet 4.6 | Chaque région prise en charge : 6 000 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Sonnet 4.6. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region modèle de jetons d'inférence par minute pour Anthropic Claude Sonnet 5 | Chaque région prise en charge : 6 000 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Sonnet 5. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region jetons d'inférence de modèle par minute pour Cohere Embed V4 | Chaque région prise en charge : 300 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Cohere Embed V4. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region jetons d'inférence de modèle par minute pour DeepSeek R1 V1 | Chaque région prise en charge : 200 000 | Oui |
Le nombre maximum de jetons inter-régions que vous pouvez soumettre pour inférence de modèle en une minute pour DeepSeek R1 V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region jetons d'inférence de modèle par minute pour Meta Llama 3.1 405B Instruct | Chaque région prise en charge : 800 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Meta Llama 3.1 405B Instruct. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region jetons d'inférence de modèle par minute pour Meta Llama 3.1 70B Instruct | Chaque région prise en charge : 600 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Meta Llama 3.1 70B Instruct. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region jetons d'inférence de modèle par minute pour Meta Llama 3.1 8B Instruct | Chaque région prise en charge : 600 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Meta Llama 3.1 8B Instruct. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region jetons d'inférence de modèle par minute pour Meta Llama 3.2 1B Instruct | Chaque région prise en charge : 600 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Meta Llama 3.2 1B Instruct. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region jetons d'inférence de modèle par minute pour Meta Llama 3.2 3B Instruct | Chaque région prise en charge : 600 000 | Oui |
Le nombre maximum de jetons que vous pouvez soumettre pour inférence de modèle en une minute pour Meta Llama 3.2 3B Instruct. Le quota prend en compte la somme combinée des jetons pour InvokeModel InvokeModelWithResponseStream,, Converse et ConverseStream. |
| Cross-region jetons d'inférence de modèle par minute pour Meta Llama 3.3 70B Instruct | Chaque région prise en charge : 600 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Meta Llama 3.3 70B Instruct. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region jetons d'inférence de modèle par minute pour Meta Llama 4 Maverick V1 | Chaque région prise en charge : 600 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Meta Llama 4 Maverick V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region jetons d'inférence de modèle par minute pour Meta Llama 4 Scout V1 | Chaque région prise en charge : 600 000 | Oui |
Le nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Meta Llama 4 Scout V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region jetons d'inférence de modèle par minute pour Mistral Pixtral Large 25.02 V1 | Chaque région prise en charge : 80 000 | Oui |
Le nombre maximum de jetons inter-régions que vous pouvez soumettre pour inférence de modèle en une minute pour Mistral Pixtral Large 25.02 V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region jetons d'inférence de modèle par minute pour Writer AI Palmyra X4 V1 | Chaque région prise en charge : 150 000 | Oui |
Nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Writer AI Palmyra X4 V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Cross-region jetons d'inférence de modèle par minute pour Writer AI Palmyra X5 V1 | Chaque région prise en charge : 150 000 | Oui |
Nombre maximum de jetons interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Writer AI Palmyra X5 V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Modèles personnalisés avec statut de création par compte | Chaque région prise en charge : 2 | Oui |
Le nombre maximum de modèles personnalisés ayant un statut de création. |
| DeleteAgent demandes par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de demandes d' DeleteAgent API par seconde. |
| DeleteAgentActionGroup demandes par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de demandes d' DeleteAgentActionGroup API par seconde. |
| DeleteAgentAlias demandes par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de demandes d' DeleteAgentAlias API par seconde. |
| DeleteAgentVersion demandes par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de demandes d' DeleteAgentVersion API par seconde. |
| DisassociateAgentKnowledgeBase demandes par seconde | Chaque Région prise en charge : 4 | Non | Le nombre maximum de demandes d' DisassociateAgentKnowledgeBase API par seconde. |
| Groupes d'actions activés par agent | Chaque région prise en charge : 15 | Oui |
Le nombre maximum de groupes d'actions que vous pouvez activer dans un agent. |
| Points finaux par profil d'inférence | Chaque région prise en charge : 5 | Non | Le nombre maximum de points de terminaison dans un profil d'inférence. Un point de terminaison est défini par un modèle et la région à laquelle les demandes d'invocation adressées au modèle sont envoyées. |
| GetAgent demandes par seconde | Chaque région prise en charge : 15 | Non | Le nombre maximum de demandes d' GetAgent API par seconde. |
| GetAgentActionGroup demandes par seconde | Chaque Région prise en charge : 20 | Non | Le nombre maximum de demandes d' GetAgentActionGroup API par seconde. |
| GetAgentAlias demandes par seconde | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes d' GetAgentAlias API par seconde. |
| GetAgentKnowledgeBase demandes par seconde | Chaque région prise en charge : 15 | Non | Le nombre maximum de demandes d' GetAgentKnowledgeBase API par seconde. |
| GetAgentVersion demandes par seconde | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes d' GetAgentVersion API par seconde. |
| Demandes d'inférence de modèles interrégionaux globales par minute pour Amazon Nova 2 Lite | Chaque Région prise en charge : 2 000 | Oui |
Le nombre maximum de demandes globales interrégionales que vous pouvez envoyer pour l'inférence de modèle en une minute pour Amazon Nova 2 Lite. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Demandes d'inférence de modèles interrégionaux globales par minute pour Amazon Nova 2 Omni | Chaque Région prise en charge : 2 000 | Oui |
Le nombre maximum de demandes globales interrégionales que vous pouvez envoyer pour l'inférence de modèles en une minute pour Amazon Nova 2 Omni. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Demandes d'inférence de modèles interrégionales globales par minute pour Amazon Nova 2 Pro Preview | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de demandes globales interrégionales que vous pouvez envoyer pour l'inférence de modèle en une minute pour Amazon Nova 2 Pro Preview. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Demandes d'inférence de modèles interrégionaux mondiaux par minute pour Anthropic Claude Haiku 4.5 | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum de demandes globales interrégionales que vous pouvez soumettre pour l'inférence de modèles en une minute pour Anthropic Claude Haiku 4.5. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Demandes d'inférence de modèles interrégionaux mondiaux par minute pour Anthropic Claude Opus 4.5 | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum de demandes globales interrégionales que vous pouvez soumettre pour l'inférence de modèles en une minute pour Anthropic Claude Opus 4.5. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Demandes d'inférence de modèles interrégionaux globales par minute pour Anthropic Claude Opus 4.6 V1 | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum de demandes globales interrégionales que vous pouvez soumettre pour l'inférence de modèles en une minute pour Anthropic Claude Opus 4.6 V1. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Demandes d'inférence de modèles interrégionaux mondiaux par minute pour Anthropic Claude Sonnet 4 V1 | Chaque région prise en charge : 200 | Oui |
Le nombre maximum de demandes globales interrégionales que vous pouvez soumettre pour l'inférence de modèles en une minute pour Anthropic Claude Sonnet 4 V1. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Demandes d'inférence de modèles interrégionaux mondiaux par minute pour Anthropic Claude Sonnet 4.5 V1 | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum de demandes globales interrégionales que vous pouvez soumettre pour l'inférence de modèles en une minute pour Anthropic Claude Sonnet 4.5 V1. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Demandes d'inférence de modèles interrégionaux globales par minute pour Anthropic Claude Sonnet 4.5 V1 1M de longueur de contexte | Chaque Région prise en charge : 1 000 | Oui |
Le nombre maximum de demandes interrégionales globales que vous pouvez soumettre pour l'inférence de modèles en une minute pour Anthropic Claude Sonnet 4.5 V1 1M Context Length. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Demandes d'inférence de modèles interrégionaux mondiaux par minute pour Anthropic Claude Sonnet 4.6 | Chaque région prise en charge : 10 000 | Oui |
Le nombre maximum de demandes globales interrégionales que vous pouvez soumettre pour l'inférence de modèles en une minute pour Anthropic Claude Sonnet 4.6. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Demandes d'inférence de modèles interrégionaux globales par minute pour Cohere Embed V4 | Chaque Région prise en charge : 2 000 | Oui |
Le nombre maximum de demandes interrégionales globales que vous pouvez soumettre pour l'inférence de modèles en une minute pour Cohere Embed V4. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| Jetons d'inférence de modèles interrégionaux mondiaux par jour pour Amazon Nova 2 Lite | Chaque région prise en charge : 11 520 000 000 | Non | Le nombre maximum de jetons interrégionaux globaux que vous pouvez soumettre pour inférence de modèle en une journée pour Amazon Nova 2 Lite. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par jour pour Amazon Nova 2 Omni | Chaque région prise en charge : 11 520 000 000 | Non | Le nombre maximum de jetons interrégionaux globaux que vous pouvez soumettre pour inférence de modèle en une journée pour Amazon Nova 2 Omni. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par jour pour Amazon Nova 2 Pro Preview | Chaque région prise en charge : 1 440 000 000 | Non | Le nombre maximum de jetons interrégionaux globaux que vous pouvez soumettre pour inférence de modèle en une journée pour Amazon Nova 2 Pro Preview. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par jour pour Anthropic Claude Fable 5 | Chaque région prise en charge : 5 760 000 000 | Non | Le nombre maximum de jetons mondiaux interrégionaux que vous pouvez soumettre pour inférence de modèle en une journée pour Anthropic Claude Fable 5. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par jour pour Anthropic Claude Haiku 4.5 | Chaque région prise en charge : 7 200 000 000 | Non | Le nombre maximum de jetons mondiaux interrégionaux que vous pouvez soumettre pour inférence de modèle en une journée pour Anthropic Claude Haiku 4.5. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par jour pour Anthropic Claude Opus 4.5 | Chaque région prise en charge : 2 880 000 000 | Non | Le nombre maximum de jetons mondiaux interrégionaux que vous pouvez soumettre pour inférence de modèle en une journée pour Anthropic Claude Opus 4.5. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par jour pour Anthropic Claude Opus 4.6 V1 | Chaque région prise en charge : 4 320 000 000 | Non | Le nombre maximum de jetons interrégionaux globaux que vous pouvez soumettre pour inférence de modèle en une journée pour Anthropic Claude Opus 4.6 V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par jour pour Anthropic Claude Opus 4.7 | Chaque région prise en charge : 14 400 000 000 | Non | Le nombre maximum de jetons mondiaux interrégionaux que vous pouvez soumettre pour inférence de modèle en une journée pour Anthropic Claude Opus 4.7. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par jour pour Anthropic Claude Opus 4.8 | Chaque région prise en charge : 43 200 000 000 | Non | Le nombre maximum de jetons mondiaux interrégionaux que vous pouvez soumettre pour inférence de modèle en une journée pour Anthropic Claude Opus 4.8. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par jour pour Anthropic Claude Opus 5 | Chaque région prise en charge : 43 200 000 000 | Non | Le nombre maximum de jetons mondiaux interrégionaux que vous pouvez soumettre pour inférence de modèle en une journée pour Anthropic Claude Opus 5. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par jour pour Anthropic Claude Sonnet 4 V1 | Chaque région prise en charge : 288 000 000 | Non | Le nombre maximum de jetons interrégionaux globaux que vous pouvez soumettre pour inférence de modèle en une journée pour Anthropic Claude Sonnet 4 V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par jour pour Anthropic Claude Sonnet 4.5 V1 | Chaque région prise en charge : 7 200 000 000 | Non | Le nombre maximum de jetons interrégionaux globaux que vous pouvez soumettre pour inférence de modèle en une journée pour Anthropic Claude Sonnet 4.5 V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par jour pour Anthropic Claude Sonnet 4.5 V1 1M de longueur de contexte | Chaque région prise en charge : 1 440 000 000 | Non | Le nombre maximum de jetons interrégionaux globaux que vous pouvez soumettre pour inférence de modèle en une journée pour Anthropic Claude Sonnet 4.5 V1 1M Context Length. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par jour pour Anthropic Claude Sonnet 4.6 | Chaque région prise en charge : 8 640 000 000 | Non | Le nombre maximum de jetons mondiaux interrégionaux que vous pouvez soumettre pour inférence de modèle en une journée pour Anthropic Claude Sonnet 4.6. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par jour pour Anthropic Claude Sonnet 5 | Chaque région prise en charge : 8 640 000 000 | Non | Le nombre maximum de jetons mondiaux interrégionaux que vous pouvez soumettre pour inférence de modèle en une journée pour Anthropic Claude Sonnet 5. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par jour pour Cohere Embed V4 | Chaque région prise en charge : 432 000 000 | Non | Le nombre maximum de jetons interrégionaux globaux que vous pouvez soumettre pour inférence de modèle en une journée pour Cohere Embed V4. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par minute pour Amazon Nova 2 Lite | Chaque région prise en charge : 8 000 000 | Oui |
Le nombre maximum de jetons interrégionaux globaux que vous pouvez soumettre pour inférence de modèle en une minute pour Amazon Nova 2 Lite. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par minute pour Amazon Nova 2 Omni | Chaque région prise en charge : 8 000 000 | Oui |
Le nombre maximum de jetons interrégionaux globaux que vous pouvez soumettre pour inférence de modèle en une minute pour Amazon Nova 2 Omni. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par minute pour Amazon Nova 2 Pro Preview | Chaque Région prise en charge : 1 000 000 | Oui |
Le nombre maximum de jetons interrégionaux globaux que vous pouvez soumettre pour inférence de modèle en une minute pour Amazon Nova 2 Pro Preview. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par minute pour Anthropic Claude Fable 5 | Chaque région prise en charge : 4 000 000 | Oui |
Le nombre maximum de jetons interrégionaux globaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Fable 5. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence du modèle interrégional mondial par minute pour Anthropic Claude Haiku 4.5 | Chaque région prise en charge : 5 000 000 | Oui |
Le nombre maximum de jetons interrégionaux globaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Haiku 4.5. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par minute pour Anthropic Claude Opus 4.5 | Chaque région prise en charge : 2 000 000 | Oui |
Le nombre maximum de jetons interrégionaux globaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Opus 4.5. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par minute pour Anthropic Claude Opus 4.6 V1 | Chaque région prise en charge : 3 000 000 | Oui |
Le nombre maximum de jetons interrégionaux globaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Opus 4.6 V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par minute pour Anthropic Claude Opus 4.7 | Chaque région prise en charge : 10 000 000 | Oui |
Le nombre maximum de jetons interrégionaux globaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Opus 4.7. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par minute pour Anthropic Claude Opus 4.8 | Chaque région prise en charge : 30 000 000 | Oui |
Le nombre maximum de jetons mondiaux interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Opus 4.8. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par minute pour Anthropic Claude Opus 5 | Chaque région prise en charge : 30 000 000 | Oui |
Le nombre maximum de jetons mondiaux interrégionaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Opus 5. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par minute pour Anthropic Claude Sonnet 4 V1 | Chaque région prise en charge : 200 000 | Oui |
Le nombre maximum de jetons interrégionaux globaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Sonnet 4 V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par minute pour Anthropic Claude Sonnet 4.5 V1 | Chaque région prise en charge : 5 000 000 | Oui |
Le nombre maximum de jetons interrégionaux globaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Sonnet 4.5 V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par minute pour Anthropic Claude Sonnet 4.5 V1 1M de longueur de contexte | Chaque Région prise en charge : 1 000 000 | Oui |
Le nombre maximum de jetons interrégionaux globaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Sonnet 4.5 V1 1M Context Length. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence du modèle interrégional mondial par minute pour Anthropic Claude Sonnet 4.6 | Chaque région prise en charge : 6 000 000 | Oui |
Le nombre maximum de jetons interrégionaux globaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Sonnet 4.6. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence du modèle interrégional mondial par minute pour Anthropic Claude Sonnet 5 | Chaque région prise en charge : 6 000 000 | Oui |
Le nombre maximum de jetons interrégionaux globaux que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Sonnet 5. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Jetons d'inférence de modèles interrégionaux mondiaux par minute pour Cohere Embed V4 | Chaque région prise en charge : 300 000 | Oui |
Le nombre maximum de jetons interrégionaux globaux que vous pouvez soumettre pour inférence de modèle en une minute pour Cohere Embed V4. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Modèles importés par compte | Chaque région prise en charge : 3 | Oui |
Le nombre maximum de modèles importés par compte. |
| Profils d'inférence par compte | Chaque Région prise en charge : 1 000 | Oui |
Le nombre maximum de profils d'inférence dans un compte. |
| ListAgentActionGroups demandes par seconde | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes d' ListAgentActionGroups API par seconde. |
| ListAgentAliases demandes par seconde | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes d' ListAgentAliases API par seconde. |
| ListAgentKnowledgeBases demandes par seconde | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes d' ListAgentKnowledgeBases API par seconde. |
| ListAgentVersions demandes par seconde | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes d' ListAgentVersions API par seconde. |
| ListAgents demandes par seconde | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes d' ListAgents API par seconde. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Amazon Nova 2 Multimodal Embeddings V1 | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Amazon Nova 2 Multimodal Embeddings V1. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Amazon Nova Premier | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Amazon Nova Premier. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Claude 3 Haiku | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude 3 Haiku. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Claude 3 Opus | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude 3 Opus. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Claude 3 Sonnet | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude 3 Sonnet. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Claude 3.5 Haiku | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude 3.5 Haiku. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Claude 3.5 Sonnet | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude 3.5 Sonnet. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Claude 3.5 Sonnet v2 | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude 3.5 Sonnet v2. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Claude 3.7 Sonnet | Chaque région prise en charge : 100 | Oui |
Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude 3.7 Sonnet. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Claude Haiku 4.5 | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude Haiku 4.5. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Claude Opus 4.5 | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude Opus 4.5. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Claude Opus 4.6 | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude Opus 4.6. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Claude Opus 5 | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude Opus 5. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Claude Sonnet 4 | Chaque région prise en charge : 100 | Oui |
Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude Sonnet 4. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Claude Sonnet 4.5. | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude Sonnet 4.5. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Claude Sonnet 4.6 | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude Sonnet 4.6. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour DeepSeek V3.2 | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour DeepSeek V3.2. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour la v3 DeepSeek | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour la DeepSeek version 3. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Devstral 2 123B | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Devstral 2 123B. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour GLM 4.7 | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour GLM 4.7. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour GLM 4.7 Flash | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour GLM 4.7 Flash. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour GLM 5 | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour GLM 5. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Gemma 3 12B | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Gemma 3 12B. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Gemma 3 27B | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Gemma 3 27B. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Gemma 3 4B | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Gemma 3 4B. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Kimi K2 Thinking | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Kimi K2 Thinking. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Kimi K2.5 | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Kimi K2.5. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Llama 3.1 405B Instruct | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Llama 3.1 405B Instruct. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Llama 3.1 70B Instruct | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Llama 3.1 70B Instruct. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Llama 3.1 8B Instruct | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Llama 3.1 8B Instruct. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Llama 3.2 11B Instruct | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Llama 3.2 11B Instruct. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Llama 3.2 1B Instruct | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots Llama 3.2 1B Instruct. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Llama 3.2 3B Instruct | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Llama 3.2 3B Instruct. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Llama 3.2 90B Instruct | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Llama 3.2 90B Instruct. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Llama 3.3 70B Instruct | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Llama 3.3 70B Instruct. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Llama 4 Maverick | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Llama 4 Maverick. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Llama 4 Scout | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Llama 4 Scout. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Magistral Small 2509 | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Magistral Small 2509. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour M2 MiniMax | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour MiniMax M2. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour MiniMax M2.1 | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour MiniMax M2.1. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour MiniMax M2.5 | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour MiniMax M2.5. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Ministral 3 14B | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Ministral 3 14B. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Ministral 3 8B | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Ministral 3 8B. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Ministral 3B | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Ministral 3B. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Mistral Large 2 (24.07) | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Mistral Large 2 (24.07). |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Mistral Large 3 | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Mistral Large 3. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Mistral Small | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Mistral Small. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour NVIDIA Nemotron 3 Super 120B A12B | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour NVIDIA Nemotron 3 Super 120B A12B. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour NVIDIA Nemotron Nano 12B | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour NVIDIA Nemotron Nano 12B. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour NVIDIA Nemotron Nano 3 30B | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour NVIDIA Nemotron Nano 3 30B. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour NVIDIA Nemotron Nano 9B | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour NVIDIA Nemotron Nano 9B. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Nova 2 Lite | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Nova 2 Lite. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Nova Lite V1 | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Nova Lite V1. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Nova Micro V1 | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Nova Micro V1. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Nova Pro V1 | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Nova Pro V1. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour OpenAI GPT OSS 120b | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour OpenAI GPT OSS 120b. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour OpenAI GPT OSS 20b | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour OpenAI GPT OSS 20b. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour OpenAI GPT OSS Safeguard 120b | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour OpenAI GPT OSS Safeguard 120b. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour OpenAI GPT OSS Safeguard 20b | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour OpenAI GPT OSS Safeguard 20b. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Qwen3 235B | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Qwen3 235B. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Qwen3 32B | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Qwen3 32B. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Qwen3 Coder 30B | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Qwen3 Coder 30B. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Qwen3 Coder 480B | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Qwen3 Coder 480B. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Qwen3 Coder Next | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Qwen3 Coder Next. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Qwen3 Next 80B | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Qwen3 Next 80B. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Qwen3 VL 235B | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Qwen3 VL 235B. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Titan Multimodal Embeddings G1 | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Titan Multimodal Embeddings G1. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Titan Text Embeddings V2 | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Titan Text Embeddings V2. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Voxtral Mini 3B 2507 | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Voxtral Mini 3B 2507. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Voxtral Small 24B 2507 | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Voxtral Small 24B 2507. |
| Nombre minimum d'enregistrements par tâche d'inférence par lots pour Writer Palmyra Vision 7B | Chaque région prise en charge : 100 | Non | Le nombre minimum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Writer Palmyra Vision 7B. |
| Nombre maximal de jetons optimisés en termes de latence invoqués par jour pour Amazon Nova Pro V1 | Chaque région prise en charge : 57 600 000 | Non | Le nombre maximum de jetons que vous pouvez soumettre pour une inférence de modèle optimisée en termes de latence en une journée pour Amazon Nova Pro V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Nombre maximum de jetons d'invocation du modèle par jour pour AI21 Labs Jamba 1.5 Large (doublé pour les appels interrégionaux) | Chaque région prise en charge : 432 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour AI21 Labs Jamba 1.5 Large. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour AI21 Labs Jamba 1.5 Mini (doublé pour les appels interrégionaux) | Chaque région prise en charge : 432 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour AI21 Labs Jamba 1.5 Mini. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Amazon Nova 2 Lite (doublé pour les appels interrégionaux) | Chaque région prise en charge : 5 760 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Amazon Nova 2 Lite. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Amazon Nova 2 Omni (doublé pour les appels interrégionaux) | Chaque région prise en charge : 5 760 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Amazon Nova 2 Omni. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Amazon Nova 2 Pro Preview (doublé pour les appels interrégionaux) | Chaque région prise en charge : 720 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Amazon Nova 2 Pro Preview. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Amazon Nova Lite (doublé pour les appels interrégionaux) | Chaque région prise en charge : 5 760 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Amazon Nova Lite. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'appel du modèle par jour pour Amazon Nova Micro (doublé pour les appels interrégionaux) | Chaque région prise en charge : 5 760 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Amazon Nova Micro. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Amazon Nova Premier V1 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 1 440 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Amazon Nova Premier V1. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Amazon Nova Pro (doublé pour les appels interrégionaux) | Chaque région prise en charge : 1 440 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Amazon Nova Pro. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Anthropic Claude 3 Haiku (doublé pour les appels interrégionaux) |
États-Unis-est-1 : 2 880 000 000 États-Unis-ouest-2 : 2 880 000 000 ap-nord-est-1 : 288 000 000 ap-sud-est-1 : 288 000 000 Chacune des autres régions prises en charge : 432 000 000 |
Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Anthropic Claude 3 Haiku. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Anthropic Claude 3.5 Haiku (doublé pour les appels interrégionaux) | Chaque région prise en charge : 2 880 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Anthropic Claude 3.5 Haiku. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Anthropic Claude 3.5 Sonnet V1 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 2 880 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Anthropic Claude 3.5 Sonnet V1. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Anthropic Claude 3.5 Sonnet V2 (doublé pour les appels interrégionaux) |
États-Unis-est-1 : 2 880 000 000 États-Unis-ouest-2 : 2 880 000 000 Chacune des autres régions prises en charge : 576 000 000 |
Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Anthropic Claude 3.5 Sonnet V2. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Anthropic Claude 3.7 Sonnet V1 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 720 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Anthropic Claude 3.7 Sonnet V1. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Anthropic Claude Fable 5 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 2 880 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Anthropic Claude Fable 5. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Anthropic Claude Haiku 4.5 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 3 600 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Anthropic Claude Haiku 4.5. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Anthropic Claude Opus 4 V1 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Anthropic Claude Opus 4 V1. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Anthropic Claude Opus 4.1 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 360 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Anthropic Claude Opus 4.1. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Anthropic Claude Opus 4.5 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 1 440 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Anthropic Claude Opus 4.5. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Anthropic Claude Opus 4.6 V1 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 2 160 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Anthropic Claude Opus 4.6 V1. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Anthropic Claude Opus 4.7 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 7 200 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Anthropic Claude Opus 4.7. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Anthropic Claude Opus 4.8 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 21 600 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Anthropic Claude Opus 4.8. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de points d'invocation du modèle par jour pour Anthropic Claude Opus 5 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 21 600 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Anthropic Claude Opus 5. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Anthropic Claude Sonnet 4 V1 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Anthropic Claude Sonnet 4 V1. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Anthropic Claude Sonnet 4 V1 1M Context Length (doublé pour les appels interrégionaux) | Chaque région prise en charge : 720 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèle pour la longueur de contexte anthropique Claude Sonnet 4 V1 1M. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Anthropic Claude Sonnet 4.5 V1 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 3 600 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Anthropic Claude Sonnet 4.5 V1. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Anthropic Claude Sonnet 4.5 V1 1M Context Length (doublé pour les appels interrégionaux) | Chaque région prise en charge : 720 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèle pour la longueur de contexte anthropique Claude Sonnet 4.5 V1 1M. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Anthropic Claude Sonnet 4.6 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 4 320 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Anthropic Claude Sonnet 4.6. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de points d'invocation du modèle par jour pour Anthropic Claude Sonnet 5 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 4 320 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Anthropic Claude Sonnet 5. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Cohere Embed V4 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 216 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Cohere Embed V4. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour DeepSeek R1 V1 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèle pour DeepSeek R1 V1. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour la DeepSeek V3 V1 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèle pour la DeepSeek V3 V1. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour DeepSeek V3.2 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour DeepSeek V3.2. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour GPT OSS Safeguard 120B (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour GPT OSS Safeguard 120B. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour GPT OSS Safeguard 20B (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour GPT OSS Safeguard 20B. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Gemma 3 12B (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence du modèle pour Gemma 3 12B. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Gemma 3 27B (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence du modèle pour Gemma 3 27B. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Gemma 3 4B (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence du modèle pour Gemma 3 4B. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Kimi K2 Thinking (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Kimi K2 Thinking. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Magistral Small 1.2 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Magistral Small 1.2. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Meta Llama 3.2 11B Instruct (doublé pour les appels interrégionaux) | Chaque région prise en charge : 432 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Meta Llama 3.2 11B Instruct. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Meta Llama 3.2 1B Instruct (doublé pour les appels interrégionaux) | Chaque région prise en charge : 432 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Meta Llama 3.2 1B Instruct. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Meta Llama 3.2 3B Instruct (doublé pour les appels interrégionaux) | Chaque région prise en charge : 432 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Meta Llama 3.2 3B Instruct. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Meta Llama 3.2 90B Instruct (doublé pour les appels interrégionaux) | Chaque région prise en charge : 432 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Meta Llama 3.2 90B Instruct. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Meta Llama 4 Maverick V1 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 432 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Meta Llama 4 Maverick V1. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Meta Llama 4 Scout V1 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 432 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Meta Llama 4 Scout V1. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons invoqués par jour pour le modèle MiniMax M2.5 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour MiniMax M2.5. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Minimax M2 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèle pour Minimax M2. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Minimax M2.1 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour M2.1 Minimax. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Ministral 14B 3.0 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Ministral 14B 3.0. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Ministral 3B 3.0 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Ministral 3B 3.0. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Ministral 8B 3.0 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Ministral 8B 3.0. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Mistral AI Mistral 7B Instruct (doublé pour les appels interrégionaux) | Chaque région prise en charge : 432 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Mistral AI Mistral 7B Instruct. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Mistral AI Mistral Large (doublé pour les appels interrégionaux) | Chaque région prise en charge : 432 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Mistral AI Mistral Large. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Mistral AI Mistral Small (doublé pour les appels interrégionaux) | Chaque région prise en charge : 432 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Mistral AI Mistral Small. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Mistral AI Mixtral 8X7B Instruct (doublé pour les appels interrégionaux) | Chaque région prise en charge : 432 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Mistral AI Mixtral 8X7B Instruct. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Mistral Devstral 2 123b (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Mistral Devstral 2 123b. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Mistral Large 3 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Mistral Large 3. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Mistral Pixtral Large 25.02 V1 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 57 600 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Mistral Pixtral Large 25.02 V1. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Moonshot AI Kimi K2.5 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Moonshot AI Kimi. K2.5 Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour NVIDIA Nemotron 3 Super 120B A12B (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèle pour NVIDIA Nemotron 3 Super 120B A12B. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour NVIDIA Nemotron Nano 2 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour NVIDIA Nemotron Nano 2. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour NVIDIA Nemotron Nano 2 VL (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour NVIDIA Nemotron Nano 2 VL. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Nemotron Nano 3 30B (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèle pour Nemotron Nano 3 30B. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour OpenAI GPT OSS 120B (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour OpenAI GPT OSS 120B. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour OpenAI GPT OSS 20B (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour OpenAI GPT OSS 20B. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Qwen3 235B a22b 2507 V1 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèle pour Qwen3 235B a22b 2507 V1. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Qwen3 32B V1 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèle pour Qwen3 32B V1. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Qwen3 Coder 30B a3b V1 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèle pour Qwen3 Coder 30B a3b V1. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Qwen3 Coder 480B a35b V1 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèle pour Qwen3 Coder 480B a35b V1. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Qwen3 Coder Next (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Qwen3 Coder Next. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Qwen3 Next 80B A3B (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèle pour Qwen3 Next 80B A3B. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Qwen3 VL 235B A22B (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèle pour Qwen3 VL 235B A22B. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Voxtral Mini 1.0 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Voxtral Mini 1.0. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Voxtral Small 1.0 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Voxtral Small 1.0. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Writer AI Palmyra X4 V1 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 108 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Writer AI Palmyra X4 V1. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Writer AI Palmyra X5 V1 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 108 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Writer AI Palmyra X5 V1. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Writer Palmyra Vision 7B (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Writer Palmyra Vision 7B. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Z.ai GLM 5 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Z.ai GLM 5. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Z.ai GLM-4.7 (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Z.ai GLM-4.7. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Nombre maximum de jetons d'invocation du modèle par jour pour Z.ai GLM-4.7 Flash (doublé pour les appels interrégionaux) | Chaque région prise en charge : 144 000 000 000 | Non | Nombre maximum de jetons quotidiens pour l'inférence de modèles pour Z.ai GLM-4.7 Flash. Combine la somme des jetons d'entrée et de sortie de toutes les requêtes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. Doublé pour les appels interrégionaux ; non applicable en cas d'augmentation du TPM approuvée. |
| Unités modèles : Débits provisionnés sans engagement sur tous les modèles de base | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle pouvant être distribuées sur des débits provisionnés sans engagement pour les modèles de base |
| Unités modélisées : débits provisionnés sans engagement sur des modèles personnalisés | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle pouvant être distribuées sur des débits provisionnés sans engagement pour les modèles personnalisés |
| Unités modèles par modèle provisionné pour AI21 Labs Mid Jurassic-2 | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour AI21 Labs Mid. Jurassic-2 |
| Unités modèles par modèle provisionné pour AI21 Labs Ultra Jurassic-2 | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour AI21 Labs Ultra. Jurassic-2 |
| Unités modèles par modèle provisionné pour Amazon Nova 2 Lite 256K V1.0 | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour Amazon Nova 2 Lite V1.0 256K. |
| Unités du modèle par modèle provisionné pour Amazon Nova Canvas | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Amazon Nova Canvas. |
| Unités de modèle par modèle provisionné pour Amazon Titan Embeddings G1 - Texte | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour Amazon Titan Embeddings G1 - Text. |
| Unités de modèle par modèle provisionné pour Amazon Titan Image Generator G1 | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour Amazon Titan Image Generator G1. |
| Unités de modèle par modèle provisionné pour Amazon Titan Image Generator G2 | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour Amazon Titan Image Generator G2. |
| Unités modèles par modèle provisionné pour Amazon Titan Lite V1 4K | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour Amazon Titan Text Lite V1 4K. |
| Unités modèles par modèle provisionné pour Amazon Titan Multimodal Embeddings G1 | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour Amazon Titan Multimodal Embeddings G1. |
| Unités de modèle par modèle provisionné pour Amazon Titan Text Embeddings V2 | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour Amazon Titan Text Embeddings V2. |
| Unités de modèle par modèle provisionné pour Amazon Titan Text G1 - Express 8K | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour Amazon Titan Text G1 - Express 8K. |
| Unités de modèle par modèle provisionné pour Amazon Titan Text Premier V1 32K | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour Amazon Titan Text Premier V1 32K. |
| Unités modèles par modèle approvisionné pour Anthropic Claude 3 Haiku 200K | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Anthropic Claude 3 Haiku 200K. |
| Unités modèles par modèle approvisionné pour Anthropic Claude 3 Haiku 48K | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Anthropic Claude 3 Haiku 48K. |
| Unités modèles par modèle approvisionné pour Anthropic Claude 3 Sonnet 200K | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour Anthropic Claude 3 Sonnet 200K. |
| Unités modèles par modèle approvisionné pour Anthropic Claude 3 Sonnet 28K | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour Anthropic Claude 3 Sonnet 28K. |
| Unités modèles par modèle approvisionné pour Anthropic Claude 3.5 Haiku 16K | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Anthropic Claude 3.5 Haiku 16K. |
| Unités modèles par modèle approvisionné pour Anthropic Claude 3.5 Haiku 200K | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Anthropic Claude 3.5 Haiku 200K. |
| Unités modèles par modèle approvisionné pour Anthropic Claude 3.5 Haiku 64K | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Anthropic Claude 3.5 Haiku 64K. |
| Unités modèles par modèle approvisionné pour Anthropic Claude 3.5 Sonnet 18K | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour Anthropic Claude 3.5 Sonnet 18K. |
| Unités modèles par modèle approvisionné pour Anthropic Claude 3.5 Sonnet 200K | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Anthropic Claude 3.5 Sonnet 200K. |
| Unités modèles par modèle approvisionné pour Anthropic Claude 3.5 Sonnet 51K | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour Anthropic Claude 3.5 Sonnet 51K. |
| Unités modèles par modèle approvisionné pour Anthropic Claude 3.5 Sonnet V2 18K | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour Anthropic Claude 3.5 Sonnet V2 18K. |
| Unités modèles par modèle approvisionné pour Anthropic Claude 3.5 Sonnet V2 200K | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour Anthropic Claude 3.5 Sonnet V2 200K. |
| Unités modèles par modèle approvisionné pour Anthropic Claude 3.5 Sonnet V2 51K | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour Anthropic Claude 3.5 Sonnet V2 51K. |
| Unités modèles par modèle approvisionné pour Anthropic Claude 3.7 V1.0 Sonnet 18K | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour Anthropic Claude 3.7 V1.0 Sonnet 18K. |
| Unités modèles par modèle approvisionné pour Anthropic Claude 3.7 V1.0 Sonnet 200K | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour Anthropic Claude 3.7 V1.0 Sonnet 200K. |
| Unités modèles par modèle approvisionné pour Anthropic Claude 3.7 V1.0 Sonnet 51K | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour Anthropic Claude 3.7 V1.0 Sonnet 51K. |
| Unités modèles par modèle approvisionné pour Anthropic Claude Instant V1 100K | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour Anthropic Claude Instant V1 100K. |
| Unités modèles par modèle approvisionné pour Anthropic Claude V2 100K | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Anthropic Claude V2 100K. |
| Unités modèles par modèle approvisionné pour Anthropic Claude V2 18K | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Anthropic Claude V2 18K. |
| Unités modèles par modèle approvisionné pour Anthropic Claude 18K V2.1 | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Anthropic Claude 18K. V2.1 |
| Unités modèles par modèle approvisionné pour Anthropic Claude 200K V2.1 | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Anthropic Claude 200K. V2.1 |
| Unités modèles par modèle provisionné pour Cohere Command | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Cohere Command. |
| Unités modèles par modèle approvisionné pour Cohere Command Light | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle approvisionné pour Cohere Command Light. |
| Unités modèles par modèle provisionné pour Cohere Command R | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour Cohere Command R 128k. |
| Unités modèles par modèle provisionné pour Cohere Command R Plus | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour Cohere Command R Plus 128k. |
| Unités modèles par modèle provisionné pour Cohere Embed English | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Cohere Embed English. |
| Unités de modèle par modèle provisionné pour Cohere Embed Multilingual | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Cohere Embed Multilingual. |
| Unités modèles par modèle approvisionné pour Meta Llama 2 13B | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Meta Llama 2 13B. |
| Unités modèles par modèle approvisionné pour Meta Llama 2 70B | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Meta Llama 2 70B. |
| Unités modèles par modèle provisionné pour Meta Llama 2 Chat 13B | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Meta Llama 2 Chat 13B. |
| Unités modèles par modèle approvisionné pour Meta Llama 2 Chat 70B | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Meta Llama 2 Chat 70B. |
| Unités modèles par modèle approvisionné pour Meta Llama 3 70B Instruct | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Meta Llama 3 70B Instruct. |
| Unités modèles par modèle approvisionné pour Meta Llama 3 8B Instruct | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Meta Llama 3 8B Instruct. |
| Unités modèles par modèle approvisionné pour Meta Llama 3.1 70B Instruct | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Meta Llama 3.1 70B Instruct. |
| Unités modèles par modèle provisionné pour Meta Llama 3.1 8B Instruct | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Meta Llama 3.1 8B Instruct. |
| Unités modèles par modèle approvisionné pour Meta Llama 3.2 11B Instruct | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Meta Llama 3.2 11B Instruct. |
| Unités modèles par modèle approvisionné pour Meta Llama 3.2 1B Instruct | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Meta Llama 3.2 1B Instruct. |
| Unités modèles par modèle approvisionné pour Meta Llama 3.2 3B Instruct | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Meta Llama 3.2 3B Instruct. |
| Unités modèles par modèle approvisionné pour Meta Llama 3.2 90B Instruct | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Meta Llama 3.2 90B Instruct. |
| Unités modèles par modèle approvisionné pour Mistral Large 2407 | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Mistral Large 2407. |
| Unités modèles par modèle approvisionné pour Mistral Small | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Mistral Small. |
| Unités modèles par modèle provisionné pour Stability.ai Stable Diffusion XL 0.8 | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour Stability.ai Stable Diffusion XL 0.8 |
| Unités modèles par modèle provisionné pour Stability.ai Stable Diffusion XL 1.0 | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour Stability.ai Stable Diffusion XL 1.0. |
| Unités de modèle par modèle provisionné pour la variante de longueur de contexte de 128 000 pour Amazon Nova Micro | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour la variante de longueur de contexte de 128 000 pour Amazon Nova Micro |
| Unités de modèle par modèle provisionné pour la variante de longueur de contexte de 24 000 pour Amazon Nova Lite | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour la variante de longueur de contexte de 24 000 pour Amazon Nova Lite |
| Unités de modèle par modèle provisionné pour la variante de longueur de contexte de 24 000 caractères pour Amazon Nova Micro | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour la variante de longueur de contexte de 24 000 pour Amazon Nova Micro |
| Unités de modèle par modèle provisionné pour la variante de longueur de contexte 24 000 pour Amazon Nova Pro | Chaque région prise en charge : 0 | Oui |
Le nombre maximum d'unités de modèle qui peuvent être attribuées à un modèle provisionné pour la variante de longueur de contexte de 24 000 pour Amazon Nova Pro |
| Unités de modèle par modèle provisionné pour la variante de longueur de contexte de 300 000 pour Amazon Nova Lite | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour la variante de longueur de contexte de 300 000 pour Amazon Nova Lite |
| Unités de modèle par modèle provisionné pour la variante de longueur de contexte de 300 000 pour Amazon Nova Pro | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être attribuées à un modèle provisionné pour la variante de longueur de contexte de 300 000 pour Amazon Nova Pro. |
| Unités modèles, avec engagement, pour Provisioned Through créées pour Meta Llama 4 Scout 17B Instruct 10M | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être allouées à un débit provisionné créé pour Meta Llama 4 Scout 17B Instruct 10M, avec engagement. |
| Unités modèles, avec engagement, pour Provisioned Through créées pour Meta Llama 4 Scout 17B Instruct 128K | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être allouées à un débit provisionné créé pour Meta Llama 4 Scout 17B Instruct 128K, avec engagement. |
| Unités modèles, avec engagement, pour Provisioned Through créées pour Meta Maverick 4 Scout 17B Instruct 128K | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être allouées à un débit provisionné créé pour Meta Llama 4 Maverick 17B Instruct 128K, avec engagement. |
| Unités modèles, avec engagement, pour Provisioned Through créées pour Meta Maverick 4 Scout 17B Instruct 1M | Chaque région prise en charge : 0 | Oui |
Nombre maximum d'unités de modèle pouvant être allouées à un débit provisionné créé pour Meta Llama 4 Maverick 17B Instruct 1M, avec engagement. |
| No-commitment unités modèles pour le débit provisionné créées pour le modèle de base Amazon Nova 2 Lite 256K V1.0 | Chaque région prise en charge : 0 | Non | Nombre maximum d'unités de modèle pouvant être allouées à un débit provisionné créé pour le modèle de base Amazon Nova 2 Lite V1.0 256 Ko, sans engagement |
| No-commitment unités modèles pour le débit provisionné créées pour le modèle personnalisé Amazon Nova 2 Lite 256K V1.0 | Chaque région prise en charge : 0 | Non | Nombre maximum d'unités de modèle pouvant être allouées à un débit provisionné créé pour le modèle personnalisé Amazon Nova 2 Lite V1.0 256K, sans engagement. |
| Nombre de routeurs rapides personnalisés par compte | Chaque région prise en charge : 500 | Non | Le nombre maximum de routeurs rapides personnalisés que vous pouvez créer par compte et par région. |
| On-Demand, demandes d'inférence de modèles optimisées en termes de latence par minute pour Amazon Nova Pro V1 | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes à la demande et optimisées en termes de latence que vous pouvez envoyer pour l'inférence de modèle en une minute pour Amazon Nova Pro V1. Le quota prend en compte la somme combinée de Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-Demand, demandes d'inférence de modèle optimisées en termes de latence par minute pour Meta Llama 3.1 405B Instruct | Chaque région prise en charge : 100 | Non | Le nombre maximum de requêtes à la demande et optimisées en termes de latence que vous pouvez soumettre pour l'inférence de modèle en une minute pour Meta Llama 3.1 405B Instruct. Le quota prend en compte la somme combinée de Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-Demand, demandes d'inférence de modèle optimisées en termes de latence par minute pour Meta Llama 3.1 70B Instruct | Chaque région prise en charge : 100 | Non | Le nombre maximum de requêtes à la demande et optimisées en termes de latence que vous pouvez soumettre pour l'inférence de modèle en une minute pour Meta Llama 3.1 70B Instruct. Le quota prend en compte la somme combinée de Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-Demand, jetons d'inférence de modèle optimisés en termes de latence par minute pour Amazon Nova Pro V1 | Chaque région prise en charge : 40 000 | Non | Nombre maximum de jetons à la demande et optimisés en termes de latence que vous pouvez soumettre pour inférence de modèle en une minute pour Amazon Nova Pro V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-Demand, jetons d'inférence de modèle optimisés en termes de latence par minute pour Meta Llama 3.1 405B Instruct | Chaque région prise en charge : 40 000 | Non | Le nombre maximum de jetons à la demande et optimisés pour la latence que vous pouvez soumettre pour inférence de modèle en une minute pour Meta Llama 3.1 405B Instruct. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-Demand, jetons d'inférence de modèle optimisés en termes de latence par minute pour Meta Llama 3.1 70B Instruct | Chaque région prise en charge : 40 000 | Non | Le nombre maximum de jetons à la demande et optimisés pour la latence que vous pouvez soumettre pour inférence de modèle en une minute pour Meta Llama 3.1 70B Instruct. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand InvokeModel requêtes simultanées asynchrones pour Amazon Nova 2 Multimodal Embeddings V1 | Chaque Région prise en charge : 30 | Non | Le nombre maximum de demandes d'inférence de modèles simultanés asynchrones que vous pouvez envoyer pour Amazon Nova 2 Multimodal Embeddings V1. Le quota prend en compte la somme combinée de Converse, ConverseStream InvokeModel, et InvokeModelWithResponseStream. |
| On-demand InvokeModel requêtes simultanées asynchrones pour TwelveLabs Marengo Embed 3.0 | Par région prise en charge : 10 | Oui |
Le nombre maximum de demandes d'inférence de modèles simultanés asynchrones que vous pouvez soumettre pour TwelveLabs Marengo Embed 3.0. Le quota prend en compte la somme combinée de Converse, ConverseStream InvokeModel, et InvokeModelWithResponseStream. |
| On-demand InvokeModel requêtes simultanées pour Amazon Nova 2 Sonic | Chaque Région prise en charge : 20 | Non | Le nombre maximum de demandes d'inférence de modèles simultanées que vous pouvez envoyer pour Amazon Nova 2 Sonic. Le quota prend en compte la somme combinée de Converse, ConverseStream InvokeModel, et InvokeModelWithResponseStream. |
| On-demand InvokeModel demandes simultanées pour Amazon Nova Reel1.0 | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes d'inférence de modèles simultanées que vous pouvez envoyer pour Amazon Nova Reel 1.0. Le quota prend en compte la somme combinée de Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand InvokeModel demandes simultanées pour Amazon Nova Reel1.1 | Chaque région prise en charge : 3 | Non | Le nombre maximum de demandes d'inférence de modèles simultanées que vous pouvez envoyer pour Amazon Nova Reel 1.1. Le quota prend en compte la somme combinée de Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand InvokeModel requêtes simultanées pour Amazon Nova Sonic | Chaque Région prise en charge : 20 | Non | Le nombre maximum de demandes simultanées que vous pouvez envoyer pour l'inférence de modèles pour Amazon Nova Sonic. |
| On-demand InvokeModel demandes simultanées pour Twelve Labs Marengo | Chaque Région prise en charge : 30 | Non | Le nombre maximum de InvokeModel demandes simultanées que vous pouvez soumettre pour l'inférence de modèles pour Twelve Labs Marengo. |
| On-demand InvokeModel demandes simultanées pour Twelve Labs Pegasus | Chaque Région prise en charge : 30 | Oui |
Le nombre maximum de InvokeModel demandes simultanées que vous pouvez soumettre pour l'inférence de modèles pour Twelve Labs Pegasus. |
| On-demand demandes d'inférence de modèle optimisées en termes de latence par minute pour Anthropic Claude 3.5 Haiku | Chaque région prise en charge : 100 | Non | Le nombre maximum de fois que vous pouvez appeler l'inférence de modèle en une minute. Le quota prend en compte la somme combinée de Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream pour Anthropic Claude 3.5 Haiku, si l'optimisation de la latence est configurée. |
| On-demand jetons d'inférence de modèle optimisés en termes de latence par minute pour Anthropic Claude 3.5 Haiku | Chaque région prise en charge : 500 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream pour Anthropic Claude 3.5 Haiku, si l'optimisation de la latence est configurée. |
| On-demand requêtes simultanées d'inférence de modèles pour Luma Ray V2 | Par région prise en charge : 1 | Non | Le nombre maximum de demandes simultanées que vous pouvez envoyer pour l'inférence de modèle pour Luma Ray V2. Le quota prend en compte la somme combinée de Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand demandes d'inférence de modèle par minute pour AI21 Labs Jamba 1.5 Large | Chaque région prise en charge : 100 | Non | Le nombre maximum de fois que vous pouvez appeler l'inférence de modèle en une minute pour AI21 Labs Jamba 1.5 Large. Le quota prend en compte la somme combinée des demandes pour Converse et InvokeModel |
| On-demand demandes d'inférence de modèle par minute pour AI21 Labs Jamba 1.5 Mini | Chaque région prise en charge : 100 | Non | Le nombre maximum de fois que vous pouvez appeler l'inférence de modèle en une minute pour AI21 Labs Jamba 1.5 Mini. Le quota prend en compte la somme combinée des demandes pour Converse et InvokeModel |
| On-demand demandes d'inférence de modèle par minute pour Amazon Nova 2 Multimodal Embeddings V1 | Chaque Région prise en charge : 2 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèle en une minute pour Amazon Nova 2 Multimodal Embeddings V1. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèles par minute pour Amazon Nova Canvas | Chaque région prise en charge : 100 | Non | Le nombre maximum de demandes que vous pouvez envoyer pour l'inférence de modèles en une minute pour Amazon Nova Canvas. Le quota prend en compte la somme combinée de Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand demandes d'inférence de modèles par minute pour Amazon Nova Lite |
États-Unis-est-1 : 2 000 UE-ouest-2 : 2 000 Chacune des autres régions prises en charge : 200 |
Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèle en une minute pour Amazon Nova Lite. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Amazon Nova Micro |
États-Unis-est-1 : 2 000 UE-ouest-2 : 2 000 Chacune des autres régions prises en charge : 200 |
Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèle en une minute pour Amazon Nova Micro. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèles par minute pour Amazon Nova Pro | Chaque région prise en charge : 250 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèle en une minute pour Amazon Nova Pro. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Amazon Rde 1.0 | Chaque région prise en charge : 200 | Non | Le nombre maximum de fois que vous pouvez appeler InvokeModel en une minute pour Amazon R 1.0. |
| On-demand demandes d'inférence de modèle par minute pour Amazon Titan Image Generator G1 | Chaque région prise en charge : 60 | Non | Le nombre maximum de fois que vous pouvez appeler Amazon Titan Image Generator G1 InvokeModel en une minute. |
| On-demand demandes d'inférence de modèle par minute pour Amazon Titan Image Generator G1 V2 | Chaque région prise en charge : 60 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèle en une minute pour Amazon Titan Image Generator G1 V2. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Amazon Titan Multimodal Embeddings G1 | Chaque Région prise en charge : 2 000 | Non | Le nombre maximum de fois que vous pouvez appeler InvokeModel en une minute pour Amazon Titan Multimodal Embeddings G1. |
| On-demand demandes d'inférence de modèles par minute pour Amazon Titan Text Embeddings | Chaque Région prise en charge : 2 000 | Non | Le nombre maximum de fois que vous pouvez appeler InvokeModel en une minute pour Amazon Titan Text Embeddings |
| On-demand demandes d'inférence de modèles par minute pour Amazon Titan Text Embeddings V2 | Chaque région prise en charge : 6 000 | Non | Le nombre maximum de fois que vous pouvez appeler InvokeModel en une minute pour Amazon Titan Text Embeddings V2 |
| On-demand demandes d'inférence de modèles par minute pour Amazon Titan Text Express | Chaque région prise en charge : 400 | Non | Le nombre maximum de fois que vous pouvez appeler l'inférence de modèle en une minute. Le quota prend en compte la somme combinée de Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream pour Amazon Titan Text Express |
| On-demand demandes d'inférence de modèles par minute pour Amazon Titan Text Premier | Chaque région prise en charge : 100 | Non | Le nombre maximum de fois que vous pouvez appeler l'inférence de modèle en une minute. Le quota prend en compte la somme combinée de Converse, ConverseStream, InvokeModel et InvokeModelWithResponseStream pour Amazon Titan Text Premier |
| On-demand demandes d'inférence de modèles par minute pour Anthropic Claude 3 Haiku |
États-Unis-est-1 : 1 000 États-Unis-Ouest-2 : 1 000 ap-nord-est-1 : 200 ap-sud-est-1 : 200 Chacune des autres régions prises en charge : 400 |
Non | Le nombre maximum de fois que vous pouvez appeler l'inférence de modèle en une minute. Le quota prend en compte la somme combinée de Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream pour Anthropic Claude 3 Haiku. |
| On-demand demandes d'inférence de modèles par minute pour Anthropic Claude 3 Opus | Chaque région prise en charge : 50 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèles en une minute pour Anthropic Claude 3 Opus. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèles par minute pour Anthropic Claude 3 Sonnet |
États-Unis-est-1 : 500 États-Unis-ouest-2 : 500 Chacune des autres régions prises en charge : 100 |
Non | Le nombre maximum de fois que vous pouvez appeler l'inférence de modèle en une minute. Le quota prend en compte la somme combinée de Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream pour Anthropic Claude 3 Sonnet. |
| On-demand demandes d'inférence de modèles par minute pour Anthropic Claude 3.5 Haiku |
États-Unis-ouest-1 : 400 Chacune des autres régions prises en charge : 1 000 |
Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèles en une minute pour Anthropic Claude 3.5 Haiku. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèles par minute pour Anthropic Claude 3.5 Sonnet |
États-Unis-ouest-2 : 250 ap-nord-est-1 : 20 ap-sud-est-1 : 20 eu-central-1 : 20 UE-Ouest-1 : 20 UE-Ouest-3 : 20 Chacune des autres régions prises en charge : 50 |
Non | Le nombre maximum de fois que vous pouvez appeler inférence de modèle en une minute pour Anthropic Claude 3.5 Sonnet. Le quota prend en compte la somme combinée de Converse, ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand demandes d'inférence de modèle par minute pour Anthropic Claude 3.5 Sonnet V2 |
États-Unis-ouest-2 : 250 Chacune des autres régions prises en charge : 50 |
Non | Le nombre maximum de fois que vous pouvez appeler l'inférence de modèle en une minute pour Anthropic Claude 3.5 Sonnet V2. Le quota prend en compte la somme combinée de Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand demandes d'inférence de modèle par minute pour Anthropic Claude 3.7 Sonnet V1 | Chaque région prise en charge : 125 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèles en une minute pour Anthropic Claude 3.7 Sonnet V1. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèles par minute pour Anthropic Claude Opus 4.6 V1 | Chaque région prise en charge : 5 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèles en une minute pour Anthropic Claude Opus 4.6 V1. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèles par minute pour Anthropic Claude Sonnet 4.6 | Chaque région prise en charge : 5 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèles en une minute pour Anthropic Claude Sonnet 4.6. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèles par minute pour Cohere Command R | Chaque région prise en charge : 400 | Non | Le nombre maximum de fois que vous pouvez appeler l'inférence de modèle en une minute. Le quota prend en compte la somme combinée de Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream pour Cohere Command R 128k. |
| On-demand demandes d'inférence de modèles par minute pour Cohere Command R Plus | Chaque région prise en charge : 400 | Non | Le nombre maximum de fois que vous pouvez appeler l'inférence de modèle en une minute. Le quota prend en compte la somme combinée de Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream pour Cohere Command R Plus 128k. |
| On-demand demandes d'inférence de modèles par minute pour Cohere Embed English | Chaque Région prise en charge : 2 000 | Non | Le nombre maximum de fois que vous pouvez appeler InvokeModel en une minute pour Cohere Embed English. |
| On-demand demandes d'inférence de modèles par minute pour Cohere Embed Multilingual | Chaque Région prise en charge : 2 000 | Non | Le nombre maximum de fois que vous pouvez appeler InvokeModel en une minute pour Cohere Embed Multilingual. |
| On-demand demandes d'inférence de modèle par minute pour Cohere Embed V4 | Chaque Région prise en charge : 1 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèle en une minute pour Cohere Embed V4. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Cohere Rde 3.5 | Chaque région prise en charge : 250 | Non | Le nombre maximum de fois que vous pouvez appeler InvokeModel en une minute pour Cohere Rde 3.5. |
| On-demand demandes d'inférence de modèle par minute pour DeepSeek V3 V1 | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèle en une minute pour la DeepSeek V3 V1. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèles par minute pour DeepSeek V3.2 | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèles en une minute. DeepSeek V3.2 Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour GPT OSS Safeguard 120B | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèle en une minute pour GPT OSS Safeguard 120B. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour GPT OSS Safeguard 20B | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèle en une minute pour GPT OSS Safeguard 20B. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Gemma 3 12B | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour Gemma 3 12B. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Gemma 3 27B | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour Gemma 3 27B. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Gemma 3 4B | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour Gemma 3 4B. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Kimi K2 Thinking | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèles en une minute pour Kimi K2 Thinking. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèles par minute pour Magistral Small 1.2 | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèles en une minute pour Magistral Small 1.2. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Meta Llama 3 70B Instruct | Chaque région prise en charge : 400 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour Meta Llama 3 70B Instruct. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Meta Llama 3 8B Instruct | Chaque région prise en charge : 800 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour Meta Llama 3 8B Instruct. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Meta Llama 3.1 405B Instruct | Chaque région prise en charge : 200 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour Meta Llama 3.1 405B Instruct. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Meta Llama 3.1 70B Instruct | Chaque région prise en charge : 400 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour Meta Llama 3.1 70B Instruct. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Meta Llama 3.1 8B Instruct | Chaque région prise en charge : 800 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour Meta Llama 3.1 8B Instruct. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Meta Llama 3.2 11B Instruct | Chaque région prise en charge : 400 | Non | Le nombre maximum de fois que vous pouvez appeler l'inférence de modèle en une minute pour Meta Llama 3.2 11B Instruct. Le quota prend en compte la somme combinée des demandes pour InvokeModel InvokeModelWithResponseStream,, Converse et ConverseStream. |
| On-demand demandes d'inférence de modèle par minute pour Meta Llama 3.2 1B Instruct | Chaque région prise en charge : 800 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour Meta Llama 3.2 1B Instruct. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Meta Llama 3.2 3B Instruct | Chaque région prise en charge : 800 | Non | Le nombre maximum de fois que vous pouvez appeler l'inférence de modèle en une minute pour Meta Llama 3.2 3B Instruct. Le quota prend en compte la somme combinée des demandes pour InvokeModel InvokeModelWithResponseStream,, Converse et ConverseStream. |
| On-demand demandes d'inférence de modèle par minute pour Meta Llama 3.2 90B Instruct | Chaque région prise en charge : 400 | Non | Le nombre maximum de fois que vous pouvez appeler l'inférence de modèle en une minute pour Meta Llama 3.2 90B Instruct. Le quota prend en compte la somme combinée des demandes pour InvokeModel InvokeModelWithResponseStream,, Converse et ConverseStream. |
| On-demand demandes d'inférence de modèle par minute pour Meta Llama 3.3 70B Instruct | Chaque région prise en charge : 400 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour Meta Llama 3.3 70B Instruct. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèles par minute pour MiniMax M2.5 | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèles en une minute. MiniMax M2.5 Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Minimax M2 | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour Minimax M2. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Minimax M2.1 | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèle en une minute pour M2.1 Minimax. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Ministral 14B 3.0 | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèles en une minute pour Ministral 14B 3.0. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Ministral 3B 3.0 | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèles en une minute pour Ministral 3B 3.0. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Ministral 8B 3.0 | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèles en une minute pour Ministral 8B 3.0. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèles par minute pour Mistral 7B Instruct | Chaque région prise en charge : 800 | Non | Le nombre maximum de fois que vous pouvez appeler InvokeModel en une minute pour Mistral mistral-7b-instruct-v0 |
| On-demand demandes d'inférence de modèles par minute pour Mistral AI Mistral Small | Chaque région prise en charge : 400 | Non | Le nombre maximum de fois que vous pouvez appeler InvokeModel et InvokeModelWithResponseStream en une minute pour Mistral AI Mistral Small |
| On-demand demandes d'inférence de modèle par minute pour Mistral Devstral 2 123b | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour Mistral Devstral 2 123b. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèles par minute pour Mistral Large | Chaque région prise en charge : 400 | Non | Le nombre maximum de fois que vous pouvez appeler InvokeModel et InvokeModelWithResponseStream en une minute pour Mistral mistral-large-2402-v1 |
| On-demand demandes d'inférence de modèle par minute pour Mistral Large 2407 | Chaque région prise en charge : 400 | Non | Le nombre maximum de fois que vous pouvez appeler l'inférence de modèle en une minute pour Mistral Large 2407. Le quota prend en compte la somme combinée des demandes pour InvokeModel, InvokeModelWithResponseStream, Converse et ConverseStream |
| On-demand demandes d'inférence de modèle par minute pour Mistral Large 3 | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèles en une minute pour Mistral Large 3. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Mistral Mixtral 8x7b Instruct | Chaque région prise en charge : 400 | Non | Le nombre maximum de fois que vous pouvez appeler InvokeModel en une minute pour Mistral mixtral-8x7b-v0 |
| On-demand demandes d'inférence de modèle par minute pour Moonshot AI Kimi K2.5 | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèles en une minute pour Moonshot AI Kimi. K2.5 Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour NVIDIA Nemotron 3 Super 120B A12B | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèle en une minute pour NVIDIA Nemotron 3 Super 120B A12B. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour NVIDIA Nemotron Nano 2 | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèle en une minute pour NVIDIA Nemotron Nano 2. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour NVIDIA Nemotron Nano 2 VL | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèle en une minute pour NVIDIA Nemotron Nano 2 VL. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Nemotron Nano 3 30B | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour Nemotron Nano 3 30B. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand requêtes d'inférence de modèle par minute pour OpenAI GPT OSS 120B | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour OpenAI GPT OSS 120B. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand requêtes d'inférence de modèle par minute pour OpenAI GPT OSS 20B | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour OpenAI GPT OSS 20B. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Qwen3 235B a22b 2507 V1 | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour Qwen3 235B a22b 2507 V1. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Qwen3 32B V1 | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour Qwen3 32B V1. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Qwen3 Coder 30B a3b V1 | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour Qwen3 Coder 30B a3b V1. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Qwen3 Coder 480B a35b V1 | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour Qwen3 Coder 480B a35b V1. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Qwen3 Coder Next | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèle en une minute pour Qwen3 Coder Next. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Qwen3 Next 80B A3B | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour Qwen3 Next 80B A3B. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Qwen3 VL 235B A22B | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour Qwen3 VL 235B A22B. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Stability.ai Stable Diffusion 3 Large | Chaque région prise en charge : 15 | Non | Le nombre maximum de fois que vous pouvez appeler InvokeModel en une minute pour Stability.ai Stable Diffusion 3 Large. |
| On-demand demandes d'inférence de modèle par minute pour Stability.ai Stable Diffusion 3 Medium | Chaque région prise en charge : 60 | Non | Le nombre maximum de fois que vous pouvez appeler InvokeModel en une minute pour Stability.ai Stable Diffusion 3 Medium |
| On-demand demandes d'inférence de modèle par minute pour Stability.ai Stable Diffusion 3.5 Large | Chaque région prise en charge : 15 | Non | Le nombre maximum de fois que vous pouvez appeler InvokeModel en une minute pour Stability.ai Stable Diffusion 3.5 Large. |
| On-demand demandes d'inférence de modèle par minute pour Stability.ai Stable Image Core | Chaque région prise en charge : 90 | Non | Le nombre maximum de fois que vous pouvez appeler Stability.ai Stable Image Core InvokeModel en une minute. |
| On-demand demandes d'inférence de modèle par minute pour Stability.ai Stable Image Ultra | Chaque Région prise en charge : 10 | Non | Le nombre maximum de fois que vous pouvez appeler InvokeModel en une minute pour Stability.ai Stable Image Ultra. |
| On-demand demandes d'inférence de modèle par minute pour Stable Image Conservative Upscale | Chaque région prise en charge : 2 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour Stable Image Conservative Upscale. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Stable Image Control Sketch | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèle en une minute pour Stable Image Control Sketch. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour une structure de contrôle d'image stable | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèle en une minute pour une structure de contrôle d'image stable. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Stable Image Creative Upscale | Chaque région prise en charge : 2 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèles en une minute pour Stable Image Creative Upscale. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour un objet d'effacement d'image stable | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèle en une minute pour un objet d'effacement d'image stable. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Stable Image Fast Upscale | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèle en une minute pour Stable Image Fast Upscale. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Stable Image Inpaint | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèle en une minute pour Stable Image Inpaint. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Stable Image Outpaint | Chaque région prise en charge : 2 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèle en une minute pour Stable Image Outpaint. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour une image stable Supprimer l'arrière-plan | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour Stable Image Remove Background. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour la recherche et la recoloration d'images stables | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour la recherche et la recolorisation d'images stables. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour la recherche et le remplacement d'images stables | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour la recherche et le remplacement d'images stables. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Stable Image Style Guide | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèle en une minute pour Stable Image Style Guide. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour un transfert de style d'image stable | Chaque Région prise en charge : 10 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèle en une minute pour le transfert de style d'image stable. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèles par minute pour Twelve Labs Marengo | Chaque région prise en charge : 100 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèles en une minute pour Twelve Labs Marengo. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèles par minute pour Twelve Labs Pegasus | Chaque région prise en charge : 60 | Oui |
Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèles en une minute pour Twelve Labs Pegasus. Le quota prend en compte la somme combinée de Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand requêtes d'inférence de modèle par minute pour TwelveLabs Marengo Embed 3.0 | Chaque région prise en charge : 500 | Oui |
Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèle en une minute pour TwelveLabs Marengo Embed 3.0. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Voxtral Mini 1.0 | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour Voxtral Mini 1.0. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Voxtral Small 1.0 | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour Voxtral Small 1.0. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèles par minute pour Writer Palmyra Vision 7B | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèles en une minute pour Writer Palmyra Vision 7B. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèle par minute pour Z.ai GLM 5 | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez soumettre pour l'inférence de modèle en une minute pour Z.ai GLM 5. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèles par minute pour Z.ai GLM-4.7 | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèles en une minute. Z.ai GLM-4.7 Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand demandes d'inférence de modèles par minute pour Flash Z.ai GLM-4.7 | Chaque région prise en charge : 10 000 | Non | Le nombre maximum de demandes à la demande que vous pouvez envoyer pour l'inférence de modèle en une minute pour Z.ai GLM-4.7 Flash. Ce quota représente le nombre total de demandes adressées à Converse, ConverseStream, InvokeModel et d' InvokeModelWithResponseStream actions. |
| On-demand jetons d'inférence de modèle par minute pour AI21 Labs Jamba 1.5 Large | Chaque région prise en charge : 300 000 | Non | Le nombre maximum de jetons que vous pouvez soumettre pour inférence de modèle en une minute pour AI21 Labs Jamba 1.5 Large. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse et InvokeModel. |
| On-demand jetons d'inférence de modèle par minute pour AI21 Labs Jamba 1.5 Mini | Chaque région prise en charge : 300 000 | Non | Le nombre maximum de jetons que vous pouvez soumettre pour inférence de modèle en une minute pour AI21 Labs Jamba 1.5 Mini. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse et InvokeModel. |
| On-demand jetons d'inférence de modèles par minute pour Amazon Nova Lite |
États-Unis-est-1 : 4 000 000 UE-Ouest-2 : 4 000 000 Chacune des autres régions prises en charge : 200 000 |
Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Amazon Nova Lite. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèles par minute pour Amazon Nova Micro |
États-Unis-est-1 : 4 000 000 UE-Ouest-2 : 4 000 000 Chacune des autres régions prises en charge : 200 000 |
Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Amazon Nova Micro. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèles par minute pour Amazon Nova Pro | Chaque région prise en charge : 1 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Amazon Nova Pro. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Amazon Titan Image Generator G1 V2 | Chaque Région prise en charge : 2 000 | Non | Nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Amazon Titan Image Generator G1 V2. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Amazon Titan Multimodal Embeddings G1 | Chaque région prise en charge : 300 000 | Non | Le nombre maximum de jetons que vous pouvez fournir InvokeModel en une minute pour Amazon Titan Multimodal Embeddings G1. |
| On-demand jetons d'inférence de modèles par minute pour Amazon Titan Text Embeddings | Chaque région prise en charge : 300 000 | Non | Le nombre maximum de jetons que vous pouvez fournir InvokeModel en une minute pour Amazon Titan Text Embeddings. |
| On-demand jetons d'inférence de modèles par minute pour Amazon Titan Text Embeddings V2 | Chaque région prise en charge : 300 000 | Non | Le nombre maximum de jetons que vous pouvez fournir InvokeModel en une minute pour Amazon Titan Text Embeddings V2. |
| On-demand jetons d'inférence de modèles par minute pour Amazon Titan Text Express | Chaque région prise en charge : 300 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie de toutes les demandes adressées à Converse InvokeModel et InvokeModelWithResponseStream à Amazon Titan Text Express. ConverseStream |
| On-demand jetons d'inférence de modèles par minute pour Amazon Titan Text Premier | Chaque région prise en charge : 300 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie de toutes les demandes adressées à Converse InvokeModel et InvokeModelWithResponseStream à Amazon Titan Text Premier. ConverseStream |
| On-demand modèle de jetons d'inférence par minute pour Anthropic Claude 3 Haiku |
États-Unis-est-1 : 2 000 000 États-Unis-Ouest-2 : 2 000 000 ap-nord-est-1 : 200 000 ap-sud-est 1 : 200 000 Chacune des autres régions prises en charge : 300 000 |
Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse InvokeModel et InvokeModelWithResponseStream pour Anthropic Claude 3 Haiku. ConverseStream |
| On-demand modèle de jetons d'inférence par minute pour Anthropic Claude 3 Opus | Chaque région prise en charge : 400 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude 3 Opus. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand modèle de jetons d'inférence par minute pour Anthropic Claude 3 Sonnet |
États-Unis-est-1 : 1 000 000 États-Unis-Ouest-2 : 1 000 000 Chacune des autres régions prises en charge : 200 000 |
Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse InvokeModel et InvokeModelWithResponseStream pour Anthropic Claude 3 Sonnet. ConverseStream |
| On-demand modèle de jetons d'inférence par minute pour Anthropic Claude 3.5 Haiku |
États-Unis-Ouest-1 : 300 000 Chacune des autres régions prises en charge : 2 000 000 |
Non | Nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude 3.5 Haiku. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand modèle de jetons d'inférence par minute pour Anthropic Claude 3.5 Sonnet |
États-Unis-Ouest-2 : 2 000 000 ap-nord-est-1 : 200 000 ap-sud-est 1 : 200 000 eu-central-1 : 200 000 UE-Ouest-1 : 200 000 UE-Ouest-3 : 200 000 Chacune des autres régions prises en charge : 400 000 |
Non | Le nombre maximum de jetons que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude 3.5 Sonnet. Le quota prend en compte la somme combinée de Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence du modèle par minute pour Anthropic Claude 3.5 Sonnet V2 |
États-Unis-Ouest-2 : 2 000 000 Chacune des autres régions prises en charge : 400 000 |
Non | Le nombre maximum de jetons que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude 3.5 Sonnet V2. Le quota prend en compte la somme combinée de Converse, ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence du modèle par minute pour Anthropic Claude 3.7 Sonnet V1 | Chaque région prise en charge : 500 000 | Non | Nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude 3.7 Sonnet V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence du modèle par minute pour Anthropic Claude Opus 4.6 V1 | Chaque région prise en charge : 1 500 000 | Non | Nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Opus 4.6 V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand modèle de jetons d'inférence par minute pour Anthropic Claude Sonnet 4.6 | Chaque région prise en charge : 3 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Anthropic Claude Sonnet 4.6. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Cohere Command R | Chaque région prise en charge : 300 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream pour Cohere Command R 128k. |
| On-demand jetons d'inférence de modèle par minute pour Cohere Command R Plus | Chaque région prise en charge : 300 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream pour Cohere Command R Plus 128k. |
| On-demand jetons d'inférence de modèle par minute pour Cohere Embed English | Chaque région prise en charge : 300 000 | Non | Le nombre maximum de jetons que vous pouvez fournir InvokeModel en une minute pour Cohere Embed English. |
| On-demand jetons d'inférence de modèles par minute pour Cohere Embed Multilingual | Chaque région prise en charge : 300 000 | Non | Le nombre maximum de jetons que vous pouvez fournir InvokeModel en une minute pour Cohere Embed Multilingual. |
| On-demand jetons d'inférence de modèle par minute pour Cohere Embed V4 | Chaque région prise en charge : 150 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Cohere Embed V4. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour DeepSeek V3 V1 | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour la DeepSeek V3 V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence du modèle par minute pour DeepSeek V3.2 | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre à des fins d'inférence de modèle en une minute. DeepSeek V3.2 Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour GPT OSS Safeguard 120B | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour GPT OSS Safeguard 120B. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour GPT OSS Safeguard 20B | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour GPT OSS Safeguard 20B. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Gemma 3 12B | Chaque région prise en charge : 100 000 000 | Non | Nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Gemma 3 12B. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Gemma 3 27B | Chaque région prise en charge : 100 000 000 | Non | Nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Gemma 3 27B. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Gemma 3 4B | Chaque région prise en charge : 100 000 000 | Non | Nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Gemma 3 4B. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Kimi K2 Thinking | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Kimi K2 Thinking. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence du modèle par minute pour Magistral Small 1.2 | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Magistral Small 1.2. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèles par minute pour Meta Llama 3 70B Instruct | Chaque région prise en charge : 300 000 | Non | Nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Meta Llama 3 70B Instruct. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèles par minute pour Meta Llama 3 8B Instruct | Chaque région prise en charge : 300 000 | Non | Nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Meta Llama 3 8B Instruct. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Meta Llama 3.1 405B Instruct | Chaque région prise en charge : 400 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Meta Llama 3.1 405B Instruct. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Meta Llama 3.1 70B Instruct | Chaque région prise en charge : 300 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Meta Llama 3.1 70B Instruct. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Meta Llama 3.1 8B Instruct | Chaque région prise en charge : 300 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Meta Llama 3.1 8B Instruct. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Meta Llama 3.2 11B Instruct | Chaque région prise en charge : 300 000 | Non | Le nombre maximum de jetons que vous pouvez soumettre pour inférence de modèle en une minute pour Meta Llama 3.2 11B Instruct. Le quota prend en compte la somme combinée des jetons pour InvokeModel InvokeModelWithResponseStream,, Converse et ConverseStream. |
| On-demand jetons d'inférence de modèle par minute pour Meta Llama 3.2 1B Instruct | Chaque région prise en charge : 300 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Meta Llama 3.2 1B Instruct. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Meta Llama 3.2 3B Instruct | Chaque région prise en charge : 300 000 | Non | Le nombre maximum de jetons que vous pouvez soumettre pour inférence de modèle en une minute pour Meta Llama 3.2 3B Instruct. Le quota prend en compte la somme combinée des jetons pour InvokeModel InvokeModelWithResponseStream,, Converse et ConverseStream. |
| On-demand jetons d'inférence de modèle par minute pour Meta Llama 3.2 90B Instruct | Chaque région prise en charge : 300 000 | Non | Le nombre maximum de jetons que vous pouvez soumettre pour inférence de modèle en une minute pour Meta Llama 3.2 90B Instruct. Le quota prend en compte la somme combinée des jetons pour InvokeModel InvokeModelWithResponseStream,, Converse et ConverseStream. |
| On-demand jetons d'inférence de modèle par minute pour Meta Llama 3.3 70B Instruct | Chaque région prise en charge : 300 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Meta Llama 3.3 70B Instruct. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence du modèle par minute pour MiniMax M2.5 | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre à des fins d'inférence de modèle en une minute. MiniMax M2.5 Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Minimax M2 | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Minimax M2. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèles par minute pour Minimax M2.1 | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour M2.1 Minimax. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Ministral 14B 3.0 | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Ministral 14B 3.0. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Ministral 3B 3.0 | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Ministral 3B 3.0. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Ministral 8B 3.0 | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Ministral 8B 3.0. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèles par minute pour Mistral AI Mistral 7B Instruct | Chaque région prise en charge : 300 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse InvokeModel et InvokeModelWithResponseStream pour Mistral AI Mistral 7B Instrut. ConverseStream |
| On-demand jetons d'inférence de modèles par minute pour Mistral AI Mistral Large | Chaque région prise en charge : 300 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse InvokeModel et InvokeModelWithResponseStream pour Mistral AI Mistral Large. ConverseStream |
| On-demand jetons d'inférence de modèles par minute pour Mistral AI Mistral Small | Chaque région prise en charge : 300 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse InvokeModel et InvokeModelWithResponseStream pour Mistral AI Mistral Small. ConverseStream |
| On-demand jetons d'inférence de modèles par minute pour Mistral AI Mixtral 8X7BB Instruct | Chaque région prise en charge : 300 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse InvokeModel et InvokeModelWithResponseStream pour Mistral AI Mixtral 8X7B Instrut. ConverseStream |
| On-demand jetons d'inférence de modèles par minute pour Mistral Devstral 2 123b | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Mistral Devstral 2 123b. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence du modèle par minute pour Mistral Large 2407 | Chaque région prise en charge : 300 000 | Non | Le nombre maximum de jetons que vous pouvez soumettre pour inférence de modèle en une minute pour Mistral Large 2407. Le quota prend en compte la somme combinée des jetons pour InvokeModel, InvokeModelWithResponseStream, Converse et ConverseStream |
| On-demand jetons d'inférence du modèle par minute pour Mistral Large 3 | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Mistral Large 3. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Moonshot AI Kimi K2.5 | Chaque région prise en charge : 100 000 000 | Non | Nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Moonshot AI Kimi. K2.5 Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour NVIDIA Nemotron 3 Super 120B A12B | Chaque région prise en charge : 100 000 000 | Non | Nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour NVIDIA Nemotron 3 Super 120B A12B. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour NVIDIA Nemotron Nano 2 | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour NVIDIA Nemotron Nano 2. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour NVIDIA Nemotron Nano 2 VL | Chaque région prise en charge : 100 000 000 | Non | Nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour NVIDIA Nemotron Nano 2 VL. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Nemotron Nano 3 30B | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Nemotron Nano 3 30B. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour OpenAI GPT OSS 120B | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour OpenAI GPT OSS 120B. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour OpenAI GPT OSS 20B | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour OpenAI GPT OSS 20B. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Qwen3 235B a22b 2507 V1 | Chaque région prise en charge : 100 000 000 | Non | Nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Qwen3 235B a22b 2507 V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Qwen3 32B V1 | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Qwen3 32B V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Qwen3 Coder 30B a3b V1 | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Qwen3 Coder 30B a3b V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Qwen3 Coder 480B a35b V1 | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Qwen3 Coder 480B a35b V1. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Qwen3 Coder Next | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Qwen3 Coder Next. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Qwen3 Next 80B A3B | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Qwen3 Next 80B A3B. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Qwen3 VL 235B A22B | Chaque région prise en charge : 100 000 000 | Non | Nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Qwen3 VL 235B A22B. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Voxtral Mini 1.0 | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Voxtral Mini 1.0. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Voxtral Small 1.0 | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Voxtral Small 1.0. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Writer Palmyra Vision 7B | Chaque région prise en charge : 100 000 000 | Non | Nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Writer Palmyra Vision 7B. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèle par minute pour Z.ai GLM 5 | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Z.ai GLM 5. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence du modèle par minute pour Z.ai GLM-4.7 | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre à des fins d'inférence de modèle en une minute. Z.ai GLM-4.7 Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| On-demand jetons d'inférence de modèles par minute pour Flash Z.ai GLM-4.7 | Chaque région prise en charge : 100 000 000 | Non | Le nombre maximum de jetons à la demande que vous pouvez soumettre pour inférence de modèle en une minute pour Z.ai GLM-4.7 Flash. Le quota prend en compte la somme combinée des jetons d'entrée et de sortie pour toutes les demandes adressées à Converse ConverseStream, InvokeModel et InvokeModelWithResponseStream. |
| Paramètres par fonction | Chaque Région prise en charge : 5 | Oui |
Le nombre maximum de paramètres que vous pouvez avoir dans une fonction de groupe d'actions. |
| PrepareAgent demandes par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de demandes d' PrepareAgent API par seconde. |
| Enregistrements par tâche d'inférence par lot pour Amazon Nova 2 Multimodal Embeddings V1 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Amazon Nova 2 Multimodal Embeddings V1. |
| Tâche d'inférence d'enregistrements par lot pour Amazon Nova Premier | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Amazon Nova Premier. |
| Dossiers par tâche d'inférence par lots pour Claude 3 Haiku | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude 3 Haiku. |
| Dossiers par tâche d'inférence par lot pour Claude 3 Opus | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude 3 Opus. |
| Dossiers par tâche d'inférence par lot pour Claude 3 Sonnet | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude 3 Sonnet. |
| Dossiers par tâche d'inférence par lots pour Claude 3.5 Haiku | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude 3.5 Haiku. |
| Dossiers par tâche d'inférence par lots pour Claude 3.5 Sonnet | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude 3.5 Sonnet. |
| Enregistrements par tâche d'inférence par lots pour Claude 3.5 Sonnet v2 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude 3.5 Sonnet v2. |
| Dossiers par tâche d'inférence par lots pour Claude 3.7 Sonnet | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude 3.7 Sonnet. |
| Dossiers par tâche d'inférence par lots pour Claude Haiku 4.5 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude Haiku 4.5. |
| Dossiers par tâche d'inférence par lots pour Claude Opus 4.5 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude Opus 4.5. |
| Dossiers par tâche d'inférence par lot pour Claude Opus 4.6 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude Opus 4.6. |
| Travail d'inférence d'enregistrements par lot pour Claude Opus 5 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude Opus 5. |
| Dossiers par tâche d'inférence par lots pour Claude Sonnet 4 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude Sonnet 4. |
| Dossiers par tâche d'inférence par lots pour Claude Sonnet 4.5 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude Sonnet 4.5. |
| Dossiers par tâche d'inférence par lots pour Claude Sonnet 4.6 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Claude Sonnet 4.6. |
| Enregistrements par tâche d'inférence par lots pour DeepSeek V3.2 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour DeepSeek V3.2. |
| Enregistrements par tâche d'inférence par lots pour la v3 DeepSeek | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour la DeepSeek version 3. |
| Enregistrements par tâche d'inférence par lot pour Devstral 2 123B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Devstral 2 123B. |
| Enregistrements par tâche d'inférence par lots pour GLM 4.7 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour GLM 4.7. |
| Enregistrements par tâche d'inférence par lots pour GLM 4.7 Flash | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour GLM 4.7 Flash. |
| Enregistrements par tâche d'inférence par lot pour GLM 5 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour GLM 5. |
| Dossiers par tâche d'inférence par lot pour Gemma 3 12B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Gemma 3 12B. |
| Dossiers par tâche d'inférence par lot pour Gemma 3 27B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Gemma 3 27B. |
| Dossiers par tâche d'inférence par lot pour Gemma 3 4B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Gemma 3 4B. |
| Dossiers par tâche d'inférence par lot pour Kimi K2 Thinking | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Kimi K2 Thinking. |
| Dossiers par tâche d'inférence par lot pour Kimi K2.5 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Kimi K2.5. |
| Enregistrements par tâche d'inférence par lot pour Llama 3.1 405B Instruct | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Llama 3.1 405B Instruct. |
| Enregistrements par tâche d'inférence par lot pour Llama 3.1 70B Instruct | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Llama 3.1 70B Instruct. |
| Enregistrements par tâche d'inférence par lots pour Llama 3.1 8B Instruct | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Llama 3.1 8B Instruct. |
| Enregistrements par tâche d'inférence par lot pour Llama 3.2 11B Instruct | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Llama 3.2 11B Instruct. |
| Enregistrements par tâche d'inférence par lot pour Llama 3.2 1B Instruct | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots Llama 3.2 1B Instruct. |
| Enregistrements par tâche d'inférence par lots pour Llama 3.2 3B Instruct | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Llama 3.2 3B Instruct. |
| Dossiers par tâche d'inférence par lot pour Llama 3.2 90B Instruct | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Llama 3.2 90B Instruct. |
| Dossiers par tâche d'inférence par lot pour Llama 3.3 70B Instruct | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Llama 3.3 70B Instruct. |
| Tâche d'inférence d'enregistrements par lot pour Llama 4 Maverick | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Llama 4 Maverick. |
| Dossiers par tâche d'inférence par lot pour Llama 4 Scout | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Llama 4 Scout. |
| Tâche d'inférence d'enregistrements par lot pour Magistral Small 2509 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Magistral Small 2509. |
| Enregistrements par tâche d'inférence par lots pour M2 MiniMax | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour MiniMax M2. |
| Enregistrements par tâche d'inférence par lots pour MiniMax M2.1 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour MiniMax M2.1. |
| Enregistrements par tâche d'inférence par lots pour MiniMax M2.5 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour MiniMax M2.5. |
| Dossiers par tâche d'inférence par lot pour Ministral 3 14B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Ministral 3 14B. |
| Dossiers par tâche d'inférence par lot pour Ministral 3 8B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Ministral 3 8B. |
| Dossiers par tâche d'inférence par lot pour Ministral 3B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Ministral 3B. |
| Dossiers par tâche d'inférence par lot pour Mistral Large 2 (24.07) | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Mistral Large 2 (24.07). |
| Tâche d'inférence d'enregistrements par lot pour Mistral Large 3 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Mistral Large 3. |
| Dossiers par tâche d'inférence par lot pour Mistral Small | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Mistral Small. |
| Enregistrements par tâche d'inférence par lots pour NVIDIA Nemotron 3 Super 120B A12B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour NVIDIA Nemotron 3 Super 120B A12B. |
| Enregistrements par tâche d'inférence par lots pour NVIDIA Nemotron Nano 12B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour NVIDIA Nemotron Nano 12B. |
| Enregistrements par tâche d'inférence par lots pour NVIDIA Nemotron Nano 3 30B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour NVIDIA Nemotron Nano 3 30B. |
| Enregistrements par tâche d'inférence par lots pour NVIDIA Nemotron Nano 9B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour NVIDIA Nemotron Nano 9B. |
| Dossiers par tâche d'inférence par lots pour Nova 2 Lite | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Nova 2 Lite. |
| Enregistrements par tâche d'inférence par lots pour Nova Lite V1 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Nova Lite V1. |
| Enregistrements par tâche d'inférence par lots pour Nova Micro V1 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Nova Micro V1. |
| Enregistrements par tâche d'inférence par lots pour Nova Pro V1 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Nova Pro V1. |
| Enregistrements par tâche d'inférence par lots pour OpenAI GPT OSS 120b | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour OpenAI GPT OSS 120b. |
| Enregistrements par tâche d'inférence par lots pour OpenAI GPT OSS 20b | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour OpenAI GPT OSS 20b. |
| Dossier d'inférence d'enregistrements par lot pour OpenAI GPT OSS Safeguard 120b | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour OpenAI GPT OSS Safeguard 120b. |
| Dossier d'inférence d'enregistrements par lot pour OpenAI GPT OSS Safeguard 20b | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour OpenAI GPT OSS Safeguard 20b. |
| Enregistrements par tâche d'inférence par lots pour Qwen3 235B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Qwen3 235B. |
| Enregistrements par tâche d'inférence par lots pour Qwen3 32B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Qwen3 32B. |
| Dossiers par tâche d'inférence par lot pour Qwen3 Coder 30B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Qwen3 Coder 30B. |
| Enregistrement par tâche d'inférence par lot pour Qwen3 Coder 480B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Qwen3 Coder 480B. |
| Dossiers par tâche d'inférence par lots pour Qwen3 Coder Next | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Qwen3 Coder Next. |
| Enregistrements par tâche d'inférence par lots pour Qwen3 Next 80B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée d'une tâche d'inférence par lots pour Qwen3 Next 80B. |
| Enregistrements par tâche d'inférence par lots pour Qwen3 VL 235B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Qwen3 VL 235B. |
| Dossiers par tâche d'inférence par lot pour Titan Multimodal Embeddings G1 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Titan Multimodal Embeddings G1. |
| Enregistrements par tâche d'inférence par lots pour Titan Text Embeddings V2 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Titan Text Embeddings V2. |
| Enregistrements par tâche d'inférence par lot pour Voxtral Mini 3B 2507 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Voxtral Mini 3B 2507. |
| Enregistrements par tâche d'inférence par lot pour Voxtral Small 24B 2507 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Voxtral Small 24B 2507. |
| Tâche d'inférence d'enregistrements par lot pour Writer Palmyra Vision 7B | Chaque région prise en charge : 100 000 | Oui |
Nombre maximum d'enregistrements dans tous les fichiers d'entrée dans une tâche d'inférence par lots pour Writer Palmyra Vision 7B. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Amazon Nova 2 Multimodal Embeddings V1 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Amazon Nova 2 Multimodal Embeddings V1. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Amazon Nova Premier | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Amazon Nova Premier. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Claude 3 Haiku | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Claude 3 Haiku. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Claude 3 Opus | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Claude 3 Opus. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Claude 3 Sonnet | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Claude 3 Sonnet. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Claude 3.5 Haiku | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Claude 3.5 Haiku. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Claude 3.5 Sonnet | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Claude 3.5 Sonnet. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Claude 3.5 Sonnet v2 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Claude 3.5 Sonnet v2. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Claude 3.7 Sonnet | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Claude 3.7 Sonnet. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Claude Haiku 4.5 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Claude Haiku 4.5. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Claude Opus 4.5 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Claude Opus 4.5. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Claude Opus 4.6 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Claude Opus 4.6. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Claude Opus 5 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Claude Opus 5. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Claude Sonnet 4 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Claude Sonnet 4. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Claude Sonnet 4.5 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Claude Sonnet 4.5. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Claude Sonnet 4.6 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Claude Sonnet 4.6. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour DeepSeek V3.2 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans le cadre d'une tâche d'inférence par lots pour DeepSeek V3.2. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour la v3 DeepSeek | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour la DeepSeek version 3. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Devstral 2 123B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Devstral 2 123B. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour GLM 4.7 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour GLM 4.7. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour GLM 4.7 Flash | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour GLM 4.7 Flash. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour GLM 5 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour GLM 5. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Gemma 3 12B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Gemma 3 12B. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Gemma 3 27B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Gemma 3 27B. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Gemma 3 4B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Gemma 3 4B. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Kimi K2 Thinking | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Kimi K2 Thinking. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Kimi K2.5 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Kimi K2.5. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Llama 3.1 405B Instruct | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Llama 3.1 405B Instruct. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Llama 3.1 70B Instruct | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Llama 3.1 70B Instruct. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Llama 3.1 8B Instruct | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Llama 3.1 8B Instruct. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Llama 3.2 11B Instruct | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Llama 3.2 11B Instruct. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Llama 3.2 1B Instruct | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots Llama 3.2 1B Instruct. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Llama 3.2 3B Instruct | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Llama 3.2 3B Instruct. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Llama 3.2 90B Instruct | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Llama 3.2 90B Instruct. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Llama 3.3 70B Instruct | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Llama 3.3 70B Instruct. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Llama 4 Maverick | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Llama 4 Maverick. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Llama 4 Scout | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Llama 4 Scout. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Magistral Small 2509 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Magistral Small 2509. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour M2 MiniMax | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour MiniMax M2. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour MiniMax M2.1 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans le cadre d'une tâche d'inférence par lots pour MiniMax M2.1. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour MiniMax M2.5 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans le cadre d'une tâche d'inférence par lots pour MiniMax M2.5. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Ministral 3 14B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Ministral 3 14B. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Ministral 3 8B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Ministral 3 8B. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Ministral 3B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Ministral 3B. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Mistral Large 2 (24.07) | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Mistral Large 2 (24.07). |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Mistral Large 3 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Mistral Large 3. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Mistral Small | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Mistral Small. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour NVIDIA Nemotron 3 Super 120B A12B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour NVIDIA Nemotron 3 Super 120B A12B. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour NVIDIA Nemotron Nano 12B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour NVIDIA Nemotron Nano 12B. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour NVIDIA Nemotron Nano 3 30B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour NVIDIA Nemotron Nano 3 30B. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour NVIDIA Nemotron Nano 9B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour NVIDIA Nemotron Nano 9B. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Nova 2 Lite | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Nova 2 Lite. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Nova Lite V1 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Nova Lite V1. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Nova Micro V1 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Nova Micro V1. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Nova Pro V1 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Nova Pro V1. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour OpenAI GPT OSS 120b | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour OpenAI GPT OSS 120b. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour OpenAI GPT OSS 20b | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour OpenAI GPT OSS 20b. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour OpenAI GPT OSS Safeguard 120b | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour OpenAI GPT OSS Safeguard 120b. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour OpenAI GPT OSS Safeguard 20b | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour OpenAI GPT OSS Safeguard 20b. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Qwen3 235B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Qwen3 235B. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Qwen3 32B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Qwen3 32B. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Qwen3 Coder 30B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Qwen3 Coder 30B. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Qwen3 Coder 480B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Qwen3 Coder 480B. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Qwen3 Coder Next | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Qwen3 Coder Next. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Qwen3 Next 80B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Qwen3 Next 80B. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Qwen3 VL 235B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Qwen3 VL 235B. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Titan Multimodal Embeddings G1 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Titan Multimodal Embeddings G1. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Titan Text Embeddings V2 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Titan Text Embeddings V2. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Voxtral Mini 3B 2507 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Voxtral Mini 3B 2507. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Voxtral Small 24B 2507 | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Voxtral Small 24B 2507. |
| Enregistrements par fichier d'entrée et par tâche d'inférence par lots pour Writer Palmyra Vision 7B | Chaque région prise en charge : 100 000 | Oui |
Le nombre maximum d'enregistrements dans un fichier d'entrée dans une tâche d'inférence par lots pour Writer Palmyra Vision 7B. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Amazon Nova 2 Multimodal Embeddings V1 | Chaque région prise en charge : 100 | Oui |
Nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Amazon Nova 2 Multimodal Embeddings V1. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Amazon Nova Premier | Chaque région prise en charge : 100 | Oui |
Nombre maximum de tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Amazon Nova Premier. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Claude 3 Haiku | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Claude 3 Haiku. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Claude 3 Opus | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Claude 3 Opus. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Claude 3 Sonnet | Chaque région prise en charge : 100 | Oui |
Nombre maximum de tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Claude 3 Sonnet. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Claude 3.5 Haiku | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Claude 3.5 Haiku. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Claude 3.5 Sonnet | Chaque région prise en charge : 100 | Oui |
Nombre maximum de tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Claude 3.5 Sonnet. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Claude 3.5 Sonnet v2 | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Claude 3.5 Sonnet v2. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Claude 3.7 Sonnet | Chaque région prise en charge : 100 | Oui |
Nombre maximum de tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Claude 3.7 Sonnet. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Claude Haiku 4.5 | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Claude Haiku 4.5. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Claude Opus 4.5 | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Claude Opus 4.5. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Claude Opus 4.6 | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Claude Opus 4.6. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Claude Sonnet 4 | Chaque région prise en charge : 100 | Oui |
Nombre maximum de tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Claude Sonnet 4. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Claude Sonnet 4.5. | Chaque région prise en charge : 100 | Oui |
Nombre maximum de tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Claude Sonnet 4.5. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Claude Sonnet 4.6 | Chaque région prise en charge : 100 | Oui |
Nombre maximum de tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Claude Sonnet 4.6. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour DeepSeek V3.2 | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour. DeepSeek V3.2 |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour la v3 DeepSeek | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour DeepSeek la v3. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Devstral 2 123B | Chaque région prise en charge : 100 | Oui |
Nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Devstral 2 123B. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour GLM 4.7 | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour GLM 4.7. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour GLM 4.7 Flash | Chaque région prise en charge : 100 | Oui |
Nombre maximum de tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour GLM 4.7 Flash. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour GLM 5 | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour GLM 5. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Gemma 3 12B | Chaque région prise en charge : 100 | Oui |
Nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Gemma 3 12B. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Gemma 3 27B | Chaque région prise en charge : 100 | Oui |
Nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Gemma 3 27B. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Gemma 3 4B | Chaque région prise en charge : 100 | Oui |
Nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Gemma 3 4B. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Kimi K2 Thinking | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Kimi K2 Thinking. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Kimi K2.5 | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Kimi. K2.5 |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Llama 3.1 405B Instruct | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Llama 3.1 405B Instruct. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Llama 3.1 70B Instruct | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Llama 3.1 70B Instruct. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Llama 3.1 8B Instruct | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Llama 3.1 8B Instruct. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Llama 3.2 11B Instruct | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Llama 3.2 11B Instruct. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Llama 3.2 1B Instruct | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Llama 3.2 1B Instruct. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Llama 3.2 3B Instruct | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Llama 3.2 3B Instruct. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Llama 3.2 90B Instruct | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Llama 3.2 90B Instruct. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Llama 3.3 70B Instruct | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Llama 3.3 70B Instruct. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Llama 4 Maverick | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Llama 4 Maverick. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Llama 4 Scout | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Llama 4 Scout. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Magistral Small 2509 | Chaque région prise en charge : 100 | Oui |
Nombre maximum de tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Magistral Small 2509. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour M2 MiniMax | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour MiniMax M2. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour MiniMax M2.1 | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour. MiniMax M2.1 |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour MiniMax M2.5 | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour. MiniMax M2.5 |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Ministral 3 14B | Chaque région prise en charge : 100 | Oui |
Nombre maximum de tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Ministral 3 14B. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Ministral 3 8B | Chaque région prise en charge : 100 | Oui |
Nombre maximum de tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Ministral 3 8B. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Ministral 3B | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Ministral 3B. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Mistral Large 2 (24.07) | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Mistral Large 2 (24.07). |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Mistral Large 3 | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Mistral Large 3. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Mistral Small | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Mistral Small. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour NVIDIA Nemotron 3 Super 120B A12B | Chaque région prise en charge : 100 | Oui |
Nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour NVIDIA Nemotron 3 Super 120B A12B. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour NVIDIA Nemotron Nano 12B | Chaque région prise en charge : 100 | Oui |
Nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour NVIDIA Nemotron Nano 12B. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour NVIDIA Nemotron Nano 3 30B | Chaque région prise en charge : 100 | Oui |
Nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour NVIDIA Nemotron Nano 3 30B. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour NVIDIA Nemotron Nano 9B | Chaque région prise en charge : 100 | Oui |
Nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour NVIDIA Nemotron Nano 9B. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Nova 2 Lite | Chaque région prise en charge : 100 | Oui |
Nombre maximum de tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Nova 2 Lite. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Nova Lite V1 | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Nova Lite V1. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Nova Micro V1 | Chaque région prise en charge : 100 | Oui |
Nombre maximum de tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Nova Micro V1. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Nova Pro V1 | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Nova Pro V1. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour OpenAI GPT OSS 120b | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour OpenAI GPT OSS 120b. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour OpenAI GPT OSS 20b | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour OpenAI GPT OSS 20b. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour OpenAI GPT OSS Safeguard 120b | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour OpenAI GPT OSS Safeguard 120b. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour OpenAI GPT OSS Safeguard 20b | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour OpenAI GPT OSS Safeguard 20b. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Qwen3 235B | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Qwen3 235B. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Qwen3 32B | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Qwen3 32B. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Qwen3 Coder 30B | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Qwen3 Coder 30B. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Qwen3 Coder 480B | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Qwen3 Coder 480B. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Qwen3 Coder Next | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Qwen3 Coder Next. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Qwen3 Next 80B | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Qwen3 Next 80B. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Qwen3 VL 235B | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Qwen3 VL 235B. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Titan Multimodal Embeddings G1 | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Titan Multimodal Embeddings G1. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Titan Text Embeddings V2 | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Titan Text Embeddings V2. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Voxtral Mini 3B 2507 | Chaque région prise en charge : 100 | Oui |
Nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Voxtral Mini 3B 2507. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Voxtral Small 24B 2507 | Chaque région prise en charge : 100 | Oui |
Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Voxtral Small 24B 2507. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle de base pour Writer Palmyra Vision 7B | Chaque région prise en charge : 100 | Oui |
Nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle de base pour Writer Palmyra Vision 7B. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle personnalisé pour Titan Multimodal Embeddings G1 | Chaque région prise en charge : 3 | Non | Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle personnalisé pour Titan Multimodal Embeddings G1. |
| Somme des tâches d'inférence par lots en cours et soumises à l'aide d'un modèle personnalisé pour Titan Text Embeddings V2 | Chaque région prise en charge : 3 | Non | Le nombre maximum de tâches d'inférence par lots en cours et soumises utilisant un modèle personnalisé pour Titan Text Embeddings V2 |
| Limite de vitesse pour Bedrock Data Automation Runtime : ListTagsForResource | Chaque région prise en charge : 25 par seconde | Non | Nombre maximum de Bedrock Data Automation Runtime : ListTagsForResource demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse pour Bedrock Data Automation Runtime : TagResource | Chaque région prise en charge : 25 par seconde | Non | Nombre maximum de Bedrock Data Automation Runtime : TagResource demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse pour Bedrock Data Automation Runtime : UntagResource | Chaque région prise en charge : 25 par seconde | Non | Nombre maximum de Bedrock Data Automation Runtime : UntagResource demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse pour Bedrock Data Automation : ListTagsForResource | Chaque région prise en charge : 25 par seconde | Non | Nombre maximum de Bedrock Data Automation : ListTagsForResource demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse pour Bedrock Data Automation : TagResource | Chaque région prise en charge : 25 par seconde | Non | Nombre maximum de Bedrock Data Automation : TagResource demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse pour Bedrock Data Automation : UntagResource | Chaque région prise en charge : 25 par seconde | Non | Nombre maximum de Bedrock Data Automation : UntagResource demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse d'accélération pour CreateBlueprint | Chaque région prise en charge : 5 par seconde | Non | Le nombre maximum de CreateBlueprint demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse d'accélérateur pour CreateBlueprintVersion | Chaque région prise en charge : 5 par seconde | Non | Le nombre maximum de CreateBlueprintVersion demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse d'accélérateur pour CreateDataAutomationLibrary | Chaque région prise en charge : 3 par seconde | Non | Le nombre maximum de CreateDataAutomationLibrary demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse d'accélérateur pour CreateDataAutomationProject | Chaque région prise en charge : 5 par seconde | Non | Le nombre maximum de CreateDataAutomationProject demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse d'accélérateur pour DeleteBlueprint | Chaque région prise en charge : 5 par seconde | Non | Le nombre maximum de DeleteBlueprint demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse d'accélérateur pour DeleteDataAutomationLibrary | Chaque région prise en charge : 3 par seconde | Non | Le nombre maximum de DeleteDataAutomationLibrary demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse d'accélérateur pour DeleteDataAutomationProject | Chaque région prise en charge : 5 par seconde | Non | Le nombre maximum de DeleteDataAutomationProject demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse d'accélérateur pour GetBlueprint | Chaque région prise en charge : 5 par seconde | Non | Le nombre maximum de GetBlueprint demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse d'accélérateur pour GetDataAutomationLibrary | Chaque région prise en charge : 5 par seconde | Non | Le nombre maximum de GetDataAutomationLibrary demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse d'accélérateur pour GetDataAutomationLibraryEntity | Chaque région prise en charge : 5 par seconde | Non | Le nombre maximum de GetDataAutomationLibraryEntity demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse d'accélérateur pour GetDataAutomationLibraryIngestionJob | Chaque région prise en charge : 5 par seconde | Non | Le nombre maximum de GetDataAutomationLibraryIngestionJob demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse d'accélérateur pour GetDataAutomationProject | Chaque région prise en charge : 5 par seconde | Non | Le nombre maximum de GetDataAutomationProject demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse d'accélérateur pour GetDataAutomationStatus | Chaque Région prise en charge : 10 par seconde | Non | Le nombre maximum de GetDataAutomationStatus demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse d'accélérateur pour InvokeDataAutomationAsync | Chaque Région prise en charge : 10 par seconde | Non | Le nombre maximum de InvokeDataAutomationAsync demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse d'accélérateur pour InvokeDataAutomationLibraryIngestionJob | Chaque région prise en charge : 5 par seconde | Non | Le nombre maximum de InvokeDataAutomationLibraryIngestionJob demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse d'accélérateur pour ListBlueprints | Chaque région prise en charge : 5 par seconde | Non | Le nombre maximum de ListBlueprints demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse d'accélérateur pour ListDataAutomationLibraries | Chaque région prise en charge : 5 par seconde | Non | Le nombre maximum de ListDataAutomationLibraries demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse d'accélérateur pour ListDataAutomationLibraryEntities | Chaque région prise en charge : 5 par seconde | Non | Le nombre maximum de ListDataAutomationLibraryEntities demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse d'accélérateur pour ListDataAutomationLibraryIngestionJobs | Chaque région prise en charge : 5 par seconde | Non | Le nombre maximum de ListDataAutomationLibraryIngestionJobs demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse d'accélérateur pour ListDataAutomationProjects | Chaque région prise en charge : 5 par seconde | Non | Le nombre maximum de ListDataAutomationProjects demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse d'accélérateur pour UpdateBlueprint | Chaque région prise en charge : 5 par seconde | Non | Le nombre maximum de UpdateBlueprint demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse d'accélérateur pour UpdateDataAutomationLibrary | Chaque région prise en charge : 5 par seconde | Non | Le nombre maximum de UpdateDataAutomationLibrary demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| Limite de vitesse d'accélérateur pour UpdateDataAutomationProject | Chaque région prise en charge : 5 par seconde | Non | Le nombre maximum de UpdateDataAutomationProject demandes que vous pouvez effectuer par seconde et par compte, dans la région actuelle |
| UpdateAgent demandes par seconde | Chaque Région prise en charge : 4 | Non | Le nombre maximum de demandes d' UpdateAgent API par seconde. |
| UpdateAgentActionGroup demandes par seconde | Chaque région prise en charge : 6 | Non | Le nombre maximum de demandes d' UpdateAgentActionGroup API par seconde. |
| UpdateAgentAlias demandes par seconde | Chaque région prise en charge : 2 | Non | Le nombre maximum de demandes d' UpdateAgentAlias API par seconde. |
| UpdateAgentKnowledgeBase demandes par seconde | Chaque Région prise en charge : 4 | Non | Le nombre maximum de demandes d' UpdateAgentKnowledgeBase API par seconde. |
| [point de terminaison du manteau rocheux] Jetons d'entrée par minute pour Claude Fable 5 | Chaque région prise en charge : 2 000 000 | Oui |
[bedrock-mantle endpoint] Nombre maximum de jetons d'entrée par minute que votre compte peut envoyer à Claude Fable 5 dans cette région. Partagé entre toutes les API de ce modèle. |
| [point de terminaison du manteau rocheux] Nombre de jetons de saisie par minute pour Claude Opus 4.7 | Chaque région prise en charge : 20 000 000 | Oui |
[bedrock-mantle endpoint] Le nombre maximum de jetons d'entrée par minute que votre compte peut envoyer à Claude Opus 4.7 dans cette région. Partagé entre toutes les API de ce modèle. |
| [point de terminaison du manteau rocheux] Nombre de jetons d'entrée par minute pour Claude Opus 4.8 | Chaque région prise en charge : 20 000 000 | Oui |
[bedrock-mantle endpoint] Le nombre maximum de jetons d'entrée par minute que votre compte peut envoyer à Claude Opus 4.8 dans cette région. Partagé entre toutes les API de ce modèle. |
| [point de terminaison du manteau rocheux] Nombre de jetons de saisie par minute pour Claude Opus 5 | Chaque région prise en charge : 20 000 000 | Oui |
[bedrock-mantle endpoint] Le nombre maximum de jetons d'entrée par minute que votre compte peut envoyer à Claude Opus 5 dans cette région. Partagé entre toutes les API de ce modèle. |
| [point de terminaison du manteau rocheux] Jetons d'entrée par minute pour Claude Sonnet 5 | Chaque région prise en charge : 3 000 000 | Oui |
[bedrock-mantle endpoint] Le nombre maximum de jetons d'entrée par minute que votre compte peut envoyer à Claude Sonnet 5 dans cette région. Partagé entre toutes les API de ce modèle. |
| [point de terminaison du manteau rocheux] Entrez des jetons par minute pour GPT-5.4 | Chaque région prise en charge : 20 000 000 | Oui |
[bedrock-mantle endpoint] Le nombre maximum de jetons d'entrée par minute auxquels votre compte peut envoyer des messages GPT-5.4 dans cette région. Partagé entre toutes les API de ce modèle. |
| [point de terminaison du manteau rocheux] Entrez des jetons par minute pour GPT-5.5 | Chaque région prise en charge : 10 000 000 | Oui |
[bedrock-mantle endpoint] Le nombre maximum de jetons d'entrée par minute auxquels votre compte peut envoyer des messages GPT-5.5 dans cette région. Partagé entre toutes les API de ce modèle. |
| [point de terminaison du manteau rocheux] Entrez des jetons par minute pour Luna GPT-5.6 | Chaque région prise en charge : 20 000 000 | Oui |
[bedrock-mantle endpoint] Le nombre maximum de jetons d'entrée par minute que votre compte peut envoyer à GPT-5.6 Luna dans cette région. Partagé entre toutes les API de ce modèle. |
| [point de terminaison du manteau rocheux] Entrez des jetons par minute pour Sol GPT-5.6 | Chaque région prise en charge : 10 000 000 | Oui |
[bedrock-mantle endpoint] Le nombre maximum de jetons d'entrée par minute que votre compte peut envoyer à GPT-5.6 Sol dans cette région. Partagé entre toutes les API de ce modèle. |
| [point de terminaison roche-manteau] Entrez des jetons par minute pour Terra GPT-5.6 | Chaque région prise en charge : 20 000 000 | Oui |
[bedrock-mantle endpoint] Le nombre maximum de jetons d'entrée par minute que votre compte peut envoyer à GPT-5.6 Terra dans cette région. Partagé entre toutes les API de ce modèle. |
| [point de terminaison du manteau rocheux] Tokens de sortie par minute pour Claude Fable 5 | Chaque région prise en charge : 200 000 | Oui |
[bedrock-mantle endpoint] Nombre maximum de jetons de sortie par minute que Claude Fable 5 peut générer pour votre compte dans cette région. Partagé entre toutes les API de ce modèle. |
| [point de terminaison du manteau rocheux] Tokens de sortie par minute pour Claude Opus 4.7 | Chaque région prise en charge : 2 000 000 | Oui |
[bedrock-mantle endpoint] Le nombre maximum de jetons de sortie par minute que Claude Opus 4.7 peut générer pour votre compte dans cette région. Partagé entre toutes les API de ce modèle. |
| [point de terminaison du manteau rocheux] Jetons de sortie par minute pour Claude Opus 4.8 | Chaque région prise en charge : 2 000 000 | Oui |
[bedrock-mantle endpoint] Le nombre maximum de jetons de sortie par minute que Claude Opus 4.8 peut générer pour votre compte dans cette région. Partagé entre toutes les API de ce modèle. |
| [point de terminaison du manteau rocheux] Tokens de sortie par minute pour Claude Opus 5 | Chaque région prise en charge : 2 000 000 | Oui |
[bedrock-mantle endpoint] Nombre maximum de jetons de sortie par minute que Claude Opus 5 peut générer pour votre compte dans cette région. Partagé entre toutes les API de ce modèle. |
| [point de terminaison du manteau rocheux] Tokens de sortie par minute pour Claude Sonnet 5 | Chaque région prise en charge : 300 000 | Oui |
[bedrock-mantle endpoint] Nombre maximum de jetons de sortie par minute que Claude Sonnet 5 peut générer pour votre compte dans cette région. Partagé entre toutes les API de ce modèle. |
| [point de terminaison du manteau rocheux] Jetons de sortie par minute pour GPT-5.4 | Chaque région prise en charge : 2 000 000 | Oui |
[bedrock-mantle endpoint] Le nombre maximum de jetons de sortie que GPT-5.4 vous pouvez générer par minute pour votre compte dans cette région. Partagé entre toutes les API de ce modèle. |
| [point de terminaison du manteau rocheux] Jetons de sortie par minute pour GPT-5.5 | Chaque Région prise en charge : 1 000 000 | Oui |
[bedrock-mantle endpoint] Le nombre maximum de jetons de sortie que GPT-5.5 vous pouvez générer par minute pour votre compte dans cette région. Partagé entre toutes les API de ce modèle. |
| [point de terminaison du manteau rocheux] Jetons de sortie par minute pour Luna GPT-5.6 | Chaque région prise en charge : 2 000 000 | Oui |
[bedrock-mantle endpoint] Nombre maximum de jetons de sortie par minute que GPT-5.6 Luna peut générer pour votre compte dans cette région. Partagé entre toutes les API de ce modèle. |
| [point de terminaison du manteau rocheux] Jetons de sortie par minute pour Sol GPT-5.6 | Chaque Région prise en charge : 1 000 000 | Oui |
[point de terminaison du manteau rocheux] Nombre maximum de jetons de sortie par minute que GPT-5.6 Sol peut générer pour votre compte dans cette région. Partagé entre toutes les API de ce modèle. |
| [point de terminaison roche-manteau] Jetons de sortie par minute pour Terra GPT-5.6 | Chaque région prise en charge : 2 000 000 | Oui |
[point de terminaison du manteau rocheux] Nombre maximum de jetons de sortie par minute que GPT-5.6 Terra peut générer pour votre compte dans cette région. Partagé entre toutes les API de ce modèle. |
Note
Vous pouvez demander une augmentation du quota de votre compte en suivant les étapes ci-dessous :
-
Si un quota est marqué Oui, vous pouvez l’ajuster en suivant les étapes décrites dans Demande d’augmentation de quota dans le Guide d’utilisation de Service Quotas.
-
Si un quota est marqué comme Non, vous pouvez soumettre une demande via le formulaire d'augmentation de la
limite pour que l'augmentation soit prise en compte. -
Pour tout modèle, vous pouvez demander une augmentation pour les quotas suivants ensemble :
-
Cross-Region InvokeModel jetons par minute pour
${model} -
Cross-Region InvokeModel demandes par minute pour
${model} -
On-demand InvokeModel jetons par minute pour
${model} -
On-demand InvokeModel demandes par minute pour
${model}
Pour demander une augmentation pour n'importe quelle combinaison de ces quotas, demandez une augmentation du nombre de Cross-Region InvokeModel jetons par minute pour le
${model}quota en suivant les étapes de la section Demander une augmentation de quota dans le guide de l'utilisateur des quotas de service. Ensuite, l'équipe d'assistance vous contactera et vous proposera la possibilité d'augmenter également les trois autres quotas. En raison de la forte demande, la priorité sera accordée aux clients dont le trafic consomme le quota qui leur est alloué. Votre demande peut être refusée si vous ne remplissez pas cette condition. -