Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.
Endpoint e quote di Amazon Bedrock
Per connetterti in modo programmatico a un AWS servizio, utilizzi un endpoint. AWS i servizi offrono i seguenti tipi di endpoint in alcune o tutte le AWS regioni supportate dal servizio: endpoint IPv4, endpoint dual-stack ed endpoint FIPS. Alcuni servizi forniscono endpoint globali. Per ulteriori informazioni, consulta AWS endpoint di servizio.
Le quote di servizio, note anche come limiti, sono il numero massimo di risorse o operazioni di servizio per l'account dell'utente AWS . Per ulteriori informazioni, consulta AWS Service Quotas.
Di seguito sono descritti gli endpoint del servizio e le quote di servizio per questo servizio.
Endpoint del servizio Amazon Bedrock
API del piano di controllo Amazon Bedrock
La tabella seguente fornisce un elenco di Region-specific endpoint supportati da Amazon Bedrock per la gestione, l'addestramento e la distribuzione dei modelli. Usa questi endpoint per le operazioni dell'API Amazon Bedrock.
| Nome della regione | Regione | Endpoint | Protocollo |
|---|---|---|---|
| US East (Ohio) | us-east-2 |
bedrock.us-east-2.amazonaws.com bedrock-fips.us-east-2.amazonaws.com |
HTTPS HTTPS |
| US East (N. Virginia) | us-east-1 |
bedrock.us-east-1.amazonaws.com bedrock-fips.us-east-1.amazonaws.com |
HTTPS HTTPS |
| Stati Uniti occidentali (California settentrionale) | us-west-1 |
bedrock.us-west-1.amazonaws.com bedrock-fips.us-west-1.amazonaws.com |
HTTPS HTTPS |
| Stati Uniti occidentali (Oregon) | us-west-2 |
bedrock.us-west-2.amazonaws.com bedrock-fips.us-west-2.amazonaws.com |
HTTPS HTTPS |
| Africa (Città del Capo) | af-south-1 | bedrock.af-south-1.amazonaws.com | HTTPS |
| Asia Pacific (Hyderabad) | ap-south-2 | bedrock.ap-south-2.amazonaws.com | HTTPS |
| Asia Pacifico (Giacarta) | ap-southeast-3 | bedrock.ap-southeast-3.amazonaws.com | HTTPS |
| Asia Pacifico (Malesia) | ap-southeast-5 | bedrock.ap-southeast-5.amazonaws.com | HTTPS |
| Asia Pacifico (Melbourne) | ap-southeast-4 | bedrock.ap-southeast-4.amazonaws.com | HTTPS |
| Asia Pacifico (Mumbai) | ap-south-1 | bedrock.ap-south-1.amazonaws.com | HTTPS |
| Asia Pacifico (Nuova Zelanda) | ap-southeast-6 | bedrock.ap-southeast-6.amazonaws.com | HTTPS |
| Asia Pacifico (Osaka-Locale) | ap-northeast-3 | bedrock.ap-northeast-3.amazonaws.com | HTTPS |
| Asia Pacifico (Seoul) | ap-northeast-2 | bedrock.ap-northeast-2.amazonaws.com | HTTPS |
| Asia Pacifico (Singapore) | ap-southeast-1 | bedrock.ap-southeast-1.amazonaws.com | HTTPS |
| Asia Pacifico (Sydney) | ap-southeast-2 | bedrock.ap-southeast-2.amazonaws.com | HTTPS |
| Asia Pacifico (Taipei) | ap-east-2 | bedrock.ap-east-2.amazonaws.com | HTTPS |
| Asia Pacifico (Thailandia) | ap-southeast-7 | bedrock.ap-southeast-7.amazonaws.com | HTTPS |
| Asia Pacifico (Tokyo) | ap-northeast-1 | bedrock.ap-northeast-1.amazonaws.com | HTTPS |
| Canada (Centrale) | ca-central-1 |
bedrock.ca-central-1.amazonaws.com bedrock-fips.ca-central-1.amazonaws.com |
HTTPS HTTPS |
| Canada occidentale (Calgary) | ca-west-1 |
bedrock.ca-west-1.amazonaws.com bedrock-fips.ca-west-1.amazonaws.com |
HTTPS HTTPS |
| Europa (Francoforte) | eu-central-1 | bedrock.eu-central-1.amazonaws.com | HTTPS |
| Europa (Irlanda) | eu-west-1 | bedrock.eu-west-1.amazonaws.com | HTTPS |
| Europa (Londra) | eu-west-2 | bedrock.eu-west-2.amazonaws.com | HTTPS |
| Europa (Milano) | eu-south-1 | bedrock.eu-south-1.amazonaws.com | HTTPS |
| Europa (Parigi) | eu-west-3 | bedrock.eu-west-3.amazonaws.com | HTTPS |
| Europa (Spagna) | eu-south-2 | bedrock.eu-south-2.amazonaws.com | HTTPS |
| Europa (Stoccolma) | eu-north-1 | bedrock.eu-north-1.amazonaws.com | HTTPS |
| Europa (Zurigo) | eu-central-2 | bedrock.eu-central-2.amazonaws.com | HTTPS |
| Israele (Tel Aviv) | il-central-1 | bedrock.il-central-1.amazonaws.com | HTTPS |
| Messico (Centrale) | mx-central-1 | bedrock.mx-central-1.amazonaws.com | HTTPS |
| Medio Oriente (Bahrein) | me-south-1 | bedrock.me-south-1.amazonaws.com | HTTPS |
| Medio Oriente (Emirati Arabi Uniti) | me-central-1 | bedrock.me-central-1.amazonaws.com | HTTPS |
| Sud America (São Paulo) | sa-east-1 | bedrock.sa-east-1.amazonaws.com | HTTPS |
| AWS GovCloud (US-East) | us-gov-east-1 |
bedrock.us-gov-east-1.amazonaws.com bedrock-fips.us-gov-east-1.amazonaws.com |
HTTPS HTTPS |
| AWS GovCloud (US-West) | us-gov-west-1 |
bedrock.us-gov-west-1.amazonaws.com bedrock-fips.us-gov-west-1.amazonaws.com |
HTTPS HTTPS |
API di runtime di Amazon Bedrock
La tabella seguente fornisce un elenco di Region-specific endpoint supportati da Amazon Bedrock per effettuare richieste di inferenza per i modelli ospitati in Amazon Bedrock. Usa questi endpoint per le operazioni dell'API Amazon Bedrock Runtime.
| Nome della regione | Regione | Endpoint | Protocollo |
|---|---|---|---|
| US East (Ohio) | us-east-2 |
bedrock-runtime.us-east-2.amazonaws.com bedrock-runtime-fips.us-east-2.amazonaws.com |
HTTPS HTTPS |
| US East (N. Virginia) | us-east-1 |
bedrock-runtime.us-east-1.amazonaws.com bedrock-runtime-fips.us-east-1.amazonaws.com |
HTTPS HTTPS |
| US West (Oregon) | us-west-2 |
bedrock-runtime.us-west-2.amazonaws.com bedrock-runtime-fips.us-west-2.amazonaws.com |
HTTPS HTTPS |
| Asia Pacific (Hyderabad) | ap-south-2 | bedrock-runtime.ap-south-2.amazonaws.com | HTTPS |
| Asia Pacifico (Mumbai) | ap-south-1 | bedrock-runtime.ap-south-1.amazonaws.com | HTTPS |
| Asia Pacifico (Osaka-Locale) | ap-northeast-3 | bedrock-runtime.ap-northeast-3.amazonaws.com | HTTPS |
| Asia Pacifico (Seoul) | ap-northeast-2 | bedrock-runtime.ap-northeast-2.amazonaws.com | HTTPS |
| Asia Pacifico (Singapore) | ap-southeast-1 | bedrock-runtime.ap-southeast-1.amazonaws.com | HTTPS |
| Asia Pacifico (Sydney) | ap-southeast-2 | bedrock-runtime.ap-southeast-2.amazonaws.com | HTTPS |
| Asia Pacifico (Tokyo) | ap-northeast-1 | bedrock-runtime.ap-northeast-1.amazonaws.com | HTTPS |
| Canada (Centrale) | ca-central-1 |
bedrock-runtime.ca-central-1.amazonaws.com bedrock-runtime-fips.ca-central-1.amazonaws.com |
HTTPS HTTPS |
| Europa (Francoforte) | eu-central-1 | bedrock-runtime.eu-central-1.amazonaws.com | HTTPS |
| Europa (Irlanda) | eu-west-1 | bedrock-runtime.eu-west-1.amazonaws.com | HTTPS |
| Europa (Londra) | eu-west-2 | bedrock-runtime.eu-west-2.amazonaws.com | HTTPS |
| Europa (Milano) | eu-south-1 | bedrock-runtime.eu-south-1.amazonaws.com | HTTPS |
| Europa (Parigi) | eu-west-3 | bedrock-runtime.eu-west-3.amazonaws.com | HTTPS |
| Europa (Spagna) | eu-south-2 | bedrock-runtime.eu-south-2.amazonaws.com | HTTPS |
| Europa (Stoccolma) | eu-north-1 | bedrock-runtime.eu-north-1.amazonaws.com | HTTPS |
| Europa (Zurigo) | eu-central-2 | bedrock-runtime.eu-central-2.amazonaws.com | HTTPS |
| Sud America (São Paulo) | sa-east-1 | bedrock-runtime.sa-east-1.amazonaws.com | HTTPS |
| AWS GovCloud (US-East) | us-gov-east-1 |
bedrock-runtime.us-gov-east-1.amazonaws.com bedrock-runtime-fips.us-gov-east-1.amazonaws.com |
HTTPS HTTPS |
| AWS GovCloud (US-West) | us-gov-west-1 |
bedrock-runtime.us-gov-west-1.amazonaws.com bedrock-runtime-fips.us-gov-west-1.amazonaws.com |
HTTPS HTTPS |
API del tempo di sviluppo di Agents for Amazon Bedrock
La tabella seguente fornisce un elenco di Region-specific endpoint supportati da Agents for Amazon Bedrock per la creazione e la gestione di agenti e knowledge base. Usa questi endpoint per gli agenti per le operazioni API di Amazon Bedrock.
| Nome della regione | Regione | Endpoint | Protocollo |
|---|---|---|---|
| Stati Uniti orientali (Virginia settentrionale) | us-east-1 | bedrock-agent.us-east-1.amazonaws.com | HTTPS |
| bedrock-agent-fips.us-east-1.amazonaws.com | HTTPS | ||
| Stati Uniti occidentali (Oregon) | us-west-2 | bedrock-agent.us-west-2.amazonaws.com | HTTPS |
| bedrock-agent-fips.us-west-2.amazonaws.com | HTTPS | ||
| Asia Pacifico (Singapore) | ap-southeast-1 | bedrock-agent.ap-southeast-1.amazonaws.com | HTTPS |
| Asia Pacifico (Sydney) | ap-southeast-2 | bedrock-agent.ap-southeast-2.amazonaws.com | HTTPS |
| Asia Pacifico (Tokyo) | ap-northeast-1 | bedrock-agent.ap-northeast-1.amazonaws.com | HTTPS |
| Asia Pacific (Seoul) | ap-northeast-2 | bedrock-agent.ap-northeast-2.amazonaws.com | HTTPS |
| Canada (Centrale) | ca-central-1 | bedrock-agent.ca-central-1.amazonaws.com | HTTPS |
| Europa (Francoforte) | eu-central-1 | bedrock-agent.eu-central-1.amazonaws.com | HTTPS |
| Europa (Irlanda) | eu-west-1 | bedrock-agent.eu-west-1.amazonaws.com | HTTPS |
| Europe (London) | eu-west-2 | bedrock-agent.eu-west-2.amazonaws.com | HTTPS |
| Europa (Parigi) | eu-west-3 | bedrock-agent.eu-west-3.amazonaws.com | HTTPS |
| Asia Pacifico (Mumbai) | ap-south-1 | bedrock-agent.ap-south-1.amazonaws.com | HTTPS |
| Sud America (San Paolo) | sa-east-1 | bedrock-agent.sa-east-1.amazonaws.com | HTTPS |
API di runtime di Agents for Amazon Bedrock
La tabella seguente fornisce un elenco di Region-specific endpoint supportati da Agents for Amazon Bedrock per richiamare agenti e interrogare le knowledge base. Usa questi endpoint per gli agenti per le operazioni dell'API Amazon Bedrock Runtime.
| Nome della regione | Regione | Endpoint | Protocollo |
|---|---|---|---|
| Stati Uniti orientali (Virginia settentrionale) | us-east-1 | bedrock-agent-runtime.us-east-1.amazonaws.com | HTTPS |
| bedrock-agent-runtime-fips.us-east-1.amazonaws.com | HTTPS | ||
| Stati Uniti occidentali (Oregon) | us-west-2 | bedrock-agent-runtime.us-west-2.amazonaws.com | HTTPS |
| bedrock-agent-runtime-fips.us-west-2.amazonaws.com | HTTPS | ||
| Asia Pacifico (Singapore) | ap-southeast-1 | bedrock-agent-runtime.ap-southeast-1.amazonaws.com | HTTPS |
| Asia Pacifico (Sydney) | ap-southeast-2 | bedrock-agent-runtime.ap-southeast-2.amazonaws.com | HTTPS |
| Asia Pacifico (Tokyo) | ap-northeast-1 | bedrock-agent-runtime.ap-northeast-1.amazonaws.com | HTTPS |
| Asia Pacific (Seoul) | ap-northeast-2 | bedrock-agent-runtime.ap-northeast-2.amazonaws.com | HTTPS |
| Canada (Centrale) | ca-central-1 | bedrock-agent-runtime.ca-central-1.amazonaws.com | HTTPS |
| Europa (Francoforte) | eu-central-1 | bedrock-agent-runtime.eu-central-1.amazonaws.com | HTTPS |
| Europa (Parigi) | eu-west-3 | bedrock-agent-runtime.eu-west-3.amazonaws.com | HTTPS |
| Europa (Irlanda) | eu-west-1 | bedrock-agent-runtime.eu-west-1.amazonaws.com | HTTPS |
| Europe (London) | eu-west-2 | bedrock-agent-runtime.eu-west-2.amazonaws.com | HTTPS |
| Asia Pacifico (Mumbai) | ap-south-1 | bedrock-agent-runtime.ap-south-1.amazonaws.com | HTTPS |
| Sud America (San Paolo) | sa-east-1 | bedrock-agent-runtime.sa-east-1.amazonaws.com | HTTPS |
API di automazione dei dati di Amazon Bedrock
La tabella seguente fornisce un elenco di Region-specific endpoint supportati da Data Automation for Amazon Bedrock. Gli endpoint che utilizzano la parola runtime richiamano progetti e progetti per estrarre informazioni dai file. Usa questi endpoint per le operazioni dell'API Amazon Bedrock Data Automation Runtime. Gli endpoint senza runtime vengono utilizzati per creare modelli e progetti che forniscono indicazioni per l'estrazione. Usa questi endpoint per le operazioni di compilazione dell'API di Amazon Bedrock Data Automation
| Nome della regione | Regione | Endpoint | Protocollo |
|---|---|---|---|
| US East (Ohio) | us-east-2 |
bedrock-data-automation.us-east-2.amazonaws.com bedrock-data-automation-runtime.us-east-2.amazonaws.com bedrock-data-automation-fips.us-east-2.amazonaws.com bedrock-data-automation-runtime-fips.us-east-2.amazonaws.com |
HTTPS HTTPS HTTPS HTTPS |
| US East (N. Virginia) | us-east-1 |
bedrock-data-automation.us-east-1.amazonaws.com bedrock-data-automation-runtime.us-east-1.api.aws bedrock-data-automation-runtime.us-east-1.amazonaws.com bedrock-data-automation.us-east-1.api.aws bedrock-data-automation-fips.us-east-1.amazonaws.com bedrock-data-automation-runtime-fips.us-east-1.api.aws bedrock-data-automation-runtime-fips.us-east-1.amazonaws.com bedrock-data-automation-fips.us-east-1.api.aws |
HTTPS HTTPS HTTPS HTTPS HTTPS HTTPS HTTPS HTTPS |
| Stati Uniti occidentali (Oregon) | us-west-2 |
bedrock-data-automation.us-west-2.amazonaws.com bedrock-data-automation-runtime.us-west-2.api.aws bedrock-data-automation-runtime.us-west-2.amazonaws.com bedrock-data-automation.us-west-2.api.aws bedrock-data-automation-fips.us-west-2.amazonaws.com bedrock-data-automation-runtime-fips.us-west-2.api.aws bedrock-data-automation-runtime-fips.us-west-2.amazonaws.com bedrock-data-automation-fips.us-west-2.api.aws |
HTTPS HTTPS HTTPS HTTPS HTTPS HTTPS HTTPS HTTPS |
| Asia Pacifico (Mumbai) | ap-south-1 |
bedrock-data-automation.ap-south-1.amazonaws.com bedrock-data-automation-runtime.ap-south-1.amazonaws.com |
HTTPS HTTPS |
| Asia Pacifico (Sydney) | ap-southeast-2 |
bedrock-data-automation.ap-southeast-2.amazonaws.com bedrock-data-automation-runtime.ap-southeast-2.amazonaws.com |
HTTPS HTTPS |
| Asia Pacifico (Tokyo) | ap-northeast-1 |
bedrock-data-automation.ap-northeast-1.amazonaws.com bedrock-data-automation-runtime.ap-northeast-1.amazonaws.com |
HTTPS HTTPS |
| Canada (Centrale) | ca-central-1 |
bedrock-data-automation.ca-central-1.amazonaws.com bedrock-data-automation-runtime.ca-central-1.amazonaws.com bedrock-data-automation-fips.ca-central-1.amazonaws.com bedrock-data-automation-runtime-fips.ca-central-1.amazonaws.com |
HTTPS HTTPS HTTPS HTTPS |
| Europa (Francoforte) | eu-central-1 |
bedrock-data-automation.eu-central-1.amazonaws.com bedrock-data-automation-runtime.eu-central-1.amazonaws.com |
HTTPS HTTPS |
| Europa (Irlanda) | eu-west-1 |
bedrock-data-automation.eu-west-1.amazonaws.com bedrock-data-automation-runtime.eu-west-1.amazonaws.com |
HTTPS HTTPS |
| Europa (Londra) | eu-west-2 |
bedrock-data-automation.eu-west-2.amazonaws.com bedrock-data-automation-runtime.eu-west-2.amazonaws.com |
HTTPS HTTPS |
| Europa (Spagna) | eu-south-2 |
bedrock-data-automation.eu-south-2.amazonaws.com bedrock-data-automation-runtime.eu-south-2.amazonaws.com |
HTTPS HTTPS |
| AWS GovCloud (US-West) | us-gov-west-1 |
bedrock-data-automation.us-gov-west-1.amazonaws.com bedrock-data-automation-runtime.us-gov-west-1.amazonaws.com bedrock-data-automation-fips.us-gov-west-1.amazonaws.com bedrock-data-automation-runtime-fips.us-gov-west-1.amazonaws.com |
HTTPS HTTPS HTTPS HTTPS |
Quote di servizio di Amazon Bedrock
Suggerimento
Poiché Amazon Bedrock ha un numero elevato di quote, ti consigliamo di visualizzare le quote di servizio utilizzando la console anziché utilizzare la tabella seguente. Apri le quote Amazon Bedrock.
| Nome | Predefinita | Adattabile | Description |
|---|---|---|---|
| (Advanced Prompt Optimization) Offerte di lavoro attive per account | Ogni regione supportata: 20 | Sì |
Il numero massimo di lavori di Advanced Prompt Optimization (APO) attivi per account. |
| (Advanced Prompt Optimization) Lavori inattivi per account | Ogni regione supportata: 5.000 | Sì |
Il numero massimo di processi APO (Advanced Prompt Optimization) inattivi per account. |
| (Ragionamento automatico) Annotazioni nella politica | Ogni regione supportata: 10 | No | Il numero massimo di annotazioni in una policy di ragionamento automatico. |
| (Automated Reasoning) richieste al secondo CancelAutomatedReasoningPolicyBuildWorkflow | Ogni regione supportata: 5 | Sì |
Il numero massimo di richieste CancelAutomatedReasoningPolicyBuildWorkflow API al secondo. |
| (Ragionamento automatico) Compilazioni simultanee per policy | Ogni regione supportata: 2 | No | Il numero massimo di build simultanee per policy di ragionamento automatico. |
| (Ragionamento automatico) Creazioni simultanee di policy per account | Ogni Regione supportata: 5 | No | Il numero massimo di policy di ragionamento automatico simultanee create in un account. |
| (Automated Reasoning) richieste al secondo CreateAutomatedReasoningPolicy | Ogni regione supportata: 5 | Sì |
Il numero massimo di richieste CreateAutomatedReasoningPolicy API al secondo. |
| (Automated Reasoning) CreateAutomatedReasoningPolicyTestCase richieste al secondo | Ogni regione supportata: 5 | Sì |
Il numero massimo di richieste CreateAutomatedReasoningPolicyTestCase API al secondo. |
| (Automated Reasoning) CreateAutomatedReasoningPolicyVersion richieste al secondo | Ogni regione supportata: 5 | Sì |
Il numero massimo di richieste CreateAutomatedReasoningPolicyVersion API al secondo. |
| (Automated Reasoning) DeleteAutomatedReasoningPolicy richieste al secondo | Ogni regione supportata: 5 | Sì |
Il numero massimo di richieste DeleteAutomatedReasoningPolicy API al secondo. |
| (Automated Reasoning) DeleteAutomatedReasoningPolicyBuildWorkflow richieste al secondo | Ogni regione supportata: 5 | Sì |
Il numero massimo di richieste DeleteAutomatedReasoningPolicyBuildWorkflow API al secondo. |
| (Automated Reasoning) DeleteAutomatedReasoningPolicyTestCase richieste al secondo | Ogni regione supportata: 5 | Sì |
Il numero massimo di richieste DeleteAutomatedReasoningPolicyTestCase API al secondo. |
| (Automated Reasoning) ExportAutomatedReasoningPolicyVersion richieste al secondo | Ogni regione supportata: 5 | Sì |
Il numero massimo di richieste ExportAutomatedReasoningPolicyVersion API al secondo. |
| (Automated Reasoning) GetAutomatedReasoningPolicy richieste al secondo | Ogni regione supportata: 10 | Sì |
Il numero massimo di richieste GetAutomatedReasoningPolicy API al secondo. |
| (Automated Reasoning) GetAutomatedReasoningPolicyAnnotations richieste al secondo | Ogni regione supportata: 10 | Sì |
Il numero massimo di richieste GetAutomatedReasoningPolicyAnnotations API al secondo. |
| (Automated Reasoning) GetAutomatedReasoningPolicyBuildWorkflow richieste al secondo | Ogni regione supportata: 10 | Sì |
Il numero massimo di richieste GetAutomatedReasoningPolicyBuildWorkflow API al secondo. |
| (Automated Reasoning) GetAutomatedReasoningPolicyBuildWorkflowResultAssets richieste al secondo | Ogni regione supportata: 10 | Sì |
Il numero massimo di richieste GetAutomatedReasoningPolicyBuildWorkflowResultAssets API al secondo. |
| (Automated Reasoning) GetAutomatedReasoningPolicyNextScenario richieste al secondo | Ogni regione supportata: 10 | Sì |
Il numero massimo di richieste GetAutomatedReasoningPolicyNextScenario API al secondo. |
| (Automated Reasoning) GetAutomatedReasoningPolicyTestCase richieste al secondo | Ogni regione supportata: 10 | Sì |
Il numero massimo di richieste GetAutomatedReasoningPolicyTestCase API al secondo. |
| (Automated Reasoning) GetAutomatedReasoningPolicyTestResult richieste al secondo | Ogni regione supportata: 10 | Sì |
Il numero massimo di richieste GetAutomatedReasoningPolicyTestResult API al secondo. |
| (Automated Reasoning) ListAutomatedReasoningPolicies richieste al secondo | Ogni regione supportata: 5 | Sì |
Il numero massimo di richieste ListAutomatedReasoningPolicies API al secondo. |
| (Automated Reasoning) ListAutomatedReasoningPolicyBuildWorkflows richieste al secondo | Ogni regione supportata: 5 | Sì |
Il numero massimo di richieste ListAutomatedReasoningPolicyBuildWorkflows API al secondo. |
| (Automated Reasoning) ListAutomatedReasoningPolicyTestCases richieste al secondo | Ogni regione supportata: 5 | Sì |
Il numero massimo di richieste ListAutomatedReasoningPolicyTestCases API al secondo. |
| (Ragionamento automatico) ListAutomatedReasoningPolicyTestResults richieste al secondo | Ogni regione supportata: 5 | Sì |
Il numero massimo di richieste ListAutomatedReasoningPolicyTestResults API al secondo. |
| Politiche (Automated Reasoning) per account | Ogni regione supportata: 100 | No | Il numero massimo di politiche di ragionamento automatico in un account. |
| (Ragionamento automatico) Regole nella politica | Ogni regione supportata: 500 | No | Il numero massimo di regole in una policy di ragionamento automatico. |
| (Ragionamento automatico) Dimensione del documento di origine (MB) | Ogni Regione supportata: 5 | No | La dimensione massima del documento di origine (MB) per la creazione di una politica di ragionamento automatico. |
| (Automated Reasoning) Token del documento di origine | Ogni regione supportata: 122.880 | No | Il numero massimo di token consentito in un documento sorgente durante la creazione di una policy di ragionamento automatico. |
| (Automated Reasoning) richieste al secondo StartAutomatedReasoningPolicyBuildWorkflow | Ogni regione supportata: 1 | Sì |
Il numero massimo di richieste StartAutomatedReasoningPolicyBuildWorkflow API al secondo. |
| (Automated Reasoning) StartAutomatedReasoningPolicyTestWorkflow richieste al secondo | Ogni regione supportata: 1 | Sì |
Il numero massimo di richieste StartAutomatedReasoningPolicyTestWorkflow API al secondo. |
| (Ragionamento automatico) Test per policy | Ogni regione supportata: 100 | No | Il numero massimo di test per policy di ragionamento automatico. |
| (Ragionamento automatico) Tipi per policy | Ogni Regione supportata: 50 | No | Il numero massimo di tipi in una politica di ragionamento automatico. |
| (Ragionamento automatico) UpdateAutomatedReasoningPolicy richieste al secondo | Ogni regione supportata: 5 | Sì |
Il numero massimo di richieste UpdateAutomatedReasoningPolicy API al secondo. |
| (Automated Reasoning) UpdateAutomatedReasoningPolicyAnnotations richieste al secondo | Ogni regione supportata: 5 | Sì |
Il numero massimo di richieste UpdateAutomatedReasoningPolicyAnnotations API al secondo. |
| (Automated Reasoning) UpdateAutomatedReasoningPolicyTestCase richieste al secondo | Ogni regione supportata: 5 | Sì |
Il numero massimo di richieste UpdateAutomatedReasoningPolicyTestCase API al secondo. |
| (Ragionamento automatico) Valori per tipo nella policy | Ogni Regione supportata: 50 | No | Il numero massimo di valori per tipo in una policy di ragionamento automatico. |
| (Ragionamento automatico) Variabili nella politica | Ogni Regione supportata: 200 | No | Il numero massimo di variabili in una policy di ragionamento automatico. |
| (Automated Reasoning) Versioni per policy | Ogni regione supportata: 1.000 | No | Il numero massimo di versioni per policy di ragionamento automatico. |
| (Automazione dei dati) (Console) Dimensione massima del file del documento (MB) | Ogni Regione supportata: 200 | No | La dimensione massima del file per la console |
| (Automazione dei dati) (Console) Numero massimo di pagine per file di documento | Ogni regione supportata: 20 | No | Il numero massimo di pagine per documento nella console |
| (Automazione dei dati) CreateBlueprint : numero massimo di blueprint per account | Ogni regione supportata: 350 | Sì |
Il numero massimo di blueprint per account |
| (Automazione dei dati) CreateBlueprintVersion : numero massimo di versioni di Blueprint per Blueprint | Ogni regione supportata: 10 | Sì |
Il numero massimo di versioni per blueprint |
| (Automazione dei dati) CreateDataAutomationLibrary : numero massimo di librerie di automazione dei dati per account | Ogni regione supportata: 10 | Sì |
Il numero massimo di librerie di automazione dei dati per account |
| (Automazione dei dati) Lunghezza della descrizione dei campi (caratteri) | Ogni regione supportata: 300 | No | La lunghezza massima della descrizione per i campi in caratteri |
| (Automazione dei dati) InvokeBlueprintOptimizationAsync : numero massimo di processi simultanei di ottimizzazione del blueprint | Ogni regione supportata: 3 | Sì |
Il numero massimo di processi aperti di Invoke Blueprint Optimization Async |
| (Automazione dei dati) InvokeBlueprintOptimizationAsync : numero massimo di lavori di ottimizzazione dei blueprint al giorno | Ogni regione supportata: 30 | No | Il numero massimo di lavori Invoke Blueprint Optimization Async al giorno |
| (Data Automation) InvokeDataAutomation (Sync) - Documento - Numero massimo di richieste | Ogni regione supportata: 60 | Sì |
Il numero massimo di InvokeDataAutomation richieste al minuto per la modalità documento |
| (Automazione dei dati) InvokeDataAutomationAsync - Audio - Numero massimo di lavori simultanei |
us-east-1: 20 us-west-2: 20 Ogni altra regione supportata: 2 |
Sì |
Il numero massimo di processi aperti di Invoke Data Automation Async per gli audio |
| (Data Automation) InvokeDataAutomationAsync - Documento - Numero massimo di lavori simultanei |
ap-south-1:5 ca-central-1:5 eu-sud-2:5 eu-west-2: 5 Ogni altra regione supportata: 25 |
Sì |
Il numero massimo di job aperti di Invoke Data Automation Async per i documenti |
| (Data Automation) InvokeDataAutomationAsync - Immagine - Numero massimo di processi simultanei |
us-east-1: 20 us-west-2: 20 Ogni altra regione supportata: 5 |
Sì |
Il numero massimo di processi aperti di Invoke Data Automation Async per le immagini |
| (Data Automation) InvokeDataAutomationAsync : numero massimo di lavori aperti | Ogni regione supportata: 1.800 | No | Il numero massimo di processi aperti di Invoke Data Automation Async per le immagini |
| (Data Automation) InvokeDataAutomationAsync - Video - Numero massimo di lavori simultanei |
us-east-1: 20 us-west-2: 20 Ognuna delle altre regioni supportate: 3 |
Sì |
Il numero massimo di lavori aperti di Invoke Data Automation Async per i video |
| (Data Automation) Numero massimo di frasi del vocabolario per libreria | Ogni regione supportata: 500 | Sì |
Il numero massimo di frasi di vocabolario personalizzate che possono essere configurate per libreria |
| (Automazione dei dati) Frequenza massima di campionamento audio (Hz) | Ogni regione supportata: 48.000 | No | La frequenza massima di campionamento audio |
| (Automazione dei dati) Numero massimo di blueprint per progetto (audio) | Ogni regione supportata: 1 | No | Il numero massimo di progetti audio per progetto |
| (Automazione dei dati) Numero massimo di blueprint per progetto (documenti) | Ogni regione supportata: 40 | No | Il numero massimo di blueprint per progetto per i documenti |
| (Automazione dei dati) Numero massimo di blueprint per progetto (immagini) | Ogni regione supportata: 1 | No | Il numero massimo di blueprint per progetto per le immagini |
| (Automazione dei dati) Numero massimo di blueprint per progetto (video) | Ogni regione supportata: 1 | No | Il numero massimo di blueprint per progetto per i video |
| (Automazione dei dati) Dimensione massima del blueprint JSON (caratteri) | Ogni regione supportata: 100.000 | No | La dimensione massima di JSON in caratteri |
| (Automazione dei dati) Livelli massimi di gerarchia dei campi | Ogni regione supportata: 1 | No | Il livello numerico massimo della gerarchia dei campi |
| (Automazione dei dati) Numero massimo di pagine per documento | Ogni regione supportata: 3.000 | No | Il numero massimo di pagine per documento |
| (Automazione dei dati) Risoluzione massima | Ogni regione supportata: 8.000 | No | La risoluzione massima per le immagini |
| (Automazione dei dati) Dimensione massima del file audio (MB) | Ogni regione supportata: 2.048 | No | La dimensione massima del file per l'audio |
| (Automazione dei dati) Durata massima dell'audio (minuti) | Ogni regione supportata: 240 | No | La lunghezza massima dell'audio in minuti |
| (Automazione dei dati) Dimensione massima del file del documento (MB) | Ogni regione supportata: 500 | No | La dimensione massima del file |
| (Automazione dei dati) Dimensione massima del file di immagine (MB) | Ogni Regione supportata: 5 | No | La dimensione massima del file per le immagini |
| (Automazione dei dati) Lunghezza massima del campo di istruzioni per Audio Blueprint - (caratteri) | Ogni regione supportata: 500 | Sì |
La lunghezza massima del campo di istruzioni per il blueprint audio in caratteri |
| (Automazione dei dati) Numero massimo di blueprint per richiesta Start Inference (audio) | Ogni regione supportata: 1 | No | Il numero massimo di blueprint in linea nella richiesta di inferenza Start |
| (Automazione dei dati) Numero massimo di blueprint per richiesta Start Inference (documenti) | Ogni regione supportata: 10 | No | Il numero massimo di blueprint in linea nella richiesta di inferenza Start |
| (Automazione dei dati) Numero massimo di blueprint per richiesta Start Inference (immagini) | Ogni regione supportata: 1 | No | Il numero massimo di blueprint in linea nella richiesta di inferenza Start |
| (Automazione dei dati) Numero massimo di blueprint per richiesta Start Inference (video) | Ogni regione supportata: 1 | No | Il numero massimo di blueprint in linea nella richiesta di inferenza Start |
| (Automazione dei dati) Numero massimo di campi di elenco per Blueprint | Ogni regione supportata: 15 | No | Il numero massimo di campi di elenco per Blueprint |
| (Automazione dei dati) Dimensione massima del file video (MB) | Ogni regione supportata: 10.240 | No | La dimensione massima del file per i video |
| (Automazione dei dati) Durata massima del video (minuti) | Ogni regione supportata: 240 | No | La lunghezza massima dei video in minuti |
| (Automazione dei dati) Frequenza minima di campionamento audio (Hz) | Ogni regione supportata: 8.000 | No | La frequenza minima di campionamento audio |
| (Automazione dei dati) Lunghezza minima dell'audio (millisecondi) | Ogni regione supportata: 500 | No | La lunghezza minima dell'audio in millisecondi |
| (Valutazione) Numero di processi simultanei di valutazione automatica del modello | Ogni regione supportata: 20 | No | Il numero massimo di processi di valutazione automatica del modello che è possibile specificare contemporaneamente in questo account nella regione corrente. |
| (Valutazione) Numero di lavori di valutazione del modello simultanei che utilizzano lavoratori umani | Ogni regione supportata: 10 | No | Il numero massimo di lavori di valutazione dei modelli che utilizzano lavoratori umani è possibile specificare contemporaneamente in questo account nella regione corrente. |
| (Valutazione) Numero di metriche personalizzate | Ogni regione supportata: 10 | No | Il numero massimo di metriche personalizzate che è possibile specificare in un processo di valutazione del modello che utilizza lavoratori umani. |
| (Valutazione) Numero di set di dati di richiesta personalizzati in un processo di valutazione del modello basato sull'uomo | Ogni regione supportata: 1 | No | Il numero massimo di set di dati di prompt personalizzati che è possibile specificare in un processo di valutazione del modello basato sull'uomo in questo account nella regione corrente. |
| (Valutazione) Numero di set di dati per processo | Ogni Regione supportata: 5 | No | Il numero massimo di set di dati che è possibile specificare in un processo di valutazione automatica del modello. Ciò include set di dati prompt personalizzati e integrati. |
| (Valutazione) Numero di lavori di valutazione | Ogni regione supportata: 5.000 | No | Il numero massimo di lavori di valutazione dei modelli che è possibile creare in questo account nella regione corrente. |
| (Valutazione) Numero di metriche per set di dati | Ogni regione supportata: 3 | No | Il numero massimo di metriche che è possibile specificare per set di dati in un processo di valutazione automatica del modello. Ciò include metriche personalizzate e integrate. |
| (Valutazione) Numero di modelli in un processo di valutazione dei modelli che utilizza lavoratori umani | Ogni regione supportata: 2 | No | Il numero massimo di modelli che è possibile specificare in un processo di valutazione dei modelli che utilizza lavoratori umani. |
| (Valutazione) Numero di modelli nel processo di valutazione automatica dei modelli | Ogni regione supportata: 1 | No | Il numero massimo di modelli che è possibile specificare in un processo di valutazione automatica dei modelli. |
| (Valutazione) Numero di prompt in un set di dati di prompt personalizzato | Ogni regione supportata: 1.000 | No | Il numero massimo di prompt che può contenere un set di dati di prompt personalizzato. |
| (Valutazione) Dimensione del prompt | Ogni regione supportata: 4 | No | La dimensione massima (in KB) di un singolo prompt in un set di dati di prompt personalizzato. |
| (Valutazione) Tempo di lavoro per i lavoratori | Ogni regione supportata: 30 | No | Il tempo massimo (in giorni) che un lavoratore può avere per completare le attività. |
| (Flussi) Nodi agenti per flusso | Ogni regione supportata: 20 | No | Il numero massimo di nodi agente. |
| (Flussi) Nodi di raccolta per flusso | Ogni regione supportata: 1 | No | Il numero massimo di nodi di raccolta. |
| (Flussi) Condiziona i nodi per flusso | Ogni Regione supportata: 5 | No | Il numero massimo di nodi di condizione. |
| (Flussi) Condizioni per nodo di condizione | Ogni Regione supportata: 5 | No | Il numero massimo di condizioni per nodo di condizione. |
| (Flussi) CreateFlow richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di CreateFlow richieste al secondo. |
| (Flussi) CreateFlowAlias richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di CreateFlowAlias richieste al secondo. |
| (Flussi) CreateFlowVersion richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di CreateFlowVersion richieste al secondo. |
| (Flussi) DeleteFlow richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di DeleteFlow richieste al secondo. |
| (Flussi) DeleteFlowAlias richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di DeleteFlowAlias richieste al secondo. |
| (Flussi) DeleteFlowVersion richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di DeleteFlowVersion richieste al secondo. |
| (Flussi) Alias di flusso per flusso | Ogni regione supportata: 10 | No | Il numero massimo di alias di flusso. |
| (Flussi) Esecuzioni dei flussi per account | Ogni regione supportata: 1.000 | Sì |
Il numero massimo di esecuzioni di flusso per account. |
| (Flussi) Versioni del flusso per flusso | Ogni regione supportata: 10 | No | Il numero massimo di versioni del flusso. |
| (Flussi) Flussi per account | Ogni regione supportata: 100 | Sì |
Il numero massimo di flussi per account. |
| (Flussi) GetFlow richieste al secondo | Ogni regione supportata: 10 | No | Il numero massimo di GetFlow richieste al secondo. |
| (Flussi) GetFlowAlias richieste al secondo | Ogni regione supportata: 10 | No | Il numero massimo di GetFlowAlias richieste al secondo. |
| (Flussi) GetFlowVersion richieste al secondo | Ogni regione supportata: 10 | No | Il numero massimo di GetFlowVersion richieste al secondo. |
| (Flussi) Nodi di codice in linea per flusso | Ogni Regione supportata: 5 | No | Il numero massimo di nodi di codice in linea per flusso. |
| (Flussi) Nodi di input per flusso | Ogni regione supportata: 1 | No | Il numero massimo di nodi di input del flusso. |
| (Flows) Nodi iteratori per flusso | Ogni regione supportata: 1 | No | Il numero massimo di nodi iteratori. |
| (Flussi) Nodi della Knowledge Base per flusso | Ogni regione supportata: 20 | No | Il numero massimo di nodi della knowledge base. |
| (Flows) Nodi di funzione Lambda per flusso | Ogni regione supportata: 20 | No | Il numero massimo di nodi di funzione Lambda. |
| (Flussi) Nodi Lex per flusso | Ogni Regione supportata: 5 | No | Il numero massimo di nodi Lex. |
| (Flussi) ListFlowAliases richieste al secondo | Ogni regione supportata: 10 | No | Il numero massimo di ListFlowAliases richieste al secondo. |
| (Flussi) ListFlowVersions richieste al secondo | Ogni regione supportata: 10 | No | Il numero massimo di ListFlowVersions richieste al secondo. |
| (Flussi) ListFlows richieste al secondo | Ogni regione supportata: 10 | No | Il numero massimo di ListFlows richieste al secondo. |
| (Flussi) Nodi di output per flusso | Ogni regione supportata: 20 | No | Il numero massimo di nodi di uscita del flusso. |
| (Flussi) PrepareFlow richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di PrepareFlow richieste al secondo. |
| (Flussi) Richiama i nodi per flusso | Ogni regione supportata: 20 | Sì |
Il numero massimo di nodi prompt. |
| (Flussi) S3 nodi di recupero per flusso | Ogni regione supportata: 10 | No | Il numero massimo di nodi di recupero S3. |
| (Flussi) S3 nodi di storage per flusso | Ogni regione supportata: 10 | No | Il numero massimo di nodi di storage S3. |
| (Flussi) Nodi totali per flusso | Ogni regione supportata: 40 | No | Il numero massimo di nodi in un flusso. |
| (Flussi) UpdateFlow richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di UpdateFlow richieste al secondo. |
| (Flussi) UpdateFlowAlias richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di UpdateFlowAlias richieste al secondo. |
| (Flussi) ValidateFlowDefinition richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di ValidateFlowDefinition richieste al secondo. |
| (Guardrails) Politiche di ragionamento automatico per guardrail | Ogni regione supportata: 2 | No | Il numero massimo di politiche di ragionamento automatico per guardrail. |
| (Guardrails) Dimensione massima di input della politica dei contenuti in unità di testo (livello classico) |
us-east-1: 1.000 us-east-2: 1.000 us-west-2: 1.000 ap-northeast-1: 1.000 ap-northeast-2:1.000 ap-south-1:1.000 ap-sutheast-1:1.000 ap-southeast-2: 1.000 eu-central-1: 1.000 eu-sud-1:25 eu-west-3:25 sa-est-1:25 Ciascuna delle altre regioni supportate: 106 |
Sì |
La dimensione massima del testo di input, misurata in unità di testo, che può essere elaborata per i filtri di contenuto. Sebbene questo limite si applichi al livello classico, consigliamo di passare al livello standard grazie alla sua robustezza superiore, alle funzionalità aggiuntive e al supporto multilingue. |
| (Guardrails) Dimensione massima di input della politica dei contenuti in unità di testo (livello Standard - Consigliato) |
us-east-1: 1.000 us-east-2: 1.000 us-west-2: 1.000 ap-northeast-1:500 ap-nordest-2:1.000 ap-sud-1:500 ap-sutheast-1:1.000 ap-sudest-2:400 eu-central-1:500 eu-sud-1:25 eu-west-1: 1.000 eu-west-3:25 Ciascuna delle altre regioni supportate: 106 |
Sì |
La dimensione massima del testo di input, misurata in unità di testo, che può essere elaborata per i filtri di contenuto. Questo vale per il livello standard, che è consigliato. |
| (Guardrails) Politica di base contestuale, dimensione massima di input in unità di testo | Ogni regione supportata: 106 | Sì |
La dimensione massima del testo di input, misurata in unità di testo, che può essere elaborata dalle politiche di base contestuali |
| (Guardrails) Lunghezza della query di base contestuale in unità di testo | Ogni regione supportata: 1 | No | La lunghezza massima, in unità di testo, della query per la base contestuale |
| (Guardrails) Lunghezza della risposta di base contestuale in unità di testo | Ogni Regione supportata: 5 | No | La lunghezza massima, in unità di testo, della risposta per la base contestuale |
| (Guardrails) Lunghezza contestuale della sorgente di messa a terra in unità di testo |
us-east-1: 100 us-west-2: 100 Ogni altra regione supportata: 50 |
No | La lunghezza massima, in unità di testo, della fonte di base per la base contestuale |
| (Guardrails) Frasi di esempio per argomento | Ogni Regione supportata: 5 | No | Il numero massimo di esempi di argomenti che possono essere inclusi per argomento |
| (Guardrails) Guardrail per account | Ogni regione supportata: 100 | No | Il numero massimo di guardrail in un account |
| (Guardrails) Politica di filtro On-demand ApplyGuardrail dei contenuti, frequenza di raffica delle unità di testo (livello classico) |
us-east-1: 1.000 us-east-2: 1.000 us-west-2: 1.000 ap-northeast-1: 1.000 ap-northeast-2:1.000 ap-south-1:1.000 ap-sutheast-1:1.000 ap-southeast-2: 1.000 eu-central-1: 1.000 Ogni altra regione supportata: 25 |
No | Il numero massimo di unità di testo in un'unica sequenza che possono essere elaborate per i filtri di contenuto. Sebbene questo limite si applichi al livello classico, consigliamo di passare al livello standard grazie alla sua robustezza superiore, alle funzionalità aggiuntive e al supporto multilingue. |
| (Guardrails) Frequenza di burst rate delle unità di testo della politica di filtro On-demand ApplyGuardrail dei contenuti (livello Standard - Consigliato) |
us-east-1: 1.000 us-east-2: 1.000 us-west-2: 1.000 ap-northeast-1:500 ap-nordest-2:1.000 ap-sud-1:500 ap-sutheast-1:1.000 ap-sudest-2:400 eu-central-1:500 eu-west-1: 1.000 Ogni altra regione supportata: 25 |
No | Il numero massimo di unità di testo in un'unica sequenza che possono essere elaborate per i filtri dei contenuti. Questo vale per il livello standard, che è consigliato. |
| (Guardrails) Unità di testo della politica di filtro On-demand ApplyGuardrail dei contenuti al secondo (livello classico) |
us-east-1: 200 us-west-2: 200 Ogni altra regione supportata: 25 |
Sì |
Il numero massimo di unità di testo al secondo che possono essere elaborate per i filtri di contenuto. Sebbene questo limite si applichi al livello classico, consigliamo di passare al livello standard grazie alla sua robustezza superiore, alle funzionalità aggiuntive e al supporto multilingue. |
| (Guardrails) Unità di testo della politica di filtro On-demand ApplyGuardrail dei contenuti al secondo (livello Standard - Consigliato) |
us-east-1: 200 us-east-2:200 us-ovest-1:200 us-west-2: 200 ap-nordest-1:50 ap-northeast-2: 100 ap-sud-1:50 ap-southeast-1: 100 eu-central-1:50 eu-west-1: 200 Ogni altra regione supportata: 25 |
Sì |
Il numero massimo di unità di testo al secondo che possono essere elaborate per i filtri dei contenuti. Questo vale per il livello standard, che è consigliato. |
| (Guardrails) Argomento On-demand ApplyGuardrail negato: criterio, unità di testo, frequenza a raffica (livello classico) |
us-east-1: 200 us-west-2: 200 Ogni altra regione supportata: 25 |
No | Il numero massimo di unità di testo in una sequenza che può essere elaborata per gli argomenti negati. Sebbene questo limite si applichi al livello classico, consigliamo di passare al livello standard grazie alla sua robustezza superiore, alle funzionalità aggiuntive e al supporto multilingue. |
| (Guardrails) Frequenza di ripetizione delle unità di testo della politica relativa all'argomento On-demand ApplyGuardrail negato (livello Standard - Consigliato) |
us-east-1: 1.000 us-east-2: 1.000 us-west-2: 1.000 ap-northeast-1:500 ap-nordest-2:1.000 ap-sud-1:500 ap-sutheast-1:1.000 ap-sudest-2:400 eu-central-1:500 eu-west-1: 1.000 Ogni altra regione supportata: 25 |
No | Il numero massimo di unità di testo in un'unica sequenza che possono essere elaborate per gli argomenti negati. Questo vale per il livello standard, che è consigliato. |
| (Guardrails) Unità di testo della politica sull'argomento On-demand ApplyGuardrail negato al secondo (livello classico) |
us-east-1:50 us-ovest-2:50 Ogni altra regione supportata: 25 |
Sì |
Il numero massimo di unità di testo al secondo che possono essere elaborate per gli argomenti negati. Sebbene questo limite si applichi al livello classico, consigliamo di passare al livello standard grazie alla sua robustezza superiore, alle funzionalità aggiuntive e al supporto multilingue. |
| (Guardrails) Unità di testo al secondo della politica relativa agli argomenti On-demand ApplyGuardrail negati (livello Standard - Consigliato) |
us-east-1: 200 us-east-2:75 us-ovest-1:75 us-west-2: 200 eu-west-1: 200 Ogni altra regione supportata: 25 |
Sì |
Il numero massimo di unità di testo al secondo che possono essere elaborate per gli argomenti negati. Questo vale per il livello standard, che è consigliato. |
| (Guardrails) Politica di filtraggio delle informazioni On-demand ApplyGuardrail sensibili, unità di testo, frequenza di raffica |
us-east-1: 1.000 us-east-2: 1.000 us-west-2: 1.000 ap-northeast-1: 1.000 ap-northeast-2:1.000 ap-south-1:1.000 ap-sutheast-1:1.000 ap-southeast-2: 1.000 eu-central-1: 1.000 Ogni altra regione supportata: 25 |
No | Il numero massimo di unità di testo in un'unica sequenza che possono essere elaborate per i filtri di informazioni sensibili. |
| (Guardrails) Le informazioni On-demand ApplyGuardrail sensibili filtrano le unità di testo delle politiche al secondo |
us-east-1: 1.000 us-east-2:100 us-ovest-1:50 us-west-2: 500 ap-nordest-1:500 ap-northeast-2: 100 ap-nordest-3:75 ap-sud-1:200 ap-sud-2:75 ap-southeast-1: 100 ap-sudest-2:250 ca-central-1:250 eu-central-1:500 eu-central-2:75 eu-nord/1:75 eu-sud-1:75 eu-sud-2:50 eu-west-1: 500 eu-west-2: 100 eu-west-3:250 mare-est-1:75 Ogni altra regione supportata: 25 |
Sì |
Il numero massimo di unità di testo al secondo che possono essere elaborate per i filtri di informazioni sensibili. |
| (Guardrails) Frequenza di burst delle unità di testo della politica di filtro On-demand ApplyGuardrail Word |
us-east-1: 1.000 us-east-2: 1.000 us-west-2: 1.000 ap-northeast-1: 1.000 ap-northeast-2:1.000 ap-south-1:1.000 ap-sutheast-1:1.000 ap-southeast-2: 1.000 eu-central-1: 1.000 Ogni altra regione supportata: 25 |
No | Il numero massimo di unità di testo in un'unica sequenza che possono essere elaborate per i filtri di parole. |
| (Guardrails) Unità di testo della politica di filtro On-demand ApplyGuardrail Word al secondo |
us-east-1: 500 us-east-2:500 us-ovest-1:500 us-west-2: 500 ap-nordest-1:500 ap-nordest-2:500 ap-sud-1:500 ap-sudest-1:500 eu-central-1:500 Ogni altra regione supportata: 25 |
Sì |
Il numero massimo di unità di testo al secondo che possono essere elaborate per i filtri di testo. |
| Frequenza di raffica delle unità di testo della politica di base On-demand ApplyGuardrail contestuale (Guardrails) | Ogni regione supportata: 106 | No | Il numero massimo di unità di testo in un'unica sequenza che possono essere elaborate per la base contestuale. |
| (Guardrails) unità di testo della politica di base On-demand ApplyGuardrail contestuale al secondo | Ogni regione supportata: 106 | Sì |
Il numero massimo di unità di testo al secondo che possono essere elaborate per la base contestuale. |
| (Guardrails) richiede una frequenza di burst On-demand ApplyGuardrail |
us-east-1: 100 us-east-2:100 us-ovest-1:100 us-west-2: 100 ap-nordest-1:100 ap-northeast-2: 100 ap-south-1: 100 ap-southeast-1: 100 eu-central-1: 100 Ogni altra regione supportata: 25 |
No | Il numero massimo di chiamate ApplyGuardrail API che puoi inviare in un'unica sequenza. |
| (Guardrails) On-demand ApplyGuardrail richieste al secondo |
us-east-1: 100 us-east-2:100 us-ovest-1:100 us-west-2: 100 ap-nordest-1:100 ap-northeast-2: 100 ap-south-1: 100 ap-southeast-1: 100 eu-central-1: 100 Ogni altra regione supportata: 25 |
Sì |
Il numero massimo di chiamate API consentite al ApplyGuardrail secondo |
| (Guardrails) On-demand InvokeGuardrailChecks richiede una frequenza di burst | Ogni regione supportata: 1.500 | No | Il numero massimo di chiamate InvokeGuardrailChecks API che puoi inviare in un'unica sequenza |
| (Guardrails) On-demand InvokeGuardrailChecks richieste al minuto | Ogni regione supportata: 1.500 | Sì |
Il numero massimo di chiamate InvokeGuardrailChecks API consentite al minuto |
| (Guardrails) Entità Regex nel filtro per informazioni sensibili | Ogni regione supportata: 30 | No | Il numero massimo di espressioni regolari del filtro guardrail che possono essere incluse in una politica relativa alle informazioni sensibili |
| (Guardrails) Lunghezza delle espressioni regolari in caratteri | Ogni regione supportata: 500 | No | La lunghezza massima, in caratteri, di un'espressione regolare del filtro guardrail |
| (Guardrails) Politica sulle informazioni sensibili: dimensione massima di input in unità di testo |
us-east-1: 1.000 us-east-2: 1.000 us-west-2: 1.000 ap-northeast-1: 1.000 ap-northeast-2:1.000 ap-south-1:1.000 ap-sutheast-1:1.000 ap-southeast-2: 1.000 eu-central-1: 1.000 Ciascuna delle altre regioni supportate: 106 |
Sì |
La dimensione massima del testo di input, misurata in unità di testo, che può essere elaborata dalle politiche di filtro delle informazioni sensibili |
| (Guardrails) Dimensione massima di input dei criteri tematici in unità di testo (livello classico) |
us-east-1: 200 us-west-2: 200 ap-southeast-1:25 eu-sud-1:25 eu-west-3:25 sa-est-1:25 Ciascuna delle altre regioni supportate: 106 |
Sì |
La dimensione massima del testo di input, misurata in unità di testo, che può essere elaborata per gli argomenti negati. Sebbene questo limite si applichi al livello classico, consigliamo di passare al livello standard grazie alla sua robustezza superiore, alle funzionalità aggiuntive e al supporto multilingue. |
| (Guardrails) Dimensione massima di input della politica tematica in unità di testo (livello Standard - Consigliato) |
us-east-1: 1.000 us-east-2: 1.000 us-west-2: 1.000 ap-northeast-1:500 ap-nordest-2:1.000 ap-sud-1:500 ap-sutheast-1:1.000 ap-sudest-2:400 eu-central-1:500 eu-sud-1:25 eu-west-1: 1.000 eu-west-3:25 Ciascuna delle altre regioni supportate: 106 |
Sì |
La dimensione massima del testo di input, misurata in unità di testo, che può essere elaborata per gli argomenti negati. Questo vale per il livello standard, che è consigliato. |
| (Guardrail) Argomenti per guardrail | Ogni regione supportata: 30 | No | Il numero massimo di argomenti che possono essere definiti nelle politiche tematiche del guardrail |
| (Guardrails) Versioni per guardrail | Ogni regione supportata: 20 | No | Il numero massimo di versioni che può avere un guardrail |
| (Guardrails) Lunghezza delle parole in caratteri | Ogni regione supportata: 100 | No | La lunghezza massima di una parola, in caratteri, in un elenco di parole bloccate |
| (Guardrails) Politica di Word: dimensione massima di input in unità di testo |
us-east-1: 1.000 us-east-2: 1.000 us-west-2: 1.000 ap-northeast-1: 1.000 ap-northeast-2:1.000 ap-south-1:1.000 ap-sutheast-1:1.000 ap-southeast-2: 1.000 eu-central-1: 1.000 Ciascuna delle altre regioni supportate: 106 |
Sì |
La dimensione massima del testo di input, misurata in unità di testo, che può essere elaborata dai criteri di filtro di Word |
| (Guardrails) Politica «Parole per parola» | Ogni regione supportata: 10.000 | No | Il numero massimo di parole che possono essere incluse in un elenco di parole bloccate |
| (Knowledge Base) Concorrenti IngestKnowledgeBaseDocuments e DeleteKnowledgeBaseDocuments richieste per account | Ogni regione supportata: 10 | No | Il numero massimo IngestKnowledgeBaseDocuments di DeleteKnowledgeBaseDocuments richieste che possono essere eseguite contemporaneamente in un account. |
| (Knowledge Bases) Processi di inserimento simultanei per account | Ogni Regione supportata: 5 | No | Il numero massimo di processi di inserimento che possono essere eseguiti contemporaneamente in un account. |
| (Knowledge Bases) Processi di inserimento simultanei per origine dati | Ogni regione supportata: 1 | No | Il numero massimo di processi di inserimento che possono essere eseguiti contemporaneamente per un'origine dati. |
| (Knowledge Bases) Lavori di inserimento simultanei per base di conoscenza | Ogni regione supportata: 1 | No | Il numero massimo di processi di inserimento che possono essere eseguiti contemporaneamente per una knowledge base. |
| (Knowledge Base) CreateDataSource richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di richieste CreateDataSource API al secondo. |
| (Knowledge Base) CreateKnowledgeBase richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di richieste CreateKnowledgeBase API al secondo. |
| (Knowledge Base) Fonti di dati per base di conoscenza | Ogni Regione supportata: 5 | No | Il numero massimo di fonti di dati per base di conoscenza. |
| (Knowledge Base) DeleteDataSource richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di richieste DeleteDataSource API al secondo. |
| (Knowledge Base) DeleteKnowledgeBase richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di richieste DeleteKnowledgeBase API al secondo. |
| (Knowledge Base) DeleteKnowledgeBaseDocuments richieste al secondo | Ogni Regione supportata: 5 | No | Il numero massimo di richieste DeleteKnowledgeBaseDocuments API al secondo. |
| (Knowledge Base) File da aggiungere o aggiornare per processo di ingestione | Ogni regione supportata: 5.000.000 | No | Il numero massimo di file nuovi e aggiornati che possono essere inseriti per processo di acquisizione. |
| (Knowledge Bases) File da eliminare per ogni processo di inserimento | Ogni regione supportata: 5.000.000 | No | Il numero massimo di file che possono essere eliminati per processo di inserimento. |
| (Knowledge Base) File da inserire per processo. IngestKnowledgeBaseDocuments | Ogni regione supportata: 25 | No | Il numero massimo di documenti che possono essere inseriti per richiesta. IngestKnowledgeBaseDocuments |
| (Knowledge Base) GenerateQuery richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di richieste GenerateQuery API al secondo. |
| (Knowledge Base) GetDataSource richieste al secondo | Ogni regione supportata: 10 | No | Il numero massimo di richieste GetDataSource API al secondo. |
| (Knowledge Base) GetIngestionJob richieste al secondo | Ogni regione supportata: 10 | No | Il numero massimo di richieste GetIngestionJob API al secondo. |
| (Knowledge Base) GetKnowledgeBase richieste al secondo | Ogni regione supportata: 10 | No | Il numero massimo di richieste GetKnowledgeBase API al secondo. |
| (Knowledge Base) GetKnowledgeBaseDocuments richieste al secondo | Ogni Regione supportata: 5 | No | Il numero massimo di richieste GetKnowledgeBaseDocuments API al secondo. |
| (Knowledge Base) IngestKnowledgeBaseDocuments richieste al secondo | Ogni Regione supportata: 5 | No | Il numero massimo di richieste IngestKnowledgeBaseDocuments API al secondo. |
| (Knowledge Bases) IngestKnowledgeBaseDocuments dimensione totale del payload | Ogni regione supportata: 6 | No | La dimensione massima (in MB) del payload totale in una IngestKnowledgeBaseDocuments richiesta. |
| (Knowledge Bases) Dimensione del file di lavoro di inserimento con contenuto testuale | Ogni Regione supportata: 50 | No | La dimensione massima (in MB) di un file con contenuto testuale (ad esempio file .txt, .pdf o .docx) in un processo di inserimento. |
| (Knowledge Bases) Dimensione del processo di inserimento | Ogni regione supportata: 100 | No | La dimensione massima (in GB) di un processo di acquisizione. |
| (Knowledge Base) Knowledge base per account | Ogni regione supportata: 100 | No | Il numero massimo di knowledge base per account. |
| (Knowledge Base) ListDataSources richieste al secondo | Ogni regione supportata: 10 | No | Il numero massimo di richieste ListDataSources API al secondo. |
| (Knowledge Base) ListIngestionJobs richieste al secondo | Ogni regione supportata: 10 | No | Il numero massimo di richieste ListIngestionJobs API al secondo. |
| (Knowledge Base) ListKnowledgeBaseDocuments richieste al secondo | Ogni Regione supportata: 5 | No | Il numero massimo di richieste ListKnowledgeBaseDocuments API al secondo. |
| (Knowledge Base) ListKnowledgeBases richieste al secondo | Ogni regione supportata: 10 | No | Il numero massimo di richieste ListKnowledgeBases API al secondo. |
| (Knowledge Bases) Numero massimo di file per il parser BDA | Ogni regione supportata: 1.000 | No | Il numero massimo di file che possono essere utilizzati con Amazon Bedrock Data Automation come parser. |
| (Knowledge Bases) Numero massimo di file per Foundation Models come parser | Ogni regione supportata: 1.000 | No | Il numero massimo di file che possono essere utilizzati con Foundation Models come parser. |
| (Knowledge Bases) Riclassifica le richieste al secondo | Ogni regione supportata: 10 | No | Il numero massimo di richieste API Rerank al secondo. |
| (Knowledge Base) Recupera richieste al secondo | Ogni regione supportata: 20 | No | Il numero massimo di richieste API Retrieve al secondo. |
| (Knowledge Base) RetrieveAndGenerate richieste al secondo | Ogni regione supportata: 20 | No | Il numero massimo di richieste RetrieveAndGenerate API al secondo. |
| (Knowledge Base) RetrieveAndGenerateStream richieste al secondo | Ogni regione supportata: 20 | No | Il numero massimo di richieste RetrieveAndGenerateStream API al secondo. |
| (Knowledge Base) StartIngestionJob richieste al secondo | Ogni regione supportata: 0.1 | No | Il numero massimo di richieste StartIngestionJob API al secondo. |
| (Knowledge Base) UpdateDataSource richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di richieste UpdateDataSource API al secondo. |
| (Knowledge Base) UpdateKnowledgeBase richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di richieste UpdateKnowledgeBase API al secondo. |
| (Knowledge Base) Dimensione della query dell'utente | Ogni regione supportata: 1.000 | No | La dimensione massima (in caratteri) di una query utente. |
| (Managed Knowledge Base) AgenticRetrieveStream richieste al secondo per account | Ogni regione supportata: 1 | No | Il numero massimo di richieste AgenticRetrieveStream API al secondo per account per i KB gestiti. |
| dimensione della query AgenticRetrieveStream utente (Managed Knowledge Bases) | Ogni regione supportata: 10.000 | No | La dimensione massima (in caratteri) di una query utente AgenticRetrieveStream per Managed KB. |
| (Managed Knowledge Bases) Lavori di inserimento simultanei per base di conoscenza | Ogni Regione supportata: 50 | No | Il numero massimo di processi di inserimento simultanei per KB gestito. |
| (Basi di conoscenza gestite) Fonti di dati per base di conoscenza | Ogni Regione supportata: 200 | No | Il numero massimo di origini dati per KB gestito. |
| (Managed Knowledge Base) DeleteKnowledgeBaseDocuments richieste al secondo | Ogni regione supportata: 10 | No | Il numero massimo di richieste DeleteKnowledgeBaseDocuments API al secondo per i KB gestiti. |
| (Managed Knowledge Base) DeleteResourcePolicy richieste al secondo | Ogni Regione supportata: 5 | No | Il numero massimo di richieste DeleteResourcePolicy API al secondo per i KB gestiti. |
| (Managed Knowledge Base) File da inserire per richiesta IngestKnowledgeBaseDocuments | Ogni regione supportata: 10 | No | Il numero massimo di file da inserire per richiesta IngestKnowledgeBaseDocuments API per i KB gestiti. |
| (Managed Knowledge Base) GetDocumentContent richieste al secondo per account | Ogni regione supportata: 100 | No | Il numero massimo di richieste GetDocumentContent API al secondo per account. |
| (Managed Knowledge Base) GetDocumentContent richieste al secondo per knowledge base | Ogni Regione supportata: 5 | No | Il numero massimo di richieste GetDocumentContent API al secondo per KB gestito. |
| (Managed Knowledge Base) GetResourcePolicy richieste al secondo | Ogni Regione supportata: 5 | No | Il numero massimo di richieste GetResourcePolicy API al secondo per i KB gestiti. |
| (Managed Knowledge Bases) Dimensione del testo estratto da un singolo file (MB) | Ogni regione supportata: 30 | No | La dimensione massima (in MB) del testo estratto da un singolo file per i KB gestiti. |
| (Managed Knowledge Base) IngestKnowledgeBaseDocuments richieste al secondo | Ogni regione supportata: 20 | No | Il numero massimo di richieste IngestKnowledgeBaseDocuments API al secondo per i KB gestiti. |
| (Managed Knowledge Bases) Knowledge base per account | Ogni regione supportata: 10.000 | No | Il numero massimo di KB gestiti per account. |
| (Managed Knowledge Base) ListKnowledgeBaseDocuments richieste al secondo | Ogni regione supportata: 10 | No | Il numero massimo di richieste ListKnowledgeBaseDocuments API al secondo per i KB gestiti. |
| (Managed Knowledge Base) PutResourcePolicy richieste al secondo | Ogni Regione supportata: 5 | No | Il numero massimo di richieste PutResourcePolicy API al secondo per i KB gestiti. |
| (Knowledge Base gestite) Recupera richieste al secondo per account | Ogni regione supportata: 100 | No | Il numero massimo di richieste API Retrieve al secondo per account per i KB gestiti. |
| (Managed Knowledge Bases) Recupera richieste al secondo per knowledge base | Ogni Regione supportata: 5 | No | Il numero massimo di richieste API Retrieve al secondo per KB gestito. |
| (Managed Knowledge Bases) Recupera le dimensioni delle query degli utenti | Ogni regione supportata: 10.000 | No | La dimensione massima (in caratteri) di una query utente per Retrieve for Managed KB. |
| (Managed Knowledge Bases) Dimensione totale dello storage per knowledge base (TB) | Ogni regione supportata: 10 | No | La dimensione massima totale di archiviazione (in TB) per KB gestiti. |
| (Personalizzazione del modello) Modelli personalizzati per account | Ogni regione supportata: 100 | Sì |
Il numero massimo di modelli personalizzati in un account. |
| (Personalizzazione del modello) implementazioni di modelli In-progress personalizzati | Ogni regione supportata: 2 | Sì |
Il numero massimo di implementazioni di modelli personalizzati in corso |
| (Personalizzazione del modello) Dimensione massima del file di input per i lavori di personalizzazione della distillazione | Ogni regione supportata: 2 GB | No | La dimensione massima del file di input per i lavori di personalizzazione della distillazione. |
| (Personalizzazione del modello) Lunghezza massima della riga per i lavori di personalizzazione della distillazione | Ogni regione supportata: 16 KB | No | La lunghezza massima della riga nel file di input per i lavori di personalizzazione della distillazione. |
| (Personalizzazione del modello) Numero massimo di prompt per i lavori di personalizzazione della distillazione | Ogni regione supportata: 15.000 | No | Il numero massimo di prompt richiesti per i lavori di personalizzazione della distillazione. |
| (Personalizzazione del modello) Numero massimo di record di formazione per un job Amazon Nova Canvas Fine-tuning | Ogni regione supportata: 10.000 | Sì |
Il numero massimo di record consentiti per un Fine-tuning lavoro Amazon Nova Canvas. |
| (Personalizzazione del modello) Lunghezza massima del contesto di ottimizzazione del modello per studenti per i lavori di personalizzazione della distillazione di Amazon Nova Micro V1 | Ogni regione supportata: 32.000 | No | La lunghezza massima del contesto di ottimizzazione del modello per studenti per i lavori di personalizzazione della distillazione di Amazon Nova Micro V1. |
| (Personalizzazione del modello) Lunghezza massima del contesto di ottimizzazione del modello da parte degli studenti per i lavori di personalizzazione della distillazione di Amazon Nova V1 | Ogni regione supportata: 32.000 | No | La lunghezza massima del contesto di ottimizzazione del modello per studenti per i lavori di personalizzazione della distillazione di Amazon Nova V1. |
| (Personalizzazione del modello) Lunghezza massima del contesto di ottimizzazione del modello per studenti per i lavori di personalizzazione della distillazione Anthropic Claude 3 haiku 20240307 V1 | Ogni regione supportata: 32.000 | No | La lunghezza massima del contesto di ottimizzazione del modello studentesco per i lavori di personalizzazione della distillazione Anthropic Claude 3 haiku 20240307 V1. |
| (Personalizzazione del modello) Lunghezza massima del contesto di ottimizzazione del modello per studenti per i lavori di personalizzazione della distillazione di Llama 3.1 70B Instruct V1 | Ogni regione supportata: 16.000 | No | La lunghezza massima del contesto di ottimizzazione del modello studentesco per i lavori di personalizzazione della distillazione Llama 3.1 70B Instruct V1. |
| (Personalizzazione del modello) Lunghezza massima del contesto di ottimizzazione del modello studentesco per i lavori di personalizzazione della distillazione di Llama 3.1 8B Instruct V1 | Ogni regione supportata: 32.000 | No | La lunghezza massima del contesto di ottimizzazione del modello studentesco per i lavori di personalizzazione della distillazione Llama 3.1 8B Instruct V1. |
| (Personalizzazione del modello) Numero minimo di richieste per i lavori di personalizzazione della distillazione | Ogni regione supportata: 100 | No | Il numero minimo di prompt richiesti per i lavori di personalizzazione della distillazione. |
| (Personalizzazione del modello) Lavori di personalizzazione pianificati | Ogni regione supportata: 10 | No | Il numero massimo di processi di personalizzazione pianificati. |
| (Personalizzazione del modello) Somma delle richieste di distribuzione di modelli personalizzati su richiesta al minuto per Amazon Nova 2 Lite | Ogni regione supportata: 2.000 | No | Somma delle richieste di distribuzione di modelli personalizzati su richiesta in ingresso e in uscita inviate al minuto a Converse e delle InvokeModelWithResponseStream azioni per Amazon ConverseStream InvokeModel Nova 2 Lite |
| (Personalizzazione del modello) Somma delle richieste di distribuzione di modelli personalizzati su richiesta al minuto per Amazon Nova Lite | Ogni regione supportata: 2.000 | No | Somma delle richieste di distribuzione di modelli personalizzati su richiesta in ingresso e in uscita inviate al minuto a Converse e InvokeModelWithResponseStream delle azioni per Amazon ConverseStream Nova InvokeModel Lite |
| (Personalizzazione del modello) Somma delle richieste di distribuzione di modelli personalizzati su richiesta al minuto per Amazon Nova Micro | Ogni regione supportata: 2.000 | No | Somma delle richieste di distribuzione di modelli personalizzati su richiesta in ingresso e in uscita inviate al minuto a Converse e InvokeModelWithResponseStream delle azioni intraprese per Amazon ConverseStream InvokeModel Nova Micro |
| (Personalizzazione del modello) Somma delle richieste di distribuzione di modelli personalizzati su richiesta al minuto per Amazon Nova Pro | Ogni Regione supportata: 200 | No | Somma delle richieste di distribuzione di modelli personalizzati su richiesta in ingresso e in uscita inviate al minuto a Converse e InvokeModelWithResponseStream delle azioni intraprese per ConverseStream Amazon InvokeModel Nova Pro |
| (Personalizzazione del modello) Somma delle richieste di distribuzione di modelli personalizzati su richiesta al minuto per Meta Llama 3.3 70B Instruct | Ogni regione supportata: 400 | No | La somma delle richieste di implementazione di modelli personalizzati su richiesta di input e output inviate al minuto a Converse e le azioni per Meta Llama 3.3 ConverseStream 70B InvokeModel Instruct InvokeModelWithResponseStream |
| (Personalizzazione del modello) Somma dei token giornalieri di distribuzione di modelli personalizzati su richiesta per Amazon Nova 2 Lite | Ogni regione supportata: 5.760.000.000 | No | La somma dei token di distribuzione di modelli personalizzati di input e output su richiesta inviati ogni giorno a Converse e le azioni per Amazon Nova 2 Lite ConverseStream InvokeModel InvokeModelWithResponseStream |
| (Personalizzazione del modello) Somma dei token giornalieri di distribuzione di modelli personalizzati su richiesta per Amazon Nova Lite | Ogni regione supportata: 5.760.000.000 | No | La somma dei token di distribuzione di modelli personalizzati in input e output su richiesta inviati ogni giorno a Converse e le azioni per Amazon Nova Lite ConverseStream InvokeModel InvokeModelWithResponseStream |
| (Personalizzazione del modello) Somma dei token giornalieri di distribuzione di modelli personalizzati su richiesta per Amazon Nova Micro | Ogni regione supportata: 5.760.000.000 | No | La somma dei token di distribuzione di modelli personalizzati in input e output su richiesta inviati ogni giorno a Converse e le azioni per Amazon Nova Micro ConverseStream InvokeModel InvokeModelWithResponseStream |
| (Personalizzazione del modello) Somma dei token giornalieri di distribuzione di modelli personalizzati su richiesta per Amazon Nova Pro | Ogni regione supportata: 1.152.000.000 | No | La somma dei token di distribuzione di modelli personalizzati in input e output su richiesta inviati ogni giorno a Converse e le azioni per Amazon Nova Pro ConverseStream InvokeModel InvokeModelWithResponseStream |
| (Personalizzazione del modello) Somma dei token giornalieri di distribuzione di modelli personalizzati su richiesta per Meta Llama 3.3 70B Instruct | Ogni regione supportata: 432.000.000 | No | La somma dei token di implementazione di modelli personalizzati in input e output su richiesta inviati giornalmente a Converse e InvokeModelWithResponseStream le azioni per Meta Llama 3.3 ConverseStream InvokeModel 70B Instruct |
| (Personalizzazione del modello) Somma dei token di distribuzione di modelli personalizzati su richiesta al minuto per Amazon Nova 2 Lite | Ogni regione supportata: 4.000.000 | No | La somma dei token di distribuzione di modelli personalizzati in input e output su richiesta inviati al minuto a Converse e InvokeModelWithResponseStream le azioni per Amazon ConverseStream Nova InvokeModel 2 Lite |
| (Personalizzazione del modello) Somma dei token di distribuzione di modelli personalizzati su richiesta al minuto per Amazon Nova Lite | Ogni regione supportata: 4.000.000 | No | La somma dei token di distribuzione di modelli personalizzati in input e output su richiesta inviati al minuto a Converse e le azioni per Amazon Nova ConverseStream InvokeModel Lite InvokeModelWithResponseStream |
| (Personalizzazione del modello) Somma dei token di distribuzione di modelli personalizzati su richiesta al minuto per Amazon Nova Micro | Ogni regione supportata: 4.000.000 | No | La somma dei token di distribuzione di modelli personalizzati in input e output su richiesta inviati al minuto a Converse e le azioni per Amazon Nova ConverseStream InvokeModel Micro InvokeModelWithResponseStream |
| (Personalizzazione del modello) Somma dei token di distribuzione di modelli personalizzati su richiesta al minuto per Amazon Nova Pro | Ogni regione supportata: 800.000 | No | La somma dei token di distribuzione di modelli personalizzati in input e output su richiesta inviati al minuto a Converse e InvokeModelWithResponseStream le azioni per Amazon ConverseStream InvokeModel Nova Pro |
| (Personalizzazione del modello) Somma dei token di distribuzione del modello personalizzato su richiesta al minuto per Meta Llama 3.3 70B Instruct | Ogni regione supportata: 300.000 | No | La somma dei token di implementazione del modello personalizzato in input e output su richiesta inviati al minuto inviati a Converse,, ConverseStream, e le azioni per Meta Llama 3.3 70B Instruct InvokeModel InvokeModelWithResponseStream |
| (Personalizzazione del modello) Somma dei record di formazione e convalida per un lavoro Amazon Nova 2 Lite Fine-tuning | Ogni regione supportata: 20.000 | Sì |
Il numero massimo combinato di record di formazione e convalida consentito per un job Amazon Nova 2 Lite. Fine-tuning |
| (Personalizzazione del modello) Somma dei record di formazione e convalida per un lavoro Amazon Nova Lite Fine-tuning | Ogni regione supportata: 20.000 | Sì |
Il numero massimo combinato di record di formazione e convalida consentito per un job Amazon Nova Lite. Fine-tuning |
| (Personalizzazione del modello) Somma dei record di formazione e convalida per un lavoro Amazon Nova Micro Fine-tuning | Ogni regione supportata: 20.000 | Sì |
Il numero massimo combinato di record di formazione e convalida consentito per un lavoro con Amazon Nova Micro. Fine-tuning |
| (Personalizzazione del modello) Somma dei record di formazione e convalida per un lavoro Amazon Nova Pro Fine-tuning | Ogni regione supportata: 20.000 | Sì |
Il numero massimo combinato di record di formazione e convalida consentito per un job Amazon Nova Pro. Fine-tuning |
| (Personalizzazione del modello) Somma dei record di formazione e convalida per un lavoro Claude 3 Haiku v1 Fine-tuning | Ogni regione supportata: 10.000 | Sì |
Il numero massimo combinato di record di formazione e convalida consentito per un lavoro Haiku di Claude 3. Fine-tuning |
| (Personalizzazione del modello) Somma dei record di formazione e convalida per un lavoro Claude 3-5-Haiku v1 Fine-tuning | Ogni regione supportata: 10.000 | Sì |
Il numero massimo combinato di record di formazione e convalida consentito per un lavoro con Claude 3-5-Haiku. Fine-tuning |
| (Personalizzazione del modello) Somma dei record di formazione e convalida per un lavoro Meta Llama 2 13B v1 Fine-tuning | Ogni regione supportata: 10.000 | Sì |
Il numero massimo combinato di record di formazione e convalida consentito per un lavoro con Meta Llama 2 13B. Fine-tuning |
| (Personalizzazione del modello) Somma dei record di formazione e convalida per un lavoro Meta Llama 2 70B v1 Fine-tuning | Ogni regione supportata: 10.000 | Sì |
Il numero massimo combinato di record di formazione e convalida consentito per un lavoro con Meta Llama 2 70B. Fine-tuning |
| (Personalizzazione del modello) Somma dei record di formazione e convalida per un lavoro Meta Llama 3.1 70B Instruct v1 Fine-tuning | Ogni regione supportata: 10.000 | Sì |
Il numero massimo combinato di record di formazione e convalida consentito per un job Meta Llama 3.1 70B Instruct. Fine-tuning |
| (Personalizzazione del modello) Somma dei record di formazione e convalida per un lavoro Meta Llama 3.1 8B Instruct v1 Fine-tuning | Ogni regione supportata: 10.000 | Sì |
Il numero massimo combinato di record di formazione e convalida consentito per un job Meta Llama 3.1 8B Instruct. Fine-tuning |
| (Personalizzazione del modello) Somma dei record di addestramento e convalida per un lavoro Meta Llama 3.2 11B Instruct v1 Fine-tuning | Ogni regione supportata: 10.000 | Sì |
Il numero massimo combinato di record di formazione e convalida consentito per un job Meta Llama 3.2 11B Instruct. Fine-tuning |
| (Personalizzazione del modello) Somma dei record di formazione e convalida per un lavoro Meta Llama 3.2 1B Instruct v1 Fine-tuning | Ogni regione supportata: 10.000 | Sì |
Il numero massimo combinato di record di formazione e convalida consentito per un lavoro Meta Llama 3.2 1B Instruct. Fine-tuning |
| (Personalizzazione del modello) Somma dei record di formazione e convalida per un lavoro Meta Llama 3.2 3B Instruct v1 Fine-tuning | Ogni regione supportata: 10.000 | Sì |
Il numero massimo combinato di record di formazione e convalida consentito per un job Meta Llama 3.2 3B Instruct. Fine-tuning |
| (Personalizzazione del modello) Somma dei record di formazione e convalida per un lavoro Meta Llama 3.2 90B Instruct v1 Fine-tuning | Ogni regione supportata: 10.000 | Sì |
Il numero massimo combinato di record di formazione e convalida consentito per un job Meta Llama 3.2 90B Instruct. Fine-tuning |
| (Personalizzazione del modello) Somma dei record di formazione e convalida per un lavoro Meta Llama 3.3 70B Instruct v1 Fine-tuning | Ogni regione supportata: 10.000 | Sì |
Il numero massimo combinato di record di formazione e convalida consentito per un lavoro Meta Llama 3.3 70B Instruct. Fine-tuning |
| (Personalizzazione del modello) Somma dei record di addestramento e convalida per un lavoro Titan Image Generator G1 V1 Fine-tuning | Ogni regione supportata: 10.000 | Sì |
Il numero massimo combinato di record di formazione e convalida consentito per un lavoro con Titan Image Generator. Fine-tuning |
| (Personalizzazione del modello) Somma dei record di formazione e convalida per un lavoro con Titan Image Generator G1 V2 Fine-tuning | Ogni regione supportata: 10.000 | Sì |
Il numero massimo combinato di record di formazione e convalida consentito per un lavoro Titan Image Generator V2. Fine-tuning |
| (Personalizzazione del modello) Somma dei record di formazione e convalida per un lavoro Titan Multimodal Embeddings G1 v1 Fine-tuning | Ogni regione supportata: 50.000 | Sì |
Il numero massimo combinato di record di formazione e convalida consentito per un job Titan Multimodal Embeddings. Fine-tuning |
| (Personalizzazione del modello) Somma dei record di formazione e convalida per un lavoro Titan Text G1 - Express v1 Continued Pre-Training | Ogni regione supportata: 100.000 | Sì |
Il numero massimo combinato di record di formazione e convalida consentito per un lavoro Titan Text Express Continued. Pre-Training |
| (Personalizzazione del modello) Somma dei record di formazione e convalida per un lavoro Titan Text G1 - Express v1 Fine-tuning | Ogni regione supportata: 10.000 | Sì |
Il numero massimo combinato di record di formazione e convalida consentito per un lavoro Titan Text Express. Fine-tuning |
| (Personalizzazione del modello) Somma dei record di formazione e convalida per un lavoro Titan Text G1 - Lite v1 Continued Pre-Training | Ogni regione supportata: 100.000 | Sì |
Il numero massimo combinato di record di formazione e convalida consentito per un lavoro Titan Text Lite Continued. Pre-Training |
| (Personalizzazione del modello) Somma dei record di formazione e convalida per un lavoro Titan Text G1 - Lite v1 Fine-tuning | Ogni regione supportata: 10.000 | Sì |
Il numero massimo combinato di record di formazione e convalida consentito per un lavoro Titan Text Lite. Fine-tuning |
| (Personalizzazione del modello) Somma dei record di formazione e convalida per un lavoro Titan Text G1 - Premier v1 Fine-tuning | Ogni regione supportata: 20.000 | Sì |
Il numero massimo combinato di record di formazione e convalida consentito per un lavoro Titan Text Premier. Fine-tuning |
| (Personalizzazione del modello) Numero totale di implementazioni di modelli personalizzati | Ogni regione supportata: 10 | Sì |
Numero totale di implementazioni di modelli personalizzati |
| (Gestione immediata) CreatePrompt richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di CreatePrompt richieste al secondo. |
| (Gestione tempestiva) CreatePromptVersion richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di CreatePromptVersion richieste al secondo. |
| (Gestione tempestiva) DeletePrompt richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di DeletePrompt richieste al secondo. |
| (Gestione tempestiva) GetPrompt richieste al secondo | Ogni regione supportata: 10 | No | Il numero massimo di GetPrompt richieste al secondo. |
| (Gestione tempestiva) ListPrompts richieste al secondo | Ogni regione supportata: 10 | No | Il numero massimo di ListPrompts richieste al secondo. |
| (Gestione tempestiva) Richieste per account | Ogni regione supportata: 500 | Sì |
Il numero massimo di richieste. |
| (Gestione tempestiva) UpdatePrompt richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di UpdatePrompt richieste al secondo. |
| (Gestione dei prompt) Versioni per prompt | Ogni regione supportata: 10 | No | Il numero massimo di versioni per prompt. |
| API per agente | Ogni regione supportata: 11 | Sì |
Il numero massimo di API che puoi aggiungere a un agente. |
| Gruppi di operazioni per agente | Ogni regione supportata: 20 | Sì |
Il numero massimo di gruppi di azioni che è possibile aggiungere a un agente. |
| Agente e collaboratori per agente | Ogni regione supportata: 1.000 | Sì |
Il numero massimo di agenti collaboratori che puoi aggiungere a un agente. |
| Agenti per account | Ogni regione supportata: 1.000 | Sì |
Il numero massimo di agenti in un account. |
| AssociateAgentKnowledgeBase richieste al secondo | Ogni regione supportata: 6 | No | Il numero massimo di richieste AssociateAgentKnowledgeBase API al secondo. |
| Alias associati per agente | Ogni regione supportata: 10 | No | Il numero massimo di alias che è possibile associare a un agente. |
| Knowledge base associate per agente | Ogni regione supportata: 2 | Sì |
Il numero massimo di knowledge base che è possibile associare a un agente. |
| Dimensione del file di input per inferenza batch (in GB) per Amazon Nova 2 Multimodal Embeddings V1 | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Amazon Nova 2 Multimodal Embeddings V1. |
| Dimensione del file di input per inferenza batch (in GB) per Amazon Nova Premier | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Amazon Nova Premier. |
| Dimensione del file di input per inferenza batch (in GB) per Claude 3 Haiku | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Claude 3 Haiku. |
| Dimensione del file di input per l'inferenza batch (in GB) per Claude 3 Opus | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Claude 3 Opus. |
| Dimensione del file di input per inferenza batch (in GB) per Claude 3 Sonnet | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Claude 3 Sonnet. |
| Dimensione del file di input per inferenza batch (in GB) per Claude 3.5 Haiku | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Claude 3.5 Haiku. |
| Dimensione del file di input per inferenza batch (in GB) per Claude 3.5 Sonnet | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Claude 3.5 Sonnet. |
| Dimensione del file di input per inferenza batch (in GB) per Claude 3.5 Sonnet v2 | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Claude 3.5 Sonnet v2. |
| Dimensione del file di input per inferenza batch (in GB) per Claude 3.7 Sonnet | Ogni regione supportata: 1 | Sì |
La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Claude 3.7 Sonnet. |
| Dimensione del file di input per inferenza batch (in GB) per Claude Haiku 4.5 | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Claude Haiku 4.5. |
| Dimensione del file di input per l'inferenza batch (in GB) per Claude Opus 4.5 | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Claude Opus 4.5. |
| Dimensione del file di input per inferenza batch (in GB) per Claude Opus 4.6 | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Claude Opus 4.6. |
| Dimensione del file di input per inferenza batch (in GB) per Claude Opus 5 | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Claude Opus 5. |
| Dimensione del file di input per inferenza batch (in GB) per Claude Sonnet 4 | Ogni regione supportata: 1 | Sì |
La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Claude Sonnet 4. |
| Dimensione del file di input per inferenza batch (in GB) per Claude Sonnet 4.5 | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Claude Sonnet 4.5. |
| Dimensione del file di input per inferenza batch (in GB) per Claude Sonnet 4.6 | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Claude Sonnet 4.6. |
| Dimensione del file di input per inferenza batch (in GB) per DeepSeek V3.2 | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per. DeepSeek V3.2 |
| Dimensione del file di input per inferenza batch (in GB) per v3 DeepSeek | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per la v3. DeepSeek |
| Dimensione del file di input per l'inferenza batch (in GB) per Devstral 2 123B | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Devstral 2 123B. |
| Dimensione del file di input per inferenza batch (in GB) per GLM 4.7 | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per GLM 4.7. |
| Dimensione del file di input per inferenza batch (in GB) per GLM 4.7 Flash | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per GLM 4.7 Flash. |
| Dimensione del file di input per inferenza batch (in GB) per GLM 5 | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per GLM 5. |
| Dimensione del file di input per inferenza batch (in GB) per Gemma 3 12B | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Gemma 3 12B. |
| Dimensione del file di input per inferenza batch (in GB) per Gemma 3 27B | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Gemma 3 27B. |
| Dimensione del file di input per inferenza batch (in GB) per Gemma 3 4B | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Gemma 3 4B. |
| Dimensione del file di input per inferenza batch (in GB) per Kimi K2 Thinking | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Kimi K2 Thinking. |
| Dimensione del file di input per inferenza batch (in GB) per Kimi K2.5 | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Kimi. K2.5 |
| Dimensione del file di input per l'inferenza batch (in GB) per Llama 3.1 405B Instruct | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Llama 3.1 405B Instruct. |
| Dimensione del file di input per l'inferenza batch (in GB) per Llama 3.1 70B Instruct | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Llama 3.1 70B Instruct. |
| Dimensione del file di input per l'inferenza batch (in GB) per Llama 3.1 8B Instruct | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Llama 3.1 8B Instruct. |
| Dimensione del file di input per l'inferenza batch (in GB) per Llama 3.2 11B Instruct | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Llama 3.2 11B Instruct. |
| Dimensione del file di input per l'inferenza batch (in GB) per Llama 3.2 1B Instruct | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch Llama 3.2 1B Instruct. |
| Dimensione del file di input per l'inferenza batch (in GB) per Llama 3.2 3B Instruct | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Llama 3.2 3B Instruct. |
| Dimensione del file di input per l'inferenza batch (in GB) per Llama 3.2 90B Instruct | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Llama 3.2 90B Instruct. |
| Dimensione del file di input per l'inferenza batch (in GB) per Llama 3.3 70B Instruct | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Llama 3.3 70B Instruct. |
| Dimensione del file di input per inferenza batch (in GB) per Llama 4 Maverick | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Llama 4 Maverick. |
| Dimensione del file di input per l'inferenza batch (in GB) per Llama 4 Scout | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Llama 4 Scout. |
| Dimensione del file di input per inferenza batch (in GB) per Magistral Small 2509 | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Magistral Small 2509. |
| Dimensione del file di input per inferenza batch (in GB) per M2 MiniMax | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per M2. MiniMax |
| Dimensione del file di input per inferenza batch (in GB) per MiniMax M2.1 | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per. MiniMax M2.1 |
| Dimensione del file di input per inferenza batch (in GB) per MiniMax M2.5 | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per. MiniMax M2.5 |
| Dimensione del file di input per inferenza batch (in GB) per Ministral 3 14B | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Ministral 3 14B. |
| Dimensione del file di input per inferenza batch (in GB) per Ministral 3 8B | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Ministral 3 8B. |
| Dimensione del file di input per inferenza batch (in GB) per Ministral 3B | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Ministral 3B. |
| Dimensione del file di input per inferenza batch (in GB) per Mistral Large 2 (24.07) | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Mistral Large 2 (24.07). |
| Dimensione del file di input per inferenza batch (in GB) per Mistral Large 3 | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Mistral Large 3. |
| Dimensione del file di input per inferenza batch (in GB) per Mistral Small | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Mistral Small. |
| Dimensione del file di input per inferenza batch (in GB) per NVIDIA Nemotron 3 Super 120B A12B | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per NVIDIA Nemotron 3 Super 120B A12B. |
| Dimensione del file di input per inferenza batch (in GB) per NVIDIA Nemotron Nano 12B | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per NVIDIA Nemotron Nano 12B. |
| Dimensione del file di input per inferenza batch (in GB) per NVIDIA Nemotron Nano 3 30B | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per NVIDIA Nemotron Nano 3 30B. |
| Dimensione del file di input per l'inferenza batch (in GB) per NVIDIA Nemotron Nano 9B | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per NVIDIA Nemotron Nano 9B. |
| Dimensione del file di input per inferenza batch (in GB) per Nova 2 Lite | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Nova 2 Lite. |
| Dimensione del file di input per inferenza batch (in GB) per Nova Lite V1 | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Nova Lite V1. |
| Dimensione del file di input per inferenza batch (in GB) per Nova Micro V1 | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Nova Micro V1. |
| Dimensione del file di input per inferenza batch (in GB) per Nova Pro V1 | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Nova Pro V1. |
| Dimensione del file di input per inferenza batch (in GB) per OpenAI GPT OSS 120b | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per OpenAI GPT OSS 120b. |
| Dimensione del file di input per l'inferenza batch (in GB) per OpenAI GPT OSS 20b | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per OpenAI GPT OSS 20b. |
| Dimensione del file di input per l'inferenza batch (in GB) per OpenAI GPT OSS Safeguard 120b | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per OpenAI GPT OSS Safeguard 120b. |
| Dimensione del file di input per l'inferenza batch (in GB) per OpenAI GPT OSS Safeguard 20b | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per OpenAI GPT OSS Safeguard 20b. |
| Dimensione del file di input per l'inferenza batch (in GB) per Qwen3 235B | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Qwen3 235B. |
| Dimensione del file di input per l'inferenza batch (in GB) per Qwen3 32B | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Qwen3 32B. |
| Dimensione del file di input per l'inferenza batch (in GB) per Qwen3 Coder 30B | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Qwen3 Coder 30B. |
| Dimensione del file di input per l'inferenza batch (in GB) per Qwen3 Coder 480B | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Qwen3 Coder 480B. |
| Dimensione del file di input per l'inferenza batch (in GB) per Qwen3 Coder Next | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Qwen3 Coder Next. |
| Dimensione del file di input per l'inferenza batch (in GB) per Qwen3 Next 80B | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Qwen3 Next 80B. |
| Dimensione del file di input per l'inferenza batch (in GB) per Qwen3 VL 235B | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Qwen3 VL 235B. |
| Dimensione del file di input per l'inferenza batch (in GB) per Titan Multimodal Embeddings G1 | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Titan Multimodal Embeddings G1. |
| Dimensione del file di input per inferenza batch (in GB) per Titan Text Embeddings V2 | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Titan Text Embeddings V2. |
| Dimensione del file di input per inferenza batch (in GB) per Voxtral Mini 3B 2507 | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Voxtral Mini 3B 2507. |
| Dimensione del file di input per l'inferenza batch (in GB) per Voxtral Small 24B 2507 | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Voxtral Small 24B 2507. |
| Dimensione del file di input per l'inferenza batch (in GB) per Writer Palmyra Vision 7B | Ogni regione supportata: 1 | No | La dimensione massima di un singolo file (in GB) inviato per l'inferenza batch per Writer Palmyra Vision 7B. |
| Dimensione del lavoro di inferenza batch (in GB) per Qwen3 Next 80B | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Qwen3 Next 80B. |
| Dimensione del processo di inferenza in batch (in GB) per Amazon Nova 2 Multimodal Embeddings V1 | Ogni regione supportata: 100 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Amazon Nova 2 Multimodal Embeddings V1. |
| Dimensione del processo di inferenza in batch (in GB) per Amazon Nova Premier | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Amazon Nova Premier. |
| Dimensione del lavoro di inferenza batch (in GB) per Claude 3 Haiku | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Claude 3 Haiku. |
| Dimensione del lavoro di inferenza batch (in GB) per Claude 3 Opus | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Claude 3 Opus. |
| Dimensione del lavoro di inferenza batch (in GB) per Claude 3 Sonnet | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Claude 3 Sonnet. |
| Dimensione del lavoro di inferenza batch (in GB) per Claude 3.5 Haiku | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Claude 3.5 Haiku. |
| Dimensione del lavoro di inferenza batch (in GB) per Claude 3.5 Sonnet | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Claude 3.5 Sonnet. |
| Dimensione del processo di inferenza batch (in GB) per Claude 3.5 Sonnet v2 | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Claude 3.5 Sonnet v2. |
| Dimensione del processo di inferenza batch (in GB) per Claude 3.7 Sonnet | Ogni regione supportata: 5 | Sì |
La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Claude 3.7 Sonnet. |
| Dimensione del lavoro di inferenza batch (in GB) per Claude Haiku 4.5 | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Claude Haiku 4.5. |
| Dimensione del lavoro di inferenza batch (in GB) per Claude Opus 4.5 | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Claude Opus 4.5. |
| Dimensione del lavoro di inferenza batch (in GB) per Claude Opus 4.6 | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Claude Opus 4.6. |
| Dimensione del lavoro di inferenza batch (in GB) per Claude Opus 5 | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Claude Opus 5. |
| Dimensione del lavoro di inferenza batch (in GB) per Claude Sonnet 4 | Ogni regione supportata: 5 | Sì |
La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Claude Sonnet 4. |
| Dimensione del lavoro di inferenza batch (in GB) per Claude Sonnet 4.5 | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Claude Sonnet 4.5. |
| Dimensione del lavoro di inferenza batch (in GB) per Claude Sonnet 4.6 | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Claude Sonnet 4.6. |
| Dimensione del processo di inferenza in batch (in GB) per DeepSeek V3.2 | Ogni Regione supportata: 5 | No | La dimensione cumulativa massima di tutti i file di input (in GB) inclusi nel processo di inferenza batch per. DeepSeek V3.2 |
| Dimensione del processo di inferenza batch (in GB) per v3 DeepSeek | Ogni Regione supportata: 5 | No | La dimensione cumulativa massima di tutti i file di input (in GB) inclusi nel processo di inferenza batch per v3. DeepSeek |
| Dimensione del lavoro di inferenza batch (in GB) per Devstral 2 123B | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Devstral 2 123B. |
| Dimensione del processo di inferenza batch (in GB) per GLM 4.7 | Ogni Regione supportata: 5 | No | La dimensione cumulativa massima di tutti i file di input (in GB) inclusi nel processo di inferenza batch per GLM 4.7. |
| Dimensione del processo di inferenza batch (in GB) per GLM 4.7 Flash | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per GLM 4.7 Flash. |
| Dimensione del processo di inferenza batch (in GB) per GLM 5 | Ogni Regione supportata: 5 | No | La dimensione cumulativa massima di tutti i file di input (in GB) inclusi nel processo di inferenza batch per GLM 5. |
| Dimensione del processo di inferenza batch (in GB) per Gemma 3 12B | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Gemma 3 12B. |
| Dimensione del lavoro di inferenza batch (in GB) per Gemma 3 27B | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Gemma 3 27B. |
| Dimensione del lavoro di inferenza batch (in GB) per Gemma 3 4B | Ogni Regione supportata: 5 | No | La dimensione cumulativa massima di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Gemma 3 4B. |
| Dimensione del lavoro di inferenza batch (in GB) per Kimi K2 Thinking | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Kimi K2 Thinking. |
| Dimensione del lavoro di inferenza in batch (in GB) per Kimi K2.5 | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Kimi. K2.5 |
| Dimensione del lavoro di inferenza batch (in GB) per Llama 3.1 405B Instruct | Ogni Regione supportata: 5 | No | La dimensione cumulativa massima di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Llama 3.1 405B Instruct. |
| Dimensione del lavoro di inferenza batch (in GB) per Llama 3.1 70B Instruct | Ogni Regione supportata: 5 | No | La dimensione cumulativa massima di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Llama 3.1 70B Instruct. |
| Dimensione del lavoro di inferenza batch (in GB) per Llama 3.1 8B Instruct | Ogni Regione supportata: 5 | No | La dimensione cumulativa massima di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Llama 3.1 8B Instruct. |
| Dimensione del lavoro di inferenza batch (in GB) per Llama 3.2 11B Instruct | Ogni Regione supportata: 5 | No | La dimensione cumulativa massima di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Llama 3.2 11B Instruct. |
| Dimensione del lavoro di inferenza batch (in GB) per Llama 3.2 1B Instruct | Ogni Regione supportata: 5 | No | La dimensione cumulativa massima di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Llama 3.2 1B Instruct. |
| Dimensione del lavoro di inferenza batch (in GB) per Llama 3.2 3B Instruct | Ogni Regione supportata: 5 | No | La dimensione cumulativa massima di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Llama 3.2 3B Instruct. |
| Dimensione del lavoro di inferenza batch (in GB) per Llama 3.2 90B Instruct | Ogni Regione supportata: 5 | No | La dimensione cumulativa massima di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Llama 3.2 90B Instruct. |
| Dimensione del lavoro di inferenza batch (in GB) per Llama 3.3 70B Instruct | Ogni Regione supportata: 5 | No | La dimensione cumulativa massima di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Llama 3.3 70B Instruct. |
| Dimensione del lavoro di inferenza batch (in GB) per Llama 4 Maverick | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Llama 4 Maverick. |
| Dimensione del lavoro di inferenza in batch (in GB) per Llama 4 Scout | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Llama 4 Scout. |
| Dimensione del processo di inferenza batch (in GB) per Magistral Small 2509 | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Magistral Small 2509. |
| Dimensione del processo di inferenza batch (in GB) per M2 MiniMax | Ogni Regione supportata: 5 | No | La dimensione cumulativa massima di tutti i file di input (in GB) inclusi nel processo di inferenza batch per M2. MiniMax |
| Dimensione del processo di inferenza batch (in GB) per MiniMax M2.1 | Ogni Regione supportata: 5 | No | La dimensione cumulativa massima di tutti i file di input (in GB) inclusi nel processo di inferenza batch per. MiniMax M2.1 |
| Dimensione del processo di inferenza batch (in GB) per MiniMax M2.5 | Ogni Regione supportata: 5 | No | La dimensione cumulativa massima di tutti i file di input (in GB) inclusi nel processo di inferenza batch per. MiniMax M2.5 |
| Dimensione del processo di inferenza in batch (in GB) per Ministral 3 14B | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Ministral 3 14B. |
| Dimensione del processo di inferenza in batch (in GB) per Ministral 3 8B | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Ministral 3 8B. |
| Dimensione del processo di inferenza in batch (in GB) per Ministral 3B | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Ministral 3B. |
| Dimensione del lavoro di inferenza batch (in GB) per Mistral Large 2 (24.07) | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Mistral Large 2 (24.07). |
| Dimensione del lavoro di inferenza batch (in GB) per Mistral Large 3 | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Mistral Large 3. |
| Dimensione del lavoro di inferenza batch (in GB) per Mistral Small | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Mistral Small. |
| Dimensione del lavoro di inferenza batch (in GB) per NVIDIA Nemotron 3 Super 120B A12B | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per NVIDIA Nemotron 3 Super 120B A12B. |
| Dimensione del processo di inferenza batch (in GB) per NVIDIA Nemotron Nano 12B | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per NVIDIA Nemotron Nano 12B. |
| Dimensione del processo di inferenza batch (in GB) per NVIDIA Nemotron Nano 3 30B | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per NVIDIA Nemotron Nano 3 30B. |
| Dimensione del processo di inferenza batch (in GB) per NVIDIA Nemotron Nano 9B | Ogni Regione supportata: 5 | No | La dimensione cumulativa massima di tutti i file di input (in GB) inclusi nel processo di inferenza batch per NVIDIA Nemotron Nano 9B. |
| Dimensione del processo di inferenza batch (in GB) per Nova Lite V1 | Ogni regione supportata: 100 | No | La dimensione cumulativa massima di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Nova Lite V1. |
| Dimensione del lavoro di inferenza batch (in GB) per Nova Micro V1 | Ogni Regione supportata: 5 | No | La dimensione cumulativa massima di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Nova Micro V1. |
| Dimensione del processo di inferenza batch (in GB) per Nova Pro V1 | Ogni regione supportata: 100 | No | La dimensione cumulativa massima di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Nova Pro V1. |
| Dimensione del processo di inferenza batch (in GB) per OpenAI GPT OSS 120b | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per OpenAI GPT OSS 120b. |
| Dimensione del processo di inferenza batch (in GB) per OpenAI GPT OSS 20b | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per OpenAI GPT OSS 20b. |
| Dimensione del processo di inferenza batch (in GB) per OpenAI GPT OSS Safeguard 120b | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per OpenAI GPT OSS Safeguard 120b. |
| Dimensione del processo di inferenza batch (in GB) per OpenAI GPT OSS Safeguard 20b | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per OpenAI GPT OSS Safeguard 20b. |
| Dimensione del lavoro di inferenza batch (in GB) per Qwen3 235B | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Qwen3 235B. |
| Dimensione del lavoro di inferenza batch (in GB) per Qwen3 32B | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Qwen3 32B. |
| Dimensione del lavoro di inferenza batch (in GB) per Qwen3 Coder 30B | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Qwen3 Coder 30B. |
| Dimensione del lavoro di inferenza batch (in GB) per Qwen3 Coder 480B | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Qwen3 Coder 480B. |
| Dimensione del lavoro di inferenza batch (in GB) per Qwen3 Coder Next | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Qwen3 Coder Next. |
| Dimensione del lavoro di inferenza batch (in GB) per Qwen3 VL 235B | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Qwen3 VL 235B. |
| Dimensione del lavoro di inferenza batch (in GB) per Titan Multimodal Embeddings G1 | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Titan Multimodal Embeddings G1. |
| Dimensione del processo di inferenza in batch (in GB) per Titan Text Embeddings V2 | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Titan Text Embeddings V2. |
| Dimensione del processo di inferenza batch (in GB) per Voxtral Mini 3B 2507 | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Voxtral Mini 3B 2507. |
| Dimensione del processo di inferenza batch (in GB) per Voxtral Small 24B 2507 | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Voxtral Small 24B 2507. |
| Dimensione del lavoro di inferenza batch (in GB) per Writer Palmyra Vision 7B | Ogni Regione supportata: 5 | No | La dimensione massima cumulativa di tutti i file di input (in GB) inclusi nel processo di inferenza batch per Writer Palmyra Vision 7B. |
| Caratteri nelle istruzioni per l'agente | Ogni regione supportata: 20.000 | No | Il numero massimo di caratteri nelle istruzioni per un agente. |
| Lavori di importazione simultanei di modelli | Ogni regione supportata: 1 | No | Il numero massimo di processi di importazione del modello che sono in corso contemporaneamente. |
| CreateAgent richieste al secondo | Ogni regione supportata: 6 | No | Il numero massimo di richieste CreateAgent API al secondo. |
| CreateAgentActionGroup richieste al secondo | Ogni regione supportata: 12 | No | Il numero massimo di richieste CreateAgentActionGroup API al secondo. |
| CreateAgentAlias richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di richieste CreateAgentAlias API al secondo. |
| Cross-Region richieste di inferenza del modello al minuto per Anthropic Claude 3.5 Haiku | Ogni regione supportata: 2.000 | No | Il numero massimo di volte che puoi chiamare InvokeModel e in un minuto. InvokeModelWithResponseStream La quota considera la somma combinata di Anthropic Claude 3.5 Haiku InvokeModel e dei InvokeModelWithResponseStream token. |
| Cross-Region modello di richieste di inferenza al minuto per Anthropic Claude 3.5 Sonnet V2 |
us-west-2: 500 Ogni altra regione supportata: 100 |
No | Il numero massimo di volte in cui è possibile chiamare inferenza del modello in un minuto per Anthropic Claude 3.5 Sonnet V2. La quota considera la somma combinata di Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-Region token di inferenza del modello al minuto per Anthropic Claude 3.5 Haiku | Ogni regione supportata: 4.000.000 | Sì |
Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e per Anthropic Claude 3.5 ConverseStream InvokeModel InvokeModelWithResponseStream Haiku. |
| Cross-Region token di inferenza del modello al minuto per Anthropic Claude 3.5 Sonnet V2 |
us-west-2:4.000.000 Ciascuna delle altre regioni supportate: 800.000 |
Sì |
Il numero massimo di token che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude 3.5 Sonnet V2. La quota considera la somma combinata di Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Amazon Nova 2 Lite | Ogni regione supportata: 2.000 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova 2 Lite. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Amazon Nova 2 Omni | Ogni regione supportata: 2.000 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova 2 Omni. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Amazon Nova 2 Pro Preview | Ogni regione supportata: 100 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova 2 Pro Preview. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Amazon Nova Lite |
us-east-1:4.000 us-est-2:4.000 us-ovest-1:4.000 us-ovest-2:4.000 Ciascuna delle altre regioni supportate: 400 |
No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova Lite. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Amazon Nova Micro |
us-east-1:4.000 us-est-2:4.000 us-ovest-2:4.000 Ciascuna delle altre regioni supportate: 400 |
No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova Micro. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Amazon Nova Premier V1 | Ogni regione supportata: 500 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova Premier V1. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Amazon Nova Pro | Ogni regione supportata: 500 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova Pro. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region modello di richieste di inferenza al minuto per Anthropic Claude 3 Haiku |
us-east-1: 2.000 us-west-2: 2.000 ap-northeast-1:400 ap-sudest-1:400 Ogni altra regione supportata: 800 |
No | Il numero massimo di volte in cui è possibile chiamare l'inferenza del modello in un minuto. La quota considera la somma combinata di Converse InvokeModel e ConverseStream, InvokeModelWithResponseStream per Anthropic Claude 3 Haiku. |
| Cross-region modello di richieste di inferenza al minuto per Anthropic Claude 3 Opus | Ogni regione supportata: 100 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude 3 Opus. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region modello di richieste di inferenza al minuto per Anthropic Claude 3 Sonnet |
us-east-1: 1.000 us-west-2: 1.000 Ogni altra regione supportata: 200 |
No | Il numero massimo di volte in cui è possibile chiamare inferenza del modello in un minuto. La quota considera la somma combinata di Converse InvokeModel e ConverseStream, InvokeModelWithResponseStream per Anthropic Claude 3 Sonnet. |
| Cross-region modello di richieste di inferenza al minuto per Anthropic Claude 3.5 Sonnet |
us-west-2: 500 ap-nordest-1:40 ap-sud-est-1:40 eu-central-1:40 eu-west-1: 40 eu-west-3:40 Ogni altra regione supportata: 100 |
No | Il numero massimo di volte in cui è possibile chiamare inferenza del modello in un minuto per Anthropic Claude 3.5 Sonnet. La quota considera la somma combinata di Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region modello di richieste di inferenza al minuto per Anthropic Claude 3.7 Sonnet V1 |
us-east-1:250 Stati Uniti-Est-2:250 us-ovest-2:250 eu-central-1: 100 eu-nord/1:100 eu-west-1:100 eu-west-3:100 Ogni altra regione supportata: 50 |
No | Il numero massimo di richieste interregionali che è possibile inviare per l'inferenza del modello in un minuto per Anthropic Claude 3.7 Sonnet V1. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region modello di richieste di inferenza al minuto per Anthropic Claude Haiku 4.5 | Ogni regione supportata: 10.000 | Sì |
Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Haiku 4.5. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region modello di richieste di inferenza al minuto per Anthropic Claude Opus 4 V1 | Ogni Regione supportata: 200 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Opus 4 V1. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region modello di richieste di inferenza al minuto per Anthropic Claude Opus 4.1 | Ogni Regione supportata: 50 | No | Il numero massimo di richieste interregionali che è possibile inviare per l'inferenza del modello in un minuto per Anthropic Claude Opus 4.1. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region modello di richieste di inferenza al minuto per Anthropic Claude Opus 4.5 | Ogni regione supportata: 10.000 | Sì |
Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Opus 4.5. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region modello di richieste di inferenza al minuto per Anthropic Claude Opus 4.6 V1 | Ogni regione supportata: 10.000 | Sì |
Il numero massimo di richieste interregionali che è possibile inviare per l'inferenza del modello in un minuto per Anthropic Claude Opus 4.6 V1. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region modello di richieste di inferenza al minuto per Anthropic Claude Sonnet 4 V1 | Ogni Regione supportata: 200 | Sì |
Il numero massimo di richieste interregionali che è possibile inviare per l'inferenza del modello in un minuto per Anthropic Claude Sonnet 4 V1. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region modello di richieste di inferenza al minuto per Anthropic Claude Sonnet 4 V1 1M Context Length | Ogni regione supportata: 5 | Sì |
Il numero massimo di richieste interregionali che è possibile inviare per l'inferenza del modello in un minuto per Anthropic Claude Sonnet 4 V1 1M Context Length. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region modello di richieste di inferenza al minuto per Anthropic Claude Sonnet 4.5 V1 | Ogni regione supportata: 10.000 | Sì |
Il numero massimo di richieste interregionali che è possibile inviare per l'inferenza del modello in un minuto per Anthropic Claude Sonnet 4.5 V1. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region modello di richieste di inferenza al minuto per Anthropic Claude Sonnet 4.5 V1 1M Context Length | Ogni regione supportata: 1.000 | Sì |
Il numero massimo di richieste interregionali che è possibile inviare per l'inferenza del modello in un minuto per Anthropic Claude Sonnet 4.5 V1 1M Context Length. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region modello di richieste di inferenza al minuto per Anthropic Claude Sonnet 4.6 | Ogni regione supportata: 10.000 | Sì |
Il numero massimo di richieste interregionali che è possibile inviare per l'inferenza del modello in un minuto per Anthropic Claude Sonnet 4.6. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Cohere Embed V4 | Ogni regione supportata: 2.000 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Cohere Embed V4. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per DeepSeek R1 V1 | Ogni Regione supportata: 200 | No | Il numero massimo di richieste interregionali che è possibile inviare per l'inferenza del modello in un minuto per R1 V1. DeepSeek Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Meta Llama 3.1 405B Instruct | Ogni regione supportata: 400 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.1 405B Instruct. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Meta Llama 3.1 70B Instruct | Ogni regione supportata: 800 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.1 70B Instruct. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Meta Llama 3.1 8B Instruct | Ogni regione supportata: 1.600 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.1 8B Instruct. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Meta Llama 3.2 1B Instruct | Ogni regione supportata: 1.600 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.2 1B Instruct. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Meta Llama 3.2 3B Instruct | Ogni regione supportata: 1.600 | No | Il numero massimo di volte in cui puoi chiamare l'inferenza del modello in un minuto per Meta Llama 3.2 3B Instruct. La quota considera la somma combinata delle richieste per InvokeModel, InvokeModelWithResponseStream, Converse e. ConverseStream |
| Cross-region richieste di inferenza del modello al minuto per Meta Llama 3.3 70B Instruct | Ogni regione supportata: 800 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.3 70B Instruct. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Meta Llama 4 Maverick V1 | Ogni regione supportata: 800 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 4 Maverick V1. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Meta Llama 4 Scout V1 | Ogni regione supportata: 800 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 4 Scout V1. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Mistral Pixtral Large 25.02 V1 | Ogni regione supportata: 10 | No | Il numero massimo di richieste interregionali che è possibile inviare per l'inferenza del modello in un minuto per Mistral Pixtral Large 25.02 V1. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Stable Image Conservative Upscale | Ogni regione supportata: 4 | No | Il numero massimo di richieste interregionali che è possibile inviare per l'inferenza del modello in un minuto per Stable Image Conservative Upscale. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Stable Image Control Sketch | Ogni regione supportata: 20 | No | Il numero massimo di richieste interregionali che è possibile inviare per l'inferenza del modello in un minuto per Stable Image Control Sketch. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Stable Image Control Structure | Ogni regione supportata: 20 | No | Il numero massimo di richieste interregionali che è possibile inviare per l'inferenza del modello in un minuto per Stable Image Control Structure. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Stable Image Creative Upscale | Ogni regione supportata: 4 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Stable Image Creative Upscale. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Stable Image Erase Object | Ogni regione supportata: 20 | No | Il numero massimo di richieste interregionali che è possibile inviare per l'inferenza del modello in un minuto per Stable Image Erase Object. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Stable Image Fast Upscale | Ogni regione supportata: 20 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Stable Image Fast Upscale. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Stable Image Inpaint | Ogni regione supportata: 20 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Stable Image Inpaint. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Stable Image Outpaint | Ogni regione supportata: 4 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Stable Image Outpaint. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Stable Image Remove Background | Ogni regione supportata: 20 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Stable Image Remove Background. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Stable Image Search e Recolor | Ogni regione supportata: 20 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Stable Image Search e Recolor. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Stable Image Search and Replace | Ogni regione supportata: 20 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Stable Image Search and Replace. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Stable Image Style Guide | Ogni regione supportata: 20 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Stable Image Style Guide. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Stable Image Style Transfer | Ogni regione supportata: 20 | No | Il numero massimo di richieste interregionali che è possibile inviare per l'inferenza del modello in un minuto per Stable Image Style Transfer. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region modello di richieste di inferenza al minuto per Twelve Labs Marengo | Ogni Regione supportata: 200 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Twelve Labs Marengo. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Twelve Labs Pegasus | Ogni regione supportata: 120 | Sì |
Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Twelve Labs Pegasus. La quota considera la somma combinata di Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per TwelveLabs Marengo Embed 3.0 | Ogni regione supportata: 1.000 | Sì |
Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Marengo Embed 3.0. TwelveLabs Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Writer AI Palmyra X4 V1 | Ogni regione supportata: 10 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Writer AI Palmyra X4 V1. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region richieste di inferenza del modello al minuto per Writer AI Palmyra X5 V1 | Ogni regione supportata: 10 | No | Il numero massimo di richieste interregionali che puoi inviare per l'inferenza del modello in un minuto per Writer AI Palmyra X5 V1. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Amazon Nova 2 Lite | Ogni regione supportata: 8.000.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova 2 Lite. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Amazon Nova 2 Omni | Ogni regione supportata: 8.000.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova 2 Omni. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Amazon Nova 2 Pro Preview | Ogni regione supportata: 1.000.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova 2 Pro Preview. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Amazon Nova Lite |
us-east-1:8.000.000 us-est-2:8.000.000 us-west-1:8.000.000 us-west-2:8.000.000 Ciascuna delle altre regioni supportate: 400.000 |
Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova Lite. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Amazon Nova Micro |
us-east-1:8.000.000 us-est-2:8.000.000 us-west-2:8.000.000 Ciascuna delle altre regioni supportate: 400.000 |
Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova Micro. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Amazon Nova Premier V1 | Ogni regione supportata: 2.000.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova Premier V1. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Amazon Nova Pro | Ogni regione supportata: 2.000.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova Pro. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Anthropic Claude 3 Haiku |
us-east-1:4.000.000 us-west-2:4.000.000 ap-nord-est-1:400.000 ap-sudest-1:400.000 Ciascuna delle altre regioni supportate: 600.000 |
Sì |
Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e per Anthropic Claude 3 ConverseStream InvokeModel InvokeModelWithResponseStream Haiku. |
| Cross-region token di inferenza del modello al minuto per Anthropic Claude 3 Opus | Ogni regione supportata: 800.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude 3 Opus. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Anthropic Claude 3 Sonnet |
us-east-1:2.000.000 us-west-2:2.000.000 Ciascuna delle altre regioni supportate: 400.000 |
Sì |
Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e per Anthropic Claude ConverseStream 3 InvokeModel InvokeModelWithResponseStream Sonnet. |
| Cross-region token di inferenza del modello al minuto per Anthropic Claude 3.5 Sonnet |
us-west-2:4.000.000 ap-nord-est-1:400.000 ap-sudest-1:400.000 eu-central-1:400.000 eu-west-1:400.000 eu-west-3:400.000 Ciascuna delle altre regioni supportate: 800.000 |
Sì |
Il numero massimo di token che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude 3.5 Sonnet. La quota considera la somma combinata di Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Anthropic Claude 3.7 Sonnet V1 |
us-east-1:1.000.000 us-est-2:1.000.000 us-west-2:1.000.000 eu-central-1:100.000 eu-nord/1:100.000 eu-west-1:100.000 eu-west-3:100.000 Ciascuna delle altre regioni supportate: 50.000 |
Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude 3.7 Sonnet V1. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Anthropic Claude Fable 5 | Ogni regione supportata: 4.000.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Fable 5. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Anthropic Claude Haiku 4.5 | Ogni regione supportata: 5.000.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Haiku 4.5. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Anthropic Claude Opus 4 V1 | Ogni regione supportata: 200.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Opus 4 V1. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Anthropic Claude Opus 4.1 | Ogni regione supportata: 500.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Opus 4.1. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Anthropic Claude Opus 4.5 | Ogni regione supportata: 2.000.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Opus 4.5. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Anthropic Claude Opus 4.6 V1 | Ogni regione supportata: 3.000.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Opus 4.6 V1. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Anthropic Claude Opus 4.7 | Ogni regione supportata: 10.000.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Opus 4.7. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Anthropic Claude Opus 4.8 | Ogni regione supportata: 30.000.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Opus 4.8. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Anthropic Claude Opus 5 | Ogni regione supportata: 30.000.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Opus 5. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Anthropic Claude Sonnet 4 V1 | Ogni regione supportata: 200.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Sonnet 4 V1. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Anthropic Claude Sonnet 4 V1 1M Context Length | Ogni regione supportata: 1.000.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Sonnet 4 V1 1M Context Length. La quota considera la somma combinata dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Anthropic Claude Sonnet 4.5 V1 | Ogni regione supportata: 5.000.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Sonnet 4.5 V1. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Anthropic Claude Sonnet 4.5 V1 1M Context Length | Ogni regione supportata: 1.000.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Sonnet 4.5 V1 1M Context Length. La quota considera la somma combinata dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Anthropic Claude Sonnet 4.6 | Ogni regione supportata: 6.000.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Sonnet 4.6. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Anthropic Claude Sonnet 5 | Ogni regione supportata: 6.000.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Sonnet 5. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Cohere Embed V4 | Ogni regione supportata: 300.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Cohere Embed V4. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per R1 V1 DeepSeek | Ogni regione supportata: 200.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per R1 V1. DeepSeek La quota considera la somma combinata dei token di input e output in tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Meta Llama 3.1 405B Instruct | Ogni regione supportata: 800.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.1 405B Instruct. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Meta Llama 3.1 70B Instruct | Ogni regione supportata: 600.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.1 70B Instruct. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Meta Llama 3.1 8B Instruct | Ogni regione supportata: 600.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.1 8B Instruct. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Meta Llama 3.2 1B Instruct | Ogni regione supportata: 600.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.2 1B Instruct. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Meta Llama 3.2 3B Instruct | Ogni regione supportata: 600.000 | Sì |
Il numero massimo di token che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.2 3B Instruct. La quota considera la somma combinata dei token per InvokeModel,, Converse e. InvokeModelWithResponseStream ConverseStream |
| Cross-region token di inferenza del modello al minuto per Meta Llama 3.3 70B Instruct | Ogni regione supportata: 600.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.3 70B Instruct. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Meta Llama 4, Maverick V1 | Ogni regione supportata: 600.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 4 Maverick V1. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Meta Llama 4 Scout V1 | Ogni regione supportata: 600.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 4 Scout V1. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Mistral Pixtral Large 25.02 V1 | Ogni regione supportata: 80.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Mistral Pixtral Large 25.02 V1. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Writer AI Palmyra X4 V1 | Ogni regione supportata: 150.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Writer AI Palmyra X4 V1. La quota considera la somma combinata dei token di input e output in tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Cross-region token di inferenza del modello al minuto per Writer AI Palmyra X5 V1 | Ogni regione supportata: 150.000 | Sì |
Il numero massimo di token interregionali che puoi inviare per l'inferenza del modello in un minuto per Writer AI Palmyra X5 V1. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Modelli personalizzati con uno stato di creazione per account | Ogni regione supportata: 2 | Sì |
Il numero massimo di modelli personalizzati con uno stato di creazione. |
| DeleteAgent richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di richieste DeleteAgent API al secondo. |
| DeleteAgentActionGroup richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di richieste DeleteAgentActionGroup API al secondo. |
| DeleteAgentAlias richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di richieste DeleteAgentAlias API al secondo. |
| DeleteAgentVersion richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di richieste DeleteAgentVersion API al secondo. |
| DisassociateAgentKnowledgeBase richieste al secondo | Ogni regione supportata: 4 | No | Il numero massimo di richieste DisassociateAgentKnowledgeBase API al secondo. |
| Gruppi di azioni abilitati per agente | Ogni regione supportata: 15 | Sì |
Il numero massimo di gruppi di azioni che è possibile abilitare in un agente. |
| Endpoint per profilo di inferenza | Ogni Regione supportata: 5 | No | Il numero massimo di endpoint in un profilo di inferenza. Un endpoint è definito da un modello e dalla regione a cui vengono inviate le richieste di invocazione al modello. |
| GetAgent richieste al secondo | Ogni regione supportata: 15 | No | Il numero massimo di richieste GetAgent API al secondo. |
| GetAgentActionGroup richieste al secondo | Ogni regione supportata: 20 | No | Il numero massimo di richieste GetAgentActionGroup API al secondo. |
| GetAgentAlias richieste al secondo | Ogni regione supportata: 10 | No | Il numero massimo di richieste GetAgentAlias API al secondo. |
| GetAgentKnowledgeBase richieste al secondo | Ogni regione supportata: 15 | No | Il numero massimo di richieste GetAgentKnowledgeBase API al secondo. |
| GetAgentVersion richieste al secondo | Ogni regione supportata: 10 | No | Il numero massimo di richieste GetAgentVersion API al secondo. |
| Richieste globali di inferenza di modelli interregionali al minuto per Amazon Nova 2 Lite | Ogni regione supportata: 2.000 | Sì |
Il numero massimo di richieste globali interregionali che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova 2 Lite. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Richieste di inferenza di modelli globali interregionali al minuto per Amazon Nova 2 Omni | Ogni regione supportata: 2.000 | Sì |
Il numero massimo di richieste globali interregionali che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova 2 Omni. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Richieste globali di inferenza di modelli interregionali al minuto per Amazon Nova 2 Pro Preview | Ogni regione supportata: 100 | Sì |
Il numero massimo di richieste globali interregionali che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova 2 Pro Preview. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Richieste di inferenza di modelli globali interregionali al minuto per Anthropic Claude Haiku 4.5 | Ogni regione supportata: 10.000 | Sì |
Il numero massimo di richieste globali interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Haiku 4.5. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Richieste di inferenza di modelli globali interregionali al minuto per Anthropic Claude Opus 4.5 | Ogni regione supportata: 10.000 | Sì |
Il numero massimo di richieste globali interregionali che è possibile inviare per l'inferenza del modello in un minuto per Anthropic Claude Opus 4.5. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Richieste di inferenza di modelli globali interregionali al minuto per Anthropic Claude Opus 4.6 V1 | Ogni regione supportata: 10.000 | Sì |
Il numero massimo di richieste globali interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Opus 4.6 V1. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Richieste di inferenza di modelli globali interregionali al minuto per Anthropic Claude Sonnet 4 V1 | Ogni Regione supportata: 200 | Sì |
Il numero massimo di richieste globali interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Sonnet 4 V1. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Richieste di inferenza di modelli globali interregionali al minuto per Anthropic Claude Sonnet 4.5 V1 | Ogni regione supportata: 10.000 | Sì |
Il numero massimo di richieste globali interregionali che è possibile inviare per l'inferenza del modello in un minuto per Anthropic Claude Sonnet 4.5 V1. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Richieste di inferenza di modelli globali interregionali al minuto per Anthropic Claude Sonnet 4.5 V1 1M Context Length | Ogni regione supportata: 1.000 | Sì |
Il numero massimo di richieste globali interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Sonnet 4.5 V1 1M Context Length. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Richieste di inferenza di modelli globali interregionali al minuto per Anthropic Claude Sonnet 4.6 | Ogni regione supportata: 10.000 | Sì |
Il numero massimo di richieste globali interregionali che è possibile inviare per l'inferenza del modello in un minuto per Anthropic Claude Sonnet 4.6. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Richieste globali di inferenza di modelli interregionali al minuto per Cohere Embed V4 | Ogni regione supportata: 2.000 | Sì |
Il numero massimo di richieste globali interregionali che puoi inviare per l'inferenza del modello in un minuto per Cohere Embed V4. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza di modelli globali interregionali al giorno per Amazon Nova 2 Lite | Ogni regione supportata: 11.520.000.000 | No | Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un giorno per Amazon Nova 2 Lite. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza di modelli globali interregionali al giorno per Amazon Nova 2 Omni | Ogni regione supportata: 11.520.000.000 | No | Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un giorno per Amazon Nova 2 Omni. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza di modelli globali interregionali al giorno per Amazon Nova 2 Pro Preview | Ogni regione supportata: 1.440.000.000 | No | Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un giorno per Amazon Nova 2 Pro Preview. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza di modelli globali interregionali al giorno per Anthropic Claude Fable 5 | Ogni regione supportata: 5.760.000.000 | No | Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un giorno per Anthropic Claude Fable 5. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token giornalieri di inferenza di modelli globali interregionali per Anthropic Claude Haiku 4.5 | Ogni regione supportata: 7.200.000.000 | No | Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un giorno per Anthropic Claude Haiku 4.5. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza di modelli globali interregionali al giorno per Anthropic Claude Opus 4.5 | Ogni regione supportata: 2.880.000.000 | No | Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un giorno per Anthropic Claude Opus 4.5. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza di modelli globali interregionali al giorno per Anthropic Claude Opus 4.6 V1 | Ogni regione supportata: 4.320.000.000 | No | Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un giorno per Anthropic Claude Opus 4.6 V1. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza di modelli globali interregionali al giorno per Anthropic Claude Opus 4.7 | Ogni regione supportata: 14.400.000.000 | No | Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un giorno per Anthropic Claude Opus 4.7. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza di modelli globali interregionali al giorno per Anthropic Claude Opus 4.8 | Ogni regione supportata: 43.200.000.000 | No | Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un giorno per Anthropic Claude Opus 4.8. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza di modelli globali interregionali al giorno per Anthropic Claude Opus 5 | Ogni regione supportata: 43.200.000.000 | No | Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un giorno per Anthropic Claude Opus 5. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza di modelli globali interregionali al giorno per Anthropic Claude Sonnet 4 V1 | Ogni regione supportata: 288.000.000 | No | Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un giorno per Anthropic Claude Sonnet 4 V1. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza di modelli globali interregionali al giorno per Anthropic Claude Sonnet 4.5 V1 | Ogni regione supportata: 7.200.000.000 | No | Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un giorno per Anthropic Claude Sonnet 4.5 V1. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza del modello globale interregionale al giorno per Anthropic Claude Sonnet 4.5 V1 1M Context Length | Ogni regione supportata: 1.440.000.000 | No | Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un giorno per Anthropic Claude Sonnet 4.5 V1 1M Context Length. La quota considera la somma combinata dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token giornalieri di inferenza di modelli globali interregionali per Anthropic Claude Sonnet 4.6 | Ogni regione supportata: 8.640.000.000 | No | Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un giorno per Anthropic Claude Sonnet 4.6. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza di modelli globali interregionali al giorno per Anthropic Claude Sonnet 5 | Ogni regione supportata: 8.640.000.000 | No | Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un giorno per Anthropic Claude Sonnet 5. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza di modelli globali interregionali al giorno per Cohere Embed V4 | Ogni regione supportata: 432.000.000 | No | Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un giorno per Cohere Embed V4. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza di modelli globali interregionali al minuto per Amazon Nova 2 Lite | Ogni regione supportata: 8.000.000 | Sì |
Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova 2 Lite. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza di modelli globali interregionali al minuto per Amazon Nova 2 Omni | Ogni regione supportata: 8.000.000 | Sì |
Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova 2 Omni. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza di modelli globali interregionali al minuto per Amazon Nova 2 Pro Preview | Ogni regione supportata: 1.000.000 | Sì |
Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova 2 Pro Preview. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza del modello globale interregionale al minuto per Anthropic Claude Fable 5 | Ogni regione supportata: 4.000.000 | Sì |
Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Fable 5. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza del modello globale interregionale al minuto per Anthropic Claude Haiku 4.5 | Ogni regione supportata: 5.000.000 | Sì |
Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Haiku 4.5. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza del modello globale interregionale al minuto per Anthropic Claude Opus 4.5 | Ogni regione supportata: 2.000.000 | Sì |
Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Opus 4.5. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza del modello globale interregionale al minuto per Anthropic Claude Opus 4.6 V1 | Ogni regione supportata: 3.000.000 | Sì |
Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Opus 4.6 V1. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza del modello globale interregionale al minuto per Anthropic Claude Opus 4.7 | Ogni regione supportata: 10.000.000 | Sì |
Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Opus 4.7. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza del modello globale interregionale al minuto per Anthropic Claude Opus 4.8 | Ogni regione supportata: 30.000.000 | Sì |
Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Opus 4.8. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza del modello globale interregionale al minuto per Anthropic Claude Opus 5 | Ogni regione supportata: 30.000.000 | Sì |
Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Opus 5. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza del modello globale interregionale al minuto per Anthropic Claude Sonnet 4 V1 | Ogni regione supportata: 200.000 | Sì |
Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Sonnet 4 V1. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza del modello globale interregionale al minuto per Anthropic Claude Sonnet 4.5 V1 | Ogni regione supportata: 5.000.000 | Sì |
Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Sonnet 4.5 V1. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza del modello globale interregionale al minuto per Anthropic Claude Sonnet 4.5 V1 1M Context Length | Ogni regione supportata: 1.000.000 | Sì |
Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Sonnet 4.5 V1 1M Context Length. La quota considera la somma combinata dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza del modello globale interregionale al minuto per Anthropic Claude Sonnet 4.6 | Ogni regione supportata: 6.000.000 | Sì |
Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Sonnet 4.6. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza del modello globale interregionale al minuto per Anthropic Claude Sonnet 5 | Ogni regione supportata: 6.000.000 | Sì |
Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Sonnet 5. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Token di inferenza di modelli globali interregionali al minuto per Cohere Embed V4 | Ogni regione supportata: 300.000 | Sì |
Il numero massimo di token globali interregionali che puoi inviare per l'inferenza del modello in un minuto per Cohere Embed V4. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Modelli importati per account | Ogni regione supportata: 3 | Sì |
Il numero massimo di modelli importati in un account. |
| Profili di inferenza per account | Ogni regione supportata: 1.000 | Sì |
Il numero massimo di profili di inferenza in un account. |
| ListAgentActionGroups richieste al secondo | Ogni regione supportata: 10 | No | Il numero massimo di richieste ListAgentActionGroups API al secondo. |
| ListAgentAliases richieste al secondo | Ogni regione supportata: 10 | No | Il numero massimo di richieste ListAgentAliases API al secondo. |
| ListAgentKnowledgeBases richieste al secondo | Ogni regione supportata: 10 | No | Il numero massimo di richieste ListAgentKnowledgeBases API al secondo. |
| ListAgentVersions richieste al secondo | Ogni regione supportata: 10 | No | Il numero massimo di richieste ListAgentVersions API al secondo. |
| ListAgents richieste al secondo | Ogni regione supportata: 10 | No | Il numero massimo di richieste ListAgents API al secondo. |
| Numero minimo di record per processo di inferenza in batch per Amazon Nova 2 Multimodal Embeddings V1 | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Amazon Nova 2 Multimodal Embeddings V1. |
| Numero minimo di record per processo di inferenza in batch per Amazon Nova Premier | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Amazon Nova Premier. |
| Numero minimo di record per processo di inferenza in batch per Claude 3 Haiku | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Claude 3 Haiku. |
| Numero minimo di record per processo di inferenza in batch per Claude 3 Opus | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Claude 3 Opus. |
| Numero minimo di record per processo di inferenza in batch per Claude 3 Sonnet | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Claude 3 Sonnet. |
| Numero minimo di record per processo di inferenza in batch per Claude 3.5 Haiku | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Claude 3.5 Haiku. |
| Numero minimo di record per processo di inferenza in batch per Claude 3.5 Sonnet | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Claude 3.5 Sonnet. |
| Numero minimo di record per processo di inferenza in batch per Claude 3.5 Sonnet v2 | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Claude 3.5 Sonnet v2. |
| Numero minimo di record per processo di inferenza in batch per Claude 3.7 Sonnet | Ogni regione supportata: 100 | Sì |
Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Claude 3.7 Sonnet. |
| Numero minimo di record per processo di inferenza in batch per Claude Haiku 4.5 | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Claude Haiku 4.5. |
| Numero minimo di record per processo di inferenza in batch per Claude Opus 4.5 | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Claude Opus 4.5. |
| Numero minimo di record per processo di inferenza in batch per Claude Opus 4.6 | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Claude Opus 4.6. |
| Numero minimo di record per processo di inferenza in batch per Claude Opus 5 | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Claude Opus 5. |
| Numero minimo di record per processo di inferenza in batch per Claude Sonnet 4 | Ogni regione supportata: 100 | Sì |
Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Claude Sonnet 4. |
| Numero minimo di record per processo di inferenza in batch per Claude Sonnet 4.5. | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Claude Sonnet 4.5. |
| Numero minimo di record per processo di inferenza in batch per Claude Sonnet 4.6 | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Claude Sonnet 4.6. |
| Numero minimo di record per processo di inferenza in batch per DeepSeek V3.2 | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per. DeepSeek V3.2 |
| Numero minimo di record per processo di inferenza batch per v3 DeepSeek | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per v3. DeepSeek |
| Numero minimo di record per processo di inferenza batch per Devstral 2 123B | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Devstral 2 123B. |
| Numero minimo di record per processo di inferenza in batch per GLM 4.7 | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per GLM 4.7. |
| Numero minimo di record per processo di inferenza in batch per GLM 4.7 Flash | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per GLM 4.7 Flash. |
| Numero minimo di record per processo di inferenza in batch per GLM 5 | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per GLM 5. |
| Numero minimo di record per processo di inferenza in batch per Gemma 3 12B | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Gemma 3 12B. |
| Numero minimo di record per processo di inferenza in batch per Gemma 3 27B | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Gemma 3 27B. |
| Numero minimo di record per processo di inferenza in batch per Gemma 3 4B | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Gemma 3 4B. |
| Numero minimo di record per processo di inferenza in batch per Kimi K2 Thinking | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Kimi K2 Thinking. |
| Numero minimo di record per processo di inferenza in batch per Kimi K2.5 | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Kimi. K2.5 |
| Numero minimo di record per processo di inferenza batch per Llama 3.1 405B Instruct | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Llama 3.1 405B Instruct. |
| Numero minimo di record per processo di inferenza batch per Llama 3.1 70B Instruct | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Llama 3.1 70B Instruct. |
| Numero minimo di record per processo di inferenza batch per Llama 3.1 8B Instruct | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Llama 3.1 8B Instruct. |
| Numero minimo di record per processo di inferenza batch per Llama 3.2 11B Instruct | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Llama 3.2 11B Instruct. |
| Numero minimo di record per processo di inferenza batch per Llama 3.2 1B Instruct | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch Llama 3.2 1B Instruct. |
| Numero minimo di record per processo di inferenza batch per Llama 3.2 3B Instruct | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Llama 3.2 3B Instruct. |
| Numero minimo di record per processo di inferenza batch per Llama 3.2 90B Instruct | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Llama 3.2 90B Instruct. |
| Numero minimo di record per processo di inferenza batch per Llama 3.3 70B Instruct | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Llama 3.3 70B Instruct. |
| Numero minimo di record per processo di inferenza in batch per Llama 4 Maverick | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Llama 4 Maverick. |
| Numero minimo di record per processo di inferenza in batch per Llama 4 Scout | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Llama 4 Scout. |
| Numero minimo di record per processo di inferenza in batch per Magistral Small 2509 | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Magistral Small 2509. |
| Numero minimo di record per processo di inferenza in batch per M2 MiniMax | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per MiniMax M2. |
| Numero minimo di record per processo di inferenza batch per MiniMax M2.1 | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per. MiniMax M2.1 |
| Numero minimo di record per processo di inferenza in batch per MiniMax M2.5 | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per. MiniMax M2.5 |
| Numero minimo di record per processo di inferenza in batch per Ministral 3 14B | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Ministral 3 14B. |
| Numero minimo di record per processo di inferenza in batch per Ministral 3 8B | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Ministral 3 8B. |
| Numero minimo di record per processo di inferenza in batch per Ministral 3B | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Ministral 3B. |
| Numero minimo di record per processo di inferenza in batch per Mistral Large 2 (24.07) | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Mistral Large 2 (24.07). |
| Numero minimo di record per processo di inferenza in batch per Mistral Large 3 | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Mistral Large 3. |
| Numero minimo di record per processo di inferenza in batch per Mistral Small | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Mistral Small. |
| Numero minimo di record per processo di inferenza in batch per NVIDIA Nemotron 3 Super 120B A12B | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per NVIDIA Nemotron 3 Super 120B A12B. |
| Numero minimo di record per processo di inferenza in batch per NVIDIA Nemotron Nano 12B | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per NVIDIA Nemotron Nano 12B. |
| Numero minimo di record per processo di inferenza in batch per NVIDIA Nemotron Nano 3 30B | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per NVIDIA Nemotron Nano 3 30B. |
| Numero minimo di record per processo di inferenza in batch per NVIDIA Nemotron Nano 9B | Ogni regione supportata: 100 | No | Il numero minimo di record su tutti i file di input in un processo di inferenza batch per NVIDIA Nemotron Nano 9B. |
| Numero minimo di record per processo di inferenza in batch per Nova 2 Lite | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Nova 2 Lite. |
| Numero minimo di record per processo di inferenza in batch per Nova Lite V1 | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Nova Lite V1. |
| Numero minimo di record per processo di inferenza in batch per Nova Micro V1 | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Nova Micro V1. |
| Numero minimo di record per processo di inferenza in batch per Nova Pro V1 | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Nova Pro V1. |
| Numero minimo di record per processo di inferenza batch per OpenAI GPT OSS 120b | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per OpenAI GPT OSS 120b. |
| Numero minimo di record per processo di inferenza batch per OpenAI GPT OSS 20b | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per OpenAI GPT OSS 20b. |
| Numero minimo di record per processo di inferenza batch per OpenAI GPT OSS Safeguard 120b | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per OpenAI GPT OSS Safeguard 120b. |
| Numero minimo di record per processo di inferenza batch per OpenAI GPT OSS Safeguard 20b | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per OpenAI GPT OSS Safeguard 20b. |
| Numero minimo di record per processo di inferenza in batch per Qwen3 235B | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Qwen3 235B. |
| Numero minimo di record per processo di inferenza in batch per Qwen3 32B | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Qwen3 32B. |
| Numero minimo di record per processo di inferenza in batch per Qwen3 Coder 30B | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Qwen3 Coder 30B. |
| Numero minimo di record per processo di inferenza in batch per Qwen3 Coder 480B | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Qwen3 Coder 480B. |
| Numero minimo di record per processo di inferenza in batch per Qwen3 Coder Next | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Qwen3 Coder Next. |
| Numero minimo di record per processo di inferenza in batch per Qwen3 Next 80B | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Qwen3 Next 80B. |
| Numero minimo di record per processo di inferenza in batch per Qwen3 VL 235B | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Qwen3 VL 235B. |
| Numero minimo di record per processo di inferenza batch per Titan Multimodal Embeddings G1 | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Titan Multimodal Embeddings G1. |
| Numero minimo di record per processo di inferenza in batch per Titan Text Embeddings V2 | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Titan Text Embeddings V2. |
| Numero minimo di record per processo di inferenza in batch per Voxtral Mini 3B 2507 | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Voxtral Mini 3B 2507. |
| Numero minimo di record per processo di inferenza in batch per Voxtral Small 24B 2507 | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Voxtral Small 24B 2507. |
| Numero minimo di record per processo di inferenza in batch per Writer Palmyra Vision 7B | Ogni regione supportata: 100 | No | Il numero minimo di record in tutti i file di input in un processo di inferenza batch per Writer Palmyra Vision 7B. |
| Token giornalieri ottimizzati per la latenza massima di richiamo del modello per Amazon Nova Pro V1 | Ogni regione supportata: 57.600.000 | No | Il numero massimo di token che puoi inviare per l'inferenza del modello con latenza ottimizzata in un giorno per Amazon Nova Pro V1. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Numero massimo di token di richiamo del modello al giorno per AI21 Labs Jamba 1.5 Large (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 432.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per AI21 Labs Jamba 1.5 Large. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per AI21 Labs Jamba 1.5 Mini (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 432.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per AI21 Labs Jamba 1.5 Mini. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Amazon Nova 2 Lite (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 5.760.000.000 | No | Numero massimo giornaliero di token per l'inferenza dei modelli per Amazon Nova 2 Lite. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Amazon Nova 2 Omni (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 5.760.000.000 | No | Numero massimo giornaliero di token per l'inferenza dei modelli per Amazon Nova 2 Omni. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Amazon Nova 2 Pro Preview (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 720.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Amazon Nova 2 Pro Preview. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Amazon Nova Lite (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 5.760.000.000 | No | Numero massimo giornaliero di token per l'inferenza dei modelli per Amazon Nova Lite. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Amazon Nova Micro (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 5.760.000.000 | No | Numero massimo giornaliero di token per l'inferenza dei modelli per Amazon Nova Micro. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Amazon Nova Premier V1 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 1.440.000.000 | No | Numero massimo giornaliero di token per l'inferenza dei modelli per Amazon Nova Premier V1. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Amazon Nova Pro (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 1.440.000.000 | No | Numero massimo giornaliero di token per l'inferenza dei modelli per Amazon Nova Pro. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Anthropic Claude 3 Haiku (raddoppiato per le chiamate interregionali) |
us-east-1:2.880.000.000 us-west-2:2.880.000.000 ap-nord-est-1:288.000.000 ap-sudest-1:288.000.000 Ciascuna delle altre regioni supportate: 432.000.000 |
No | Numero massimo giornaliero di token per l'inferenza del modello per Anthropic Claude 3 Haiku. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Anthropic Claude 3.5 Haiku (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 2.880.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Anthropic Claude 3.5 Haiku. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Anthropic Claude 3.5 Sonnet V1 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 2.880.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Anthropic Claude 3.5 Sonnet V1. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Anthropic Claude 3.5 Sonnet V2 (raddoppiato per le chiamate interregionali) |
us-east-1:2.880.000.000 us-west-2:2.880.000.000 Ciascuna delle altre regioni supportate: 576.000.000 |
No | Numero massimo giornaliero di token per l'inferenza del modello per Anthropic Claude 3.5 Sonnet V2. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Anthropic Claude 3.7 Sonnet V1 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 720.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Anthropic Claude 3.7 Sonnet V1. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Anthropic Claude Fable 5 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 2.880.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Anthropic Claude Fable 5. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Anthropic Claude Haiku 4.5 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 3.600.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Anthropic Claude Haiku 4.5. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Anthropic Claude Opus 4 V1 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Anthropic Claude Opus 4 V1. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Anthropic Claude Opus 4.1 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 360.000.000 | No | Numero massimo giornaliero di token per l'inferenza dei modelli per Anthropic Claude Opus 4.1. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Anthropic Claude Opus 4.5 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 1.440.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Anthropic Claude Opus 4.5. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Anthropic Claude Opus 4.6 V1 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 2.160.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Anthropic Claude Opus 4.6 V1. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Anthropic Claude Opus 4.7 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 7.200.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Anthropic Claude Opus 4.7. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Anthropic Claude Opus 4.8 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 21.600.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Anthropic Claude Opus 4.8. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Anthropic Claude Opus 5 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 21.600.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Anthropic Claude Opus 5. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Anthropic Claude Sonnet 4 V1 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Anthropic Claude Sonnet 4 V1. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Anthropic Claude Sonnet 4 V1 1M Context Length (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 720.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Anthropic Claude Sonnet 4 V1 1M Context Length. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Anthropic Claude Sonnet 4.5 V1 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 3.600.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Anthropic Claude Sonnet 4.5 V1. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Anthropic Claude Sonnet 4.5 V1 1M Context Length (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 720.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Anthropic Claude Sonnet 4.5 V1 1M Context Length. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Anthropic Claude Sonnet 4.6 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 4.320.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Anthropic Claude Sonnet 4.6. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Anthropic Claude Sonnet 5 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 4.320.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Anthropic Claude Sonnet 5. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Cohere Embed V4 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 216.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Cohere Embed V4. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per DeepSeek R1 V1 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per R1 V1. DeepSeek Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per DeepSeek V3 V1 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per V3 V1. DeepSeek Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per (raddoppiato per le DeepSeek V3.2 chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per. DeepSeek V3.2 Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per GPT OSS Safeguard 120B (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per GPT OSS Safeguard 120B. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per GPT OSS Safeguard 20B (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per GPT OSS Safeguard 20B. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Gemma 3 12B (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Gemma 3 12B. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Gemma 3 27B (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Gemma 3 27B. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Gemma 3 4B (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Gemma 3 4B. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Kimi K2 Thinking (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza dei modelli per Kimi K2 Thinking. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Magistral Small 1.2 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Magistral Small 1.2. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Meta Llama 3.2 11B Instruct (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 432.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Meta Llama 3.2 11B Instruct. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Meta Llama 3.2 1B Instruct (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 432.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Meta Llama 3.2 1B Instruct. Combina la somma dei token di input e output tra tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Meta Llama 3.2 3B Instruct (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 432.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Meta Llama 3.2 3B Instruct. Combina la somma dei token di input e output tra tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Meta Llama 3.2 90B Instruct (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 432.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Meta Llama 3.2 90B Instruct. Combina la somma dei token di input e output tra tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Meta Llama 4 Maverick V1 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 432.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Meta Llama 4 Maverick V1. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Meta Llama 4 Scout V1 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 432.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Meta Llama 4 Scout V1. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per (raddoppiato per le MiniMax M2.5 chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per. MiniMax M2.5 Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Minimax M2 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Minimax M2. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per M2.1 Minimax (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Minimax. M2.1 Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Ministral 14B 3.0 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Ministral 14B 3.0. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Ministral 3B 3.0 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Ministral 3B 3.0. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Ministral 8B 3.0 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Ministral 8B 3.0. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Mistral AI Mistral 7B Instruct (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 432.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Mistral AI Mistral 7B Instruct. Combina la somma dei token di input e output tra tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Mistral AI Mistral Large (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 432.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Mistral AI Mistral Large. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Mistral AI Mistral Small (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 432.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Mistral AI Mistral Small. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Mistral AI Mixtral 8X7B Instruct (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 432.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Mistral AI Mixtral 8X7B Instruct. Combina la somma dei token di input e output tra tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Mistral Devstral 2 123b (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Mistral Devstral 2 123b. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Mistral Large 3 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Mistral Large 3. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Mistral Pixtral Large 25.02 V1 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 57.600.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Mistral Pixtral Large 25.02 V1. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Moonshot AI Kimi (raddoppiato per le chiamate interregionali) K2.5 | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Moonshot AI Kimi. K2.5 Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per NVIDIA Nemotron 3 Super 120B A12B (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per NVIDIA Nemotron 3 Super 120B A12B. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per NVIDIA Nemotron Nano 2 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per NVIDIA Nemotron Nano 2. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per NVIDIA Nemotron Nano 2 VL (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per NVIDIA Nemotron Nano 2 VL. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Nemotron Nano 3 30B (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Nemotron Nano 3 30B. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per OpenAI GPT OSS 120B (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per OpenAI GPT OSS 120B. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per OpenAI GPT OSS 20B (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per OpenAI GPT OSS 20B. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Qwen3 235B a22b 2507 V1 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Qwen3 235B a22b 2507 V1. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Qwen3 32B V1 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Qwen3 32B V1. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Qwen3 Coder 30B a3b V1 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Qwen3 Coder 30B a3b V1. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Qwen3 Coder 480B a35b V1 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Qwen3 Coder 480B a35b V1. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Qwen3 Coder Next (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Qwen3 Coder Next. Combina la somma dei token di input e output tra tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Qwen3 Next 80B A3B (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Qwen3 Next 80B A3B. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Qwen3 VL 235B A22B (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Qwen3 VL 235B A22B. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Voxtral Mini 1.0 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Voxtral Mini 1.0. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Voxtral Small 1.0 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Voxtral Small 1.0. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Writer AI Palmyra X4 V1 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 108.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Writer AI Palmyra X4 V1. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Writer AI Palmyra X5 V1 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 108.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Writer AI Palmyra X5 V1. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Writer Palmyra Vision 7B (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Writer Palmyra Vision 7B. Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Z.ai GLM 5 (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per GLM 5. Z.ai Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per (raddoppiato per le Z.ai GLM-4.7 chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per. Z.ai GLM-4.7 Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Numero massimo di token di richiamo del modello al giorno per Z.ai GLM-4.7 Flash (raddoppiato per le chiamate interregionali) | Ogni regione supportata: 144.000.000.000 | No | Numero massimo giornaliero di token per l'inferenza del modello per Flash. Z.ai GLM-4.7 Combina la somma dei token di input e output di tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream Raddoppiato per le chiamate interregionali; non applicabile in caso di aumento del TPM approvato. |
| Unità modello senza impegno Produttività assegnata tra i modelli base | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità di modello che possono essere distribuite su Provisioned Throughput senza impegno per i modelli base |
| Unità modello Provisioned Throughput senza impegno su modelli personalizzati | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità di modello che possono essere distribuite su Provisioned Throughput senza impegno per modelli personalizzati |
| Unità modello per modello fornito per AI21 Labs Mid Jurassic-2 | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per AI21 Labs Mid. Jurassic-2 |
| Unità modello per modello fornito per AI21 Labs Ultra Jurassic-2 | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per AI21 Labs Ultra. Jurassic-2 |
| Unità modello per modello fornito per Amazon Nova 2 Lite 256K V1.0 | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Amazon Nova 2 Lite 256K. V1.0 |
| Unità modello per modello fornito per Amazon Nova Canvas | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Amazon Nova Canvas. |
| Unità di modello per modello fornito per Amazon Titan Embeddings G1 - Text | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità di modello che possono essere assegnate a un modello fornito per Amazon Titan Embeddings G1 - Text. |
| Unità modello per modello fornito per Amazon Titan Image Generator G1 | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità di modello che possono essere assegnate a un modello fornito per Amazon Titan Image Generator G1. |
| Unità di modello per modello fornito per Amazon Titan Image Generator G2 | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità di modello che possono essere assegnate a un modello fornito per Amazon Titan Image Generator G2. |
| Unità modello per modello fornito per Amazon Titan Lite V1 4K | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità di modello che possono essere assegnate a un modello fornito per Amazon Titan Text Lite V1 4K. |
| Unità modello per modello fornito per Amazon Titan Multimodal Embeddings G1 | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità di modello che possono essere assegnate a un modello fornito per Amazon Titan Multimodal Embeddings G1. |
| Unità di modello per modello fornito per Amazon Titan Text Embeddings V2 | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità di modello che possono essere assegnate a un modello fornito per Amazon Titan Text Embeddings V2. |
| Unità modello per modello fornito per Amazon Titan Text G1 - Express 8K | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità di modello che possono essere assegnate a un modello fornito per Amazon Titan Text G1 - Express 8K. |
| Unità modello per modello fornito per Amazon Titan Text Premier V1 32K | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità di modello che possono essere assegnate a un modello fornito per Amazon Titan Text Premier V1 32K. |
| Unità modello per modello fornito per Anthropic Claude 3 Haiku 200K | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Anthropic Claude 3 Haiku 200K. |
| Unità del modello per modello fornito per Anthropic Claude 3 Haiku 48K | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Anthropic Claude 3 Haiku 48K. |
| Unità del modello per modello fornito per Anthropic Claude 3 Sonnet 200K | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Anthropic Claude 3 Sonnet 200K. |
| Unità modello per modello fornito per Anthropic Claude 3 Sonnet 28K | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Anthropic Claude 3 Sonnet 28K. |
| Unità del modello per modello fornito per Anthropic Claude 3.5 Haiku 16K | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Anthropic Claude 3.5 Haiku 16K. |
| Unità del modello per modello fornito per Anthropic Claude 3.5 Haiku 200K | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Anthropic Claude 3.5 Haiku 200K. |
| Unità del modello per modello fornito per Anthropic Claude 3.5 Haiku 64K | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Anthropic Claude 3.5 Haiku 64K. |
| Unità del modello per modello fornito per Anthropic Claude 3.5 Sonnet 18K | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Anthropic Claude 3.5 Sonnet 18K. |
| Unità modello per modello fornito per Anthropic Claude 3.5 Sonnet 200K | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Anthropic Claude 3.5 Sonnet 200K. |
| Unità di modello per modello fornito per Anthropic Claude 3.5 Sonnet 51K | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Anthropic Claude 3.5 Sonnet 51K. |
| Unità del modello per modello fornito per Anthropic Claude 3.5 Sonnet V2 18K | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Anthropic Claude 3.5 Sonnet V2 18K. |
| Unità del modello per modello fornito per Anthropic Claude 3.5 Sonnet V2 200K | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Anthropic Claude 3.5 Sonnet V2 200K. |
| Unità del modello per modello fornito per Anthropic Claude 3.5 Sonnet V2 51K | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Anthropic Claude 3.5 Sonnet V2 51K. |
| Unità del modello per modello fornito per Anthropic Claude 3.7 Sonnet 18K V1.0 | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Anthropic Claude 3.7 Sonnet 18K. V1.0 |
| Unità modello per modello fornito per Anthropic Claude 3.7 Sonnet 200K V1.0 | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Anthropic Claude 3.7 Sonnet 200K. V1.0 |
| Unità modello per modello fornito per Anthropic Claude 3.7 Sonnet 51K V1.0 | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Anthropic Claude 3.7 Sonnet 51K. V1.0 |
| Unità del modello per modello fornito per Anthropic Claude Instant V1 100K | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Anthropic Claude Instant V1 100K. |
| Unità del modello per modello fornito per Anthropic Claude V2 100K | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Anthropic Claude V2 100K. |
| Unità del modello per modello fornito per Anthropic Claude V2 18K | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Anthropic Claude V2 18K. |
| Unità del modello per modello fornito per Anthropic Claude 18K V2.1 | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Anthropic Claude 18K. V2.1 |
| Unità del modello per modello fornito per Anthropic Claude 200K V2.1 | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Anthropic Claude 200K. V2.1 |
| Unità modello per modello assegnato per Cohere Command | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Cohere Command. |
| Unità modello per modello fornito per Cohere Command Light | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Cohere Command Light. |
| Unità modello per modello fornito per Cohere Command R | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Cohere Command R 128k. |
| Unità modello per modello fornito per Cohere Command R Plus | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Cohere Command R Plus 128k. |
| Unità modello per modello fornito per Cohere Embed English | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Cohere Embed English. |
| Unità modello per modello fornito per Cohere Embed Multilingual | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Cohere Embed Multilingual. |
| Unità modello per modello fornito per Meta Llama 2 13B | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Meta Llama 2 13B. |
| Unità modello per modello fornito per Meta Llama 2 70B | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Meta Llama 2 70B. |
| Unità modello per modello fornito per Meta Llama 2 Chat 13B | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Meta Llama 2 Chat 13B. |
| Unità modello per modello fornito per Meta Llama 2 Chat 70B | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Meta Llama 2 Chat 70B. |
| Unità modello per modello fornito per Meta Llama 3 70B Instruct | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Meta Llama 3 70B Instruct. |
| Unità modello per modello fornito per Meta Llama 3 8B Instruct | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Meta Llama 3 8B Instruct. |
| Unità di modello per modello fornito per Meta Llama 3.1 70B Instruct | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Meta Llama 3.1 70B Instruct. |
| Unità di modello per modello fornito per Meta Llama 3.1 8B Instruct | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Meta Llama 3.1 8B Instruct. |
| Unità di modello per modello fornito per Meta Llama 3.2 11B Instruct | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Meta Llama 3.2 11B Instruct. |
| Unità di modello per modello fornito per Meta Llama 3.2 1B Instruct | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Meta Llama 3.2 1B Instruct. |
| Unità di modello per modello fornito per Meta Llama 3.2 3B Instruct | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Meta Llama 3.2 3B Instruct. |
| Unità di modello per modello fornito per Meta Llama 3.2 90B Instruct | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Meta Llama 3.2 90B Instruct. |
| Unità modello per modello fornito per Mistral Large 2407 | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Mistral Large 2407. |
| Unità modello per modello fornito per Mistral Small | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Mistral Small. |
| Unità modello per modello fornito per Stable Diffusion XL 0.8 Stability.ai | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Stable Diffusion XL 0.8 Stability.ai |
| Unità modello per modello fornito per Stable Diffusion XL 1.0 Stability.ai | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per Stability.ai Stable Diffusion XL 1.0. |
| Unità modello per modello fornito per la variante con lunghezza di contesto di 128.000 per Amazon Nova Micro | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per la variante con lunghezza di contesto di 128k per Amazon Nova Micro |
| Unità modello per modello fornito per la variante con lunghezza di contesto di 24k per Amazon Nova Lite | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità di modello che possono essere assegnate a un modello fornito per la variante con lunghezza di contesto di 24k per Amazon Nova Lite |
| Unità modello per modello fornito per la variante con lunghezza di contesto di 24k per Amazon Nova Micro | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per la variante con lunghezza di contesto di 24k per Amazon Nova Micro |
| Unità modello per modello fornito per la variante con lunghezza di contesto di 24k per Amazon Nova Pro | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un modello fornito per la variante con lunghezza di contesto di 24k per Amazon Nova Pro |
| Unità modello per modello fornito per la variante con lunghezza di contesto di 300.000 per Amazon Nova Lite | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità di modello che possono essere assegnate a un modello fornito per la variante con lunghezza di contesto di 300.000 per Amazon Nova Lite |
| Unità modello per modello fornito per la variante con lunghezza di contesto di 300.000 per Amazon Nova Pro | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità di modello che possono essere assegnate a un modello fornito per la variante con lunghezza di contesto di 300.000 per Amazon Nova Pro. |
| Unità modello, con impegno, per Provisioned Throrough create per Meta Llama 4 Scout 17B Instruct 10M | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità modello che possono essere assegnate a un Provisioned Throughput creato per Meta Llama 4 Scout 17B Instruct 10M, con impegno. |
| Unità modello, con impegno, per Provisioned Through create per Meta Llama 4 Scout 17B Instruct 128K | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità del modello che possono essere assegnate a un Provisioned Throughput creato per Meta Llama 4 Scout 17B Instruct 128K, con impegno. |
| Unità modello, con impegno, per Provisioned Through create per Meta Maverick 4 Scout 17B Instruct 128K | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità del modello che possono essere assegnate a un Provisioned Throughput creato per Meta Llama 4 Maverick 17B Instruct 128K, con impegno. |
| Unità modello, con impegno, per Provisioned Through create per Meta Maverick 4 Scout 17B Instruct 1M | Ogni regione supportata: 0 | Sì |
Il numero massimo di unità del modello che possono essere assegnate a un Provisioned Throughput creato per Meta Llama 4 Maverick 17B Instruct 1M, con impegno. |
| No-commitment unità modello per Provisioned Throughput create per il modello base Amazon Nova 2 Lite 256K V1.0 | Ogni regione supportata: 0 | No | Il numero massimo di unità del modello che possono essere allocate a un Provisioned Throughput creato per il modello base Amazon Nova 2 Lite 256K, senza impegno V1.0 |
| No-commitment unità modello per Provisioned Throughput create per il modello personalizzato Amazon Nova 2 Lite 256K V1.0 | Ogni regione supportata: 0 | No | Il numero massimo di unità di modello che possono essere allocate a un Provisioned Throughput creato per il modello personalizzato Amazon Nova 2 Lite V1.0 256K, senza impegno. |
| Numero di router prompt personalizzati per account | Ogni regione supportata: 500 | No | Il numero massimo di router prompt personalizzati che è possibile creare per account e per regione. |
| On-Demand, richieste di inferenza del modello ottimizzate per la latenza al minuto per Amazon Nova Pro V1 | Ogni regione supportata: 10 | No | Il numero massimo di richieste su richiesta e ottimizzate per la latenza che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova Pro V1. La quota considera la somma combinata di Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-Demand, richieste di inferenza del modello ottimizzate per la latenza al minuto per Meta Llama 3.1 405B Instruct | Ogni regione supportata: 100 | No | Il numero massimo di richieste su richiesta e ottimizzate per la latenza che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.1 405B Instruct. La quota considera la somma combinata di Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-Demand, richieste di inferenza del modello ottimizzate per la latenza al minuto per Meta Llama 3.1 70B Instruct | Ogni regione supportata: 100 | No | Il numero massimo di richieste su richiesta e ottimizzate per la latenza che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.1 70B Instruct. La quota considera la somma combinata di Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-Demand, token di inferenza del modello ottimizzati per la latenza al minuto per Amazon Nova Pro V1 | Ogni regione supportata: 40.000 | No | Il numero massimo di token on-demand e ottimizzati per la latenza che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova Pro V1. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-Demand, token di inferenza del modello ottimizzati per la latenza al minuto per Meta Llama 3.1 405B Instruct | Ogni regione supportata: 40.000 | No | Il numero massimo di token on-demand e ottimizzati per la latenza che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.1 405B Instruct. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-Demand, token di inferenza del modello ottimizzati per la latenza al minuto per Meta Llama 3.1 70B Instruct | Ogni regione supportata: 40.000 | No | Il numero massimo di token on-demand e ottimizzati per la latenza che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.1 70B Instruct. La quota considera la somma combinata dei token di input e output di tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand InvokeModel richieste simultanee asincrone per Amazon Nova 2 Multimodal Embeddings V1 | Ogni regione supportata: 30 | No | Il numero massimo di richieste di inferenza di modelli simultanei asincrone che puoi inviare per Amazon Nova 2 Multimodal Embeddings V1. La quota considera la somma combinata di Converse,,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand InvokeModel richieste simultanee asincrone per Marengo Embed 3.0 TwelveLabs | Ogni regione supportata: 10 | Sì |
Il numero massimo di richieste di inferenza di modelli simultanei asincrone che puoi inviare per Marengo Embed 3.0. TwelveLabs La quota considera la somma combinata di Converse,,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand InvokeModel richieste simultanee per Amazon Nova 2 Sonic | Ogni regione supportata: 20 | No | Il numero massimo di richieste simultanee di inferenza di modelli che puoi inviare per Amazon Nova 2 Sonic. La quota considera la somma combinata di Converse,,, ConverseStream e. InvokeModel InvokeModelWithResponseStream |
| On-demand InvokeModel richieste simultanee per Amazon Nova Reel1.0 | Ogni regione supportata: 10 | No | Il numero massimo di richieste simultanee di inferenza di modelli che puoi inviare per Amazon Nova Reel 1.0. La quota considera la somma combinata di Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand InvokeModel richieste simultanee per Amazon Nova Reel1.1 | Ogni regione supportata: 3 | No | Il numero massimo di richieste simultanee di inferenza di modelli che puoi inviare per Amazon Nova Reel 1.1. La quota considera la somma combinata di Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand InvokeModel richieste simultanee per Amazon Nova Sonic | Ogni regione supportata: 20 | No | Il numero massimo di richieste simultanee che puoi inviare per l'inferenza del modello per Amazon Nova Sonic. |
| On-demand InvokeModel richieste simultanee per Twelve Labs Marengo | Ogni regione supportata: 30 | No | Il numero massimo di InvokeModel richieste simultanee che è possibile inviare per l'inferenza del modello per Twelve Labs Marengo. |
| On-demand InvokeModel richieste simultanee per Twelve Labs Pegasus | Ogni regione supportata: 30 | Sì |
Il numero massimo di InvokeModel richieste simultanee che puoi inviare per l'inferenza del modello per Twelve Labs Pegasus. |
| On-demand richieste di inferenza di modelli ottimizzate per la latenza al minuto per Anthropic Claude 3.5 Haiku | Ogni regione supportata: 100 | No | Il numero massimo di volte in cui è possibile chiamare inferenza del modello in un minuto. La quota considera la somma combinata di Converse InvokeModel e ConverseStream, InvokeModelWithResponseStream per Anthropic Claude 3.5 Haiku, se l'ottimizzazione della latenza è configurata. |
| On-demand token di inferenza del modello ottimizzati per la latenza al minuto per Anthropic Claude 3.5 Haiku | Ogni regione supportata: 500.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse InvokeModel e InvokeModelWithResponseStream per Anthropic Claude 3.5 ConverseStream Haiku, se l'ottimizzazione della latenza è configurata. |
| On-demand inferenza del modello: richieste simultanee per Luma Ray V2 | Ogni regione supportata: 1 | No | Il numero massimo di richieste simultanee che è possibile inviare per l'inferenza del modello per Luma Ray V2. La quota considera la somma combinata di Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per AI21 Labs Jamba 1.5 Large | Ogni regione supportata: 100 | No | Il numero massimo di volte in cui è possibile chiamare inferenza del modello in un minuto per AI21 Labs Jamba 1.5 Large. La quota considera la somma combinata delle richieste per Converse e InvokeModel |
| On-demand richieste di inferenza del modello al minuto per AI21 Labs Jamba 1.5 Mini | Ogni regione supportata: 100 | No | Il numero massimo di volte in cui è possibile chiamare inferenza del modello in un minuto per AI21 Labs Jamba 1.5 Mini. La quota considera la somma combinata delle richieste per Converse e InvokeModel |
| On-demand richieste di inferenza del modello al minuto per Amazon Nova 2 Multimodal Embeddings V1 | Ogni regione supportata: 2.000 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova 2 Multimodal Embeddings V1. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Amazon Nova Canvas | Ogni regione supportata: 100 | No | Il numero massimo di richieste che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova Canvas. La quota considera la somma combinata di Converse, ConverseStream, InvokeModel e. InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Amazon Nova Lite |
us-east-1: 2.000 eu-west-2:2.000 Ogni altra regione supportata: 200 |
No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova Lite. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Amazon Nova Micro |
us-east-1: 2.000 eu-west-2:2.000 Ogni altra regione supportata: 200 |
No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova Micro. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Amazon Nova Pro | Ogni regione supportata: 250 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova Pro. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Amazon Rerank 1.0 | Ogni Regione supportata: 200 | No | Il numero massimo di volte che puoi chiamare InvokeModel in un minuto per Amazon Rerank 1.0. |
| On-demand richieste di inferenza del modello al minuto per Amazon Titan Image Generator G1 | Ogni regione supportata: 60 | No | Il numero massimo di volte che puoi chiamare InvokeModel in un minuto per Amazon Titan Image Generator G1. |
| On-demand richieste di inferenza del modello al minuto per Amazon Titan Image Generator G1 V2 | Ogni regione supportata: 60 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Amazon Titan Image Generator G1 V2. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Amazon Titan Multimodal Embeddings G1 | Ogni regione supportata: 2.000 | No | Il numero massimo di volte che puoi chiamare InvokeModel in un minuto per Amazon Titan Multimodal Embeddings G1. |
| On-demand richieste di inferenza di modelli al minuto per Amazon Titan Text Embeddings | Ogni regione supportata: 2.000 | No | Il numero massimo di volte che puoi chiamare InvokeModel in un minuto per Amazon Titan Text Embeddings |
| On-demand richieste di inferenza del modello al minuto per Amazon Titan Text Embeddings V2 | Ogni regione supportata: 6.000 | No | Il numero massimo di volte che puoi chiamare InvokeModel in un minuto per Amazon Titan Text Embeddings V2 |
| On-demand richieste di inferenza di modelli al minuto per Amazon Titan Text Express | Ogni regione supportata: 400 | No | Il numero massimo di volte in cui puoi chiamare inferenza del modello in un minuto. La quota considera la somma combinata di Converse InvokeModel e ConverseStream, InvokeModelWithResponseStream per Amazon Titan Text Express |
| On-demand richieste di inferenza dei modelli al minuto per Amazon Titan Text Premier | Ogni regione supportata: 100 | No | Il numero massimo di volte in cui puoi chiamare l'inferenza del modello in un minuto. La quota considera la somma combinata di Converse InvokeModel e ConverseStream, InvokeModelWithResponseStream per Amazon Titan Text Premier |
| On-demand modello di richieste di inferenza al minuto per Anthropic Claude 3 Haiku |
us-east-1: 1.000 us-west-2: 1.000 ap-northeast-1:200 ap-sudest-1:200 Ciascuna delle altre regioni supportate: 400 |
No | Il numero massimo di volte in cui è possibile chiamare l'inferenza del modello in un minuto. La quota considera la somma combinata di Converse InvokeModel e ConverseStream, InvokeModelWithResponseStream per Anthropic Claude 3 Haiku. |
| On-demand modello di richieste di inferenza al minuto per Anthropic Claude 3 Opus | Ogni Regione supportata: 50 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude 3 Opus. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand modello di richieste di inferenza al minuto per Anthropic Claude 3 Sonnet |
us-east-1: 500 us-west-2: 500 Ogni altra regione supportata: 100 |
No | Il numero massimo di volte in cui è possibile chiamare inferenza del modello in un minuto. La quota considera la somma combinata di Converse InvokeModel e ConverseStream, InvokeModelWithResponseStream per Anthropic Claude 3 Sonnet. |
| On-demand modello di richieste di inferenza al minuto per Anthropic Claude 3.5 Haiku |
us-west-1:400 Tutte le altre regioni supportate: 1.000 |
No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude 3.5 Haiku. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand modello di richieste di inferenza al minuto per Anthropic Claude 3.5 Sonnet |
us-west-2:250 ap-nordest-1:20 ap-sud-est-1:20 eu-central-1:20 eu-west-1: 20 eu-west-3:20 Ogni altra regione supportata: 50 |
No | Il numero massimo di volte in cui è possibile chiamare inferenza del modello in un minuto per Anthropic Claude 3.5 Sonnet. La quota considera la somma combinata di Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand modello di richieste di inferenza al minuto per Anthropic Claude 3.5 Sonnet V2 |
us-west-2:250 Ogni altra regione supportata: 50 |
No | Il numero massimo di volte in cui è possibile chiamare inferenza del modello in un minuto per Anthropic Claude 3.5 Sonnet V2. La quota considera la somma combinata di Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand modello di richieste di inferenza al minuto per Anthropic Claude 3.7 Sonnet V1 | Ogni regione supportata: 125 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per Anthropic Claude 3.7 Sonnet V1. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand modello di richieste di inferenza al minuto per Anthropic Claude Opus 4.6 V1 | Ogni regione supportata: 5.000 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per Anthropic Claude Opus 4.6 V1. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand modello di richieste di inferenza al minuto per Anthropic Claude Sonnet 4.6 | Ogni regione supportata: 5.000 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per Anthropic Claude Sonnet 4.6. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Cohere Command R | Ogni regione supportata: 400 | No | Il numero massimo di volte in cui è possibile chiamare l'inferenza del modello in un minuto. La quota considera la somma combinata di Converse InvokeModel e ConverseStream, InvokeModelWithResponseStream per Cohere Command R 128k. |
| On-demand richieste di inferenza del modello al minuto per Cohere Command R Plus | Ogni regione supportata: 400 | No | Il numero massimo di volte in cui è possibile chiamare l'inferenza del modello in un minuto. La quota considera la somma combinata di Converse InvokeModel e ConverseStream, InvokeModelWithResponseStream per Cohere Command R Plus 128k. |
| On-demand modello di richieste di inferenza al minuto per Cohere Embed English | Ogni regione supportata: 2.000 | No | Il numero massimo di volte che puoi chiamare InvokeModel in un minuto per Cohere Embed English. |
| On-demand modello di richieste di inferenza al minuto per Cohere Embed Multilingual | Ogni regione supportata: 2.000 | No | Il numero massimo di volte che puoi chiamare InvokeModel in un minuto per Cohere Embed Multilingual. |
| On-demand richieste di inferenza del modello al minuto per Cohere Embed V4 | Ogni regione supportata: 1.000 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Cohere Embed V4. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Cohere Rerank 3.5 | Ogni regione supportata: 250 | No | Il numero massimo di volte che puoi chiamare InvokeModel in un minuto per Cohere Rerank 3.5. |
| On-demand richieste di inferenza del modello al minuto per V3 V1 DeepSeek | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per V3 V1. DeepSeek Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per DeepSeek V3.2 | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta per le quali è possibile inviare per l'inferenza del modello in un minuto. DeepSeek V3.2 Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per GPT OSS Safeguard 120B | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per GPT OSS Safeguard 120B. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per GPT OSS Safeguard 20B | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per GPT OSS Safeguard 20B. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand modello di richieste di inferenza al minuto per Gemma 3 12B | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Gemma 3 12B. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand modello di richieste di inferenza al minuto per Gemma 3 27B | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Gemma 3 27B. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand modello di richieste di inferenza al minuto per Gemma 3 4B | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Gemma 3 4B. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Kimi K2 Thinking | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Kimi K2 Thinking. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand modello di richieste di inferenza al minuto per Magistral Small 1.2 | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Magistral Small 1.2. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Meta Llama 3 70B Instruct | Ogni regione supportata: 400 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3 70B Instruct. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Meta Llama 3 8B Instruct | Ogni regione supportata: 800 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3 8B Instruct. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Meta Llama 3.1 405B Instruct | Ogni Regione supportata: 200 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.1 405B Instruct. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Meta Llama 3.1 70B Instruct | Ogni regione supportata: 400 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.1 70B Instruct. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Meta Llama 3.1 8B Instruct | Ogni regione supportata: 800 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.1 8B Instruct. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Meta Llama 3.2 11B Instruct | Ogni regione supportata: 400 | No | Il numero massimo di volte in cui puoi chiamare l'inferenza del modello in un minuto per Meta Llama 3.2 11B Instruct. La quota considera la somma combinata delle richieste per InvokeModel, InvokeModelWithResponseStream, Converse e. ConverseStream |
| On-demand richieste di inferenza del modello al minuto per Meta Llama 3.2 1B Instruct | Ogni regione supportata: 800 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.2 1B Instruct. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Meta Llama 3.2 3B Instruct | Ogni regione supportata: 800 | No | Il numero massimo di volte in cui puoi chiamare l'inferenza del modello in un minuto per Meta Llama 3.2 3B Instruct. La quota considera la somma combinata delle richieste per InvokeModel, InvokeModelWithResponseStream, Converse e. ConverseStream |
| On-demand richieste di inferenza del modello al minuto per Meta Llama 3.2 90B Instruct | Ogni regione supportata: 400 | No | Il numero massimo di volte in cui puoi chiamare l'inferenza del modello in un minuto per Meta Llama 3.2 90B Instruct. La quota considera la somma combinata delle richieste per InvokeModel, InvokeModelWithResponseStream, Converse e. ConverseStream |
| On-demand richieste di inferenza del modello al minuto per Meta Llama 3.3 70B Instruct | Ogni regione supportata: 400 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.3 70B Instruct. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per MiniMax M2.5 | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta per le quali è possibile inviare per l'inferenza del modello in un minuto. MiniMax M2.5 Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Minimax M2 | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per Minimax M2. Questa quota rappresenta il numero totale di richieste InvokeModel e InvokeModelWithResponseStream azioni al Converse. ConverseStream |
| On-demand richieste di inferenza del modello al minuto per Minimax M2.1 | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Minimax. M2.1 Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand modello di richieste di inferenza al minuto per Ministral 14B 3.0 | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Ministral 14B 3.0. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand modello di richieste di inferenza al minuto per Ministral 3B 3.0 | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Ministral 3B 3.0. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand modello di richieste di inferenza al minuto per Ministral 8B 3.0 | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Ministral 8B 3.0. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Mistral 7B Instruct | Ogni regione supportata: 800 | No | Il numero massimo di volte che puoi chiamare in un minuto per Mistral InvokeModel mistral-7b-instruct-v0 |
| On-demand modellare le richieste di inferenza al minuto per Mistral AI Mistral Small | Ogni regione supportata: 400 | No | Il numero massimo di volte che puoi chiamare InvokeModel e InvokeModelWithResponseStream in un minuto per Mistral AI Mistral Small |
| On-demand modello di richieste di inferenza al minuto per Mistral Devstral 2 123b | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per Mistral Devstral 2 123b. Questa quota rappresenta il numero totale di richieste e azioni al Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Mistral Large | Ogni regione supportata: 400 | No | Il numero massimo di volte che puoi chiamare InvokeModel e InvokeModelWithResponseStream in un minuto per Mistral mistral-large 2402-v1 |
| On-demand richieste di inferenza del modello al minuto per Mistral Large 2407 | Ogni regione supportata: 400 | No | Il numero massimo di volte in cui è possibile chiamare l'inferenza del modello in un minuto per Mistral Large 2407. La quota considera la somma combinata delle richieste per InvokeModel, Converse e InvokeModelWithResponseStream ConverseStream |
| On-demand richieste di inferenza del modello al minuto per Mistral Large 3 | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Mistral Large 3. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Mistral Mixtral 8x7b Instruct | Ogni regione supportata: 400 | No | Il numero massimo di volte che puoi chiamare in un minuto per Mistral mixtral-8x7b-v0 InvokeModel |
| On-demand richieste di inferenza del modello al minuto per Moonshot AI Kimi K2.5 | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Moonshot AI Kimi. K2.5 Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per NVIDIA Nemotron 3 Super 120B A12B | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per NVIDIA Nemotron 3 Super 120B A12B. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per NVIDIA Nemotron Nano 2 | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per NVIDIA Nemotron Nano 2. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per NVIDIA Nemotron Nano 2 VL | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per NVIDIA Nemotron Nano 2 VL. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Nemotron Nano 3 30B | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per Nemotron Nano 3 30B. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per OpenAI GPT OSS 120B | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per OpenAI GPT OSS 120B. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per OpenAI GPT OSS 20B | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per OpenAI GPT OSS 20B. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Qwen3 235B a22b 2507 V1 | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per Qwen3 235B a22b 2507 V1. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Qwen3 32B V1 | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per Qwen3 32B V1. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Qwen3 Coder 30B a3b V1 | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per Qwen3 Coder 30B a3b V1. Questa quota rappresenta il numero totale di richieste al Converse e di azioni. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Qwen3 Coder 480B a35b V1 | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per Qwen3 Coder 480B a35b V1. Questa quota rappresenta il numero totale di richieste e azioni al Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Qwen3 Coder Next | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per Qwen3 Coder Next. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Qwen3 Next 80B A3B | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per Qwen3 Next 80B A3B. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Qwen3 VL 235B A22B | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per Qwen3 VL 235B A22B. Questa quota rappresenta il numero totale di richieste e azioni al Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Stability.ai Stable Diffusion 3 Large | Ogni regione supportata: 15 | No | Il numero massimo di volte che puoi chiamare InvokeModel in un minuto per Stability.ai Stable Diffusion 3 Large. |
| On-demand richieste di inferenza del modello al minuto per Stability.ai Stable Diffusion 3 Medium | Ogni regione supportata: 60 | No | Il numero massimo di volte che puoi chiamare InvokeModel in un minuto per Stability.ai Stable Diffusion 3 Medium |
| On-demand richieste di inferenza del modello al minuto per Stability.ai Stable Diffusion 3.5 Large | Ogni regione supportata: 15 | No | Il numero massimo di volte che puoi chiamare InvokeModel in un minuto per Stability.ai Stable Diffusion 3.5 Large. |
| On-demand richieste di inferenza del modello al minuto per Stability.ai Stable Image Core | Ogni regione supportata: 90 | No | Il numero massimo di volte che puoi chiamare InvokeModel in un minuto per Stability.ai Stable Image Core. |
| On-demand richieste di inferenza del modello al minuto per Stability.ai Stable Image Ultra | Ogni regione supportata: 10 | No | Il numero massimo di volte che puoi chiamare InvokeModel in un minuto per Stability.ai Stable Image Ultra. |
| On-demand richieste di inferenza del modello al minuto per Stable Image Conservative Upscale | Ogni regione supportata: 2 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per Stable Image Conservative Upscale. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Stable Image Control Sketch | Ogni regione supportata: 10 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per Stable Image Control Sketch. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Stable Image Control Structure | Ogni regione supportata: 10 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per Stable Image Control Structure. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Stable Image Creative Upscale | Ogni regione supportata: 2 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Stable Image Creative Upscale. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Stable Image Erase Object | Ogni regione supportata: 10 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per Stable Image Erase Object. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Stable Image Fast Upscale | Ogni regione supportata: 10 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per Stable Image Fast Upscale. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Stable Image Inpaint | Ogni regione supportata: 10 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Stable Image Inpaint. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Stable Image Outpaint | Ogni regione supportata: 2 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Stable Image Outpaint. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Stable Image Remove Background | Ogni regione supportata: 10 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Stable Image Remove Background. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Stable Image Search e Recolor | Ogni regione supportata: 10 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Stable Image Search e Recolor. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Stable Image Search and Replace | Ogni regione supportata: 10 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Stable Image Search and Replace. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Stable Image Style Guide | Ogni regione supportata: 10 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Stable Image Style Guide. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Stable Image Style Transfer | Ogni regione supportata: 10 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per Stable Image Style Transfer. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand modello di richieste di inferenza al minuto per Twelve Labs Marengo | Ogni regione supportata: 100 | No | Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per Twelve Labs Marengo. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Twelve Labs Pegasus | Ogni regione supportata: 60 | Sì |
Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Twelve Labs Pegasus. La quota considera la somma combinata di Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per TwelveLabs Marengo Embed 3.0 | Ogni regione supportata: 500 | Sì |
Il numero massimo di richieste su richiesta che è possibile inviare per l'inferenza del modello in un minuto per Marengo Embed 3.0. TwelveLabs Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Voxtral Mini 1.0 | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Voxtral Mini 1.0. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Voxtral Small 1.0 | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Voxtral Small 1.0. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Writer Palmyra Vision 7B | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Writer Palmyra Vision 7B. Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Z.ai GLM 5 | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per GLM 5. Z.ai Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Z.ai GLM-4.7 | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta per le quali è possibile inviare per l'inferenza del modello in un minuto. Z.ai GLM-4.7 Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand richieste di inferenza del modello al minuto per Flash Z.ai GLM-4.7 | Ogni regione supportata: 10.000 | No | Il numero massimo di richieste su richiesta che puoi inviare per l'inferenza del modello in un minuto per Flash. Z.ai GLM-4.7 Questa quota rappresenta il numero totale di richieste e azioni a Converse. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per AI21 Labs Jamba 1.5 Large | Ogni regione supportata: 300.000 | No | Il numero massimo di token che puoi inviare per l'inferenza del modello in un minuto per AI21 Labs Jamba 1.5 Large. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. InvokeModel |
| On-demand token di inferenza del modello al minuto per AI21 Labs Jamba 1.5 Mini | Ogni regione supportata: 300.000 | No | Il numero massimo di token che puoi inviare per l'inferenza del modello in un minuto per AI21 Labs Jamba 1.5 Mini. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. InvokeModel |
| On-demand token di inferenza del modello al minuto per Amazon Nova Lite |
us-east-1:4.000.000 eu-west-2:4.000.000 Ciascuna delle altre regioni supportate: 200.000 |
No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova Lite. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Amazon Nova Micro |
us-east-1:4.000.000 eu-west-2:4.000.000 Ciascuna delle altre regioni supportate: 200.000 |
No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova Micro. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Amazon Nova Pro | Ogni regione supportata: 1.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Amazon Nova Pro. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Amazon Titan Image Generator G1 V2 | Ogni regione supportata: 2.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Amazon Titan Image Generator G1 V2. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Amazon Titan Multimodal Embeddings G1 | Ogni regione supportata: 300.000 | No | Il numero massimo di token che puoi fornire in un minuto per Amazon Titan Multimodal InvokeModel Embeddings G1. |
| On-demand token di inferenza del modello al minuto per Amazon Titan Text Embeddings | Ogni regione supportata: 300.000 | No | Il numero massimo di token che puoi fornire InvokeModel in un minuto per Amazon Titan Text Embeddings. |
| On-demand token di inferenza del modello al minuto per Amazon Titan Text Embeddings V2 | Ogni regione supportata: 300.000 | No | Il numero massimo di token che puoi fornire InvokeModel in un minuto per Amazon Titan Text Embeddings V2. |
| On-demand token di inferenza del modello al minuto per Amazon Titan Text Express | Ogni regione supportata: 300.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse InvokeModel e InvokeModelWithResponseStream per Amazon Titan ConverseStream Text Express. |
| On-demand token di inferenza del modello al minuto per Amazon Titan Text Premier | Ogni regione supportata: 300.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse InvokeModel e InvokeModelWithResponseStream per Amazon Titan ConverseStream Text Premier. |
| On-demand token di inferenza del modello al minuto per Anthropic Claude 3 Haiku |
us-east-1:2.000.000 us-west-2:2.000.000 ap-northeast-1:200.000 ap-sudest-1:200.000 Ciascuna delle altre regioni supportate: 300.000 |
No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e per Anthropic Claude 3 ConverseStream InvokeModel InvokeModelWithResponseStream Haiku. |
| On-demand token di inferenza del modello al minuto per Anthropic Claude 3 Opus | Ogni regione supportata: 400.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude 3 Opus. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Anthropic Claude 3 Sonnet |
us-east-1:1.000.000 us-west-2:1.000.000 Ciascuna delle altre regioni supportate: 200.000 |
No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse InvokeModel e InvokeModelWithResponseStream per Anthropic Claude 3 Sonnet. ConverseStream |
| On-demand token di inferenza del modello al minuto per Anthropic Claude 3.5 Haiku |
us-west-1:300.000 Ciascuna delle altre regioni supportate: 2.000.000 |
No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude 3.5 Haiku. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Anthropic Claude 3.5 Sonnet |
us-west-2:2.000.000 ap-northeast-1:200.000 ap-sudest-1:200.000 eu-central-1:200.000 eu-west-1:200.000 eu-west-3:200.000 Ciascuna delle altre regioni supportate: 400.000 |
No | Il numero massimo di token che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude 3.5 Sonnet. La quota considera la somma combinata di Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Anthropic Claude 3.5 Sonnet V2 |
us-west-2:2.000.000 Ciascuna delle altre regioni supportate: 400.000 |
No | Il numero massimo di token che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude 3.5 Sonnet V2. La quota considera la somma combinata di Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Anthropic Claude 3.7 Sonnet V1 | Ogni regione supportata: 500.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude 3.7 Sonnet V1. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Anthropic Claude Opus 4.6 V1 | Ogni regione supportata: 1.500.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Opus 4.6 V1. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Anthropic Claude Sonnet 4.6 | Ogni regione supportata: 3.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Anthropic Claude Sonnet 4.6. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Cohere Command R | Ogni regione supportata: 300.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e per Cohere InvokeModel Command ConverseStream R 128k InvokeModelWithResponseStream . |
| On-demand token di inferenza del modello al minuto per Cohere Command R Plus | Ogni regione supportata: 300.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse InvokeModel e InvokeModelWithResponseStream per Cohere Command ConverseStream R Plus 128k. |
| On-demand token di inferenza del modello al minuto per Cohere Embed English | Ogni regione supportata: 300.000 | No | Il numero massimo di token che puoi fornire InvokeModel in un minuto per Cohere Embed English. |
| On-demand token di inferenza del modello al minuto per Cohere Embed Multilingual | Ogni regione supportata: 300.000 | No | Il numero massimo di token che puoi fornire in un minuto per Cohere Embed InvokeModel Multilingual. |
| On-demand token di inferenza del modello al minuto per Cohere Embed V4 | Ogni regione supportata: 150.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Cohere Embed V4. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per V3, V1 DeepSeek | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per V3 V1. DeepSeek La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per DeepSeek V3.2 | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta per cui è possibile inviare per l'inferenza del modello in un minuto. DeepSeek V3.2 La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per GPT OSS Safeguard 120B | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per GPT OSS Safeguard 120B. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per GPT OSS Safeguard 20B | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per GPT OSS Safeguard 20B. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Gemma 3 12B | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Gemma 3 12B. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Gemma 3 27B | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Gemma 3 27B. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Gemma 3 4B | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Gemma 3 4B. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Kimi K2 Thinking | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Kimi K2 Thinking. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Magistral Small 1.2 | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Magistral Small 1.2. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Meta Llama 3 70B Instruct | Ogni regione supportata: 300.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3 70B Instruct. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Meta Llama 3 8B Instruct | Ogni regione supportata: 300.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3 8B Instruct. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Meta Llama 3.1 405B Instruct | Ogni regione supportata: 400.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.1 405B Instruct. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Meta Llama 3.1 70B Instruct | Ogni regione supportata: 300.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.1 70B Instruct. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Meta Llama 3.1 8B Instruct | Ogni regione supportata: 300.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.1 8B Instruct. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Meta Llama 3.2 11B Instruct | Ogni regione supportata: 300.000 | No | Il numero massimo di token che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.2 11B Instruct. La quota considera la somma combinata dei token per InvokeModel,, Converse e. InvokeModelWithResponseStream ConverseStream |
| On-demand token di inferenza del modello al minuto per Meta Llama 3.2 1B Instruct | Ogni regione supportata: 300.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.2 1B Instruct. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Meta Llama 3.2 3B Instruct | Ogni regione supportata: 300.000 | No | Il numero massimo di token che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.2 3B Instruct. La quota considera la somma combinata dei token per InvokeModel,, Converse e. InvokeModelWithResponseStream ConverseStream |
| On-demand token di inferenza del modello al minuto per Meta Llama 3.2 90B Instruct | Ogni regione supportata: 300.000 | No | Il numero massimo di token che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.2 90B Instruct. La quota considera la somma combinata dei token per InvokeModel,, Converse e. InvokeModelWithResponseStream ConverseStream |
| On-demand token di inferenza del modello al minuto per Meta Llama 3.3 70B Instruct | Ogni regione supportata: 300.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Meta Llama 3.3 70B Instruct. La quota considera la somma combinata dei token di input e output in tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per MiniMax M2.5 | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta per cui è possibile inviare per l'inferenza del modello in un minuto. MiniMax M2.5 La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Minimax M2 | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Minimax M2. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Minimax M2.1 | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Minimax. M2.1 La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Ministral 14B 3.0 | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Ministral 14B 3.0. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Ministral 3B 3.0 | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Ministral 3B 3.0. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Ministral 8B 3.0 | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Ministral 8B 3.0. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Mistral AI Mistral 7B Instruct | Ogni regione supportata: 300.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e per Mistral AI Mistral ConverseStream InvokeModel 7B InvokeModelWithResponseStream Instruct. |
| On-demand token di inferenza del modello al minuto per Mistral AI Mistral Large | Ogni regione supportata: 300.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e per Mistral AI ConverseStream Mistral InvokeModel InvokeModelWithResponseStream Large. |
| On-demand token di inferenza del modello al minuto per Mistral AI Mistral Small | Ogni regione supportata: 300.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e per Mistral AI ConverseStream Mistral InvokeModel InvokeModelWithResponseStream Small. |
| On-demand token di inferenza del modello al minuto per Mistral AI Mixtral 8X7BB Instruct | Ogni regione supportata: 300.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse InvokeModel e InvokeModelWithResponseStream per Mistral AI Mixtral ConverseStream 8X7B Instruct. |
| On-demand token di inferenza del modello al minuto per Mistral Devstral 2 123b | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Mistral Devstral 2 123b. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Mistral Large 2407 | Ogni regione supportata: 300.000 | No | Il numero massimo di token che puoi inviare per l'inferenza del modello in un minuto per Mistral Large 2407. La quota considera la somma combinata dei token per,, Converse e InvokeModel InvokeModelWithResponseStream ConverseStream |
| On-demand token di inferenza del modello al minuto per Mistral Large 3 | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Mistral Large 3. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Moonshot AI Kimi K2.5 | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Moonshot AI Kimi. K2.5 La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per NVIDIA Nemotron 3 Super 120B A12B | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per NVIDIA Nemotron 3 Super 120B A12B. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per NVIDIA Nemotron Nano 2 | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per NVIDIA Nemotron Nano 2. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per NVIDIA Nemotron Nano 2 VL | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per NVIDIA Nemotron Nano 2 VL. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Nemotron Nano 3 30B | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Nemotron Nano 3 30B. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per OpenAI GPT OSS 120B | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per OpenAI GPT OSS 120B. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per OpenAI GPT OSS 20B | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per OpenAI GPT OSS 20B. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Qwen3 235B, a22b 2507 V1 | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Qwen3 235B a22b 2507 V1. La quota considera la somma combinata dei token di input e output di tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Qwen3 32B V1 | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Qwen3 32B V1. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Qwen3 Coder 3.0B, a3b V1 | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Qwen3 Coder 30B a3b V1. La quota considera la somma combinata dei token di input e output di tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Qwen3 Coder 480B a35b V1 | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Qwen3 Coder 480B a35b V1. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Qwen3 Coder Next | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Qwen3 Coder Next. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Qwen3 Next 80B A3B | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Qwen3 Next 80B A3B. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse,, e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Qwen3 VL 235B A22B | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Qwen3 VL 235B A22B. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Voxtral Mini 1.0 | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Voxtral Mini 1.0. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Voxtral Small 1.0 | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Voxtral Small 1.0. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Writer Palmyra Vision 7B | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Writer Palmyra Vision 7B. La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per GLM 5 Z.ai | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per GLM 5. Z.ai La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Z.ai GLM-4.7 | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta per cui è possibile inviare per l'inferenza del modello in un minuto. Z.ai GLM-4.7 La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| On-demand token di inferenza del modello al minuto per Flash Z.ai GLM-4.7 | Ogni regione supportata: 100.000.000 | No | Il numero massimo di token su richiesta che puoi inviare per l'inferenza del modello in un minuto per Flash. Z.ai GLM-4.7 La quota considera la somma combinata dei token di input e output per tutte le richieste a Converse e. ConverseStream InvokeModel InvokeModelWithResponseStream |
| Parametri per funzione | Ogni regione supportata: 5 | Sì |
Il numero massimo di parametri che è possibile avere in una funzione di gruppo di azioni. |
| PrepareAgent richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di richieste PrepareAgent API al secondo. |
| Record per processo di inferenza in batch per Amazon Nova 2 Multimodal Embeddings V1 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Amazon Nova 2 Multimodal Embeddings V1. |
| Record per processo di inferenza in batch per Amazon Nova Premier | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record su tutti i file di input in un processo di inferenza batch per Amazon Nova Premier. |
| Record per processo di inferenza in batch per Claude 3 Haiku | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Claude 3 Haiku. |
| Record per processo di inferenza in batch per Claude 3 Opus | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Claude 3 Opus. |
| Record per processo di inferenza in batch per Claude 3 Sonnet | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Claude 3 Sonnet. |
| Record per processo di inferenza in batch per Claude 3.5 Haiku | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Claude 3.5 Haiku. |
| Record per processo di inferenza batch per Claude 3.5 Sonnet | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Claude 3.5 Sonnet. |
| Record per processo di inferenza batch per Claude 3.5 Sonnet v2 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Claude 3.5 Sonnet v2. |
| Record per processo di inferenza batch per Claude 3.7 Sonnet | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Claude 3.7 Sonnet. |
| Record per processo di inferenza batch per Claude Haiku 4.5 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Claude Haiku 4.5. |
| Record per processo di inferenza batch per Claude Opus 4.5 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Claude Opus 4.5. |
| Record per processo di inferenza batch per Claude Opus 4.6 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Claude Opus 4.6. |
| Record per processo di inferenza batch per Claude Opus 5 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Claude Opus 5. |
| Record per processo di inferenza batch per Claude Sonnet 4 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Claude Sonnet 4. |
| Record per processo di inferenza batch per Claude Sonnet 4.5 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Claude Sonnet 4.5. |
| Record per processo di inferenza batch per Claude Sonnet 4.6 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Claude Sonnet 4.6. |
| Record per processo di inferenza in batch per DeepSeek V3.2 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record su tutti i file di input in un processo di inferenza batch per. DeepSeek V3.2 |
| Record per processo di inferenza batch per v3 DeepSeek | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record su tutti i file di input in un processo di inferenza batch per v3. DeepSeek |
| Record per processo di inferenza batch per Devstral 2 123B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Devstral 2 123B. |
| Record per processo di inferenza in batch per GLM 4.7 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record su tutti i file di input in un processo di inferenza batch per GLM 4.7. |
| Record per processo di inferenza batch per GLM 4.7 Flash | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record su tutti i file di input in un processo di inferenza batch per GLM 4.7 Flash. |
| Record per processo di inferenza in batch per GLM 5 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record su tutti i file di input in un processo di inferenza batch per GLM 5. |
| Record per processo di inferenza batch per Gemma 3 12B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Gemma 3 12B. |
| Record per processo di inferenza batch per Gemma 3 27B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Gemma 3 27B. |
| Record per processo di inferenza batch per Gemma 3 4B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Gemma 3 4B. |
| Record per processo di inferenza in batch per Kimi K2 Thinking | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Kimi K2 Thinking. |
| Record per processo di inferenza in batch per Kimi K2.5 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record su tutti i file di input in un processo di inferenza batch per Kimi. K2.5 |
| Record per processo di inferenza batch per Llama 3.1 405B Instruct | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Llama 3.1 405B Instruct. |
| Record per processo di inferenza batch per Llama 3.1 70B Instruct | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Llama 3.1 70B Instruct. |
| Record per processo di inferenza batch per Llama 3.1 8B Instruct | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Llama 3.1 8B Instruct. |
| Record per processo di inferenza batch per Llama 3.2 11B Instruct | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Llama 3.2 11B Instruct. |
| Record per processo di inferenza batch per Llama 3.2 1B Instruct | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch Llama 3.2 1B Instruct. |
| Record per processo di inferenza batch per Llama 3.2 3B Instruct | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Llama 3.2 3B Instruct. |
| Record per processo di inferenza batch per Llama 3.2 90B Instruct | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Llama 3.2 90B Instruct. |
| Record per processo di inferenza batch per Llama 3.3 70B Instruct | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Llama 3.3 70B Instruct. |
| Record per processo di inferenza in batch per Llama 4 Maverick | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Llama 4 Maverick. |
| Record per processo di inferenza in batch per Llama 4 Scout | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Llama 4 Scout. |
| Record per processo di inferenza in batch per Magistral Small 2509 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Magistral Small 2509. |
| Record per processo di inferenza batch per M2 MiniMax | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per MiniMax M2. |
| Record per processo di inferenza batch per MiniMax M2.1 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record su tutti i file di input in un processo di inferenza batch per. MiniMax M2.1 |
| Record per processo di inferenza batch per MiniMax M2.5 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record su tutti i file di input in un processo di inferenza batch per. MiniMax M2.5 |
| Record per processo di inferenza in batch per Ministral 3 14B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Ministral 3 14B. |
| Record per processo di inferenza in batch per Ministral 3 8B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Ministral 3 8B. |
| Record per processo di inferenza in batch per Ministral 3B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Ministral 3B. |
| Record per processo di inferenza batch per Mistral Large 2 (24.07) | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record su tutti i file di input in un processo di inferenza batch per Mistral Large 2 (24.07). |
| Record per processo di inferenza batch per Mistral Large 3 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record su tutti i file di input in un processo di inferenza batch per Mistral Large 3. |
| Record per processo di inferenza batch per Mistral Small | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record su tutti i file di input in un processo di inferenza batch per Mistral Small. |
| Record per processo di inferenza batch per NVIDIA Nemotron 3 Super 120B A12B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record su tutti i file di input in un processo di inferenza batch per NVIDIA Nemotron 3 Super 120B A12B. |
| Record per processo di inferenza batch per NVIDIA Nemotron Nano 12B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record su tutti i file di input in un processo di inferenza batch per NVIDIA Nemotron Nano 12B. |
| Record per processo di inferenza batch per NVIDIA Nemotron Nano 3 30B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record su tutti i file di input in un processo di inferenza batch per NVIDIA Nemotron Nano 3 30B. |
| Record per processo di inferenza batch per NVIDIA Nemotron Nano 9B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record su tutti i file di input in un processo di inferenza batch per NVIDIA Nemotron Nano 9B. |
| Record per processo di inferenza batch per Nova 2 Lite | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record su tutti i file di input in un processo di inferenza batch per Nova 2 Lite. |
| Record per processo di inferenza batch per Nova Lite V1 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record su tutti i file di input in un processo di inferenza batch per Nova Lite V1. |
| Record per processo di inferenza batch per Nova Micro V1 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record su tutti i file di input in un processo di inferenza batch per Nova Micro V1. |
| Record per processo di inferenza batch per Nova Pro V1 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record su tutti i file di input in un processo di inferenza batch per Nova Pro V1. |
| Record per processo di inferenza batch per OpenAI GPT OSS 120b | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per OpenAI GPT OSS 120b. |
| Record per processo di inferenza batch per OpenAI GPT OSS 20b | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per OpenAI GPT OSS 20b. |
| Record per processo di inferenza batch per OpenAI GPT OSS Safeguard 120b | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per OpenAI GPT OSS Safeguard 120b. |
| Record per processo di inferenza batch per OpenAI GPT OSS Safeguard 20b | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per OpenAI GPT OSS Safeguard 20b. |
| Record per processo di inferenza batch per Qwen3 235B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Qwen3 235B. |
| Record per processo di inferenza batch per Qwen3 32B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Qwen3 32B. |
| Record per processo di inferenza batch per Qwen3 Coder 30B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Qwen3 Coder 30B. |
| Record per processo di inferenza batch per Qwen3 Coder 480B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Qwen3 Coder 480B. |
| Record per processo di inferenza batch per Qwen3 Coder Next | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Qwen3 Coder Next. |
| Record per processo di inferenza batch per Qwen3 Next 80B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Qwen3 Next 80B. |
| Record per processo di inferenza batch per Qwen3 VL 235B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Qwen3 VL 235B. |
| Record per processo di inferenza batch per Titan Multimodal Embeddings G1 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Titan Multimodal Embeddings G1. |
| Record per processo di inferenza batch per Titan Text Embeddings V2 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Titan Text Embeddings V2. |
| Record per processo di inferenza in batch per Voxtral Mini 3B 2507 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Voxtral Mini 3B 2507. |
| Record per processo di inferenza in batch per Voxtral Small 24B 2507 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Voxtral Small 24B 2507. |
| Record per processo di inferenza in batch per Writer Palmyra Vision 7B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in tutti i file di input in un processo di inferenza batch per Writer Palmyra Vision 7B. |
| Record per file di input per processo di inferenza in batch per Amazon Nova 2 Multimodal Embeddings V1 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Amazon Nova 2 Multimodal Embeddings V1. |
| Record per file di input per processo di inferenza in batch per Amazon Nova Premier | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Amazon Nova Premier. |
| Record per file di input per processo di inferenza in batch per Claude 3 Haiku | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Claude 3 Haiku. |
| Record per file di input per processo di inferenza batch per Claude 3 Opus | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Claude 3 Opus. |
| Record per file di input per processo di inferenza batch per Claude 3 Sonnet | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Claude 3 Sonnet. |
| Record per file di input per processo di inferenza batch per Claude 3.5 Haiku | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Claude 3.5 Haiku. |
| Record per file di input per processo di inferenza batch per Claude 3.5 Sonnet | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Claude 3.5 Sonnet. |
| Record per file di input per processo di inferenza batch per Claude 3.5 Sonnet v2 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Claude 3.5 Sonnet v2. |
| Record per file di input per processo di inferenza batch per Claude 3.7 Sonnet | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Claude 3.7 Sonnet. |
| Record per file di input per processo di inferenza batch per Claude Haiku 4.5 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Claude Haiku 4.5. |
| Record per file di input per processo di inferenza batch per Claude Opus 4.5 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Claude Opus 4.5. |
| Record per file di input per processo di inferenza batch per Claude Opus 4.6 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Claude Opus 4.6. |
| Record per file di input per processo di inferenza batch per Claude Opus 5 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Claude Opus 5. |
| Record per file di input per processo di inferenza batch per Claude Sonnet 4 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Claude Sonnet 4. |
| Record per file di input per processo di inferenza batch per Claude Sonnet 4.5 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Claude Sonnet 4.5. |
| Record per file di input per processo di inferenza batch per Claude Sonnet 4.6 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Claude Sonnet 4.6. |
| Record per file di input per processo di inferenza batch per DeepSeek V3.2 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per. DeepSeek V3.2 |
| Record per file di input per processo di inferenza batch per v3 DeepSeek | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per v3. DeepSeek |
| Record per file di input per processo di inferenza batch per Devstral 2 123B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Devstral 2 123B. |
| Record per file di input per processo di inferenza batch per GLM 4.7 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per GLM 4.7. |
| Record per file di input per processo di inferenza batch per GLM 4.7 Flash | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per GLM 4.7 Flash. |
| Record per file di input per processo di inferenza in batch per GLM 5 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per GLM 5. |
| Record per file di input per processo di inferenza batch per Gemma 3 12B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Gemma 3 12B. |
| Record per file di input per processo di inferenza batch per Gemma 3 27B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Gemma 3 27B. |
| Record per file di input per processo di inferenza batch per Gemma 3 4B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Gemma 3 4B. |
| Record per file di input per processo di inferenza batch per Kimi K2 Thinking | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Kimi K2 Thinking. |
| Record per file di input per processo di inferenza in batch per Kimi K2.5 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Kimi. K2.5 |
| Record per file di input per processo di inferenza batch per Llama 3.1 405B Instruct | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Llama 3.1 405B Instruct. |
| Record per file di input per processo di inferenza batch per Llama 3.1 70B Instruct | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Llama 3.1 70B Instruct. |
| Record per file di input per processo di inferenza batch per Llama 3.1 8B Instruct | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Llama 3.1 8B Instruct. |
| Record per file di input per processo di inferenza batch per Llama 3.2 11B Instruct | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Llama 3.2 11B Instruct. |
| Record per file di input per processo di inferenza batch per Llama 3.2 1B Instruct | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch Llama 3.2 1B Instruct. |
| Record per file di input per processo di inferenza batch per Llama 3.2 3B Instruct | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Llama 3.2 3B Instruct. |
| Record per file di input per processo di inferenza batch per Llama 3.2 90B Instruct | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Llama 3.2 90B Instruct. |
| Record per file di input per processo di inferenza batch per Llama 3.3 70B Instruct | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Llama 3.3 70B Instruct. |
| Record per file di input per processo di inferenza batch per Llama 4 Maverick | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Llama 4 Maverick. |
| Record per file di input per processo di inferenza in batch per Llama 4 Scout | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Llama 4 Scout. |
| Record per file di input per processo di inferenza in batch per Magistral Small 2509 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Magistral Small 2509. |
| Record per file di input per processo di inferenza batch per M2 MiniMax | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per MiniMax M2. |
| Record per file di input per processo di inferenza batch per MiniMax M2.1 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per. MiniMax M2.1 |
| Record per file di input per processo di inferenza batch per MiniMax M2.5 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per. MiniMax M2.5 |
| Record per file di input per processo di inferenza batch per Ministral 3 14B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Ministral 3 14B. |
| Record per file di input per processo di inferenza batch per Ministral 3 8B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Ministral 3 8B. |
| Record per file di input per processo di inferenza in batch per Ministral 3B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Ministral 3B. |
| Record per file di input per processo di inferenza batch per Mistral Large 2 (24.07) | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Mistral Large 2 (24.07). |
| Record per file di input per processo di inferenza batch per Mistral Large 3 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Mistral Large 3. |
| Record per file di input per processo di inferenza batch per Mistral Small | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Mistral Small. |
| Record per file di input per processo di inferenza batch per NVIDIA Nemotron 3 Super 120B A12B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per NVIDIA Nemotron 3 Super 120B A12B. |
| Record per file di input per processo di inferenza batch per NVIDIA Nemotron Nano 12B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per NVIDIA Nemotron Nano 12B. |
| Record per file di input per processo di inferenza batch per NVIDIA Nemotron Nano 3 30B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per NVIDIA Nemotron Nano 3 30B. |
| Record per file di input per processo di inferenza batch per NVIDIA Nemotron Nano 9B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per NVIDIA Nemotron Nano 9B. |
| Record per file di input per processo di inferenza batch per Nova 2 Lite | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Nova 2 Lite. |
| Record per file di input per processo di inferenza batch per Nova Lite V1 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Nova Lite V1. |
| Record per file di input per processo di inferenza batch per Nova Micro V1 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Nova Micro V1. |
| Record per file di input per processo di inferenza batch per Nova Pro V1 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Nova Pro V1. |
| Record per file di input per processo di inferenza batch per OpenAI GPT OSS 120b | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per OpenAI GPT OSS 120b. |
| Record per file di input per processo di inferenza batch per OpenAI GPT OSS 20b | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per OpenAI GPT OSS 20b. |
| Record per file di input per processo di inferenza batch per OpenAI GPT OSS Safeguard 120b | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per OpenAI GPT OSS Safeguard 120b. |
| Record per file di input per processo di inferenza batch per OpenAI GPT OSS Safeguard 20b | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per OpenAI GPT OSS Safeguard 20b. |
| Record per file di input per processo di inferenza batch per Qwen3 235B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Qwen3 235B. |
| Record per file di input per processo di inferenza batch per Qwen3 32B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Qwen3 32B. |
| Record per file di input per processo di inferenza batch per Qwen3 Coder 30B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Qwen3 Coder 30B. |
| Record per file di input per processo di inferenza batch per Qwen3 Coder 480B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Qwen3 Coder 480B. |
| Record per file di input per processo di inferenza batch per Qwen3 Coder Next | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Qwen3 Coder Next. |
| Record per file di input per processo di inferenza batch per Qwen3 Next 80B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Qwen3 Next 80B. |
| Record per file di input per processo di inferenza batch per Qwen3 VL 235B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Qwen3 VL 235B. |
| Record per file di input per processo di inferenza batch per Titan Multimodal Embeddings G1 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Titan Multimodal Embeddings G1. |
| Record per file di input per processo di inferenza batch per Titan Text Embeddings V2 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Titan Text Embeddings V2. |
| Record per file di input per processo di inferenza in batch per Voxtral Mini 3B 2507 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Voxtral Mini 3B 2507. |
| Record per file di input per processo di inferenza batch per Voxtral Small 24B 2507 | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Voxtral Small 24B 2507. |
| Record per file di input per processo di inferenza batch per Writer Palmyra Vision 7B | Ogni regione supportata: 100.000 | Sì |
Il numero massimo di record in un file di input in un processo di inferenza batch per Writer Palmyra Vision 7B. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Amazon Nova 2 Multimodal Embeddings V1 | Ogni regione supportata: 100 | Sì |
Il numero massimo di processi di inferenza batch in corso e inviati utilizzando un modello base per Amazon Nova 2 Multimodal Embeddings V1. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Amazon Nova Premier | Ogni regione supportata: 100 | Sì |
Il numero massimo di processi di inferenza batch in corso e inviati utilizzando un modello base per Amazon Nova Premier. |
| Somma dei lavori di inferenza in batch in corso e inviati utilizzando un modello base per Claude 3 Haiku | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude 3 Haiku. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude 3 Opus | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude 3 Opus. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude 3 Sonnet | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude 3 Sonnet. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude 3.5 Haiku | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude 3.5 Haiku. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude 3.5 Sonnet | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude 3.5 Sonnet. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude 3.5 Sonnet v2 | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude 3.5 Sonnet v2. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude 3.7 Sonnet | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude 3.7 Sonnet. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude Haiku 4.5 | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude Haiku 4.5. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude Opus 4.5 | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude Opus 4.5. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude Opus 4.6 | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude Opus 4.6. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude Sonnet 4 | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude Sonnet 4. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude Sonnet 4.5. | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude Sonnet 4.5. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude Sonnet 4.6 | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Claude Sonnet 4.6. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per DeepSeek V3.2 | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per. DeepSeek V3.2 |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per v3 DeepSeek | Ogni regione supportata: 100 | Sì |
Il numero massimo di processi di inferenza batch in corso e inviati utilizzando un modello base per la v3. DeepSeek |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Devstral 2 123B | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Devstral 2 123B. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per GLM 4.7 | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per GLM 4.7. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per GLM 4.7 Flash | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per GLM 4.7 Flash. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per GLM 5 | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per GLM 5. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Gemma 3 12B | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Gemma 3 12B. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Gemma 3 27B | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Gemma 3 27B. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Gemma 3 4B | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Gemma 3 4B. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Kimi K2 Thinking | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Kimi K2 Thinking. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Kimi K2.5 | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Kimi. K2.5 |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Llama 3.1 405B Instruct | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Llama 3.1 405B Instruct. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Llama 3.1 70B Instruct | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Llama 3.1 70B Instruct. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Llama 3.1 8B Instruct | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Llama 3.1 8B Instruct. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Llama 3.2 11B Instruct | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Llama 3.2 11B Instruct. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Llama 3.2 1B Instruct | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Llama 3.2 1B Instruct. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Llama 3.2 3B Instruct | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Llama 3.2 3B Instruct. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Llama 3.2 90B Instruct | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Llama 3.2 90B Instruct. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Llama 3.3 70B Instruct | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Llama 3.3 70B Instruct. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Llama 4 Maverick | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Llama 4 Maverick. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Llama 4 Scout | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Llama 4 Scout. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Magistral Small 2509 | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Magistral Small 2509. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per M2 MiniMax | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per M2. MiniMax |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per MiniMax M2.1 | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per. MiniMax M2.1 |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per MiniMax M2.5 | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per. MiniMax M2.5 |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Ministral 3 14B | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Ministral 3 14B. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Ministral 3 8B | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Ministral 3 8B. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Ministral 3B | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Ministral 3B. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Mistral Large 2 (24.07) | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Mistral Large 2 (24.07). |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Mistral Large 3 | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Mistral Large 3. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Mistral Small | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Mistral Small. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per NVIDIA Nemotron 3 Super 120B A12B | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per NVIDIA Nemotron 3 Super 120B A12B. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per NVIDIA Nemotron Nano 12B | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per NVIDIA Nemotron Nano 12B. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per NVIDIA Nemotron Nano 3 30B | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per NVIDIA Nemotron Nano 3 30B. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per NVIDIA Nemotron Nano 9B | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per NVIDIA Nemotron Nano 9B. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Nova 2 Lite | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Nova 2 Lite. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Nova Lite V1 | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Nova Lite V1. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Nova Micro V1 | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Nova Micro V1. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Nova Pro V1 | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Nova Pro V1. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per OpenAI GPT OSS 120b | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per OpenAI GPT OSS 120b. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per OpenAI GPT OSS 20b | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per OpenAI GPT OSS 20b. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per OpenAI GPT OSS Safeguard 120b | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per OpenAI GPT OSS Safeguard 120b. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per OpenAI GPT OSS Safeguard 20b | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per OpenAI GPT OSS Safeguard 20b. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Qwen3 235B | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Qwen3 235B. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Qwen3 32B | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Qwen3 32B. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Qwen3 Coder 30B | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Qwen3 Coder 30B. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Qwen3 Coder 480B | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Qwen3 Coder 480B. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Qwen3 Coder Next | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Qwen3 Coder Next. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Qwen3 Next 80B | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Qwen3 Next 80B. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Qwen3 VL 235B | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Qwen3 VL 235B. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Titan Multimodal Embeddings G1 | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Titan Multimodal Embeddings G1. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Titan Text Embeddings V2 | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Titan Text Embeddings V2. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Voxtral Mini 3B 2507 | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Voxtral Mini 3B 2507. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Voxtral Small 24B 2507 | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Voxtral Small 24B 2507. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello base per Writer Palmyra Vision 7B | Ogni regione supportata: 100 | Sì |
Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello base per Writer Palmyra Vision 7B. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello personalizzato per Titan Multimodal Embeddings G1 | Ogni regione supportata: 3 | No | Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello personalizzato per Titan Multimodal Embeddings G1. |
| Somma dei lavori di inferenza batch in corso e inviati utilizzando un modello personalizzato per Titan Text Embeddings V2 | Ogni regione supportata: 3 | No | Il numero massimo di lavori di inferenza batch in corso e inviati utilizzando un modello personalizzato per Titan Text Embeddings V2 |
| Limite di velocità di accelerazione per Bedrock Data Automation Runtime: ListTagsForResource | Ogni regione supportata: 25 al secondo | No | Il numero massimo di Bedrock Data Automation Runtime: ListTagsForResource richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per Bedrock Data Automation Runtime: TagResource | Ogni regione supportata: 25 al secondo | No | Il numero massimo di Bedrock Data Automation Runtime: TagResource richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per Bedrock Data Automation Runtime: UntagResource | Ogni regione supportata: 25 al secondo | No | Il numero massimo di Bedrock Data Automation Runtime: UntagResource richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per Bedrock Data Automation: ListTagsForResource | Ogni regione supportata: 25 al secondo | No | Il numero massimo di Bedrock Data Automation: ListTagsForResource richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per Bedrock Data Automation: TagResource | Ogni regione supportata: 25 al secondo | No | Il numero massimo di Bedrock Data Automation: TagResource richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per Bedrock Data Automation: UntagResource | Ogni regione supportata: 25 al secondo | No | Il numero massimo di Bedrock Data Automation: UntagResource richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per CreateBlueprint | Ogni regione supportata: 5 al secondo | No | Il numero massimo di CreateBlueprint richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per CreateBlueprintVersion | Ogni regione supportata: 5 al secondo | No | Il numero massimo di CreateBlueprintVersion richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per CreateDataAutomationLibrary | Ogni regione supportata: 3 al secondo | No | Il numero massimo di CreateDataAutomationLibrary richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per CreateDataAutomationProject | Ogni regione supportata: 5 al secondo | No | Il numero massimo di CreateDataAutomationProject richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per DeleteBlueprint | Ogni regione supportata: 5 al secondo | No | Il numero massimo di DeleteBlueprint richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per DeleteDataAutomationLibrary | Ogni regione supportata: 3 al secondo | No | Il numero massimo di DeleteDataAutomationLibrary richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per DeleteDataAutomationProject | Ogni regione supportata: 5 al secondo | No | Il numero massimo di DeleteDataAutomationProject richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per GetBlueprint | Ogni regione supportata: 5 al secondo | No | Il numero massimo di GetBlueprint richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per GetDataAutomationLibrary | Ogni regione supportata: 5 al secondo | No | Il numero massimo di GetDataAutomationLibrary richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per GetDataAutomationLibraryEntity | Ogni regione supportata: 5 al secondo | No | Il numero massimo di GetDataAutomationLibraryEntity richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per GetDataAutomationLibraryIngestionJob | Ogni regione supportata: 5 al secondo | No | Il numero massimo di GetDataAutomationLibraryIngestionJob richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per GetDataAutomationProject | Ogni regione supportata: 5 al secondo | No | Il numero massimo di GetDataAutomationProject richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per GetDataAutomationStatus | Ogni regione supportata: 10 al secondo | No | Il numero massimo di GetDataAutomationStatus richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per InvokeDataAutomationAsync | Ogni regione supportata: 10 al secondo | No | Il numero massimo di InvokeDataAutomationAsync richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per InvokeDataAutomationLibraryIngestionJob | Ogni regione supportata: 5 al secondo | No | Il numero massimo di InvokeDataAutomationLibraryIngestionJob richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per ListBlueprints | Ogni regione supportata: 5 al secondo | No | Il numero massimo di ListBlueprints richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per ListDataAutomationLibraries | Ogni regione supportata: 5 al secondo | No | Il numero massimo di ListDataAutomationLibraries richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per ListDataAutomationLibraryEntities | Ogni regione supportata: 5 al secondo | No | Il numero massimo di ListDataAutomationLibraryEntities richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per ListDataAutomationLibraryIngestionJobs | Ogni regione supportata: 5 al secondo | No | Il numero massimo di ListDataAutomationLibraryIngestionJobs richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per ListDataAutomationProjects | Ogni regione supportata: 5 al secondo | No | Il numero massimo di ListDataAutomationProjects richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per UpdateBlueprint | Ogni regione supportata: 5 al secondo | No | Il numero massimo di UpdateBlueprint richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per UpdateDataAutomationLibrary | Ogni regione supportata: 5 al secondo | No | Il numero massimo di UpdateDataAutomationLibrary richieste che puoi effettuare al secondo per account, nella regione corrente |
| Limite di velocità di accelerazione per UpdateDataAutomationProject | Ogni regione supportata: 5 al secondo | No | Il numero massimo di UpdateDataAutomationProject richieste che puoi effettuare al secondo per account, nella regione corrente |
| UpdateAgent richieste al secondo | Ogni regione supportata: 4 | No | Il numero massimo di richieste UpdateAgent API al secondo. |
| UpdateAgentActionGroup richieste al secondo | Ogni regione supportata: 6 | No | Il numero massimo di richieste UpdateAgentActionGroup API al secondo. |
| UpdateAgentAlias richieste al secondo | Ogni regione supportata: 2 | No | Il numero massimo di richieste UpdateAgentAlias API al secondo. |
| UpdateAgentKnowledgeBase richieste al secondo | Ogni regione supportata: 4 | No | Il numero massimo di richieste UpdateAgentKnowledgeBase API al secondo. |
| [bedrock-mantle endpoint] Token di input al minuto per Claude Fable 5 | Ogni regione supportata: 2.000.000 | Sì |
[bedrock-mantle endpoint] Il numero massimo di token di input al minuto che il tuo account può inviare a Claude Fable 5 in questa regione. Condiviso tra tutte le API per questo modello. |
| [bedrock-mantle endpoint] Token di input al minuto per Claude Opus 4.7 | Ogni regione supportata: 20.000.000 | Sì |
[bedrock-mantle endpoint] Il numero massimo di token di input al minuto che l'account può inviare a Claude Opus 4.7 in questa regione. Condiviso tra tutte le API per questo modello. |
| [bedrock-mantle endpoint] Token di input al minuto per Claude Opus 4.8 | Ogni regione supportata: 20.000.000 | Sì |
[bedrock-mantle endpoint] Il numero massimo di token di input al minuto che l'account può inviare a Claude Opus 4.8 in questa regione. Condiviso tra tutte le API per questo modello. |
| [bedrock-mantle endpoint] Token di input al minuto per Claude Opus 5 | Ogni regione supportata: 20.000.000 | Sì |
[bedrock-mantle endpoint] Il numero massimo di token di input al minuto che l'account può inviare a Claude Opus 5 in questa regione. Condiviso tra tutte le API per questo modello. |
| [bedrock-mantle endpoint] Token di input al minuto per Claude Sonnet 5 | Ogni regione supportata: 3.000.000 | Sì |
[bedrock-mantle endpoint] Il numero massimo di token di input al minuto che l'account può inviare a Claude Sonnet 5 in questa regione. Condiviso tra tutte le API per questo modello. |
| [bedrock-mantle endpoint] Token di input al minuto per GPT-5.4 | Ogni regione supportata: 20.000.000 | Sì |
[bedrock-mantle endpoint] Il numero massimo di token di input al minuto che il tuo account può inviare in questa regione. GPT-5.4 Condiviso tra tutte le API per questo modello. |
| [bedrock-mantle endpoint] Token di input al minuto per GPT-5.5 | Ogni regione supportata: 10.000.000 | Sì |
[bedrock-mantle endpoint] Il numero massimo di token di input al minuto che il tuo account può inviare in questa regione. GPT-5.5 Condiviso tra tutte le API per questo modello. |
| [bedrock-mantle endpoint] Token di input al minuto per Luna GPT-5.6 | Ogni regione supportata: 20.000.000 | Sì |
[bedrock-mantle endpoint] Il numero massimo di token di input al minuto che il tuo account può inviare a Luna in questa regione. GPT-5.6 Condiviso tra tutte le API per questo modello. |
| [bedrock-mantle endpoint] Token di input al minuto per Sol GPT-5.6 | Ogni regione supportata: 10.000.000 | Sì |
[bedrock-mantle endpoint] Il numero massimo di token di input al minuto che il tuo account può inviare a Sol in questa regione. GPT-5.6 Condiviso tra tutte le API per questo modello. |
| [bedrock-mantle endpoint] Token di input al minuto per Terra GPT-5.6 | Ogni regione supportata: 20.000.000 | Sì |
[bedrock-mantle endpoint] Il numero massimo di token di input al minuto che l'account può inviare a Terra in questa regione. GPT-5.6 Condiviso tra tutte le API per questo modello. |
| [bedrock-mantle endpoint] Token di output al minuto per Claude Fable 5 | Ogni regione supportata: 200.000 | Sì |
[bedrock-mantle endpoint] Il numero massimo di token di output al minuto che Claude Fable 5 può generare per il tuo account in questa regione. Condiviso tra tutte le API per questo modello. |
| [bedrock-mantle endpoint] Token di output al minuto per Claude Opus 4.7 | Ogni regione supportata: 2.000.000 | Sì |
[bedrock-mantle endpoint] Il numero massimo di token di output al minuto che Claude Opus 4.7 può generare per il tuo account in questa regione. Condiviso tra tutte le API per questo modello. |
| [bedrock-mantle endpoint] Token di output al minuto per Claude Opus 4.8 | Ogni regione supportata: 2.000.000 | Sì |
[bedrock-mantle endpoint] Il numero massimo di token di output al minuto che Claude Opus 4.8 può generare per il tuo account in questa regione. Condiviso tra tutte le API per questo modello. |
| [bedrock-mantle endpoint] Token di output al minuto per Claude Opus 5 | Ogni regione supportata: 2.000.000 | Sì |
[bedrock-mantle endpoint] Il numero massimo di token di output al minuto che Claude Opus 5 può generare per il tuo account in questa regione. Condiviso tra tutte le API per questo modello. |
| [bedrock-mantle endpoint] Token di output al minuto per Claude Sonnet 5 | Ogni regione supportata: 300.000 | Sì |
[bedrock-mantle endpoint] Il numero massimo di token di output al minuto che Claude Sonnet 5 può generare per il tuo account in questa regione. Condiviso tra tutte le API per questo modello. |
| [bedrock-mantle endpoint] Token di output al minuto per GPT-5.4 | Ogni regione supportata: 2.000.000 | Sì |
[bedrock-mantle endpoint] È GPT-5.4 possibile generare il numero massimo di token di output al minuto per il tuo account in questa regione. Condiviso tra tutte le API per questo modello. |
| [bedrock-mantle endpoint] Token di output al minuto per GPT-5.5 | Ogni regione supportata: 1.000.000 | Sì |
[bedrock-mantle endpoint] È possibile generare il numero massimo di token di output al minuto per il tuo account in questa regione. GPT-5.5 Condiviso tra tutte le API per questo modello. |
| [bedrock-mantle endpoint] Token di output al minuto per Luna GPT-5.6 | Ogni regione supportata: 2.000.000 | Sì |
[bedrock-mantle endpoint] Il numero massimo di token di output al minuto che GPT-5.6 Luna può generare per il tuo account in questa regione. Condiviso tra tutte le API per questo modello. |
| [bedrock-mantle endpoint] Token di output al minuto per Sol GPT-5.6 | Ogni regione supportata: 1.000.000 | Sì |
[bedrock-mantle endpoint] Il numero massimo di token di output al minuto che Sol può generare per il tuo account in questa regione. GPT-5.6 Condiviso tra tutte le API per questo modello. |
| [bedrock-mantle endpoint] Token di output al minuto per Terra GPT-5.6 | Ogni regione supportata: 2.000.000 | Sì |
[bedrock-mantle endpoint] Il numero massimo di token di output al minuto che GPT-5.6 Terra può generare per il tuo account in questa regione. Condiviso tra tutte le API per questo modello. |
Nota
Puoi richiedere un aumento delle quote per il tuo account seguendo questa procedura:
-
Se una quota è contrassegnata con Sì, puoi modificarla seguendo la procedura riportata nella sezione Richiesta di aumento delle quote nella Guida per l’utente di Service Quotas.
-
Se una quota è contrassegnata come No, puoi inviare una richiesta tramite il modulo di aumento del limite per
prendere in considerazione un aumento. -
Per qualsiasi modello, puoi richiedere un aumento per le quote seguenti:
-
Cross-Region InvokeModel gettoni al minuto per
${model} -
Cross-Region InvokeModel richieste al minuto per
${model} -
On-demand InvokeModel gettoni al minuto per
${model} -
On-demand InvokeModel richieste al minuto per
${model}
Per richiedere un aumento per qualsiasi combinazione di queste quote, richiedi un aumento dei Cross-Region InvokeModel token al minuto per la
${model}quota seguendo i passaggi indicati in Richiedere un aumento della quota nella Guida per l'utente delle quote di servizio. Dopo averlo fatto, il team di supporto ti contatterà e ti offrirà la possibilità di aumentare anche le altre tre quote. A causa dell’enorme domanda, verrà data priorità ai clienti che generano traffico che utilizza la loro assegnazione di quote esistenti. La tua richiesta potrebbe essere rifiutata se non soddisfi questa condizione. -