View a markdown version of this page

Endpunkte und Kontingente von Amazon Bedrock - AWS Allgemeine Referenz

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

Endpunkte und Kontingente von Amazon Bedrock

Um programmgesteuert eine Verbindung zu einem AWS Service herzustellen, verwenden Sie einen Endpunkt. AWS Dienste bieten in einigen oder allen AWS Regionen, die der Dienst unterstützt, die folgenden Endpunkttypen an: IPv4-Endpunkte, Dual-Stack-Endpunkte und FIPS-Endpunkte. Einige Dienste bieten globale Endpunkte. Weitere Informationen finden Sie unter AWS Dienstendpunkte.

Dienstkontingente, auch als Limits bezeichnet, sind die maximale Anzahl von Serviceressourcen oder Vorgängen für Ihr AWS Konto. Weitere Informationen finden Sie unter AWS Service Quotas.

Im Folgenden werden die Service-Endpunkte und -kontingente für diesen Service beschrieben.

Amazon Bedrock-Serviceendpunkte

APIs für die Steuerungsebene von Amazon Bedrock

Die folgende Tabelle enthält eine Liste der Region-specific Endpunkte, die Amazon Bedrock für die Verwaltung, Schulung und Bereitstellung von Modellen unterstützt. Verwenden Sie diese Endpunkte für Amazon Bedrock-API-Operationen.

Name der Region Region Endpunkt Protocol (Protokoll)
USA Ost (Ohio) us-east-2

bedrock.us-east-2.amazonaws.com

bedrock-fips.us-east-2.amazonaws.com

HTTPS

HTTPS

USA Ost (Nord-Virginia) us-east-1

bedrock.us-east-1.amazonaws.com

bedrock-fips.us-east-1.amazonaws.com

HTTPS

HTTPS

USA West (Nordkalifornien) us-west-1

bedrock.us-west-1.amazonaws.com

bedrock-fips.us-west-1.amazonaws.com

HTTPS

HTTPS

USA West (Oregon) us-west-2

bedrock.us-west-2.amazonaws.com

bedrock-fips.us-west-2.amazonaws.com

HTTPS

HTTPS

Afrika (Kapstadt) af-south-1 bedrock.af-south-1.amazonaws.com HTTPS
Asien-Pazifik (Hyderabad) ap-south-2 bedrock.ap-south-2.amazonaws.com HTTPS
Asien-Pazifik (Jakarta) ap-southeast-3 bedrock.ap-southeast-3.amazonaws.com HTTPS
Asien-Pazifik (Malaysia) ap-southeast-5 bedrock.ap-southeast-5.amazonaws.com HTTPS
Asien-Pazifik (Melbourne) ap-southeast-4 bedrock.ap-southeast-4.amazonaws.com HTTPS
Asien-Pazifik (Mumbai) ap-south-1 bedrock.ap-south-1.amazonaws.com HTTPS
Asien-Pazifik (Neuseeland) ap-southeast-6 bedrock.ap-southeast-6.amazonaws.com HTTPS
Asien-Pazifik (Osaka) ap-northeast-3 bedrock.ap-northeast-3.amazonaws.com HTTPS
Asien-Pazifik (Seoul) ap-northeast-2 bedrock.ap-northeast-2.amazonaws.com HTTPS
Asien-Pazifik (Singapur) ap-southeast-1 bedrock.ap-southeast-1.amazonaws.com HTTPS
Asien-Pazifik (Sydney) ap-southeast-2 bedrock.ap-southeast-2.amazonaws.com HTTPS
Asien-Pazifik (Taipeh) ap-east-2 bedrock.ap-east-2.amazonaws.com HTTPS
Asien-Pazifik (Thailand) ap-southeast-7 bedrock.ap-southeast-7.amazonaws.com HTTPS
Asien-Pazifik (Tokio) ap-northeast-1 bedrock.ap-northeast-1.amazonaws.com HTTPS
Kanada (Zentral) ca-central-1

bedrock.ca-central-1.amazonaws.com

bedrock-fips.ca-central-1.amazonaws.com

HTTPS

HTTPS

Kanada West (Calgary) ca-west-1

bedrock.ca-west-1.amazonaws.com

bedrock-fips.ca-west-1.amazonaws.com

HTTPS

HTTPS

Europa (Frankfurt) eu-central-1 bedrock.eu-central-1.amazonaws.com HTTPS
Europa (Irland) eu-west-1 bedrock.eu-west-1.amazonaws.com HTTPS
Europa (London) eu-west-2 bedrock.eu-west-2.amazonaws.com HTTPS
Europa (Mailand) eu-south-1 bedrock.eu-south-1.amazonaws.com HTTPS
Europa (Paris) eu-west-3 bedrock.eu-west-3.amazonaws.com HTTPS
Europa (Spanien) eu-south-2 bedrock.eu-south-2.amazonaws.com HTTPS
Europa (Stockholm) eu-north-1 bedrock.eu-north-1.amazonaws.com HTTPS
Europa (Zürich) eu-central-2 bedrock.eu-central-2.amazonaws.com HTTPS
Israel (Tel Aviv) il-central-1 bedrock.il-central-1.amazonaws.com HTTPS
Mexiko (Zentral) mx-central-1 bedrock.mx-central-1.amazonaws.com HTTPS
Naher Osten (Bahrain) me-south-1 bedrock.me-south-1.amazonaws.com HTTPS
Naher Osten (VAE) me-central-1 bedrock.me-central-1.amazonaws.com HTTPS
Südamerika (São Paulo) sa-east-1 bedrock.sa-east-1.amazonaws.com HTTPS
AWS GovCloud (US-East) us-gov-east-1

bedrock.us-gov-east-1.amazonaws.com

bedrock-fips.us-gov-east-1.amazonaws.com

HTTPS

HTTPS

AWS GovCloud (US-West) us-gov-west-1

bedrock.us-gov-west-1.amazonaws.com

bedrock-fips.us-gov-west-1.amazonaws.com

HTTPS

HTTPS

Amazon Bedrock-Laufzeit-APIs

Die folgende Tabelle enthält eine Liste von Region-specific Endpunkten, die Amazon Bedrock unterstützt, um Inferenzanfragen für in Amazon Bedrock gehostete Modelle zu stellen. Verwenden Sie diese Endpunkte für Amazon Bedrock Runtime-API-Operationen.

Name der Region Region Endpunkt Protocol (Protokoll)
USA Ost (Ohio) us-east-2

bedrock-runtime.us-east-2.amazonaws.com

bedrock-runtime-fips.us-east-2.amazonaws.com

HTTPS

HTTPS

USA Ost (Nord-Virginia) us-east-1

bedrock-runtime.us-east-1.amazonaws.com

bedrock-runtime-fips.us-east-1.amazonaws.com

HTTPS

HTTPS

USA West (Oregon) us-west-2

bedrock-runtime.us-west-2.amazonaws.com

bedrock-runtime-fips.us-west-2.amazonaws.com

HTTPS

HTTPS

Asien-Pazifik (Hyderabad) ap-south-2 bedrock-runtime.ap-south-2.amazonaws.com HTTPS
Asien-Pazifik (Mumbai) ap-south-1 bedrock-runtime.ap-south-1.amazonaws.com HTTPS
Asien-Pazifik (Osaka) ap-northeast-3 bedrock-runtime.ap-northeast-3.amazonaws.com HTTPS
Asien-Pazifik (Seoul) ap-northeast-2 bedrock-runtime.ap-northeast-2.amazonaws.com HTTPS
Asien-Pazifik (Singapur) ap-southeast-1 bedrock-runtime.ap-southeast-1.amazonaws.com HTTPS
Asien-Pazifik (Sydney) ap-southeast-2 bedrock-runtime.ap-southeast-2.amazonaws.com HTTPS
Asien-Pazifik (Tokio) ap-northeast-1 bedrock-runtime.ap-northeast-1.amazonaws.com HTTPS
Kanada (Zentral) ca-central-1

bedrock-runtime.ca-central-1.amazonaws.com

bedrock-runtime-fips.ca-central-1.amazonaws.com

HTTPS

HTTPS

Europa (Frankfurt) eu-central-1 bedrock-runtime.eu-central-1.amazonaws.com HTTPS
Europa (Irland) eu-west-1 bedrock-runtime.eu-west-1.amazonaws.com HTTPS
Europa (London) eu-west-2 bedrock-runtime.eu-west-2.amazonaws.com HTTPS
Europa (Mailand) eu-south-1 bedrock-runtime.eu-south-1.amazonaws.com HTTPS
Europa (Paris) eu-west-3 bedrock-runtime.eu-west-3.amazonaws.com HTTPS
Europa (Spanien) eu-south-2 bedrock-runtime.eu-south-2.amazonaws.com HTTPS
Europa (Stockholm) eu-north-1 bedrock-runtime.eu-north-1.amazonaws.com HTTPS
Europa (Zürich) eu-central-2 bedrock-runtime.eu-central-2.amazonaws.com HTTPS
Südamerika (São Paulo) sa-east-1 bedrock-runtime.sa-east-1.amazonaws.com HTTPS
AWS GovCloud (US-East) us-gov-east-1

bedrock-runtime.us-gov-east-1.amazonaws.com

bedrock-runtime-fips.us-gov-east-1.amazonaws.com

HTTPS

HTTPS

AWS GovCloud (US-West) us-gov-west-1

bedrock-runtime.us-gov-west-1.amazonaws.com

bedrock-runtime-fips.us-gov-west-1.amazonaws.com

HTTPS

HTTPS

Build-Time-APIs für Agents für Amazon Bedrock

Die folgende Tabelle enthält eine Liste von Region-specific Endpunkten, die Agents for Amazon Bedrock für die Erstellung und Verwaltung von Agenten und Wissensdatenbanken unterstützt. Verwenden Sie diese Endpunkte für Agenten für Amazon Bedrock-API-Operationen.

Name der Region Region Endpunkt Protocol (Protokoll)
USA Ost (Nord-Virginia) us-east-1 bedrock-agent.us-east-1.amazonaws.com HTTPS
bedrock-agent-fips.us-east-1.amazonaws.com HTTPS
USA West (Oregon) us-west-2 bedrock-agent.us-west-2.amazonaws.com HTTPS
bedrock-agent-fips.us-west-2.amazonaws.com HTTPS
Asien-Pazifik (Singapur) ap-southeast-1 bedrock-agent.ap-southeast-1.amazonaws.com HTTPS
Asien-Pazifik (Sydney) ap-southeast-2 bedrock-agent.ap-southeast-2.amazonaws.com HTTPS
Asien-Pazifik (Tokio) ap-northeast-1 bedrock-agent.ap-northeast-1.amazonaws.com HTTPS
Asien-Pazifik (Seoul) ap-northeast-2 bedrock-agent.ap-northeast-2.amazonaws.com HTTPS
Kanada (Zentral) ca-central-1 bedrock-agent.ca-central-1.amazonaws.com HTTPS
Europa (Frankfurt) eu-central-1 bedrock-agent.eu-central-1.amazonaws.com HTTPS
Europa (Irland) eu-west-1 bedrock-agent.eu-west-1.amazonaws.com HTTPS
Europa (London) eu-west-2 bedrock-agent.eu-west-2.amazonaws.com HTTPS
Europa (Paris) eu-west-3 bedrock-agent.eu-west-3.amazonaws.com HTTPS
Asien-Pazifik (Mumbai) ap-south-1 bedrock-agent.ap-south-1.amazonaws.com HTTPS
Südamerika (São Paulo) sa-east-1 bedrock-agent.sa-east-1.amazonaws.com HTTPS

Runtime-APIs für Agents für Amazon Bedrock

Die folgende Tabelle enthält eine Liste von Region-specific Endpunkten, die Agents for Amazon Bedrock zum Aufrufen von Agenten und zum Abfragen von Wissensdatenbanken unterstützt. Verwenden Sie diese Endpunkte für Agenten für Amazon Bedrock Runtime-API-Operationen.

Name der Region Region Endpunkt Protocol (Protokoll)
USA Ost (Nord-Virginia) us-east-1 bedrock-agent-runtime.us-east-1.amazonaws.com HTTPS
bedrock-agent-runtime-fips.us-east-1.amazonaws.com HTTPS
USA West (Oregon) us-west-2 bedrock-agent-runtime.us-west-2.amazonaws.com HTTPS
bedrock-agent-runtime-fips.us-west-2.amazonaws.com HTTPS
Asien-Pazifik (Singapur) ap-southeast-1 bedrock-agent-runtime.ap-southeast-1.amazonaws.com HTTPS
Asien-Pazifik (Sydney) ap-southeast-2 bedrock-agent-runtime.ap-southeast-2.amazonaws.com HTTPS
Asien-Pazifik (Tokio) ap-northeast-1 bedrock-agent-runtime.ap-northeast-1.amazonaws.com HTTPS
Asien-Pazifik (Seoul) ap-northeast-2 bedrock-agent-runtime.ap-northeast-2.amazonaws.com HTTPS
Kanada (Zentral) ca-central-1 bedrock-agent-runtime.ca-central-1.amazonaws.com HTTPS
Europa (Frankfurt) eu-central-1 bedrock-agent-runtime.eu-central-1.amazonaws.com HTTPS
Europa (Paris) eu-west-3 bedrock-agent-runtime.eu-west-3.amazonaws.com HTTPS
Europa (Irland) eu-west-1 bedrock-agent-runtime.eu-west-1.amazonaws.com HTTPS
Europa (London) eu-west-2 bedrock-agent-runtime.eu-west-2.amazonaws.com HTTPS
Asien-Pazifik (Mumbai) ap-south-1 bedrock-agent-runtime.ap-south-1.amazonaws.com HTTPS
Südamerika (São Paulo) sa-east-1 bedrock-agent-runtime.sa-east-1.amazonaws.com HTTPS

Amazon Bedrock APIs zur Datenautomatisierung

Die folgende Tabelle enthält eine Liste der Region-specific Endpunkte, die Data Automation for Amazon Bedrock unterstützt. Endpunkte, die das Wort runtime Aufrufen von Blueprints und Projekten verwenden, um Informationen aus Dateien zu extrahieren. Verwenden Sie diese Endpunkte für Amazon Bedrock Data Automation Runtime-API-Operationen. Endpunkte ohne Endpunkte runtime werden zur Erstellung von Blueprints und Projekten verwendet, um Anleitungen zur Extraktion bereitzustellen. Verwenden Sie diese Endpunkte für Buildtime-Operationen der Amazon Bedrock Data Automation API

Name der Region Region Endpunkt Protocol (Protokoll)
USA Ost (Ohio) us-east-2

bedrock-data-automation.us-east-2.amazonaws.com

bedrock-data-automation-runtime.us-east-2.amazonaws.com

bedrock-data-automation-fips.us-east-2.amazonaws.com

bedrock-data-automation-runtime-fips.us-east-2.amazonaws.com

HTTPS

HTTPS

HTTPS

HTTPS

USA Ost (Nord-Virginia) us-east-1

bedrock-data-automation.us-east-1.amazonaws.com

bedrock-data-automation-runtime.us-east-1.api.aws

bedrock-data-automation-runtime.us-east-1.amazonaws.com

bedrock-data-automation.us-east-1.api.aws

bedrock-data-automation-fips.us-east-1.amazonaws.com

bedrock-data-automation-runtime-fips.us-east-1.api.aws

bedrock-data-automation-runtime-fips.us-east-1.amazonaws.com

bedrock-data-automation-fips.us-east-1.api.aws

HTTPS

HTTPS

HTTPS

HTTPS

HTTPS

HTTPS

HTTPS

HTTPS

USA West (Oregon) us-west-2

bedrock-data-automation.us-west-2.amazonaws.com

bedrock-data-automation-runtime.us-west-2.api.aws

bedrock-data-automation-runtime.us-west-2.amazonaws.com

bedrock-data-automation.us-west-2.api.aws

bedrock-data-automation-fips.us-west-2.amazonaws.com

bedrock-data-automation-runtime-fips.us-west-2.api.aws

bedrock-data-automation-runtime-fips.us-west-2.amazonaws.com

bedrock-data-automation-fips.us-west-2.api.aws

HTTPS

HTTPS

HTTPS

HTTPS

HTTPS

HTTPS

HTTPS

HTTPS

Asien-Pazifik (Mumbai) ap-south-1

bedrock-data-automation.ap-south-1.amazonaws.com

bedrock-data-automation-runtime.ap-south-1.amazonaws.com

HTTPS

HTTPS

Asien-Pazifik (Sydney) ap-southeast-2

bedrock-data-automation.ap-southeast-2.amazonaws.com

bedrock-data-automation-runtime.ap-southeast-2.amazonaws.com

HTTPS

HTTPS

Asien-Pazifik (Tokio) ap-northeast-1

bedrock-data-automation.ap-northeast-1.amazonaws.com

bedrock-data-automation-runtime.ap-northeast-1.amazonaws.com

HTTPS

HTTPS

Kanada (Zentral) ca-central-1

bedrock-data-automation.ca-central-1.amazonaws.com

bedrock-data-automation-runtime.ca-central-1.amazonaws.com

bedrock-data-automation-fips.ca-central-1.amazonaws.com

bedrock-data-automation-runtime-fips.ca-central-1.amazonaws.com

HTTPS

HTTPS

HTTPS

HTTPS

Europa (Frankfurt) eu-central-1

bedrock-data-automation.eu-central-1.amazonaws.com

bedrock-data-automation-runtime.eu-central-1.amazonaws.com

HTTPS

HTTPS

Europa (Irland) eu-west-1

bedrock-data-automation.eu-west-1.amazonaws.com

bedrock-data-automation-runtime.eu-west-1.amazonaws.com

HTTPS

HTTPS

Europa (London) eu-west-2

bedrock-data-automation.eu-west-2.amazonaws.com

bedrock-data-automation-runtime.eu-west-2.amazonaws.com

HTTPS

HTTPS

Europa (Spanien) eu-south-2

bedrock-data-automation.eu-south-2.amazonaws.com

bedrock-data-automation-runtime.eu-south-2.amazonaws.com

HTTPS

HTTPS

AWS GovCloud (US-West) us-gov-west-1

bedrock-data-automation.us-gov-west-1.amazonaws.com

bedrock-data-automation-runtime.us-gov-west-1.amazonaws.com

bedrock-data-automation-fips.us-gov-west-1.amazonaws.com

bedrock-data-automation-runtime-fips.us-gov-west-1.amazonaws.com

HTTPS

HTTPS

HTTPS

HTTPS

Amazon-Bedrock-Servicekontingente

Tipp

Da Amazon Bedrock über eine große Anzahl von Kontingenten verfügt, empfehlen wir, dass Sie die Servicekontingente mithilfe der Konsole einsehen, anstatt die folgende Tabelle zu verwenden. Öffnen Sie Amazon Bedrock-Kontingente. Verwenden Sie das Suchfeld, um bestimmte Kontingente zu finden. Verwenden Sie das Zahnradsymbol, um zu steuern, wie viele Kontingente auf einer Seite angezeigt werden.

Name Standard Anpassbar Description
(Erweiterte Prompt-Optimierung) Aktive Jobs pro Konto Jede unterstützte Region: 20 Ja Die maximale Anzahl aktiver APO-Jobs (Advanced Prompt Optimization) pro Konto.
(Advanced Prompt Optimization) Inaktive Jobs pro Konto Jede unterstützte Region: 5 000 Ja Die maximale Anzahl inaktiver APO-Jobs (Advanced Prompt Optimization) pro Konto.
(Automatisierte Argumentation) Anmerkungen in der Richtlinie Jede unterstützte Region: 10 Nein Die maximale Anzahl von Anmerkungen in einer Richtlinie für automatisiertes Denken.
(Automated Reasoning) -Anfragen pro Sekunde CancelAutomatedReasoningPolicyBuildWorkflow Jede unterstützte Region: 5 Yes (Ja) Die maximale Anzahl von CancelAutomatedReasoningPolicyBuildWorkflow API-Anfragen pro Sekunde.
(Automatisierte Argumentation) Gleichzeitige Builds pro Richtlinie Jede unterstützte Region: 2 Nein Die maximale Anzahl gleichzeitiger Builds pro Automated Reasoning-Richtlinie.
(Automated Reasoning) Gleichzeitige Policy-Builds pro Konto Jede unterstützte Region: 5 Nein Die maximale Anzahl gleichzeitiger Automated Reasoning-Policy-Builds in einem Konto.
(Automated Reasoning) -Anfragen pro Sekunde CreateAutomatedReasoningPolicy Jede unterstützte Region: 5 Yes (Ja) Die maximale Anzahl von CreateAutomatedReasoningPolicy API-Anfragen pro Sekunde.
(Automatisierte Argumentation) CreateAutomatedReasoningPolicyTestCase Anfragen pro Sekunde Jede unterstützte Region: 5 Yes (Ja) Die maximale Anzahl von CreateAutomatedReasoningPolicyTestCase API-Anfragen pro Sekunde.
(Automatisierte Argumentation) CreateAutomatedReasoningPolicyVersion Anfragen pro Sekunde Jede unterstützte Region: 5 Yes (Ja) Die maximale Anzahl von CreateAutomatedReasoningPolicyVersion API-Anfragen pro Sekunde.
(Automatisierte Argumentation) DeleteAutomatedReasoningPolicy Anfragen pro Sekunde Jede unterstützte Region: 5 Yes (Ja) Die maximale Anzahl von DeleteAutomatedReasoningPolicy API-Anfragen pro Sekunde.
(Automatisierte Argumentation) DeleteAutomatedReasoningPolicyBuildWorkflow Anfragen pro Sekunde Jede unterstützte Region: 5 Yes (Ja) Die maximale Anzahl von DeleteAutomatedReasoningPolicyBuildWorkflow API-Anfragen pro Sekunde.
(Automatisierte Argumentation) DeleteAutomatedReasoningPolicyTestCase Anfragen pro Sekunde Jede unterstützte Region: 5 Yes (Ja) Die maximale Anzahl von DeleteAutomatedReasoningPolicyTestCase API-Anfragen pro Sekunde.
(Automatisierte Argumentation) ExportAutomatedReasoningPolicyVersion Anfragen pro Sekunde Jede unterstützte Region: 5 Yes (Ja) Die maximale Anzahl von ExportAutomatedReasoningPolicyVersion API-Anfragen pro Sekunde.
(Automatisierte Argumentation) GetAutomatedReasoningPolicy Anfragen pro Sekunde Jede unterstützte Region: 10 Yes (Ja) Die maximale Anzahl von GetAutomatedReasoningPolicy API-Anfragen pro Sekunde.
(Automatisierte Argumentation) GetAutomatedReasoningPolicyAnnotations Anfragen pro Sekunde Jede unterstützte Region: 10 Yes (Ja) Die maximale Anzahl von GetAutomatedReasoningPolicyAnnotations API-Anfragen pro Sekunde.
(Automatisierte Argumentation) GetAutomatedReasoningPolicyBuildWorkflow Anfragen pro Sekunde Jede unterstützte Region: 10 Yes (Ja) Die maximale Anzahl von GetAutomatedReasoningPolicyBuildWorkflow API-Anfragen pro Sekunde.
(Automatisierte Argumentation) GetAutomatedReasoningPolicyBuildWorkflowResultAssets Anfragen pro Sekunde Jede unterstützte Region: 10 Yes (Ja) Die maximale Anzahl von GetAutomatedReasoningPolicyBuildWorkflowResultAssets API-Anfragen pro Sekunde.
(Automatisierte Argumentation) GetAutomatedReasoningPolicyNextScenario Anfragen pro Sekunde Jede unterstützte Region: 10 Yes (Ja) Die maximale Anzahl von GetAutomatedReasoningPolicyNextScenario API-Anfragen pro Sekunde.
(Automatisierte Argumentation) GetAutomatedReasoningPolicyTestCase Anfragen pro Sekunde Jede unterstützte Region: 10 Yes (Ja) Die maximale Anzahl von GetAutomatedReasoningPolicyTestCase API-Anfragen pro Sekunde.
(Automatisierte Argumentation) GetAutomatedReasoningPolicyTestResult Anfragen pro Sekunde Jede unterstützte Region: 10 Yes (Ja) Die maximale Anzahl von GetAutomatedReasoningPolicyTestResult API-Anfragen pro Sekunde.
(Automatisierte Argumentation) ListAutomatedReasoningPolicies Anfragen pro Sekunde Jede unterstützte Region: 5 Yes (Ja) Die maximale Anzahl von ListAutomatedReasoningPolicies API-Anfragen pro Sekunde.
(Automatisierte Argumentation) ListAutomatedReasoningPolicyBuildWorkflows Anfragen pro Sekunde Jede unterstützte Region: 5 Yes (Ja) Die maximale Anzahl von ListAutomatedReasoningPolicyBuildWorkflows API-Anfragen pro Sekunde.
(Automatisierte Argumentation) ListAutomatedReasoningPolicyTestCases Anfragen pro Sekunde Jede unterstützte Region: 5 Yes (Ja) Die maximale Anzahl von ListAutomatedReasoningPolicyTestCases API-Anfragen pro Sekunde.
(Automated Reasoning) ListAutomatedReasoningPolicyTestResults Anfragen pro Sekunde Jede unterstützte Region: 5 Yes (Ja) Die maximale Anzahl von ListAutomatedReasoningPolicyTestResults API-Anfragen pro Sekunde.
(Automatisierte Argumentation) Richtlinien pro Konto Jede unterstützte Region: 100 Nein Die maximale Anzahl an Richtlinien für automatisiertes Denken in einem Konto.
(Automatisiertes Denken) Regeln in der Richtlinie Jede unterstützte Region: 500 Nein Die maximale Anzahl von Regeln in einer Richtlinie für automatisiertes Denken.
(Automated Reasoning) Größe des Quelldokuments (MB) Jede unterstützte Region: 5 Nein Die maximale Größe des Quelldokuments (MB) für die Erstellung einer Richtlinie für automatisiertes Denken.
(Automatisiertes Denken) Tokens für das Quelldokument Jede unterstützte Region: 122.880 Nein Die maximale Anzahl von Tokens, die in einem Quelldokument bei der Erstellung einer Automated Reasoning-Richtlinie zulässig ist.
(Automated Reasoning) StartAutomatedReasoningPolicyBuildWorkflow -Anfragen pro Sekunde Jede unterstützte Region: 1 Ja Die maximale Anzahl von StartAutomatedReasoningPolicyBuildWorkflow API-Anfragen pro Sekunde.
(Automatisiertes Denken) StartAutomatedReasoningPolicyTestWorkflow Anfragen pro Sekunde Jede unterstützte Region: 1 Ja Die maximale Anzahl von StartAutomatedReasoningPolicyTestWorkflow API-Anfragen pro Sekunde.
(Automatisierte Argumentation) Tests pro Richtlinie Jede unterstützte Region: 100 Nein Die maximale Anzahl von Tests pro Automated Reasoning-Richtlinie.
Typen (Automated Reasoning) pro Richtlinie Jede unterstützte Region: 50 Nein Die maximale Anzahl von Typen in einer Automated Reasoning-Richtlinie.
(Automated Reasoning) UpdateAutomatedReasoningPolicy Anfragen pro Sekunde Jede unterstützte Region: 5 Yes (Ja) Die maximale Anzahl von UpdateAutomatedReasoningPolicy API-Anfragen pro Sekunde.
(Automatisiertes Denken) UpdateAutomatedReasoningPolicyAnnotations Anfragen pro Sekunde Jede unterstützte Region: 5 Yes (Ja) Die maximale Anzahl von UpdateAutomatedReasoningPolicyAnnotations API-Anfragen pro Sekunde.
(Automatisiertes Denken) UpdateAutomatedReasoningPolicyTestCase Anfragen pro Sekunde Jede unterstützte Region: 5 Yes (Ja) Die maximale Anzahl von UpdateAutomatedReasoningPolicyTestCase API-Anfragen pro Sekunde.
(Automatisierte Argumentation) Werte pro Richtlinientyp Jede unterstützte Region: 50 Nein Die maximale Anzahl von Werten pro Typ in einer Automated Reasoning-Richtlinie.
(Automatisiertes Denken) Variablen in der Richtlinie Jede unterstützte Region: 200 Nein Die maximale Anzahl von Variablen in einer Richtlinie für automatisiertes Denken.
(Automatisierte Argumentation) Versionen pro Richtlinie Jede unterstützte Region: 1 000 Nein Die maximale Anzahl von Versionen pro Automated Reasoning-Richtlinie.
(Datenautomatisierung) (Konsole) Maximale Größe der Dokumentdatei (MB) Jede unterstützte Region: 200 Nein Die maximale Dateigröße für die Konsole
(Datenautomatisierung) (Konsole) Maximale Anzahl von Seiten pro Dokumentdatei Jede unterstützte Region: 20 Nein Die maximale Anzahl von Seiten pro Dokument in der Konsole
(Datenautomatisierung) CreateBlueprint — Maximale Anzahl von Blueprints pro Konto Jede unterstützte Region: 350 Ja Die maximale Anzahl von Blueprints pro Konto
(Datenautomatisierung) CreateBlueprintVersion — Maximale Anzahl von Blueprint-Versionen pro Blueprint Jede unterstützte Region: 10 Yes (Ja) Die maximale Anzahl von Versionen pro Blueprint
(Datenautomatisierung) CreateDataAutomationLibrary — Maximale Anzahl von Datenautomatisierungsbibliotheken pro Konto Jede unterstützte Region: 10 Yes (Ja) Die maximale Anzahl von Datenautomatisierungsbibliotheken pro Konto
(Datenautomatisierung) Länge der Beschreibung für Felder (Zeichen) Jede unterstützte Region: 300 Nein Die maximale Länge der Beschreibung für Felder in Zeichen
(Datenautomatisierung) InvokeBlueprintOptimizationAsync — Maximale Anzahl gleichzeitiger Blueprint-Optimierungsaufträge Jede unterstützte Region: 3 Ja Die maximale Anzahl von offenen Async-Aufträgen zum Aufrufen von Blueprint Optimization
(Datenautomatisierung) InvokeBlueprintOptimizationAsync — Maximale Anzahl von Blueprint-Optimierungsaufträgen pro Tag Jede unterstützte Region: 30 Nein Die maximale Anzahl von asynchronen Aufrufen von Blueprint Optimization Jobs pro Tag
(Datenautomatisierung) InvokeDataAutomation (Sync) — Dokument — Maximale Anzahl von Anfragen Jede unterstützte Region: 60 Ja Die maximale Anzahl von InvokeDataAutomation Anfragen pro Minute für die Dokumentmodalität
(Datenautomatisierung) InvokeDataAutomationAsync — Audio — Maximale Anzahl gleichzeitiger Jobs

us-east-1: 20

us-west-2: 20

Jede der anderen unterstützten Regionen: 2

Ja Die maximale Anzahl von offenen Invoke Data Automation Async-Jobs für Audios
(Data Automation) InvokeDataAutomationAsync — Dokument — Maximale Anzahl gleichzeitiger Jobs

AP-South-1:5

ca-central-1:5

eu-Süd-2:5

eu-west-2: 5

Jede der anderen unterstützten Regionen: 25

Ja Die maximale Anzahl von offenen Invoke Data Automation Async-Jobs für Dokumente
(Data Automation) InvokeDataAutomationAsync — Image — Maximale Anzahl gleichzeitiger Jobs

us-east-1: 20

us-west-2: 20

Jede der anderen unterstützten Regionen: 5

Ja Die maximale Anzahl von offenen Invoke Data Automation Async-Jobs für Bilder
(Data Automation) InvokeDataAutomationAsync — Maximale Anzahl offener Jobs Jede unterstützte Region: 1 800 Nein Die maximale Anzahl von offenen Invoke Data Automation Async-Jobs für Bilder
(Data Automation) InvokeDataAutomationAsync — Video — Maximale Anzahl gleichzeitiger Jobs

us-east-1: 20

us-west-2: 20

Jede der anderen unterstützten Regionen: 3

Ja Die maximale Anzahl von offenen Invoke Data Automation Async-Jobs für Videos
(Data Automation) Maximale Anzahl von Vokabelphrasen pro Bibliothek Jede unterstützte Region: 500 Ja Die maximale Anzahl benutzerdefinierter Vokabelphrasen, die pro Bibliothek konfiguriert werden können
(Datenautomatisierung) Maximale Audio-Abtastrate (Hz) Jede unterstützte Region: 48.000 Nein Die maximale Audio-Sample-Rate
(Datenautomatisierung) Maximale Anzahl von Blueprints pro Projekt (Audios) Jede unterstützte Region: 1 Nein Die maximale Anzahl von Blueprints pro Projekt für Audios
(Datenautomatisierung) Maximale Blueprints pro Projekt (Dokumente) Jede unterstützte Region: 40 Nein Die maximale Anzahl von Blueprints pro Projekt für Dokumente
(Datenautomatisierung) Maximale Blueprints pro Projekt (Bilder) Jede unterstützte Region: 1 Nein Die maximale Anzahl von Blueprints pro Projekt für Bilder
(Datenautomatisierung) Maximale Blueprints pro Projekt (Videos) Jede unterstützte Region: 1 Nein Die maximale Anzahl von Blueprints pro Projekt für Videos
(Datenautomatisierung) Maximale JSON-Blueprint-Größe (Zeichen) Jede unterstützte Region: 100 000 Nein Die maximale Größe von JSON in Zeichen
(Datenautomatisierung) Maximale Ebenen der Feldhierarchie Jede unterstützte Region: 1 Nein Die maximale Anzahl der Ebenen der Feldhierarchie
(Datenautomatisierung) Maximale Anzahl von Seiten pro Dokument Jede unterstützte Region: 3 000 Nein Die maximale Anzahl von Seiten pro Dokument
(Datenautomatisierung) Maximale Auflösung Jede unterstützte Region: 8 000 Nein Die maximale Auflösung für Bilder
(Datenautomatisierung) Maximale Größe der Audiodatei (MB) Jede unterstützte Region: 2 048 Nein Die maximale Dateigröße für Audio
(Datenautomatisierung) Maximale Audiolänge (Minuten) Jede unterstützte Region: 240 Nein Die maximale Länge für Audio in Minuten
(Datenautomatisierung) Maximale Größe der Dokumentdatei (MB) Jede unterstützte Region: 500 Nein Die maximale Dateigröße
(Datenautomatisierung) Maximale Bilddateigröße (MB) Jede unterstützte Region: 5 Nein Die maximale Dateigröße für Bilder
(Datenautomatisierung) Maximale Anweisungsfeldlänge für Audio Blueprint — (Zeichen) Jede unterstützte Region: 500 Ja Die maximale Länge des Befehlsfeldes für den Audio-Blueprint in Zeichen
(Datenautomatisierung) Maximale Anzahl von Blueprints pro Start-Inferenz-Anfrage (Audios) Jede unterstützte Region: 1 Nein Die maximale Anzahl von Inline-Blueprints in der Start-Inferenzanforderung
(Datenautomatisierung) Maximale Anzahl von Blueprints pro Start-Inferenzanforderung (Dokumente) Jede unterstützte Region: 10 Nein Die maximale Anzahl von Inline-Blueprints in der Start-Inferenzanforderung
(Datenautomatisierung) Maximale Anzahl von Blueprints pro Start-Inferenzanforderung (Bilder) Jede unterstützte Region: 1 Nein Die maximale Anzahl von Inline-Blueprints in der Start-Inferenzanforderung
(Datenautomatisierung) Maximale Anzahl von Blueprints pro Start-Inferenzanforderung (Videos) Jede unterstützte Region: 1 Nein Die maximale Anzahl von Inline-Blueprints in der Start-Inferenzanforderung
(Datenautomatisierung) Maximale Anzahl von Listenfeldern pro Blueprint Jede unterstützte Region: 15 Nein Die maximale Anzahl von Listenfeldern pro Blueprint
(Datenautomatisierung) Maximale Videodateigröße (MB) Jede unterstützte Region: 10 240 Nein Die maximale Dateigröße für Videos
(Datenautomatisierung) Maximale Videolänge (Minuten) Jede unterstützte Region: 240 Nein Die maximale Länge für Videos in Minuten
(Datenautomatisierung) Minimale Audio-Abtastrate (Hz) Jede unterstützte Region: 8 000 Nein Die minimale Audio-Samplerate
(Datenautomatisierung) Minimale Audiolänge (Millisekunden) Jede unterstützte Region: 500 Nein Die Mindestlänge für Audio in Milisekunden
(Bewertung) Anzahl der gleichzeitigen automatischen Modellevaluierungsaufträge Jede unterstützte Region: 20 Nein Die maximale Anzahl an automatischen Modellevaluierungsaufträgen, die Sie in diesem Konto in der aktuellen Region gleichzeitig angeben können.
(Bewertung) Anzahl gleichzeitiger Modellevaluierungsaufträge, bei denen menschliche Mitarbeiter zum Einsatz kommen Jede unterstützte Region: 10 Nein Die maximale Anzahl von Modellevaluierungsaufträgen, bei denen menschliche Mitarbeiter zum Einsatz kommen, können Sie in diesem Konto in der aktuellen Region gleichzeitig angeben.
(Bewertung) Anzahl der benutzerdefinierten Metriken Jede unterstützte Region: 10 Nein Die maximale Anzahl benutzerdefinierter Metriken, die Sie in einem Modellevaluierungsauftrag angeben können, bei dem menschliche Mitarbeiter eingesetzt werden.
(Bewertung) Anzahl der Datensätze mit benutzerdefinierten Eingabeaufforderungen in einer von Menschen durchgeführten Modellevaluierung Jede unterstützte Region: 1 Nein Die maximale Anzahl von Datensätzen für benutzerdefinierte Eingabeaufforderungen, die Sie in einem Auftrag zur Bewertung von Modellen am Menschen in diesem Konto in der aktuellen Region angeben können.
(Bewertung) Anzahl der Datensätze pro Auftrag Jede unterstützte Region: 5 Nein Die maximale Anzahl von Datensätzen, die Sie in einem automatisierten Modellevaluierungsauftrag angeben können. Dies umfasst sowohl benutzerdefinierte als auch integrierte Prompt-Datensätze.
(Bewertung) Anzahl der Bewertungsaufträge Jede unterstützte Region: 5 000 Nein Die maximale Anzahl von Modellevaluierungsaufträgen, die Sie in diesem Konto in der aktuellen Region erstellen können.
(Bewertung) Anzahl der Metriken pro Datensatz Jede unterstützte Region: 3 Nein Die maximale Anzahl von Metriken, die Sie pro Datensatz in einem automatisierten Modellbewertungsauftrag angeben können. Dies umfasst sowohl benutzerdefinierte als auch integrierte Metriken.
(Bewertung) Anzahl der Modelle in einem Modellevaluierungsauftrag, bei dem menschliche Mitarbeiter eingesetzt werden Jede unterstützte Region: 2 Nein Die maximale Anzahl von Modellen, die Sie in einem Modellevaluierungsauftrag angeben können, bei dem menschliche Mitarbeiter zum Einsatz kommen.
(Bewertung) Anzahl der Modelle im Auftrag zur automatisierten Modellevaluierung Jede unterstützte Region: 1 Nein Die maximale Anzahl von Modellen, die Sie in einem automatisierten Modellevaluierungsauftrag angeben können.
(Bewertung) Anzahl der Eingabeaufforderungen in einem Datensatz mit benutzerdefinierten Eingabeaufforderungen Jede unterstützte Region: 1 000 Nein Die maximale Anzahl von Eingabeaufforderungen, die ein Datensatz mit benutzerdefinierten Eingabeaufforderungen enthalten kann.
(Bewertung) Größe der Eingabeaufforderung Jede unterstützte Region: 4 Nein Die maximale Größe (in KB) einer einzelnen Eingabeaufforderung in einem Datensatz mit benutzerdefinierten Eingabeaufforderungen.
(Bewertung) Aufgabenzeit für Mitarbeiter Jede unterstützte Region: 30 Nein Die maximale Zeitdauer (in Tagen), die einer Arbeitskraft zur Erledigung von Aufgaben zur Verfügung stehen kann.
(Flows) Agentenknoten pro Flow Jede unterstützte Region: 20 Nein Die maximale Anzahl von Agentenknoten.
(Flows) Collector-Knoten pro Flow Jede unterstützte Region: 1 Nein Die maximale Anzahl von Kollektorknoten.
(Flüsse) Konditionsknoten pro Fluss Jede unterstützte Region: 5 Nein Die maximale Anzahl von Bedingungsknoten.
(Flows) Bedingungen pro Bedingungsknoten Jede unterstützte Region: 5 Nein Die maximale Anzahl von Bedingungen pro Bedingungsknoten.
(Flows) CreateFlow -Anforderungen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von CreateFlow Anfragen pro Sekunde.
(Flows) CreateFlowAlias -Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von CreateFlowAlias Anfragen pro Sekunde.
(Flows) CreateFlowVersion -Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von CreateFlowVersion Anfragen pro Sekunde.
(Flows) DeleteFlow -Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von DeleteFlow Anfragen pro Sekunde.
(Flows) DeleteFlowAlias -Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von DeleteFlowAlias Anfragen pro Sekunde.
(Flows) DeleteFlowVersion -Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von DeleteFlowVersion Anfragen pro Sekunde.
(Flows) Flow-Aliase pro Flow Jede unterstützte Region: 10 Nein Die maximale Anzahl von Flow-Aliasen.
(Flows) Flow-Ausführungen pro Konto Jede unterstützte Region: 1 000 Ja Die maximale Anzahl von Flow-Ausführungen pro Konto.
(Flows) Flow-Versionen pro Flow Jede unterstützte Region: 10 Nein Die maximale Anzahl von Flow-Versionen.
(Flows) Flows pro Konto Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von Flows pro Konto.
(Flows) GetFlow -Anfragen pro Sekunde Jede unterstützte Region: 10 Nein Die maximale Anzahl von GetFlow Anfragen pro Sekunde.
(Flows) GetFlowAlias -Anfragen pro Sekunde Jede unterstützte Region: 10 Nein Die maximale Anzahl von GetFlowAlias Anfragen pro Sekunde.
(Flows) GetFlowVersion -Anfragen pro Sekunde Jede unterstützte Region: 10 Nein Die maximale Anzahl von GetFlowVersion Anfragen pro Sekunde.
(Flows) Inline-Codeknoten pro Flow Jede unterstützte Region: 5 Nein Die maximale Anzahl von Inline-Codeknoten pro Flow.
(Flows) Eingabeknoten pro Flow Jede unterstützte Region: 1 Nein Die maximale Anzahl von Flow-Eingabeknoten.
(Flüsse) Iteratorknoten pro Fluss Jede unterstützte Region: 1 Nein Die maximale Anzahl von Iteratorknoten.
(Flows) Knowledge Base-Knoten pro Flow Jede unterstützte Region: 20 Nein Die maximale Anzahl von Knowledge Base-Knoten.
(Flows) Lambda-Funktionsknoten pro Flow Jede unterstützte Region: 20 Nein Die maximale Anzahl von Lambda-Funktionsknoten.
(Flows) Lex-Knoten pro Flow Jede unterstützte Region: 5 Nein Die maximale Anzahl von Lex-Knoten.
(Flows) ListFlowAliases -Anfragen pro Sekunde Jede unterstützte Region: 10 Nein Die maximale Anzahl von ListFlowAliases Anfragen pro Sekunde.
(Flows) ListFlowVersions -Anfragen pro Sekunde Jede unterstützte Region: 10 Nein Die maximale Anzahl von ListFlowVersions Anfragen pro Sekunde.
(Flows) ListFlows -Anfragen pro Sekunde Jede unterstützte Region: 10 Nein Die maximale Anzahl von ListFlows Anfragen pro Sekunde.
(Flows) Ausgabeknoten pro Flow Jede unterstützte Region: 20 Nein Die maximale Anzahl von Flow-Ausgangsknoten.
(Flows) PrepareFlow -Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von PrepareFlow Anfragen pro Sekunde.
(Flows) Fordert Knoten pro Flow auf Jede unterstützte Region: 20 Ja Die maximale Anzahl von Prompt-Knoten.
(Flows) S3-Abrufknoten pro Flow Jede unterstützte Region: 10 Nein Die maximale Anzahl von S3-Abrufknoten.
(Flows) S3-Speicherknoten pro Flow Jede unterstützte Region: 10 Nein Die maximale Anzahl von S3-Speicherknoten.
(Flows) Gesamtzahl der Knoten pro Flow Jede unterstützte Region: 40 Nein Die maximale Anzahl von Knoten in einem Flow.
(Flows) UpdateFlow -Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von UpdateFlow Anfragen pro Sekunde.
(Flows) UpdateFlowAlias -Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von UpdateFlowAlias Anfragen pro Sekunde.
(Flows) ValidateFlowDefinition -Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von ValidateFlowDefinition Anfragen pro Sekunde.
(Leitplanken) Richtlinien für automatisiertes Denken pro Leitplanke Jede unterstützte Region: 2 Nein Die maximale Anzahl von Richtlinien für automatisiertes Denken pro Leitplanke.
(Guardrails) Maximale Eingabegröße der Inhaltsrichtlinie in Texteinheiten (Stufe Classic)

us-east-1: 1 000

us-east-2: 1 000

us-west-2: 1 000

ap-northeast-1: 1 000

ap-northeast-2:1.000

AP-Süd-1:1.000

AP-Southeast-1:1.000

ap-southeast-2: 1 000

eu-central-1: 1 000

eu-Süd-1:25

EU-West-3:25

sa-ost-1:25

Jede der anderen unterstützten Regionen: 106

Ja Die maximale Größe des Eingabetexts, gemessen in Texteinheiten, der für Inhaltsfilter verarbeitet werden kann. Dieses Limit gilt zwar für den klassischen Tarif, wir empfehlen jedoch, auf den Standard-Tarif zu migrieren, da dieser besonders robust ist, zusätzliche Funktionen bietet und mehrere Sprachen unterstützt.
(Guardrails) Maximale Eingabegröße der Inhaltsrichtlinie in Texteinheiten (Standardstufe — empfohlen)

us-east-1: 1 000

us-east-2: 1 000

us-west-2: 1 000

ap-northeast-1:500

ap-northeast-2:1.000

AP-Süd-1:500

ap-southeast-1:1.000

AP-Southeast-2:400

eu-central-1:500

EU-Süd-1:25

eu-west-1: 1,000

EU-West-3:25

Jede der anderen unterstützten Regionen: 106

Ja Die maximale Größe des Eingabetexts, gemessen in Texteinheiten, der für Inhaltsfilter verarbeitet werden kann. Dies gilt für die Standardebene, die empfohlen wird.
(Guardrails) Kontextuelle Erdungsrichtlinie — Maximale Eingabegröße in Texteinheiten Jede unterstützte Region: 106 Ja Die maximale Größe des Eingabetexts, gemessen in Texteinheiten, der durch kontextabhängige Erdungsrichtlinien verarbeitet werden kann
(Leitplanken) Länge der kontextuellen Erdungsabfrage in Texteinheiten Jede unterstützte Region: 1 Nein Die maximale Länge der Abfrage für die kontextuelle Erdung in Texteinheiten
(Leitplanken) Länge der Antwort auf die kontextuelle Erdung in Texteinheiten Jede unterstützte Region: 5 Nein Die maximale Länge der Antwort für die kontextuelle Erdung in Texteinheiten
(Leitplanken) Länge der Quelle für die kontextuelle Erdung in Texteinheiten

us-east-1: 100

us-west-2: 100

Jede der anderen unterstützten Regionen: 50

Nein Die maximale Länge der Erdungsquelle für die kontextuelle Erdung in Texteinheiten
(Leitplanken) Beispielphrasen pro Thema Jede unterstützte Region: 5 Nein Die maximale Anzahl an Themenbeispielen, die pro Thema aufgenommen werden können
(Leitplanken) Leitplanken pro Konto Jede unterstützte Region: 100 Nein Die maximale Anzahl von Leitplanken in einem Konto
(Guardrails) Texteinheiten für On-demand ApplyGuardrail Inhaltsfilterrichtlinien, Burst Rate (Stufe Classic)

us-east-1: 1 000

us-east-2: 1 000

us-west-2: 1 000

ap-northeast-1: 1 000

AP-Nordost-2:1.000

AP-Süd-1:1.000

AP-Southeast-1:1.000

ap-southeast-2: 1 000

eu-central-1: 1 000

Jede der anderen unterstützten Regionen: 25

Nein Die maximale Anzahl von Texteinheiten in einem Burst, die für Inhaltsfilter verarbeitet werden können. Dieses Limit gilt zwar für den klassischen Tarif, wir empfehlen jedoch, auf den Standard-Tarif zu migrieren, da dieser besonders robust ist, zusätzliche Funktionen bietet und mehrere Sprachen unterstützt.
(Leitplanken) Die Richtlinie für On-demand ApplyGuardrail Inhaltsfilter enthält Texteinheiten (Burdrails), Burst-Rate (Standardstufe — empfohlen)

us-east-1: 1 000

us-east-2: 1 000

us-west-2: 1 000

ap-northeast-1:500

ap-northeast-2:1.000

AP-Süd-1:500

ap-southeast-1:1.000

AP-Southeast-2:400

eu-central-1:500

eu-west-1: 1,000

Jede der anderen unterstützten Regionen: 25

Nein Die maximale Anzahl von Texteinheiten in einem Burst, die für Inhaltsfilter verarbeitet werden können. Dies gilt für die Standardstufe, die empfohlen wird.
(Guardrails) Texteinheiten pro Sekunde für On-demand ApplyGuardrail Inhaltsfilterrichtlinien (Stufe Classic)

us-east-1: 200

us-west-2: 200

Jede der anderen unterstützten Regionen: 25

Ja Die maximale Anzahl von Texteinheiten pro Sekunde, die für Inhaltsfilter verarbeitet werden können. Dieses Limit gilt zwar für den klassischen Tarif, wir empfehlen jedoch, auf den Standard-Tarif zu migrieren, da dieser besonders robust ist, zusätzliche Funktionen bietet und mehrsprachige Unterstützung bietet.
(Guardrails) Texteinheiten pro Sekunde für On-demand ApplyGuardrail Inhaltsfilterrichtlinien (Standardstufe — empfohlen)

us-east-1: 200

US-East-2:200

US-West-1:200

us-west-2: 200

ap-northeast-1:50

ap-northeast-2: 100

AP-Süd-1:50

ap-southeast-1: 100

eu-central-1:50

eu-west-1: 200

Jede der anderen unterstützten Regionen: 25

Ja Die maximale Anzahl von Texteinheiten pro Sekunde, die für Inhaltsfilter verarbeitet werden können. Dies gilt für die Standardstufe, die empfohlen wird.
(Guardrails) Texteinheiten für On-demand ApplyGuardrail abgelehnte Themenrichtlinien, Burst Rate (Stufe Classic)

us-east-1: 200

us-west-2: 200

Jede der anderen unterstützten Regionen: 25

Nein Die maximale Anzahl von Texteinheiten in einem Burst, die für abgelehnte Themen verarbeitet werden können. Dieses Limit gilt zwar für den klassischen Tarif, wir empfehlen jedoch, auf den Standard-Tarif zu migrieren, da dieser besonders robust ist, zusätzliche Funktionen bietet und mehrere Sprachen unterstützt.
(Guardrails) Burst-Rate für Texteinheiten, die für Themenrichtlinien On-demand ApplyGuardrail verweigert wurden (Standardstufe — empfohlen)

us-east-1: 1 000

us-east-2: 1 000

us-west-2: 1 000

ap-northeast-1:500

ap-northeast-2:1.000

AP-Süd-1:500

ap-southeast-1:1.000

AP-Southeast-2:400

eu-central-1:500

eu-west-1: 1,000

Jede der anderen unterstützten Regionen: 25

Nein Die maximale Anzahl von Texteinheiten in einem Burst, die für abgelehnte Themen verarbeitet werden können. Dies gilt für die Standardstufe, die empfohlen wird.
(Guardrails) Texteinheiten pro Sekunde pro Sekunde für On-demand ApplyGuardrail abgelehnte Themenrichtlinien (Stufe Classic)

us-east-1:50

US-West-2:50

Jede der anderen unterstützten Regionen: 25

Ja Die maximale Anzahl von Texteinheiten pro Sekunde, die für abgelehnte Themen verarbeitet werden können. Dieses Limit gilt zwar für den klassischen Tarif, wir empfehlen jedoch, auf den Standard-Tarif zu migrieren, da dieser besonders robust ist, zusätzliche Funktionen bietet und mehrsprachige Unterstützung bietet.
(Guardrails) Texteinheiten pro Sekunde für On-demand ApplyGuardrail abgelehnte Themenrichtlinien (Standardstufe — empfohlen)

us-east-1: 200

US-East-2:75

US-West-1:75

us-west-2: 200

eu-west-1: 200

Jede der anderen unterstützten Regionen: 25

Ja Die maximale Anzahl von Texteinheiten pro Sekunde, die für abgelehnte Themen verarbeitet werden können. Dies gilt für die Standardstufe, die empfohlen wird.
(Leitplanken) Richtlinie zum Filtern On-demand ApplyGuardrail vertraulicher Informationen, Texteinheiten, Burst-Rate

us-east-1: 1 000

us-east-2: 1 000

us-west-2: 1 000

ap-northeast-1: 1 000

ap-northeast-2:1.000

AP-Süd-1:1.000

AP-Southeast-1:1.000

ap-southeast-2: 1 000

eu-central-1: 1 000

Jede der anderen unterstützten Regionen: 25

Nein Die maximale Anzahl von Texteinheiten in einem Burst, die für Filter vertraulicher Informationen verarbeitet werden können.
(Guardrails) Texteinheiten pro Sekunde für Filterrichtlinien für On-demand ApplyGuardrail sensible Informationen

us-east-1: 1,000

US-East-2:100

US-West-1:50

us-west-2: 500

ap-northeast-1:500

ap-northeast-2: 100

ap-northeast-3:75

AP-Süd-1:200

AP-Süd-2:75

ap-southeast-1: 100

AP-Soudost-2:250

ca-central-1:250

EU-Zentral-1:500

EU-Zentral-2:75

EU-Nord-1:75

EU-Süd-1:75

EU-Süd-2:50

eu-west-1: 500

eu-west-2: 100

EU-West-3:250

sa-ost-1:75

Jede der anderen unterstützten Regionen: 25

Ja Die maximale Anzahl von Texteinheiten pro Sekunde, die für Filter für vertrauliche Informationen verarbeitet werden können.
(Leitplanken) Texteinheiten in der On-demand ApplyGuardrail Textfilterrichtlinie (Burdrails)

us-east-1: 1 000

us-east-2: 1 000

us-west-2: 1 000

ap-northeast-1: 1 000

ap-northeast-2:1.000

AP-Süd-1:1.000

AP-Southeast-1:1.000

ap-southeast-2: 1 000

eu-central-1: 1 000

Jede der anderen unterstützten Regionen: 25

Nein Die maximale Anzahl von Texteinheiten in einem Burst, die für Wortfilter verarbeitet werden können.
(Guardrails) On-demand ApplyGuardrail Texteinheiten pro Sekunde für die Textfilterrichtlinie

us-east-1: 500

US-East-2:500

US-West-1:500

us-west-2: 500

ap-northeast-1:500

ap-northeast-2:500

AP-Süd-1:500

ap-southeast-1:500

eu-central-1:500

Jede der anderen unterstützten Regionen: 25

Ja Die maximale Anzahl von Texteinheiten pro Sekunde, die für Wortfilter verarbeitet werden können.
(Leitplanken) On-demand ApplyGuardrail Kontextuelle Grundregeln, Texteinheiten, Burst-Rate Jede unterstützte Region: 106 Nein Die maximale Anzahl von Texteinheiten in einem Burst, die zur kontextuellen Erdung verarbeitet werden können.
(Leitplanken) Texteinheiten pro Sekunde für die On-demand ApplyGuardrail kontextabhängige Erdungsrichtlinie Jede unterstützte Region: 106 Ja Die maximale Anzahl von Texteinheiten pro Sekunde, die für die kontextuelle Erdung verarbeitet werden können.
(Guardrails) fordert die Burst-Rate an On-demand ApplyGuardrail

us-east-1: 100

us-east-2:100

US-West-1:100

us-west-2: 100

ap-northeast-1:100

ap-northeast-2: 100

ap-south-1: 100

ap-southeast-1: 100

eu-central-1: 100

Jede der anderen unterstützten Regionen: 25

Nein Die maximale Anzahl von ApplyGuardrail API-Aufrufen, die Sie in einem Burst senden können.
(Guardrails) On-demand ApplyGuardrail -Anfragen pro Sekunde

us-east-1: 100

us-east-2:100

US-West-1:100

us-west-2: 100

ap-northeast-1:100

ap-northeast-2: 100

ap-south-1: 100

ap-southeast-1: 100

eu-central-1: 100

Jede der anderen unterstützten Regionen: 25

Ja Die maximal zulässige Anzahl von ApplyGuardrail API-Aufrufen pro Sekunde
(Guardrails) On-demand InvokeGuardrailChecks fordert die Burst-Rate an Jede unterstützte Region: 1 500 Nein Die maximale Anzahl von InvokeGuardrailChecks API-Aufrufen, die Sie in einem Burst senden können
(Guardrails) On-demand InvokeGuardrailChecks -Anfragen pro Minute Jede unterstützte Region: 1 500 Ja Die maximal zulässige Anzahl von InvokeGuardrailChecks API-Aufrufen pro Minute
(Guardrails) Regex-Entitäten im Filter für vertrauliche Informationen Jede unterstützte Region: 30 Nein Die maximale Anzahl von Guardrail-Filter-Regexes, die in eine Richtlinie für vertrauliche Informationen aufgenommen werden können
(Guardrails) Regex-Länge in Zeichen Jede unterstützte Region: 500 Nein Die maximale Länge eines Guardrail-Filter-Regex in Zeichen
(Guardrails) Maximale Eingabegröße der Richtlinie für vertrauliche Informationen in Texteinheiten

us-east-1: 1 000

us-east-2: 1 000

us-west-2: 1 000

ap-northeast-1: 1 000

ap-northeast-2:1.000

AP-Süd-1:1.000

AP-Southeast-1:1.000

ap-southeast-2: 1 000

eu-central-1: 1 000

Jede der anderen unterstützten Regionen: 106

Ja Die maximale Größe des Eingabetexts, gemessen in Texteinheiten, der durch Filterrichtlinien für vertrauliche Informationen verarbeitet werden kann
(Leitplanken) Maximale Eingabegröße der Themenrichtlinie in Texteinheiten (Stufe Classic)

us-east-1: 200

us-west-2: 200

AP-Southeast-1:25

eu-Süd-1:25

EU-West-3:25

sa-ost-1:25

Jede der anderen unterstützten Regionen: 106

Ja Die maximale Größe des Eingabetexts, gemessen in Texteinheiten, der für abgelehnte Themen verarbeitet werden kann. Dieses Limit gilt zwar für den klassischen Tarif, wir empfehlen jedoch, auf den Standard-Tarif zu migrieren, da dieser besonders robust ist, zusätzliche Funktionen bietet und mehrsprachige Unterstützung bietet.
(Guardrails) Maximale Eingabegröße der Themenrichtlinie in Texteinheiten (Standardstufe — empfohlen)

us-east-1: 1 000

us-east-2: 1 000

us-west-2: 1 000

ap-northeast-1:500

ap-northeast-2:1.000

AP-Süd-1:500

ap-southeast-1:1.000

AP-Southeast-2:400

eu-central-1:500

EU-Süd-1:25

eu-west-1: 1,000

EU-West-3:25

Jede der anderen unterstützten Regionen: 106

Ja Die maximale Größe des Eingabetexts, gemessen in Texteinheiten, der für abgelehnte Themen verarbeitet werden kann. Dies gilt für die Standardebene, die empfohlen wird.
(Leitplanken) Themen pro Leitplanke Jede unterstützte Region: 30 Nein Die maximale Anzahl von Themen, die in den Themenrichtlinien von Guardrail definiert werden können
(Guardrails) Versionen pro Leitplanke Jede unterstützte Region: 20 Nein Die maximale Anzahl an Versionen, die eine Leitplanke haben kann
(Leitplanken) Wortlänge in Zeichen Jede unterstützte Region: 100 Nein Die maximale Länge eines Wortes in Zeichen in einer Liste blockierter Wörter
(Guardrails) Die maximale Eingabegröße der Word-Richtlinie in Texteinheiten

us-east-1: 1 000

us-east-2: 1 000

us-west-2: 1 000

ap-northeast-1: 1 000

ap-northeast-2:1.000

AP-Süd-1:1.000

AP-Southeast-1:1.000

ap-southeast-2: 1 000

eu-central-1: 1 000

Jede der anderen unterstützten Regionen: 106

Ja Die maximale Größe des Eingabetexts, gemessen in Texteinheiten, der durch Word-Filterrichtlinien verarbeitet werden kann
(Leitplanken) Richtlinie „Wörter pro Wort“ Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von Wörtern, die in einer Liste blockierter Wörter enthalten sein können
(Wissensdatenbanken) Gleichzeitig IngestKnowledgeBaseDocuments und DeleteKnowledgeBaseDocuments Anfragen pro Konto Jede unterstützte Region: 10 Nein Die maximale Anzahl von DeleteKnowledgeBaseDocuments Anfragen IngestKnowledgeBaseDocuments und Anfragen, die gleichzeitig in einem Konto ausgeführt werden können.
(Wissensdatenbanken) Gleichzeitige Aufnahmeaufträge pro Konto Jede unterstützte Region: 5 Nein Die maximale Anzahl von Erfassungsaufträgen, die gleichzeitig in einem Konto ausgeführt werden können.
(Wissensdatenbanken) Gleichzeitige Aufnahmeaufträge pro Datenquelle Jede unterstützte Region: 1 Nein Die maximale Anzahl von Aufnahmeaufträgen, die gleichzeitig für eine Datenquelle ausgeführt werden können.
(Wissensdatenbanken) Gleichzeitige Aufnahmeaufträge pro Wissensdatenbank Jede unterstützte Region: 1 Nein Die maximale Anzahl von Erfassungsaufträgen, die gleichzeitig für eine Wissensdatenbank ausgeführt werden können.
(Knowledge Bases) CreateDataSource -Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von CreateDataSource API-Anfragen pro Sekunde.
(Wissensdatenbanken) CreateKnowledgeBase Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von CreateKnowledgeBase API-Anfragen pro Sekunde.
(Wissensdatenbanken) Datenquellen pro Wissensdatenbank Jede unterstützte Region: 5 Nein Die maximale Anzahl von Datenquellen pro Wissensdatenbank.
(Wissensdatenbanken) DeleteDataSource Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von DeleteDataSource API-Anfragen pro Sekunde.
(Wissensdatenbanken) DeleteKnowledgeBase Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von DeleteKnowledgeBase API-Anfragen pro Sekunde.
(Wissensdatenbanken) DeleteKnowledgeBaseDocuments Anfragen pro Sekunde Jede unterstützte Region: 5 Nein Die maximale Anzahl von DeleteKnowledgeBaseDocuments API-Anfragen pro Sekunde.
(Wissensdatenbanken) Dateien, die pro Aufnahmeauftrag hinzugefügt oder aktualisiert werden müssen Jede unterstützte Region: 5 000 000 Nein Die maximale Anzahl neuer und aktualisierter Dateien, die pro Aufnahmeauftrag aufgenommen werden können.
(Wissensdatenbanken) Dateien, die pro Aufnahmeauftrag gelöscht werden sollen Jede unterstützte Region: 5 000 000 Nein Die maximale Anzahl von Dateien, die pro Aufnahmeauftrag gelöscht werden können.
(Wissensdatenbanken) Dateien, die pro Auftrag aufgenommen werden sollen. IngestKnowledgeBaseDocuments Jede unterstützte Region: 25 Nein Die maximale Anzahl von Dokumenten, die pro IngestKnowledgeBaseDocuments Anfrage aufgenommen werden können.
(Wissensdatenbanken) GenerateQuery Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von GenerateQuery API-Anfragen pro Sekunde.
(Wissensdatenbanken) GetDataSource Anfragen pro Sekunde Jede unterstützte Region: 10 Nein Die maximale Anzahl von GetDataSource API-Anfragen pro Sekunde.
(Wissensdatenbanken) GetIngestionJob Anfragen pro Sekunde Jede unterstützte Region: 10 Nein Die maximale Anzahl von GetIngestionJob API-Anfragen pro Sekunde.
(Wissensdatenbanken) GetKnowledgeBase Anfragen pro Sekunde Jede unterstützte Region: 10 Nein Die maximale Anzahl von GetKnowledgeBase API-Anfragen pro Sekunde.
(Wissensdatenbanken) GetKnowledgeBaseDocuments Anfragen pro Sekunde Jede unterstützte Region: 5 Nein Die maximale Anzahl von GetKnowledgeBaseDocuments API-Anfragen pro Sekunde.
(Wissensdatenbanken) IngestKnowledgeBaseDocuments Anfragen pro Sekunde Jede unterstützte Region: 5 Nein Die maximale Anzahl von IngestKnowledgeBaseDocuments API-Anfragen pro Sekunde.
(Wissensdatenbanken) IngestKnowledgeBaseDocuments Gesamtgröße der Nutzlast Jede unterstützte Region: 6 Nein Die maximale Größe (in MB) der gesamten Nutzlast in einer IngestKnowledgeBaseDocuments Anfrage.
(Wissensdatenbanken) Größe der Datei für den Erfassungsauftrag mit Textinhalt Jede unterstützte Region: 50 Nein Die maximale Größe (in MB) einer Datei mit Textinhalt (z. B. TXT-, PDF- oder DOCX-Dateien) in einem Aufnahme-Job.
(Wissensdatenbanken) Größe des Auftrags „Aufnahme“ Jede unterstützte Region: 100 Nein Die maximale Größe (in GB) eines Erfassungsauftrags.
(Wissensdatenbanken) Wissensdatenbanken pro Konto Jede unterstützte Region: 100 Nein Die maximale Anzahl von Wissensdatenbanken pro Konto.
(Wissensdatenbanken) ListDataSources -Anfragen pro Sekunde Jede unterstützte Region: 10 Nein Die maximale Anzahl von ListDataSources API-Anfragen pro Sekunde.
(Wissensdatenbanken) ListIngestionJobs Anfragen pro Sekunde Jede unterstützte Region: 10 Nein Die maximale Anzahl von ListIngestionJobs API-Anfragen pro Sekunde.
(Wissensdatenbanken) ListKnowledgeBaseDocuments Anfragen pro Sekunde Jede unterstützte Region: 5 Nein Die maximale Anzahl von ListKnowledgeBaseDocuments API-Anfragen pro Sekunde.
(Wissensdatenbanken) ListKnowledgeBases Anfragen pro Sekunde Jede unterstützte Region: 10 Nein Die maximale Anzahl von ListKnowledgeBases API-Anfragen pro Sekunde.
(Wissensdatenbanken) Maximale Anzahl von Dateien für den BDA-Parser Jede unterstützte Region: 1 000 Nein Die maximale Anzahl von Dateien, die mit Amazon Bedrock Data Automation als Parser verwendet werden können.
(Wissensdatenbanken) Maximale Anzahl von Dateien für Foundation Models als Parser Jede unterstützte Region: 1 000 Nein Die maximale Anzahl von Dateien, die mit Foundation Models als Parser verwendet werden können.
(Wissensdatenbanken) Ordnen Sie Anfragen pro Sekunde neu zu Jede unterstützte Region: 10 Nein Die maximale Anzahl von Reranking-API-Anfragen pro Sekunde.
(Wissensdatenbanken) Rufen Sie Anfragen pro Sekunde ab Jede unterstützte Region: 20 Nein Die maximale Anzahl von Retrieve-API-Anfragen pro Sekunde.
(Knowledge Bases) RetrieveAndGenerate -Anfragen pro Sekunde Jede unterstützte Region: 20 Nein Die maximale Anzahl von RetrieveAndGenerate API-Anfragen pro Sekunde.
(Wissensdatenbanken) RetrieveAndGenerateStream Anfragen pro Sekunde Jede unterstützte Region: 20 Nein Die maximale Anzahl von RetrieveAndGenerateStream API-Anfragen pro Sekunde.
(Wissensdatenbanken) StartIngestionJob Anfragen pro Sekunde Jede unterstützte Region: 0,1 Nein Die maximale Anzahl von StartIngestionJob API-Anfragen pro Sekunde.
(Wissensdatenbanken) UpdateDataSource Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von UpdateDataSource API-Anfragen pro Sekunde.
(Wissensdatenbanken) UpdateKnowledgeBase Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von UpdateKnowledgeBase API-Anfragen pro Sekunde.
(Wissensdatenbanken) Größe der Benutzerabfrage Jede unterstützte Region: 1 000 Nein Die maximale Größe (in Zeichen) einer Benutzerabfrage.
(Verwaltete Wissensdatenbanken) AgenticRetrieveStream Anfragen pro Sekunde pro Konto Jede unterstützte Region: 1 Nein Die maximale Anzahl von AgenticRetrieveStream API-Anfragen pro Sekunde pro Konto für verwaltete KBs.
Größe der AgenticRetrieveStream Benutzerabfragen (verwaltete Wissensdatenbanken) Jede unterstützte Region: 10 000 Nein Die maximale Größe (in Zeichen) einer Benutzerabfrage AgenticRetrieveStream für verwaltete KBs.
(Verwaltete Wissensdatenbanken) Gleichzeitige Aufnahmeaufträge pro Wissensdatenbank Jede unterstützte Region: 50 Nein Die maximale Anzahl gleichzeitiger Aufnahmeaufträge pro verwalteter KB.
(Verwaltete Wissensdatenbanken) Datenquellen pro Wissensdatenbank Jede unterstützte Region: 200 Nein Die maximale Anzahl von Datenquellen pro verwalteter KB.
(Verwaltete Wissensdatenbanken) DeleteKnowledgeBaseDocuments Anfragen pro Sekunde Jede unterstützte Region: 10 Nein Die maximale Anzahl von DeleteKnowledgeBaseDocuments API-Anfragen pro Sekunde für verwaltete KBs.
(Verwaltete Wissensdatenbanken) DeleteResourcePolicy Anfragen pro Sekunde Jede unterstützte Region: 5 Nein Die maximale Anzahl von DeleteResourcePolicy API-Anfragen pro Sekunde für verwaltete KBs.
(Verwaltete Wissensdatenbanken) Dateien, die pro Anfrage aufgenommen werden sollen IngestKnowledgeBaseDocuments Jede unterstützte Region: 10 Nein Die maximale Anzahl von Dateien, die pro IngestKnowledgeBaseDocuments API-Anfrage für verwaltete KBs aufgenommen werden können.
(Verwaltete Wissensdatenbanken) GetDocumentContent Anfragen pro Sekunde pro Konto Jede unterstützte Region: 100 Nein Die maximale Anzahl von GetDocumentContent API-Anfragen pro Sekunde pro Konto.
(Verwaltete Wissensdatenbanken) GetDocumentContent Anfragen pro Sekunde pro Wissensdatenbank Jede unterstützte Region: 5 Nein Die maximale Anzahl von GetDocumentContent API-Anfragen pro Sekunde pro verwalteter KB.
(Verwaltete Wissensdatenbanken) GetResourcePolicy Anfragen pro Sekunde Jede unterstützte Region: 5 Nein Die maximale Anzahl von GetResourcePolicy API-Anfragen pro Sekunde für verwaltete KBs.
(Verwaltete Wissensdatenbanken) Extrahierte Textgröße für einzelne Dateien (MB) Jede unterstützte Region: 30 Nein Die maximale Größe (in MB) von extrahiertem Text aus einer einzelnen Datei für verwaltete KBs.
(Verwaltete Wissensdatenbanken) IngestKnowledgeBaseDocuments Anfragen pro Sekunde Jede unterstützte Region: 20 Nein Die maximale Anzahl von IngestKnowledgeBaseDocuments API-Anfragen pro Sekunde für verwaltete KBs.
(Verwaltete Wissensdatenbanken) Wissensdatenbanken pro Konto Jede unterstützte Region: 10 000 Nein Die maximale Anzahl verwalteter KB pro Konto.
(Verwaltete Wissensdatenbanken) ListKnowledgeBaseDocuments Anfragen pro Sekunde Jede unterstützte Region: 10 Nein Die maximale Anzahl von ListKnowledgeBaseDocuments API-Anfragen pro Sekunde für verwaltete KBs.
(Verwaltete Wissensdatenbanken) PutResourcePolicy Anfragen pro Sekunde Jede unterstützte Region: 5 Nein Die maximale Anzahl von PutResourcePolicy API-Anfragen pro Sekunde für verwaltete KBs.
(Managed Knowledge Bases) Anfragen pro Sekunde pro Konto abrufen Jede unterstützte Region: 100 Nein Die maximale Anzahl von Retrive-API-Anfragen pro Sekunde pro Konto für verwaltete KBs.
(Verwaltete Wissensdatenbanken) Ruft Anfragen pro Sekunde pro Wissensdatenbank ab Jede unterstützte Region: 5 Nein Die maximale Anzahl von Retrive-API-Anfragen pro Sekunde pro verwalteter KB.
(Verwaltete Wissensdatenbanken) Ruft die Größe der Benutzerabfragen ab Jede unterstützte Region: 10 000 Nein Die maximale Größe (in Zeichen) einer Benutzerabfrage für Retrieve for Managed KBs.
(Verwaltete Wissensdatenbanken) Gesamtspeichergröße pro Wissensdatenbank (TB) Jede unterstützte Region: 10 Nein Die maximale Gesamtspeichergröße (in TB) pro verwaltetem KB.
(Modellanpassung) Benutzerdefinierte Modelle pro Konto Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl benutzerdefinierter Modelle in einem Konto.
(Modellanpassung) Bereitstellungen In-progress benutzerdefinierter Modelle Jede unterstützte Region: 2 Ja Die maximale Anzahl von laufenden Bereitstellungen benutzerdefinierter Modelle
(Modellanpassung) Maximale Größe der Eingabedatei für Destillationsanpassungsaufträge Jede unterstützte Region: 2 Gigabyte Nein Die maximale Größe der Eingabedatei für Aufträge zur Anpassung der Destillation.
(Modellanpassung) Maximale Leitungslänge für Destillationsanpassungen Jede unterstützte Region: 16 Kilobyte Nein Die maximale Leitungslänge in der Eingabedatei für Destillationsanpassungsaufträge.
(Modellanpassung) Maximale Anzahl von Aufforderungen für Aufträge zur Anpassung der Destillation Jede unterstützte Region: 15 000 Nein Die maximale Anzahl von Eingabeaufforderungen, die für die Anpassung der Destillation erforderlich sind.
(Modellanpassung) Maximale Anzahl von Trainingsaufzeichnungen für einen Amazon Nova Canvas-Job Fine-tuning Jede unterstützte Region: 10 000 Ja Die maximal zulässige Anzahl von Datensätzen für einen Amazon Nova Fine-tuning Canvas-Job.
(Modellanpassung) Maximale Länge des Kontextes für die Feinabstimmung des Studentenmodells für Amazon Nova Micro V1-Aufträge zur Anpassung der Destillation Jede unterstützte Region: 32.000 Nein Die maximale Länge des Kontextes zur Feinabstimmung des Studentenmodells für Amazon Nova Micro V1-Aufträge zur Anpassung der Destillation.
(Modellanpassung) Maximale Länge des Kontextes für die Feinabstimmung des Studentenmodells für Aufträge zur Anpassung der Destillation an Amazon Nova V1 Jede unterstützte Region: 32.000 Nein Die maximale Länge des Kontextes zur Feinabstimmung des Studentenmodells für Amazon Nova V1-Aufträge zur Anpassung der Destillation.
(Modellanpassung) Maximale Länge des Kontextes zur Feinabstimmung des Studentenmodells für Aufträge zur Anpassung der Destillation 20240307 V1 von Anthropic Claude 3 Haiku Jede unterstützte Region: 32.000 Nein Die maximale Länge des Kontextes zur Feinabstimmung des Studentenmodells für die Anpassung der Destillation 20240307 V1 von Anthropic Claude 3 Haiku.
(Modellanpassung) Maximale Länge des Kontextes für die Feinabstimmung des Schülermodells für Aufträge zur Anpassung der Destillation in Lama 3.1 70B Instruct V1 Jede unterstützte Region: 16 000 Nein Die maximale Länge des Kontextes für die Feinabstimmung des Schülermodells für Aufträge zur Anpassung der Destillation in Lama 3.1 70B Instruct V1.
(Modellanpassung) Maximale Länge des Kontextes für die Feinabstimmung des Schülermodells für Aufträge zur Anpassung der Destillation in Lama 3.1 8B Instruct V1 Jede unterstützte Region: 32.000 Nein Die maximale Länge des Kontextes zur Feinabstimmung des Studentenmodells für Aufträge zur Anpassung der Destillation in Llama 3.1 8B Instruct V1.
(Anpassung des Modells) Mindestanzahl von Aufforderungen für Aufträge zur Anpassung der Destillation Jede unterstützte Region: 100 Nein Die Mindestanzahl von Eingabeaufforderungen, die für die Anpassung der Destillation erforderlich sind.
(Modellanpassung) Geplante Anpassungsaufträge Jede unterstützte Region: 10 Nein Die maximale Anzahl an geplanten Anpassungsaufträgen.
(Modellanpassung) Summe der On-Demand-Bereitstellungsanfragen für benutzerdefinierte Modelle pro Minute für Amazon Nova 2 Lite Jede unterstützte Region: 2.000 Nein Die Summe der Input- und Output-Anfragen zur On-Demand-Bereitstellung eines benutzerdefinierten Modells pro Minute, die an Converse gesendet wurden ConverseStream InvokeModel, und der InvokeModelWithResponseStream Aktionen für Amazon Nova 2 Lite
(Modellanpassung) Summe der On-Demand-Bereitstellungsanfragen für benutzerdefinierte Modelle pro Minute für Amazon Nova Lite Jede unterstützte Region: 2.000 Nein Die Summe der Input- und Output-Anfragen zur On-Demand-Bereitstellung eines benutzerdefinierten Modells pro Minute, die an Converse gesendet wurden ConverseStream InvokeModel, und InvokeModelWithResponseStream Aktionen für Amazon Nova Lite
(Modellanpassung) Summe der On-Demand-Bereitstellungsanfragen für benutzerdefinierte Modelle pro Minute für Amazon Nova Micro Jede unterstützte Region: 2.000 Nein Die Summe der Input- und Output-Anfragen zur On-Demand-Bereitstellung eines benutzerdefinierten Modells pro Minute, die an Converse gesendet wurden ConverseStream InvokeModel, und der InvokeModelWithResponseStream Aktionen für Amazon Nova Micro
(Modellanpassung) Summe der On-Demand-Bereitstellungsanfragen für benutzerdefinierte Modelle pro Minute für Amazon Nova Pro Jede unterstützte Region: 200 Nein Die Summe der Input- und Output-Anfragen zur On-Demand-Bereitstellung eines benutzerdefinierten Modells pro Minute, die an Converse gesendet werden ConverseStream InvokeModel, und der InvokeModelWithResponseStream Aktionen für Amazon Nova Pro
(Modellanpassung) Summe der Anfragen zur Bereitstellung eines benutzerdefinierten Modells auf Abruf pro Minute für Meta Llama 3.3 70B Instruct Jede unterstützte Region: 400 Nein Die Summe der Input- und Output-Anfragen zur On-Demand-Bereitstellung eines benutzerdefinierten Modells pro Minute, die an das Converse gesendet werden ConverseStream InvokeModel, und der InvokeModelWithResponseStream Aktionen für Meta Llama 3.3 70B Instruct
(Modellanpassung) Summe der On-Demand-Token für die Bereitstellung benutzerdefinierter Modelle pro Tag für Amazon Nova 2 Lite Jede unterstützte Region: 5.760.000.000 Nein Die Summe der Eingabe- und Ausgabe-Token für die On-Demand-Bereitstellung benutzerdefinierter Modelle pro Tag, die an Converse übermittelt werden ConverseStream InvokeModel, und der InvokeModelWithResponseStream Aktionen für Amazon Nova 2 Lite
(Modellanpassung) Summe der On-Demand-Bereitstellungstoken für benutzerdefinierte Modelle pro Tag für Amazon Nova Lite Jede unterstützte Region: 5.760.000.000 Nein Die Summe der Eingabe- und Ausgabe-Token für die On-Demand-Bereitstellung benutzerdefinierter Modelle pro Tag, die an Converse übermittelt werden ConverseStream InvokeModel, und InvokeModelWithResponseStream der Aktionen für Amazon Nova Lite
(Modellanpassung) Summe der On-Demand-Bereitstellungstoken für benutzerdefinierte Modelle pro Tag für Amazon Nova Micro Jede unterstützte Region: 5.760.000.000 Nein Die Summe der Eingabe- und Ausgabe-Token für die On-Demand-Bereitstellung benutzerdefinierter Modelle pro Tag, die an Converse übermittelt werden ConverseStream InvokeModel, und InvokeModelWithResponseStream der Aktionen für Amazon Nova Micro
(Modellanpassung) Summe der On-Demand-Bereitstellungstoken für benutzerdefinierte Modelle pro Tag für Amazon Nova Pro Jede unterstützte Region: 1.152.000.000 Nein Die Summe der Eingabe- und Ausgabe-Token für die On-Demand-Bereitstellung benutzerdefinierter Modelle pro Tag, die an Converse übermittelt werden ConverseStream InvokeModel, und InvokeModelWithResponseStream der Aktionen für Amazon Nova Pro
(Modellanpassung) Summe der On-Demand-Bereitstellungstoken für benutzerdefinierte Modelle pro Tag für Meta Llama 3.3 70B Instruct Jede unterstützte Region: 432.000.000 Nein Die Summe der Eingabe- und Ausgabe-Token für die On-Demand-Bereitstellung benutzerdefinierter Modelle pro Tag, die an das Converse gesendet werden ConverseStream InvokeModel, und der InvokeModelWithResponseStream Aktionen für Meta Llama 3.3 70B Instruct
(Modellanpassung) Summe der On-Demand-Token für die Bereitstellung benutzerdefinierter Modelle pro Minute für Amazon Nova 2 Lite Jede unterstützte Region: 4.000.000 Nein Die Summe der Eingabe- und Ausgabe-Token für die On-Demand-Bereitstellung benutzerdefinierter Modelle pro Minute, die an Converse gesendet werden ConverseStream InvokeModel, und der InvokeModelWithResponseStream Aktionen für Amazon Nova 2 Lite
(Modellanpassung) Summe der On-Demand-Token für die Bereitstellung benutzerdefinierter Modelle pro Minute für Amazon Nova Lite Jede unterstützte Region: 4.000.000 Nein Die Summe der Eingabe- und Ausgabe-Token für die On-Demand-Bereitstellung benutzerdefinierter Modelle pro Minute, die an Converse gesendet werden ConverseStream InvokeModel, und InvokeModelWithResponseStream Aktionen für Amazon Nova Lite
(Modellanpassung) Summe der On-Demand-Token für die Bereitstellung benutzerdefinierter Modelle pro Minute für Amazon Nova Micro Jede unterstützte Region: 4.000.000 Nein Die Summe der Eingabe- und Ausgabe-Token für die On-Demand-Bereitstellung benutzerdefinierter Modelle pro Minute, die an Converse gesendet werden ConverseStream InvokeModel, und InvokeModelWithResponseStream Aktionen für Amazon Nova Micro
(Modellanpassung) Summe der On-Demand-Token für die Bereitstellung benutzerdefinierter Modelle pro Minute für Amazon Nova Pro Jede unterstützte Region: 800.000 Nein Die Summe der Eingabe- und Ausgabe-Token für die On-Demand-Bereitstellung benutzerdefinierter Modelle pro Minute, die an Converse gesendet werden ConverseStream InvokeModel, und InvokeModelWithResponseStream Aktionen für Amazon Nova Pro
(Modellanpassung) Summe der On-Demand-Bereitstellungstoken für benutzerdefinierte Modelle pro Minute für Meta Llama 3.3 70B Instruct Jede unterstützte Region: 300 000 Nein Die Summe der Eingabe- und Ausgabe-Token für die On-Demand-Bereitstellung benutzerdefinierter Modelle pro Minute, die an Converse gesendet werden ConverseStream InvokeModel, und der InvokeModelWithResponseStream Aktionen für Meta Llama 3.3 70B Instruct
(Modellanpassung) Summe der Schulungs- und Validierungsaufzeichnungen für einen Amazon Nova 2 Lite-Job Fine-tuning Jede unterstützte Region: 20 000 Ja Die maximale kombinierte Anzahl von Schulungs- und Validierungsdatensätzen, die für einen Amazon Nova 2 Fine-tuning Lite-Auftrag zulässig ist.
(Modellanpassung) Summe der Schulungs- und Validierungsaufzeichnungen für einen Amazon Nova Fine-tuning Lite-Job Jede unterstützte Region: 20 000 Ja Die maximale kombinierte Anzahl von Schulungs- und Validierungsaufzeichnungen, die für einen Amazon Nova Fine-tuning Lite-Job zulässig ist.
(Modellanpassung) Summe der Schulungs- und Validierungsaufzeichnungen für einen Amazon Nova Fine-tuning Micro-Job Jede unterstützte Region: 20 000 Ja Die maximale kombinierte Anzahl von Schulungs- und Validierungsaufzeichnungen, die für einen Amazon Nova Fine-tuning Micro-Job zulässig ist.
(Modellanpassung) Summe der Schulungs- und Validierungsaufzeichnungen für einen Amazon Nova Fine-tuning Pro-Job Jede unterstützte Region: 20 000 Ja Die maximale kombinierte Anzahl von Schulungs- und Validierungsaufzeichnungen, die für einen Amazon Nova Fine-tuning Pro-Job zulässig ist.
(Modellanpassung) Summe der Schulungs- und Validierungsaufzeichnungen für einen Claude 3 Haiku v1-Job Fine-tuning Jede unterstützte Region: 10 000 Ja Die maximale kombinierte Anzahl von Schulungs- und Validierungsaufzeichnungen, die für einen Claude Fine-tuning 3-Haiku-Job zulässig ist.
(Modellanpassung) Summe der Schulungs- und Validierungsaufzeichnungen für einen Claude 3-5-Haiku v1-Job Fine-tuning Jede unterstützte Region: 10 000 Ja Die maximale kombinierte Anzahl von Schulungs- und Validierungsaufzeichnungen, die für einen Claude 3-5-Haiku-Job zulässig ist. Fine-tuning
(Modellanpassung) Summe der Schulungs- und Validierungsaufzeichnungen für einen Meta Llama 2 13B v1-Job Fine-tuning Jede unterstützte Region: 10 000 Ja Die maximale kombinierte Anzahl von Trainings- und Validierungsdatensätzen, die für einen Meta Llama 2 13B-Job zulässig ist. Fine-tuning
(Modellanpassung) Summe der Schulungs- und Validierungsaufzeichnungen für einen Meta Llama 2 70B v1-Job Fine-tuning Jede unterstützte Region: 10 000 Ja Die maximale kombinierte Anzahl von Trainings- und Validierungsdatensätzen, die für einen Meta Llama 2 70B-Job zulässig ist. Fine-tuning
(Modellanpassung) Summe der Schulungs- und Validierungsaufzeichnungen für einen Meta Llama 3.1 70B Instruct v1-Job Fine-tuning Jede unterstützte Region: 10 000 Ja Die maximale kombinierte Anzahl von Trainings- und Validierungsdatensätzen, die für einen Meta Llama 3.1 70B Instruct-Job zulässig ist. Fine-tuning
(Modellanpassung) Summe der Trainings- und Validierungsaufzeichnungen für einen Meta Llama 3.1 8B Instruct v1-Job Fine-tuning Jede unterstützte Region: 10 000 Ja Die maximale kombinierte Anzahl von Trainings- und Validierungsdatensätzen, die für einen Meta Llama 3.1 8B Instruct-Job zulässig ist. Fine-tuning
(Modellanpassung) Summe der Trainings- und Validierungsaufzeichnungen für einen Meta Llama 3.2 11B Instruct v1-Job Fine-tuning Jede unterstützte Region: 10 000 Ja Die maximale kombinierte Anzahl von Trainings- und Validierungsdatensätzen, die für einen Meta Llama 3.2 11B Instruct-Job zulässig ist. Fine-tuning
(Modellanpassung) Summe der Trainings- und Validierungsaufzeichnungen für einen Meta Llama 3.2 1B Instruct v1-Job Fine-tuning Jede unterstützte Region: 10 000 Ja Die maximale kombinierte Anzahl von Trainings- und Validierungsdatensätzen, die für einen Meta Llama 3.2 1B Fine-tuning Instruct-Job zulässig ist.
(Modellanpassung) Summe der Trainings- und Validierungsaufzeichnungen für einen Meta Llama 3.2 3B Instruct v1-Job Fine-tuning Jede unterstützte Region: 10 000 Ja Die maximale kombinierte Anzahl von Trainings- und Validierungsdatensätzen, die für einen Meta Llama 3.2 3B Instruct-Job zulässig ist. Fine-tuning
(Modellanpassung) Summe der Trainings- und Validierungsaufzeichnungen für einen Meta Llama 3.2 90B Instruct v1-Job Fine-tuning Jede unterstützte Region: 10 000 Ja Die maximale kombinierte Anzahl von Trainings- und Validierungsdatensätzen, die für einen Meta Llama 3.2 90B Instruct-Job zulässig ist. Fine-tuning
(Modellanpassung) Summe der Trainings- und Validierungsaufzeichnungen für einen Meta Llama 3.3 70B Instruct v1-Job Fine-tuning Jede unterstützte Region: 10 000 Ja Die maximale kombinierte Anzahl von Trainings- und Validierungsaufzeichnungen, die für einen Meta Llama 3.3 70B Instruct-Job zulässig ist. Fine-tuning
(Modellanpassung) Summe der Schulungs- und Validierungsaufzeichnungen für einen Titan Image Generator G1 V1-Job Fine-tuning Jede unterstützte Region: 10 000 Ja Die maximale kombinierte Anzahl von Trainings- und Validierungsdatensätzen, die für einen Titan Image Fine-tuning Generator-Job zulässig ist.
(Modellanpassung) Summe der Trainings- und Validierungsdatensätze für einen Titan Image Generator G1 Fine-tuning V2-Job Jede unterstützte Region: 10 000 Ja Die maximale kombinierte Anzahl von Trainings- und Validierungsdatensätzen, die für einen Titan Image Generator Fine-tuning V2-Job zulässig ist.
(Modellanpassung) Summe der Trainings- und Validierungsdatensätze für einen Titan Multimodal Embeddings G1 v1-Job Fine-tuning Jede unterstützte Region: 50 000 Ja Die maximale kombinierte Anzahl von Trainings- und Validierungsdatensätzen, die für einen Titan Multimodal Embeddings-Job zulässig ist. Fine-tuning
(Modellanpassung) Summe der Trainings- und Validierungsdatensätze für einen Titan Text G1 - Express v1 Continue-Job Pre-Training Jede unterstützte Region: 100 000 Ja Die maximale kombinierte Anzahl von Schulungs- und Validierungsdatensätzen, die für einen Titan Text Express Continued Pre-Training Job zulässig ist.
(Modellanpassung) Summe der Schulungs- und Validierungsaufzeichnungen für einen Titan Text G1 - Express Fine-tuning v1-Job Jede unterstützte Region: 10 000 Ja Die maximale kombinierte Anzahl von Schulungs- und Validierungsdatensätzen, die für einen Titan Text Fine-tuning Express-Auftrag zulässig ist.
(Modellanpassung) Summe der Trainings- und Validierungsaufzeichnungen für einen Titan Text G1 - Lite v1 Pre-Training Continue-Job Jede unterstützte Region: 100 000 Ja Die maximale kombinierte Anzahl von Schulungs- und Validierungsaufzeichnungen, die für einen Titan Text Lite Continued Pre-Training Job zulässig ist.
(Modellanpassung) Summe der Schulungs- und Validierungsaufzeichnungen für einen Titan Text G1 - Lite Fine-tuning v1-Job Jede unterstützte Region: 10 000 Ja Die maximale kombinierte Anzahl von Schulungs- und Validierungsaufzeichnungen, die für einen Titan Text Fine-tuning Lite-Job zulässig ist.
(Modellanpassung) Summe der Schulungs- und Validierungsaufzeichnungen für einen Titan Text G1 — Premier Fine-tuning v1-Job Jede unterstützte Region: 20 000 Ja Die maximale kombinierte Anzahl von Schulungs- und Validierungsdatensätzen, die für einen Titan Text Fine-tuning Premier-Auftrag zulässig ist.
(Modellanpassung) Gesamtzahl der Bereitstellungen benutzerdefinierter Modelle Jede unterstützte Region: 10 Yes (Ja) Gesamtzahl der Bereitstellungen benutzerdefinierter Modelle
(Prompte Verwaltung) CreatePrompt Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von CreatePrompt Anfragen pro Sekunde.
(Prompt-Verwaltung) CreatePromptVersion Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von CreatePromptVersion Anfragen pro Sekunde.
(Prompt-Verwaltung) DeletePrompt Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von DeletePrompt Anfragen pro Sekunde.
(Prompt-Verwaltung) GetPrompt Anfragen pro Sekunde Jede unterstützte Region: 10 Nein Die maximale Anzahl von GetPrompt Anfragen pro Sekunde.
(Prompt-Verwaltung) ListPrompts Anfragen pro Sekunde Jede unterstützte Region: 10 Nein Die maximale Anzahl von ListPrompts Anfragen pro Sekunde.
(Prompt-Verwaltung) Eingabeaufforderungen pro Konto Jede unterstützte Region: 500 Ja Die maximale Anzahl von Eingabeaufforderungen.
(Prompt-Verwaltung) UpdatePrompt Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von UpdatePrompt Anfragen pro Sekunde.
(Verwaltung von Eingabeaufforderungen) Versionen pro Aufforderung Jede unterstützte Region: 10 Nein Die maximale Anzahl von Versionen pro Eingabeaufforderung.
APIs pro Agent Jede unterstützte Region: 11 Ja Die maximale Anzahl von APIs, die Sie einem Agenten hinzufügen können.
Aktionsgruppen pro Agent Jede unterstützte Region: 20 Ja Die maximale Anzahl von Aktionsgruppen, die Sie einem Agenten hinzufügen können.
Mitarbeiter des Agenten pro Agent Jede unterstützte Region: 1 000 Ja Die maximale Anzahl von Mitarbeiteragenten, die Sie einem Agenten hinzufügen können.
Agenten pro Konto Jede unterstützte Region: 1 000 Ja Die maximale Anzahl von Agenten in einem Konto.
AssociateAgentKnowledgeBase Anfragen pro Sekunde Jede unterstützte Region: 6 Nein Die maximale Anzahl von AssociateAgentKnowledgeBase API-Anfragen pro Sekunde.
Zugeordnete Aliase pro Agent Jede unterstützte Region: 10 Nein Die maximale Anzahl von Aliasen, die Sie einem Agenten zuordnen können.
Zugeordnete Wissensdatenbanken pro Agent Jede unterstützte Region: 2 Ja Die maximale Anzahl von Wissensdatenbanken, die Sie einem Agenten zuordnen können.
Größe der Batch-Inferenz-Eingabedatei (in GB) für Amazon Nova 2 Multimodal Embeddings V1 Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für Amazon Nova 2 Multimodal Embeddings V1 eingereicht wurde.
Größe der Eingabedatei für Batch-Inferenzen (in GB) für Amazon Nova Premier Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Amazon Nova Premier eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Claude 3 Haiku Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für Claude 3-Haiku eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Claude 3 Opus Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Claude 3 Opus eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Claude 3 Sonnet Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Claude 3 Sonnet eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Claude 3.5 Haiku Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für Claude 3.5-Haiku eingereicht wurde.
Größe der Eingabedatei für Batch-Inferenzen (in GB) für Claude 3.5 Sonnet Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Claude 3.5 Sonnet eingereicht wurde.
Größe der Eingabedatei für Batch-Inferenzen (in GB) für Claude 3.5 Sonnet v2 Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Claude 3.5 Sonnet v2 eingereicht wurde.
Größe der Eingabedatei für Batch-Inferenzen (in GB) für Claude 3.7 Sonnet Jede unterstützte Region: 1 Ja Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Claude 3.7 Sonnet eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Claude Haiku 4.5 Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Claude Haiku 4.5 eingereicht wurde.
Größe der Eingabedatei für Batch-Inferenzen (in GB) für Claude Opus 4.5 Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Claude Opus 4.5 eingereicht wurde.
Größe der Eingabedatei für Batch-Inferenz (in GB) für Claude Opus 4.6 Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Claude Opus 4.6 eingereicht wurde.
Größe der Eingabedatei für Batch-Inferenzen (in GB) für Claude Opus 5 Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Claude Opus 5 eingereicht wurde.
Größe der Eingabedatei für Batch-Inferenz (in GB) für Claude Sonnet 4 Jede unterstützte Region: 1 Ja Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Claude Sonnet 4 eingereicht wurde.
Größe der Eingabedatei für Batch-Inferenzen (in GB) für Claude Sonnet 4.5 Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Claude Sonnet 4.5 eingereicht wurde.
Größe der Eingabedatei für Batch-Inferenzen (in GB) für Claude Sonnet 4.6 Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Claude Sonnet 4.6 eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für DeepSeek V3.2 Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für eingereicht wurde. DeepSeek V3.2
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Version 3 DeepSeek Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für DeepSeek Version 3 eingereicht wurde.
Größe der Eingabedatei für Batch-Inferenzen (in GB) für Devstral 2 123B Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Devstral 2 123B eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für GLM 4.7 Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für GLM 4.7 eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für GLM 4.7 Flash Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für GLM 4.7 Flash eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für GLM 5 Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für GLM 5 eingereicht wurde.
Größe der Eingabedatei für Batch-Inferenz (in GB) für Gemma 3 12B Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Gemma 3 12B eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Gemma 3 27B Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Gemma 3 27B eingereicht wurde.
Größe der Batch-Inferenz-Eingabedatei (in GB) für Gemma 3 4B Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Gemma 3 4B eingereicht wurde.
Größe der Eingabedatei für Batch-Inferenzen (in GB) für Kimi K2 Thinking Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für Kimi K2 Thinking eingereicht wurde.
Größe der Eingabedatei für Batch-Inferenzen (in GB) für Kimi K2.5 Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Kimi eingereicht wurde. K2.5
Größe der Batch-Inferenz-Eingabedatei (in GB) für Llama 3.1 405B Instruct Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für Llama 3.1 405B Instruct eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Llama 3.1 70B Instruct Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für Llama 3.1 70B Instruct eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Llama 3.1 8B Instruct Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für Llama 3.1 8B Instruct eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Llama 3.2 11B Instruct Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für Llama 3.2 11B Instruct eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Llama 3.2 1B Instruct Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz Llama 3.2 1B Instruct eingereicht wurde.
Größe der Batch-Inferenz-Eingabedatei (in GB) für Llama 3.2 3B Instruct Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für Llama 3.2 3B Instruct eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Llama 3.2 90B Instruct Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für Llama 3.2 90B Instruct eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Llama 3.3 70B Instruct Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für Llama 3.3 70B Instruct eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Llama 4 Maverick Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für Llama 4 Maverick eingereicht wurde.
Größe der Batch-Inferenz-Eingabedatei (in GB) für Llama 4 Scout Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für Llama 4 Scout eingereicht wurde.
Größe der Eingabedatei für Batch-Inferenz (in GB) für Magistral Small 2509 Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Magistral Small 2509 eingereicht wurde.
Größe der Eingabedatei für Batch-Inferenz (in GB) für M2 MiniMax Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für MiniMax M2 eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für MiniMax M2.1 Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für eingereicht wurde. MiniMax M2.1
Größe der Eingabedatei für die Batch-Inferenz (in GB) für MiniMax M2.5 Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für eingereicht wurde. MiniMax M2.5
Größe der Eingabedatei für Batch-Inferenzen (in GB) für Ministral 3 14B Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Ministral 3 14B eingereicht wurde.
Größe der Eingabedatei für Batch-Inferenzen (in GB) für Ministral 3 8B Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Ministral 3 8B eingereicht wurde.
Größe der Eingabedatei für Batch-Inferenzen (in GB) für Ministral 3B Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Ministral 3B eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Mistral Large 2 (24,07) Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für Mistral Large 2 eingereicht wurde (24,07).
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Mistral Large 3 Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Mistral Large 3 eingereicht wurde.
Größe der Eingabedatei für Batch-Inferenz (in GB) für Mistral Small Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Mistral Small eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für NVIDIA Nemotron 3 Super 120B A12B Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für NVIDIA Nemotron 3 Super 120B A12B eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für NVIDIA Nemotron Nano 12B Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für NVIDIA Nemotron Nano 12B eingereicht wurde.
Größe der Eingabedatei für Batch-Inferenzen (in GB) für NVIDIA Nemotron Nano 3 30B Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für NVIDIA Nemotron Nano 3 30B eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für NVIDIA Nemotron Nano 9B Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für NVIDIA Nemotron Nano 9B eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Nova 2 Lite Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Nova 2 Lite eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Nova Lite V1 Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Nova Lite V1 eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Nova Micro V1 Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Nova Micro V1 eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Nova Pro V1 Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Nova Pro V1 eingereicht wurde.
Größe der Batch-Inferenz-Eingabedatei (in GB) für OpenAI GPT OSS 120b Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für OpenAI GPT OSS 120b eingereicht wurde.
Größe der Eingabedatei für Batch-Inferenzen (in GB) für OpenAI GPT OSS 20b Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für OpenAI GPT OSS 20b eingereicht wurde.
Größe der Eingabedatei für Batch-Inferenzen (in GB) für OpenAI GPT OSS Safeguard 120b Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für OpenAI GPT OSS Safeguard 120b eingereicht wurde.
Größe der Eingabedatei für Batch-Inferenzen (in GB) für OpenAI GPT OSS Safeguard 20b Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für OpenAI GPT OSS Safeguard 20b eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Qwen3 235B Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Qwen3 235B eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Qwen3 32B Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Qwen3 32B eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Qwen3 Coder 30B Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für Qwen3 Coder 30B eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Qwen3 Coder 480B Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für Qwen3 Coder 480B eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Qwen3 Coder Next Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für Qwen3 Coder Next eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Qwen3 Next 80B Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die zur Batch-Inferenz für Qwen3 Next 80B eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Qwen3 VL 235B Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Qwen3 VL 235B eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Titan Multimodal Embeddings G1 Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Titan Multimodal Embeddings G1 eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Titan Text Embeddings V2 Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Titan Text Embeddings V2 eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Voxtral Mini 3B 2507 Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für den Voxtral Mini 3B 2507 eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Voxtral Small 24B 2507 Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Voxtral Small 24B 2507 eingereicht wurde.
Größe der Eingabedatei für die Batch-Inferenz (in GB) für Writer Palmyra Vision 7B Jede unterstützte Region: 1 Nein Die maximale Größe einer einzelnen Datei (in GB), die für die Batch-Inferenz für Writer Palmyra Vision 7B eingereicht wurde.
Größe des Batch-Inferenz-Jobs (in GB) für Qwen3 Next 80B Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Qwen3 Next 80B enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Amazon Nova 2 Multimodal Embeddings V1 Jede unterstützte Region: 100 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Amazon Nova 2 Multimodal Embeddings V1 enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Amazon Nova Premier Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Amazon Nova Premier enthalten sind.
Batch-Inferenz-Jobgröße (in GB) für Claude 3 Haiku Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Claude 3-Haiku enthalten sind.
Größe des Batch-Inferenzauftrags (in GB) für Claude 3 Opus Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Claude 3 Opus enthalten sind.
Größe des Batch-Inferenzauftrags (in GB) für Claude 3 Sonnet Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Claude 3 Sonnet enthalten sind.
Größe des Batch-Inferenzauftrags (in GB) für Claude 3.5 Haiku Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Claude 3.5-Haiku enthalten sind.
Größe des Batch-Inferenzauftrags (in GB) für Claude 3.5 Sonnet Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Claude 3.5 Sonnet enthalten sind.
Größe des Batch-Inferenzauftrags (in GB) für Claude 3.5 Sonnet v2 Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Claude 3.5 Sonnet v2 enthalten sind.
Größe des Batch-Inferenzauftrags (in GB) für Claude 3.7 Sonnet Jede unterstützte Region: 5 Yes (Ja) Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Claude 3.7 Sonnet enthalten sind.
Größe des Batch-Inferenzauftrags (in GB) für Claude Haiku 4.5 Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Claude Haiku 4.5 enthalten sind.
Größe des Batch-Inferenzauftrags (in GB) für Claude Opus 4.5 Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Claude Opus 4.5 enthalten sind.
Größe des Batch-Inferenzauftrags (in GB) für Claude Opus 4.6 Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Claude Opus 4.6 enthalten sind.
Größe des Batch-Inferenzauftrags (in GB) für Claude Opus 5 Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Claude Opus 5 enthalten sind.
Größe des Batch-Inferenzauftrags (in GB) für Claude Sonnet 4 Jede unterstützte Region: 5 Yes (Ja) Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Claude Sonnet 4 enthalten sind.
Größe des Batch-Inferenzauftrags (in GB) für Claude Sonnet 4.5 Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Claude Sonnet 4.5 enthalten sind.
Größe des Batch-Inferenzauftrags (in GB) für Claude Sonnet 4.6 Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Claude Sonnet 4.6 enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für DeepSeek V3.2 Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenzauftrag für enthalten sind. DeepSeek V3.2
Größe des Batch-Inferenz-Jobs (in GB) für v3 DeepSeek Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Version 3 enthalten sind. DeepSeek
Größe des Batch-Inferenz-Jobs (in GB) für Devstral 2 123B Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Devstral 2 123B enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für GLM 4.7 Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für GLM 4.7 enthalten sind.
Größe des Batch-Inferenzauftrags (in GB) für GLM 4.7 Flash Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für GLM 4.7 Flash enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für GLM 5 Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für GLM 5 enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Gemma 3 12B Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Gemma 3 12B enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Gemma 3 27B Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Gemma 3 27B enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Gemma 3 4B Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Gemma 3 4B enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Kimi K2 Thinking Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Kimi K2 Thinking enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Kimi K2.5 Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Kimi enthalten sind. K2.5
Größe des Batch-Inferenz-Jobs (in GB) für Llama 3.1 405B Instruct Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Llama 3.1 405B Instruct enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Llama 3.1 70B Instruct Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Llama 3.1 70B Instruct enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Llama 3.1 8B Instruct Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Llama 3.1 8B Instruct enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Llama 3.2 11B Instruct Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Llama 3.2 11B Instruct enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Llama 3.2 1B Instruct Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Llama 3.2 1B Instruct enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Llama 3.2 3B Instruct Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Llama 3.2 3B Instruct enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Llama 3.2 90B Instruct Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Llama 3.2 90B Instruct enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Llama 3.3 70B Instruct Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Llama 3.3 70B Instruct enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Llama 4 Maverick Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Llama 4 Maverick enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Llama 4 Scout Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Llama 4 Scout enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Magistral Small 2509 Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenzauftrag für Magistral Small 2509 enthalten sind.
Größe des Batch-Inferenzauftrags (in GB) für M2 MiniMax Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenzauftrag für M2 enthalten sind. MiniMax
Größe des Batch-Inferenz-Jobs (in GB) für MiniMax M2.1 Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenzauftrag für enthalten sind. MiniMax M2.1
Größe des Batch-Inferenz-Auftrags (in GB) für MiniMax M2.5 Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenzauftrag für enthalten sind. MiniMax M2.5
Größe des Batch-Inferenzauftrags (in GB) für Ministral 3 14B Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenzauftrag für Ministral 3 14B enthalten sind.
Größe des Batch-Inferenzauftrags (in GB) für Ministral 3 8B Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Ministral 3 8B enthalten sind.
Größe des Batch-Inferenzauftrags (in GB) für Ministral 3B Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenzauftrag für Ministral 3B enthalten sind.
Größe des Batch-Inferenzauftrags (in GB) für Mistral Large 2 (24,07) Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Mistral Large 2 enthalten sind (24,07).
Größe des Batch-Inferenz-Jobs (in GB) für Mistral Large 3 Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Mistral Large 3 enthalten sind.
Größe des Batch-Inferenzauftrags (in GB) für Mistral Small Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Mistral Small enthalten sind.
Größe des Batch-Inferenzauftrags (in GB) für NVIDIA Nemotron 3 Super 120B A12B Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für NVIDIA Nemotron 3 Super 120B A12B enthalten sind.
Größe des Batch-Inferenzauftrags (in GB) für NVIDIA Nemotron Nano 12B Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für NVIDIA Nemotron Nano 12B enthalten sind.
Größe des Batch-Inferenzauftrags (in GB) für NVIDIA Nemotron Nano 3 30B Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für NVIDIA Nemotron Nano 3 30B enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für NVIDIA Nemotron Nano 9B Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für NVIDIA Nemotron Nano 9B enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Nova Lite V1 Jede unterstützte Region: 100 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Nova Lite V1 enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Nova Micro V1 Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Nova Micro V1 enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Nova Pro V1 Jede unterstützte Region: 100 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Nova Pro V1 enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für OpenAI GPT OSS 120b Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für OpenAI GPT OSS 120b enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für OpenAI GPT OSS 20b Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für OpenAI GPT OSS 20b enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für OpenAI GPT OSS Safeguard 120b Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für OpenAI GPT OSS Safeguard 120b enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für OpenAI GPT OSS Safeguard 20b Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für OpenAI GPT OSS Safeguard 20b enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Qwen3 235B Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Qwen3 235B enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Qwen3 32B Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Qwen3 32B enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Qwen3 Coder 30B Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Qwen3 Coder 30B enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Qwen3 Coder 480B Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Qwen3 Coder 480B enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Qwen3 Coder Next Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Qwen3 Coder Next enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Qwen3 VL 235B Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Qwen3 VL 235B enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Titan Multimodal Embeddings G1 Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Titan Multimodal Embeddings G1 enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Titan Text Embeddings V2 Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Titan Text Embeddings V2 enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Voxtral Mini 3B 2507 Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Voxtral Mini 3B 2507 enthalten sind.
Größe des Batch-Inferenzauftrags (in GB) für Voxtral Small 24B 2507 Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Voxtral Small 24B 2507 enthalten sind.
Größe des Batch-Inferenz-Jobs (in GB) für Writer Palmyra Vision 7B Jede unterstützte Region: 5 Nein Die maximale kumulative Größe aller Eingabedateien (in GB), die im Batch-Inferenz-Job für Writer Palmyra Vision 7B enthalten sind.
Charaktere in den Anweisungen für Agenten Jede unterstützte Region: 20 000 Nein Die maximale Anzahl von Zeichen in den Anweisungen für einen Agenten.
Gleichzeitige Modellimportaufträge Jede unterstützte Region: 1 Nein Die maximale Anzahl von Modellimportaufträgen, die gleichzeitig ausgeführt werden.
CreateAgent Anfragen pro Sekunde Jede unterstützte Region: 6 Nein Die maximale Anzahl von CreateAgent API-Anfragen pro Sekunde.
CreateAgentActionGroup Anfragen pro Sekunde Jede unterstützte Region: 12 Nein Die maximale Anzahl von CreateAgentActionGroup API-Anfragen pro Sekunde.
CreateAgentAlias Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von CreateAgentAlias API-Anfragen pro Sekunde.
Cross-Region Modellieren Sie Inferenzanfragen pro Minute für Anthropic Claude 3.5 Haiku Jede unterstützte Region: 2.000 Nein Die maximale Häufigkeit, mit der Sie anrufen können, InvokeModel und InvokeModelWithResponseStream das in einer Minute. Die Quote berücksichtigt die Summe der InvokeModelWithResponseStream Tokens InvokeModel und der Tokens für Anthropic Claude 3.5 Haiku.
Cross-Region Modellieren Sie Inferenzanfragen pro Minute für Anthropic Claude 3.5 Sonnet V2

us-west-2: 500

Jede der anderen unterstützten Regionen: 100

Nein Die maximale Häufigkeit, mit der Sie Modellinferenz innerhalb einer Minute für Anthropic Claude 3.5 Sonnet V2 aufrufen können. Bei der Quote wird die Summe aus Converse, und berücksichtigt. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-Region Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude 3.5 Haiku Jede unterstützte Region: 4.000.000 Ja Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse InvokeModel und InvokeModelWithResponseStream für Anthropic Claude 3.5 Haiku. ConverseStream
Cross-Region Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude 3.5 Sonnet V2

US-West-2:4.000.000

Jede der anderen unterstützten Regionen: 800.000

Ja Die maximale Anzahl an Tokens, die Sie innerhalb einer Minute für Anthropic Claude 3.5 Sonnet V2 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe von Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanforderungen pro Minute für Amazon Nova 2 Lite Jede unterstützte Region: 2.000 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Amazon Nova 2 Lite innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen ConverseStream. InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Amazon Nova 2 Omni Jede unterstützte Region: 2.000 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Amazon Nova 2 Omni innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Amazon Nova 2 Pro Preview Jede unterstützte Region: 100 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Amazon Nova 2 Pro Preview innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen ConverseStream. InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Amazon Nova Lite

US-East-1:4.000

us-east-2:4.000

US-West-1:4.000

US-West-2:4.000

Jede der anderen unterstützten Regionen: 400

Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Amazon Nova Lite innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen und Aktionen an Converse. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Amazon Nova Micro

US-East-1:4.000

us-east-2:4.000

US-West-2:4.000

Jede der anderen unterstützten Regionen: 400

Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Amazon Nova Micro innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen ConverseStream. InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Amazon Nova Premier V1 Jede unterstützte Region: 500 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Amazon Nova Premier V1 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen ConverseStream. InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Amazon Nova Pro Jede unterstützte Region: 500 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Amazon Nova Pro innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen ConverseStream. InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Anthropic Claude 3 Haiku

us-east-1: 2 000

us-west-2: 2 000

ap-northeast-1:400

ap-southeast-1:400

Jede der anderen unterstützten Regionen: 800

Nein Die maximale Häufigkeit, mit der Sie die Modellinferenz innerhalb einer Minute aufrufen können. Bei der Quote wird die Summe aus Converse InvokeModel und ConverseStream, und InvokeModelWithResponseStream für Anthropic Claude 3 Haiku berücksichtigt.
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Anthropic Claude 3 Opus Jede unterstützte Region: 100 Nein Die maximale Anzahl regionsübergreifender Anfragen, die Sie für Anthropic Claude 3 Opus innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Anthropic Claude 3 Sonnet

us-east-1: 1,000

us-west-2: 1,000

Jede der anderen unterstützten Regionen: 200

Nein Die maximale Häufigkeit, mit der Sie die Modellinferenz innerhalb einer Minute aufrufen können. Bei der Quote wird die Summe aus Converse InvokeModel und ConverseStream, und InvokeModelWithResponseStream für Anthropic Claude 3 Sonnet berücksichtigt.
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Anthropic Claude 3.5 Sonnet

us-west-2: 500

ap-northeast-1:40

ap-southeast-1:40

eu-central-1:40

eu-west-1: 40

EU-West-3:40

Jede der anderen unterstützten Regionen: 100

Nein Die maximale Häufigkeit, mit der Sie Modellinferenz in einer Minute für Anthropic Claude 3.5 Sonnet aufrufen können. Die Quote berücksichtigt die Summe von Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanforderungen pro Minute für Anthropic Claude 3.7 Sonnet V1

us-east-1:250

US-Ost-2:250

US-West-2:250

eu-central-1: 100

EU-Nord-1:100

EU-West-1:100

eu-west-3:100

Jede der anderen unterstützten Regionen: 50

Nein Die maximale Anzahl regionsübergreifender Anfragen, die Sie innerhalb einer Minute zur Modellinferenz für Anthropic Claude 3.7 Sonnet V1 einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Anthropic Claude Haiku 4.5 Jede unterstützte Region: 10 000 Ja Die maximale Anzahl regionsübergreifender Anfragen, die Sie für Anthropic Claude Haiku 4.5 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Anthropic Claude Opus 4 V1 Jede unterstützte Region: 200 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Anthropic Claude Opus 4 V1 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Anthropic Claude Opus 4.1 Jede unterstützte Region: 50 Nein Die maximale Anzahl regionsübergreifender Anfragen, die Sie für Anthropic Claude Opus 4.1 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Anthropic Claude Opus 4.5 Jede unterstützte Region: 10 000 Ja Die maximale Anzahl regionsübergreifender Anfragen, die Sie für Anthropic Claude Opus 4.5 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Anthropic Claude Opus 4.6 V1 Jede unterstützte Region: 10 000 Ja Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Anthropic Claude Opus 4.6 V1 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Anthropic Claude Sonnet 4 V1 Jede unterstützte Region: 200 Ja Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Anthropic Claude Sonnet 4 V1 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Anthropic Claude Sonnet 4 V1 1M Context Length Jede unterstützte Region: 5 Yes (Ja) Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie innerhalb einer Minute für Anthropic Claude Sonnet 4 V1 1M Context Length einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen und Aktionen an Converse. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Anthropic Claude Sonnet 4.5 V1 Jede unterstützte Region: 10 000 Ja Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie innerhalb einer Minute für Anthropic Claude Sonnet 4.5 V1 zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Anthropic Claude Sonnet 4.5 V1 1M Context Lang Jede unterstützte Region: 1 000 Ja Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie innerhalb einer Minute für Anthropic Claude Sonnet 4.5 V1 1M Context Length einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen und Aktionen an Converse. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Anthropic Claude Sonnet 4.6 Jede unterstützte Region: 10 000 Ja Die maximale Anzahl regionsübergreifender Anfragen, die Sie für Anthropic Claude Sonnet 4.6 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Cohere Embed V4 Jede unterstützte Region: 2.000 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Cohere Embed V4 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für DeepSeek R1 V1 Jede unterstützte Region: 200 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für R1 V1 innerhalb einer Minute zur Modellinferenz einreichen können. DeepSeek Dieses Kontingent entspricht der Gesamtzahl der Anfragen und Aktionen an Converse. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Meta Llama 3.1 405B Instruct Jede unterstützte Region: 400 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Meta Llama 3.1 405B Instruct innerhalb einer Minute einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen und Aktionen an Converse. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Meta Llama 3.1 70B Instruct Jede unterstützte Region: 800 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Meta Llama 3.1 70B Instruct innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen und Aktionen an Converse. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Meta Llama 3.1 8B Instruct Jede unterstützte Region: 1 600 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Meta Llama 3.1 8B Instruct innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen und Aktionen an Converse. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Meta Llama 3.2 1B Instruct Jede unterstützte Region: 1 600 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie innerhalb einer Minute für Meta Llama 3.2 1B Instruct zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Meta Llama 3.2 3B Instruct Jede unterstützte Region: 1 600 Nein Die maximale Häufigkeit, mit der Sie innerhalb einer Minute Modellinferenz für Meta Llama 3.2 3B Instruct aufrufen können. Das Kontingent berücksichtigt die Summe der Anfragen für InvokeModel, InvokeModelWithResponseStream, Converse und. ConverseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Meta Llama 3.3 70B Instruct Jede unterstützte Region: 800 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Meta Llama 3.3 70B Instruct innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen und Aktionen an Converse. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Meta Llama 4 Maverick V1 Jede unterstützte Region: 800 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Meta Llama 4 Maverick V1 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen und Aktionen an Converse. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Meta Llama 4 Scout V1 Jede unterstützte Region: 800 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie innerhalb einer Minute für Meta Llama 4 Scout V1 zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Mistral Pixtral Large 25.02 V1 Jede unterstützte Region: 10 Nein Die maximale Anzahl regionsübergreifender Anfragen, die Sie für Mistral Pixtral Large 25.02 V1 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Stable Image Conservative Upscale Jede unterstützte Region: 4 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Stable Image Conservative Upscale innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Stable Image Control Sketch Jede unterstützte Region: 20 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Stable Image Control Sketch innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und Aktionen ConverseStream. InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanforderungen pro Minute für eine stabile Image Control Structure Jede unterstützte Region: 20 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Stable Image Control Structure innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und Aktionen ConverseStream. InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Stable Image Creative Upscale Jede unterstützte Region: 4 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Stable Image Creative Upscale innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Stable Image Erase Object Jede unterstützte Region: 20 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für ein stabiles Bildlöschobjekt innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und Aktionen ConverseStream. InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanforderungen pro Minute für Stable Image Fast Upscale Jede unterstützte Region: 20 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Stable Image Fast Upscale innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Stable Image Inpaint Jede unterstützte Region: 20 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Stable Image Inpaint innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Stable Image Outpaint Jede unterstützte Region: 4 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Stable Image Outpaint innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Stable Image Remove Background Jede unterstützte Region: 20 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie innerhalb einer Minute zur Modellinferenz für den stabilen Hintergrund zum Entfernen von Bildern einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen und Aktionen an Converse. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Stable Image Search und Recolor Jede unterstützte Region: 20 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Stable Image Search und Recolor innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für „Stable Image Search and Replace“ Jede unterstützte Region: 20 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für die Suche und das Ersetzen von stabilen Bildern innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen ConverseStream. InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für den Stable Image Style Guide Jede unterstützte Region: 20 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie innerhalb einer Minute für den Stable Image Style Guide zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen ConverseStream. InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Stable Image Style Transfer Jede unterstützte Region: 20 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für die Übertragung von stabilen Bildstilen innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen ConverseStream. InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Twelve Labs Marengo Jede unterstützte Region: 200 Nein Die maximale Anzahl regionsübergreifender Anfragen, die Sie für Twelve Labs Marengo innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Twelve Labs Pegasus Jede unterstützte Region: 120 Ja Die maximale Anzahl regionsübergreifender Anfragen, die Sie für Twelve Labs Pegasus innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe von Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für TwelveLabs Marengo Embed 3.0 Jede unterstützte Region: 1 000 Ja Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Marengo Embed 3.0 innerhalb einer Minute zur Modellinferenz einreichen können. TwelveLabs Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Writer AI Palmyra X4 V1 Jede unterstützte Region: 10 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Writer AI Palmyra X4 V1 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenzanfragen pro Minute für Writer AI Palmyra X5 V1 Jede unterstützte Region: 10 Nein Die maximale Anzahl von regionsübergreifenden Anfragen, die Sie für Writer AI Palmyra X5 V1 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Amazon Nova 2 Lite Jede unterstützte Region: 8.000.000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Amazon Nova 2 Lite zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, ConverseStream und. InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Amazon Nova 2 Omni Jede unterstützte Region: 8.000.000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Amazon Nova 2 Omni zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Amazon Nova 2 Pro Preview Jede unterstützte Region: 1 000 000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Amazon Nova 2 Pro Preview zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, ConverseStream und. InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Amazon Nova Lite

us-east-1:8.000.000

us-east-2:8.000.000

us-west-1:8.000.000

us-west-2:8.000.000

Jede der anderen unterstützten Regionen: 400.000

Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Amazon Nova Lite zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, ConverseStream und. InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Amazon Nova Micro

us-east-1:8.000.000

us-east-2:8.000.000

US-West-2:8.000.000

Jede der anderen unterstützten Regionen: 400.000

Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Amazon Nova Micro zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, ConverseStream und. InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Amazon Nova Premier V1 Jede unterstützte Region: 2.000.000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Amazon Nova Premier V1 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, ConverseStream und. InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Amazon Nova Pro Jede unterstützte Region: 2.000.000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Amazon Nova Pro zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, ConverseStream und. InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude 3 Haiku

us-east-1:4.000.000

us-west-2:4.000.000

ap-northeast-1:400.000

ap-southeast-1:400.000

Jede der anderen unterstützten Regionen: 600.000

Ja Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse InvokeModel und InvokeModelWithResponseStream für Anthropic Claude 3 Haiku. ConverseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude 3 Opus Jede unterstützte Region: 800.000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Anthropic Claude 3 Opus zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude 3 Sonnet

us-east-1:2.000.000

us-west-2:2.000.000

Jede der anderen unterstützten Regionen: 400.000

Ja Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse InvokeModel und InvokeModelWithResponseStream für Anthropic Claude 3 Sonnet. ConverseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude 3.5 Sonnet

US-West-2:4.000.000

ap-northeast-1:400.000

ap-southeast-1:400.000

eu-central-1:400.000

EU-West-1:400.000

eu-west-3:400.000

Jede der anderen unterstützten Regionen: 800.000

Ja Die maximale Anzahl an Tokens, die Sie innerhalb einer Minute für Anthropic Claude 3.5 Sonnet zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe von Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude 3.7 Sonnet V1

us-east-1:1.000.000

us-east-2:1.000.000

US-West-2:1.000.000

EU-Zentral-1:100.000

EU-Nord-1:100.000

eu-west-1:100.000

eu-west-3:100.000

Jede der anderen unterstützten Regionen: 50.000

Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Anthropic Claude 3.7 Sonnet V1 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude Fable 5 Jede unterstützte Region: 4.000.000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Anthropic Claude Fable 5 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude Haiku 4.5 Jede unterstützte Region: 5 000 000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Anthropic Claude Haiku 4.5 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude Opus 4 V1 Jede unterstützte Region: 200 000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Anthropic Claude Opus 4 V1 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude Opus 4.1 Jede unterstützte Region: 500 000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Anthropic Claude Opus 4.1 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude Opus 4.5 Jede unterstützte Region: 2.000.000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Anthropic Claude Opus 4.5 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude Opus 4.6 V1 Jede unterstützte Region: 3.000.000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Anthropic Claude Opus 4.6 V1 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude Opus 4.7 Jede unterstützte Region: 10 000 000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Anthropic Claude Opus 4.7 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude Opus 4.8 Jede unterstützte Region: 30.000.000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Anthropic Claude Opus 4.8 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude Opus 5 Jede unterstützte Region: 30.000.000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Anthropic Claude Opus 5 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude Sonnet 4 V1 Jede unterstützte Region: 200 000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Anthropic Claude Sonnet 4 V1 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude Sonnet 4 V1 1M Context Length Jede unterstützte Region: 1 000 000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Anthropic Claude Sonnet 4 V1 1M Context Length zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude Sonnet 4.5 V1 Jede unterstützte Region: 5 000 000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Anthropic Claude Sonnet 4.5 V1 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude Sonnet 4.5 V1 1M Context Length Jede unterstützte Region: 1 000 000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Anthropic Claude Sonnet 4.5 V1 1M Context Length zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude Sonnet 4.6 Jede unterstützte Region: 6.000.000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Anthropic Claude Sonnet 4.6 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude Sonnet 5 Jede unterstützte Region: 6.000.000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Anthropic Claude Sonnet 5 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Cohere Embed V4 Jede unterstützte Region: 300 000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Cohere Embed V4 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für DeepSeek R1 V1 Jede unterstützte Region: 200 000 Ja Die maximale Anzahl von regionsübergreifenden Token, die Sie innerhalb einer Minute für R1 V1 zur Modellinferenz einreichen können. DeepSeek Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Meta Llama 3.1 405B Instruct Jede unterstützte Region: 800.000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Meta Llama 3.1 405B Instruct zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Meta Llama 3.1 70B Instruct Jede unterstützte Region: 600.000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Meta Llama 3.1 70B Instruct zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Meta Llama 3.1 8B Instruct Jede unterstützte Region: 600.000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Meta Llama 3.1 8B Instruct zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Meta Llama 3.2 1B Instruct Jede unterstützte Region: 600.000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Meta Llama 3.2 1B Instruct zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Meta Llama 3.2 3B Instruct Jede unterstützte Region: 600.000 Ja Die maximale Anzahl an Tokens, die Sie innerhalb einer Minute für Meta Llama 3.2 3B Instruct zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Tokens für InvokeModel, InvokeModelWithResponseStream, Converse und. ConverseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Meta Llama 3.3 70B Instruct Jede unterstützte Region: 600.000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Meta Llama 3.3 70B Instruct zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Meta Llama 4 Maverick V1 Jede unterstützte Region: 600.000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Meta Llama 4 Maverick V1 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Meta Llama 4 Scout V1 Jede unterstützte Region: 600.000 Ja Die maximale Anzahl an regionsübergreifenden Token, die du innerhalb einer Minute für Meta Llama 4 Scout V1 zur Modellinferenz einreichen kannst. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Mistral Pixtral Large 25.02 V1 Jede unterstützte Region: 80 000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie innerhalb einer Minute für Mistral Pixtral Large 25.02 V1 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Cross-region Modellieren Sie Inferenz-Token pro Minute für Writer AI Palmyra X4 V1 Jede unterstützte Region: 150 000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie für Writer AI Palmyra X4 V1 innerhalb einer Minute zur Modellinferenz einreichen können. Die Quote berücksichtigt die kombinierte Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, ConverseStream, InvokeModel und InvokeModelWithResponseStream.
Cross-region Modellieren Sie Inferenz-Token pro Minute für Writer AI Palmyra X5 V1 Jede unterstützte Region: 150 000 Ja Die maximale Anzahl an regionsübergreifenden Token, die Sie für Writer AI Palmyra X5 V1 innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Benutzerdefinierte Modelle mit einem Erstellungsstatus pro Konto Jede unterstützte Region: 2 Ja Die maximale Anzahl von benutzerdefinierten Modellen mit dem Status „Erstellen“.
DeleteAgent Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von DeleteAgent API-Anfragen pro Sekunde.
DeleteAgentActionGroup Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von DeleteAgentActionGroup API-Anfragen pro Sekunde.
DeleteAgentAlias Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von DeleteAgentAlias API-Anfragen pro Sekunde.
DeleteAgentVersion Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von DeleteAgentVersion API-Anfragen pro Sekunde.
DisassociateAgentKnowledgeBase Anfragen pro Sekunde Jede unterstützte Region: 4 Nein Die maximale Anzahl von DisassociateAgentKnowledgeBase API-Anfragen pro Sekunde.
Aktionsgruppen pro Agent aktiviert Jede unterstützte Region: 15 Ja Die maximale Anzahl von Aktionsgruppen, die Sie in einem Agenten aktivieren können.
Endpunkte pro Inferenzprofil Jede unterstützte Region: 5 Nein Die maximale Anzahl von Endpunkten in einem Inferenzprofil. Ein Endpunkt wird durch ein Modell und die Region definiert, an die die Aufrufanforderungen an das Modell gesendet werden.
GetAgent Anfragen pro Sekunde Jede unterstützte Region: 15 Nein Die maximale Anzahl von GetAgent API-Anfragen pro Sekunde.
GetAgentActionGroup Anfragen pro Sekunde Jede unterstützte Region: 20 Nein Die maximale Anzahl von GetAgentActionGroup API-Anfragen pro Sekunde.
GetAgentAlias Anfragen pro Sekunde Jede unterstützte Region: 10 Nein Die maximale Anzahl von GetAgentAlias API-Anfragen pro Sekunde.
GetAgentKnowledgeBase Anfragen pro Sekunde Jede unterstützte Region: 15 Nein Die maximale Anzahl von GetAgentKnowledgeBase API-Anfragen pro Sekunde.
GetAgentVersion Anfragen pro Sekunde Jede unterstützte Region: 10 Nein Die maximale Anzahl von GetAgentVersion API-Anfragen pro Sekunde.
Globale regionsübergreifende Modellinferenzanfragen pro Minute für Amazon Nova 2 Lite Jede unterstützte Region: 2.000 Ja Die maximale Anzahl globaler regionsübergreifender Anfragen, die Sie für Amazon Nova 2 Lite innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen ConverseStream. InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modellinferenzanfragen pro Minute für Amazon Nova 2 Omni Jede unterstützte Region: 2.000 Ja Die maximale Anzahl globaler regionsübergreifender Anfragen, die Sie für Amazon Nova 2 Omni innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modellinferenzanfragen pro Minute für Amazon Nova 2 Pro Preview Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl globaler regionsübergreifender Anfragen, die Sie für Amazon Nova 2 Pro Preview innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen ConverseStream. InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modellinferenzanfragen pro Minute für Anthropic Claude Haiku 4.5 Jede unterstützte Region: 10 000 Ja Die maximale Anzahl globaler regionsübergreifender Anfragen, die Sie innerhalb einer Minute zur Modellinferenz für Anthropic Claude Haiku 4.5 einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen und Aktionen an Converse. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modellinferenzanfragen pro Minute für Anthropic Claude Opus 4.5 Jede unterstützte Region: 10 000 Ja Die maximale Anzahl globaler regionsübergreifender Anfragen, die Sie für Anthropic Claude Opus 4.5 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modellinferenzanfragen pro Minute für Anthropic Claude Opus 4.6 V1 Jede unterstützte Region: 10 000 Ja Die maximale Anzahl globaler regionsübergreifender Anfragen, die Sie für Anthropic Claude Opus 4.6 V1 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen und Aktionen an Converse. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modellinferenzanfragen pro Minute für Anthropic Claude Sonnet 4 V1 Jede unterstützte Region: 200 Ja Die maximale Anzahl globaler regionsübergreifender Anfragen, die Sie für Anthropic Claude Sonnet 4 V1 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen und Aktionen an Converse. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modellinferenzanfragen pro Minute für Anthropic Claude Sonnet 4.5 V1 Jede unterstützte Region: 10 000 Ja Die maximale Anzahl globaler regionsübergreifender Anfragen, die Sie für Anthropic Claude Sonnet 4.5 V1 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen und Aktionen an Converse. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modellinferenzanfragen pro Minute für Anthropic Claude Sonnet 4.5 V1 1M Context Length Jede unterstützte Region: 1 000 Ja Die maximale Anzahl globaler regionsübergreifender Anfragen, die Sie innerhalb einer Minute zur Modellinferenz für Anthropic Claude Sonnet 4.5 V1 1M Context Length einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen und Aktionen an Converse. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modellinferenzanfragen pro Minute für Anthropic Claude Sonnet 4.6 Jede unterstützte Region: 10 000 Ja Die maximale Anzahl globaler regionsübergreifender Anfragen, die Sie für Anthropic Claude Sonnet 4.6 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modellinferenzanfragen pro Minute für Cohere Embed V4 Jede unterstützte Region: 2.000 Ja Die maximale Anzahl globaler regionsübergreifender Anfragen, die Sie für Cohere Embed V4 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Tag für Amazon Nova 2 Lite Jede unterstützte Region: 11.520.000.000 Nein Die maximale Anzahl globaler regionsübergreifender Token, die Sie an einem Tag zur Modellinferenz für Amazon Nova 2 Lite einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, ConverseStream und. InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Tag für Amazon Nova 2 Omni Jede unterstützte Region: 11.520.000.000 Nein Die maximale Anzahl globaler regionsübergreifender Token, die Sie an einem Tag für Amazon Nova 2 Omni zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Tag für Amazon Nova 2 Pro Preview Jede unterstützte Region: 1.440.000.000 Nein Die maximale Anzahl globaler regionsübergreifender Token, die Sie an einem Tag für Amazon Nova 2 Pro Preview zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, ConverseStream und. InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Tag für Anthropic Claude Fable 5 Jede unterstützte Region: 5.760.000.000 Nein Die maximale Anzahl globaler regionsübergreifender Token, die Sie an einem Tag für Anthropic Claude Fable 5 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Tag für Anthropic Claude Haiku 4.5 Jede unterstützte Region: 7.200.000.000 Nein Die maximale Anzahl globaler regionsübergreifender Token, die Sie an einem Tag für Anthropic Claude Haiku 4.5 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Tag für Anthropic Claude Opus 4.5 Jede unterstützte Region: 2.880.000.000 Nein Die maximale Anzahl globaler regionsübergreifender Token, die Sie an einem Tag für Anthropic Claude Opus 4.5 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Tag für Anthropic Claude Opus 4.6 V1 Jede unterstützte Region: 4.320.000.000 Nein Die maximale Anzahl globaler regionsübergreifender Token, die Sie an einem Tag für Anthropic Claude Opus 4.6 V1 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Tag für Anthropic Claude Opus 4.7 Jede unterstützte Region: 14.400.000.000 Nein Die maximale Anzahl globaler regionsübergreifender Token, die Sie an einem Tag für Anthropic Claude Opus 4.7 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Tag für Anthropic Claude Opus 4.8 Jede unterstützte Region: 43.200.000.000 Nein Die maximale Anzahl globaler regionsübergreifender Token, die Sie an einem Tag für Anthropic Claude Opus 4.8 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modellinferenz-Token pro Tag für Anthropic Claude Opus 5 Jede unterstützte Region: 43.200.000.000 Nein Die maximale Anzahl globaler regionsübergreifender Token, die Sie an einem Tag für Anthropic Claude Opus 5 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Tag für Anthropic Claude Sonnet 4 V1 Jede unterstützte Region: 288.000.000 Nein Die maximale Anzahl globaler regionsübergreifender Token, die Sie an einem Tag für Anthropic Claude Sonnet 4 V1 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Tag für Anthropic Claude Sonnet 4.5 V1 Jede unterstützte Region: 7.200.000.000 Nein Die maximale Anzahl globaler regionsübergreifender Token, die Sie an einem Tag für Anthropic Claude Sonnet 4.5 V1 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Tag für Anthropic Claude Sonnet 4.5 V1 1M Context Length Jede unterstützte Region: 1.440.000.000 Nein Die maximale Anzahl globaler regionsübergreifender Token, die Sie an einem Tag zur Modellinferenz einreichen können, für Anthropic Claude Sonnet 4.5 V1 1M Context Length. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Tag für Anthropic Claude Sonnet 4.6 Jede unterstützte Region: 8.640.000.000 Nein Die maximale Anzahl globaler regionsübergreifender Token, die Sie an einem Tag für Anthropic Claude Sonnet 4.6 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Tag für Anthropic Claude Sonnet 5 Jede unterstützte Region: 8.640.000.000 Nein Die maximale Anzahl globaler regionsübergreifender Token, die Sie an einem Tag für Anthropic Claude Sonnet 5 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Tag für Cohere Embed V4 Jede unterstützte Region: 432.000.000 Nein Die maximale Anzahl globaler regionsübergreifender Token, die Sie an einem Tag für Cohere Embed V4 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Minute für Amazon Nova 2 Lite Jede unterstützte Region: 8.000.000 Ja Die maximale Anzahl globaler regionsübergreifender Token, die Sie innerhalb einer Minute für Amazon Nova 2 Lite zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, ConverseStream und. InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Minute für Amazon Nova 2 Omni Jede unterstützte Region: 8.000.000 Ja Die maximale Anzahl globaler regionsübergreifender Token, die Sie innerhalb einer Minute für Amazon Nova 2 Omni zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modellinferenz-Token pro Minute für Amazon Nova 2 Pro Preview Jede unterstützte Region: 1 000 000 Ja Die maximale Anzahl globaler regionsübergreifender Token, die Sie für Amazon Nova 2 Pro Preview innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, ConverseStream und. InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Minute für Anthropic Claude Fable 5 Jede unterstützte Region: 4.000.000 Ja Die maximale Anzahl globaler regionsübergreifender Token, die Sie innerhalb einer Minute für Anthropic Claude Fable 5 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Minute für Anthropic Claude Haiku 4.5 Jede unterstützte Region: 5 000 000 Ja Die maximale Anzahl globaler regionsübergreifender Token, die Sie innerhalb einer Minute für Anthropic Claude Haiku 4.5 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Minute für Anthropic Claude Opus 4.5 Jede unterstützte Region: 2.000.000 Ja Die maximale Anzahl globaler regionsübergreifender Token, die Sie innerhalb einer Minute für Anthropic Claude Opus 4.5 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Minute für Anthropic Claude Opus 4.6 V1 Jede unterstützte Region: 3.000.000 Ja Die maximale Anzahl globaler regionsübergreifender Token, die Sie innerhalb einer Minute für Anthropic Claude Opus 4.6 V1 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Minute für Anthropic Claude Opus 4.7 Jede unterstützte Region: 10 000 000 Ja Die maximale Anzahl globaler regionsübergreifender Token, die Sie innerhalb einer Minute für Anthropic Claude Opus 4.7 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globales regionsübergreifendes Modell-Inferenz-Token pro Minute für Anthropic Claude Opus 4.8 Jede unterstützte Region: 30.000.000 Ja Die maximale Anzahl globaler regionsübergreifender Token, die Sie innerhalb einer Minute für Anthropic Claude Opus 4.8 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Minute für Anthropic Claude Opus 5 Jede unterstützte Region: 30.000.000 Ja Die maximale Anzahl globaler regionsübergreifender Token, die Sie innerhalb einer Minute für Anthropic Claude Opus 5 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Minute für Anthropic Claude Sonnet 4 V1 Jede unterstützte Region: 200 000 Ja Die maximale Anzahl globaler regionsübergreifender Token, die Sie innerhalb einer Minute für Anthropic Claude Sonnet 4 V1 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Minute für Anthropic Claude Sonnet 4.5 V1 Jede unterstützte Region: 5 000 000 Ja Die maximale Anzahl globaler regionsübergreifender Token, die Sie innerhalb einer Minute für Anthropic Claude Sonnet 4.5 V1 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modellinferenz-Token pro Minute für Anthropic Claude Sonnet 4.5 V1 1M Context Length Jede unterstützte Region: 1 000 000 Ja Die maximale Anzahl globaler regionsübergreifender Token, die Sie innerhalb einer Minute für Anthropic Claude Sonnet 4.5 V1 1M Context Length zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Minute für Anthropic Claude Sonnet 4.6 Jede unterstützte Region: 6.000.000 Ja Die maximale Anzahl globaler regionsübergreifender Token, die Sie innerhalb einer Minute für Anthropic Claude Sonnet 4.6 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Minute für Anthropic Claude Sonnet 5 Jede unterstützte Region: 6.000.000 Ja Die maximale Anzahl globaler regionsübergreifender Token, die Sie innerhalb einer Minute für Anthropic Claude Sonnet 5 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Globale regionsübergreifende Modell-Inferenz-Token pro Minute für Cohere Embed V4 Jede unterstützte Region: 300 000 Ja Die maximale Anzahl globaler regionsübergreifender Token, die Sie innerhalb einer Minute für Cohere Embed V4 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Importierte Modelle pro Konto Jede unterstützte Region: 3 Ja Die maximale Anzahl importierter Modelle in einem Konto.
Inferenzprofile pro Konto Jede unterstützte Region: 1 000 Ja Die maximale Anzahl von Inferenzprofilen in einem Konto.
ListAgentActionGroups Anfragen pro Sekunde Jede unterstützte Region: 10 Nein Die maximale Anzahl von ListAgentActionGroups API-Anfragen pro Sekunde.
ListAgentAliases Anfragen pro Sekunde Jede unterstützte Region: 10 Nein Die maximale Anzahl von ListAgentAliases API-Anfragen pro Sekunde.
ListAgentKnowledgeBases Anfragen pro Sekunde Jede unterstützte Region: 10 Nein Die maximale Anzahl von ListAgentKnowledgeBases API-Anfragen pro Sekunde.
ListAgentVersions Anfragen pro Sekunde Jede unterstützte Region: 10 Nein Die maximale Anzahl von ListAgentVersions API-Anfragen pro Sekunde.
ListAgents Anfragen pro Sekunde Jede unterstützte Region: 10 Nein Die maximale Anzahl von ListAgents API-Anfragen pro Sekunde.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Amazon Nova 2 Multimodal Embeddings V1 Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Amazon Nova 2 Multimodal Embeddings V1.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Amazon Nova Premier Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Amazon Nova Premier.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Claude 3 Haiku Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Claude 3-Haiku.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Claude 3 Opus Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Claude 3 Opus.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Claude 3 Sonnet Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Claude 3 Sonnet.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Claude 3.5 Haiku Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Claude 3.5-Haiku.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Claude 3.5 Sonnet Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Claude 3.5 Sonnet.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Claude 3.5 Sonnet v2 Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Claude 3.5 Sonnet v2.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Claude 3.7 Sonnet Jede unterstützte Region: 100 Yes (Ja) Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Claude 3.7 Sonnet.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Claude Haiku 4.5 Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Claude Haiku 4.5.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Claude Opus 4.5 Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Claude Opus 4.5.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Claude Opus 4.6 Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Claude Opus 4.6.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Claude Opus 5 Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Claude Opus 5.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Claude Sonnet 4 Jede unterstützte Region: 100 Yes (Ja) Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Claude Sonnet 4.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Claude Sonnet 4.5. Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Claude Sonnet 4.5.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Claude Sonnet 4.6 Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Claude Sonnet 4.6.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für DeepSeek V3.2 Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für. DeepSeek V3.2
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für v3 DeepSeek Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Version 3. DeepSeek
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für Devstral 2 123B Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Devstral 2 123B.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für GLM 4.7 Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenz-Job für GLM 4.7.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für GLM 4.7 Flash Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für GLM 4.7 Flash.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für GLM 5 Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für GLM 5.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Gemma 3 12B Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Gemma 3 12B.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Gemma 3 27B Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Gemma 3 27B.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Gemma 3 4B Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Gemma 3 4B.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für Kimi K2 Thinking Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Kimi K2 Thinking.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für Kimi K2.5 Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Kimi. K2.5
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für Llama 3.1 405B Instruct Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenz-Job für Llama 3.1 405B Instruct.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für Llama 3.1 70B Instruct Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenz-Job für Llama 3.1 70B Instruct.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für Llama 3.1 8B Instruct Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenz-Job für Llama 3.1 8B Instruct.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für Llama 3.2 11B Instruct Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenz-Job für Llama 3.2 11B Instruct.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für Llama 3.2 1B Instruct Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob Llama 3.2 1B Instruct.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für Llama 3.2 3B Instruct Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Llama 3.2 3B Instruct.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für Llama 3.2 90B Instruct Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenz-Job für Llama 3.2 90B Instruct.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für Llama 3.3 70B Instruct Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenz-Job für Llama 3.3 70B Instruct.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für Llama 4 Maverick Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Llama 4 Maverick.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für Llama 4 Scout Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Llama 4 Scout.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für Magistral Small 2509 Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Magistral Small 2509.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für M2 MiniMax Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für MiniMax M2.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für MiniMax M2.1 Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für. MiniMax M2.1
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für MiniMax M2.5 Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für. MiniMax M2.5
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Ministral 3 14B Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Ministral 3 14B.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Ministral 3 8B Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Ministral 3 8B.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Ministral 3B Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Ministral 3B.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Mistral Large 2 (24,07) Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Mistral Large 2 (24,07).
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Mistral Large 3 Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Mistral Large 3.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Mistral Small Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Mistral Small.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für NVIDIA Nemotron 3 Super 120B A12B Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenz-Job für NVIDIA Nemotron 3 Super 120B A12B.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für NVIDIA Nemotron Nano 12B Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für NVIDIA Nemotron Nano 12B.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für NVIDIA Nemotron Nano 3 30B Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für NVIDIA Nemotron Nano 3 30B.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für NVIDIA Nemotron Nano 9B Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenz-Job für NVIDIA Nemotron Nano 9B.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für Nova 2 Lite Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Nova 2 Lite.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Nova Lite V1 Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Nova Lite V1.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Nova Micro V1 Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Nova Micro V1.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Nova Pro V1 Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Nova Pro V1.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für OpenAI GPT OSS 120b Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für OpenAI GPT OSS 120b.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für OpenAI GPT OSS 20b Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für OpenAI GPT OSS 20b.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für OpenAI GPT OSS Safeguard 120b Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für OpenAI GPT OSS Safeguard 120b.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für OpenAI GPT OSS Safeguard 20b Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für OpenAI GPT OSS Safeguard 20b.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für Qwen3 235B Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenz-Job für Qwen3 235B.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Qwen3 32B Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Qwen3 32B.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für Qwen3 Coder 30B Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenz-Job für Qwen3 Coder 30B.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für Qwen3 Coder 480B Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenz-Job für Qwen3 Coder 480B.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für Qwen3 Coder Next Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenz-Job für Qwen3 Coder Next.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für Qwen3 Next 80B Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Qwen3 Next 80B.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für Qwen3 VL 235B Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Qwen3 VL 235B.
Mindestanzahl von Datensätzen pro Batch-Inferenz-Job für Titan Multimodal Embeddings G1 Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Titan Multimodal Embeddings G1.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Titan Text Embeddings V2 Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Titan Text Embeddings V2.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Voxtral Mini 3B 2507 Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Voxtral Mini 3B 2507.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Voxtral Small 24B 2507 Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Voxtral Small 24B 2507.
Mindestanzahl von Datensätzen pro Batch-Inferenzauftrag für Writer Palmyra Vision 7B Jede unterstützte Region: 100 Nein Die Mindestanzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Writer Palmyra Vision 7B.
Modellieren Sie die maximale latenzoptimierte Tokens pro Tag für Amazon Nova Pro V1 Jede unterstützte Region: 57.600.000 Nein Die maximale Anzahl an Tokens, die Sie für Amazon Nova Pro V1 an einem Tag zur latenzoptimierten Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
Modellieren Sie die maximale Anzahl an Token pro Tag für AI21 Labs Jamba 1.5 Large (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 432.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für AI21 Labs Jamba 1.5 Large. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für AI21 Labs Jamba 1.5 Mini (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 432.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für AI21 Labs Jamba 1.5 Mini. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Amazon Nova 2 Lite (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 5.760.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Amazon Nova 2 Lite. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse ConverseStream, InvokeModel und. InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Amazon Nova 2 Omni (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 5.760.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Amazon Nova 2 Omni. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und ConverseStream. InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Maximale Anzahl an Tokens pro Tag für das Modell für Amazon Nova 2 Pro Preview (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 720.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Amazon Nova 2 Pro Preview. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse ConverseStream, InvokeModel und. InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Amazon Nova Lite (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 5.760.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Amazon Nova Lite. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, ConverseStream, InvokeModel und. InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Amazon Nova Micro (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 5.760.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Amazon Nova Micro. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse ConverseStream, InvokeModel und. InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Amazon Nova Premier V1 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 1.440.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Amazon Nova Premier V1. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse ConverseStream, InvokeModel und. InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Amazon Nova Pro (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 1.440.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Amazon Nova Pro. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse ConverseStream, InvokeModel und. InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Anthropic Claude 3 Haiku (verdoppelt für regionsübergreifende Aufrufe)

us-east-1:2.880.000.000

us-west-2:2.880.000.000

ap-northeast-1:288.000.000

ap-southeast-1:288.000.000

Jede der anderen unterstützten Regionen: 432.000.000

Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Anthropic Claude 3 Haiku. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Anthropic Claude 3.5 Haiku (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 2.880.000.000 Nein Tägliche maximale Anzahl an Tokens für Modellinferenz für Anthropic Claude 3.5 Haiku. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Anthropic Claude 3.5 Sonnet V1 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 2.880.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Anthropic Claude 3.5 Sonnet V1. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Anthropic Claude 3.5 Sonnet V2 (verdoppelt für regionsübergreifende Aufrufe)

us-east-1:2.880.000.000

us-west-2:2.880.000.000

Jede der anderen unterstützten Regionen: 576.000.000

Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Anthropic Claude 3.5 Sonnet V2. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Anthropic Claude 3.7 Sonnet V1 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 720.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Anthropic Claude 3.7 Sonnet V1. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Anthropic Claude Fable 5 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 2.880.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Anthropic Claude Fable 5. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Anthropic Claude Haiku 4.5 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 3.600.000.000 Nein Tägliche maximale Anzahl an Tokens für Modellinferenz für Anthropic Claude Haiku 4.5. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Anthropic Claude Opus 4 V1 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Anthropic Claude Opus 4 V1. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Anthropic Claude Opus 4.1 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 360.000.000 Nein Tägliche maximale Anzahl an Tokens für Modellinferenz für Anthropic Claude Opus 4.1. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Anthropic Claude Opus 4.5 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 1.440.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Anthropic Claude Opus 4.5. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Anthropic Claude Opus 4.6 V1 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 2.160.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Anthropic Claude Opus 4.6 V1. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Anthropic Claude Opus 4.7 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 7.200.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Anthropic Claude Opus 4.7. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Anthropic Claude Opus 4.8 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 21.600.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Anthropic Claude Opus 4.8. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Anthropic Claude Opus 5 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 21.600.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Anthropic Claude Opus 5. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Anthropic Claude Sonnet 4 V1 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Anthropic Claude Sonnet 4 V1. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Token pro Tag für Anthropic Claude Sonnet 4 V1 1M Context Length (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 720.000.000 Nein Tägliche maximale Anzahl an Tokens für Modellinferenz für Anthropic Claude Sonnet 4 V1 1M Context Length. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Anthropic Claude Sonnet 4.5 V1 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 3.600.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Anthropic Claude Sonnet 4.5 V1. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Token pro Tag für Anthropic Claude Sonnet 4.5 V1 1M Context Length (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 720.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Anthropic Claude Sonnet 4.5 V1 1M Context Length. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Anthropic Claude Sonnet 4.6 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 4.320.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Anthropic Claude Sonnet 4.6. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Anthropic Claude Sonnet 5 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 4.320.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Anthropic Claude Sonnet 5. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Cohere Embed V4 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 216.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Cohere Embed V4. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse,, und ConverseStream. InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für DeepSeek R1 V1 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für R1 V1. DeepSeek Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse,, und ConverseStream. InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für DeepSeek V3 V1 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für Modellinferenz für V3 V1. DeepSeek Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse ConverseStream, InvokeModel und. InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für DeepSeek V3.2 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für. DeepSeek V3.2 Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse ConverseStream, InvokeModel und. InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für GPT OSS Safeguard 120B (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Maximale tägliche Anzahl an Tokens für Modellinferenz für GPT OSS Safeguard 120B. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für GPT OSS Safeguard 20B (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für Modellinferenz für GPT OSS Safeguard 20B. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Gemma 3 12B (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Gemma 3 12B. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Gemma 3 27B (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Gemma 3 27B. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Gemma 3 4B (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Gemma 3 4B. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse,, und ConverseStream. InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Kimi K2 Thinking (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für Modellinferenz für Kimi K2 Thinking. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Maximale Anzahl an Tokens pro Tag für das Modell Magistral Small 1.2 (verdoppelt für regionsübergreifende Anrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Magistral Small 1.2. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Meta Llama 3.2 11B Instruct (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 432.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Meta Llama 3.2 11B Instruct. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Meta Llama 3.2 1B Instruct (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 432.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Meta Llama 3.2 1B Instruct. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Meta Llama 3.2 3B Instruct (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 432.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Meta Llama 3.2 3B Instruct. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Meta Llama 3.2 90B Instruct (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 432.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Meta Llama 3.2 90B Instruct. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Meta Llama 4 Maverick V1 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 432.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Meta Llama 4 Maverick V1. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Meta Llama 4 Scout V1 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 432.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Meta Llama 4 Scout V1. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und ConverseStream. InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für MiniMax M2.5 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für. MiniMax M2.5 Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse ConverseStream, InvokeModel und. InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Minimax M2 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Minimax M2. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse,, und ConverseStream. InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Minimax M2.1 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Minimax. M2.1 Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und ConverseStream. InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Ministral 14B 3.0 (verdoppelt für regionsübergreifende Anrufe) Jede unterstützte Region: 144.000.000.000 Nein Maximale tägliche Anzahl an Tokens für Modellinferenz für Ministral 14B 3.0. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Ministral 3B 3.0 (verdoppelt für regionsübergreifende Anrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für Modellinferenz für Ministral 3B 3.0. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und ConverseStream. InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Ministral 8B 3.0 (verdoppelt für regionsübergreifende Anrufe) Jede unterstützte Region: 144.000.000.000 Nein Maximale tägliche Anzahl an Tokens für Modellinferenz für Ministral 8B 3.0. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Mistral AI Mistral 7B Instruct (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 432.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Mistral AI Mistral 7B Instruct. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Mistral AI Mistral Large (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 432.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Mistral AI Mistral Large. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Mistral AI Mistral Small (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 432.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Mistral AI Mistral Small. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Mistral AI Mixtral 8X7B Instruct (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 432.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Mistral AI Mixtral 8X7B Instruct. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Mistral Devstral 2 123b (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Mistral Devstral 2 123b. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Mistral Large 3 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Mistral Large 3. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Mistral Pixtral Large 25.02 V1 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 57.600.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Mistral Pixtral Large 25.02 V1. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Moonshot AI Kimi K2.5 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Moonshot AI Kimi. K2.5 Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für NVIDIA Nemotron 3 Super 120B A12B (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für NVIDIA Nemotron 3 Super 120B A12B. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für NVIDIA Nemotron Nano 2 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für NVIDIA Nemotron Nano 2. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für NVIDIA Nemotron Nano 2 VL (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für NVIDIA Nemotron Nano 2 VL. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Nemotron Nano 3 30B (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Nemotron Nano 3 30B. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für OpenAI GPT OSS 120B (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für Modellinferenz für OpenAI GPT OSS 120B. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für OpenAI GPT OSS 20B (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für Modellinferenz für OpenAI GPT OSS 20B. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Qwen3 235B a22b 2507 V1 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Qwen3 235B a22b 2507 V1. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Qwen3 32B V1 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Qwen3 32B V1. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Qwen3 Coder 30B a3b V1 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Qwen3 Coder 30B a3b V1. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Qwen3 Coder 480B a35b V1 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Qwen3 Coder 480B a35b V1. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Qwen3 Coder Next (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Qwen3 Coder Next. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Qwen3 Next 80B A3B (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Qwen3 Next 80B A3B. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Qwen3 VL 235B A22B (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Qwen3 VL 235B A22B. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Voxtral Mini 1.0 (verdoppelt für regionsübergreifende Anrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für Modellinferenz für Voxtral Mini 1.0. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Voxtral Small 1.0 (verdoppelt für regionsübergreifende Anrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für Modellinferenz für Voxtral Small 1.0. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Writer AI Palmyra X4 V1 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 108.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Writer AI Palmyra X4 V1. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Writer AI Palmyra X5 V1 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 108.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Writer AI Palmyra X5 V1. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Writer Palmyra Vision 7B (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Writer Palmyra Vision 7B. Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Z.ai GLM 5 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für GLM 5. Z.ai Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse,, und ConverseStream. InvokeModel InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Z.ai GLM-4.7 (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für. Z.ai GLM-4.7 Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse ConverseStream, InvokeModel und. InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modellieren Sie die maximale Anzahl an Tokens pro Tag für Z.ai GLM-4.7 Flash (verdoppelt für regionsübergreifende Aufrufe) Jede unterstützte Region: 144.000.000.000 Nein Tägliche maximale Anzahl an Tokens für die Modellinferenz für Flash. Z.ai GLM-4.7 Kombiniert die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse ConverseStream, InvokeModel und. InvokeModelWithResponseStream Bei regionsübergreifenden Anrufen verdoppelt; gilt nicht im Falle einer genehmigten TPM-Erhöhung.
Modelleinheiten — unverbindlicher Bereitgestellter Durchsatz für alle Basismodelle Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die auf unverbindlich bereitgestellte Durchsätze für Basismodelle verteilt werden können
Modelleinheiten für unverbindliche Bereitstellungsdurchsätze auf benutzerdefinierte Modelle Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die auf unverbindliche, bereitgestellte Durchsätze für benutzerdefinierte Modelle verteilt werden können
Modelleinheiten pro bereitgestelltem Modell für AI21 Labs Mid Jurassic-2 Jede unterstützte Region: 0 Ja Die maximale Anzahl von Modelleinheiten, die einem bereitgestellten Modell für AI21 Labs Mid zugewiesen werden können. Jurassic-2
Modelleinheiten pro bereitgestelltem Modell für AI21 Labs Ultra Jurassic-2 Jede unterstützte Region: 0 Ja Die maximale Anzahl von Modelleinheiten, die einem bereitgestellten Modell für AI21 Labs Ultra zugewiesen werden können. Jurassic-2
Modelleinheiten pro bereitgestelltem Modell für Amazon Nova 2 Lite 256K V1.0 Jede unterstützte Region: 0 Ja Die maximale Anzahl von Modelleinheiten, die einem bereitgestellten Modell für Amazon Nova 2 Lite 256K zugewiesen werden können. V1.0
Modelleinheiten pro bereitgestelltem Modell für Amazon Nova Canvas Jede unterstützte Region: 0 Ja Die maximale Anzahl von Modelleinheiten, die einem bereitgestellten Modell für Amazon Nova Canvas zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Amazon Titan Embeddings G1 — Text Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Amazon Titan Embeddings G1 — Text zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Amazon Titan Image Generator G1 Jede unterstützte Region: 0 Ja Die maximale Anzahl von Modelleinheiten, die einem bereitgestellten Modell für Amazon Titan Image Generator G1 zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Amazon Titan Image Generator G2 Jede unterstützte Region: 0 Ja Die maximale Anzahl von Modelleinheiten, die einem bereitgestellten Modell für Amazon Titan Image Generator G2 zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Amazon Titan Lite V1 4K Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Amazon Titan Text Lite V1 4K zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Amazon Titan Multimodal Embeddings G1 Jede unterstützte Region: 0 Ja Die maximale Anzahl von Modelleinheiten, die einem bereitgestellten Modell für Amazon Titan Multimodal Embeddings G1 zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Amazon Titan Text Embeddings V2 Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Amazon Titan Text Embeddings V2 zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Amazon Titan Text G1 — Express 8K Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Amazon Titan Text G1 — Express 8K zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Amazon Titan Text Premier V1 32K Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Amazon Titan Text Premier V1 32K zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Anthropic Claude 3 Haiku 200K Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Anthropic Claude 3 Haiku 200K zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Anthropic Claude 3 Haiku 48K Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Anthropic Claude 3 Haiku 48K zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Anthropic Claude 3 Sonnet 200K Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Anthropic Claude 3 Sonnet 200K zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Anthropic Claude 3 Sonnet 28K Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Anthropic Claude 3 Sonnet 28K zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Anthropic Claude 3.5 Haiku 16K Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Anthropic Claude 3.5 Haiku 16K zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Anthropic Claude 3.5 Haiku 200K Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Anthropic Claude 3.5 Haiku 200K zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Anthropic Claude 3.5 Haiku 64K Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Anthropic Claude 3.5 Haiku 64K zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Anthropic Claude 3.5 Sonnet 18K Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Anthropic Claude 3.5 Sonnet 18K zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Anthropic Claude 3.5 Sonnet 200K Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Anthropic Claude 3.5 Sonnet 200K zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Anthropic Claude 3.5 Sonnet 51K Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Anthropic Claude 3.5 Sonnet 51K zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Anthropic Claude 3.5 Sonnet V2 18K Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Anthropic Claude 3.5 Sonnet V2 18K zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Anthropic Claude 3.5 Sonnet V2 200K Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Anthropic Claude 3.5 Sonnet V2 200K zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Anthropic Claude 3.5 Sonnet V2 51K Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Anthropic Claude 3.5 Sonnet V2 51K zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Anthropic Claude 3.7 Sonnet 18K V1.0 Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Anthropic Claude 3.7 Sonnet 18K zugewiesen werden können. V1.0
Modelleinheiten pro bereitgestelltem Modell für Anthropic Claude 3.7 Sonnet 200K V1.0 Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Anthropic Claude 3.7 Sonnet 200K zugewiesen werden können. V1.0
Modelleinheiten pro bereitgestelltem Modell für Anthropic Claude 3.7 Sonnet 51K V1.0 Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Anthropic Claude 3.7 Sonnet 51K zugewiesen werden können. V1.0
Modelleinheiten pro bereitgestelltem Modell für Anthropic Claude Instant V1 100K Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Anthropic Claude Instant V1 100K zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Anthropic Claude V2 100K Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Anthropic Claude V2 100K zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Anthropic Claude V2 18K Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Anthropic Claude V2 18K zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Anthropic Claude 18K V2.1 Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Anthropic Claude 18K zugewiesen werden können. V2.1
Modelleinheiten pro bereitgestelltem Modell für Anthropic Claude 200K V2.1 Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Anthropic Claude 200K zugewiesen werden können. V2.1
Modelleinheiten pro bereitgestelltem Modell für Cohere Command Jede unterstützte Region: 0 Ja Die maximale Anzahl von Modelleinheiten, die einem für Cohere Command bereitgestellten Modell zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Cohere Command Light Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Cohere Command Light zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Cohere Command R Jede unterstützte Region: 0 Ja Die maximale Anzahl von Modelleinheiten, die einem bereitgestellten Modell für Cohere Command R 128k zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Cohere Command R Plus Jede unterstützte Region: 0 Ja Die maximale Anzahl von Modelleinheiten, die einem bereitgestellten Modell für Cohere Command R Plus 128k zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Cohere Embed English Jede unterstützte Region: 0 Ja Die maximale Anzahl von Modelleinheiten, die einem bereitgestellten Modell für Cohere Embed English zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Cohere Embed Multilingual Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem für Cohere Embed Multilingual bereitgestellten Modell zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Meta Llama 2 13B Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Meta Llama 2 13B zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Meta Llama 2 70B Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Meta Llama 2 70B zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Meta Llama 2 Chat 13B Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Meta Llama 2 Chat 13B zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Meta Llama 2 Chat 70B Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Meta Llama 2 Chat 70B zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Meta Llama 3 70B Instruct Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Meta Llama 3 70B Instruct zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Meta Llama 3 8B Instruct Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Meta Llama 3 8B Instruct zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Meta Llama 3.1 70B Instruct Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Meta Llama 3.1 70B Instruct zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Meta Llama 3.1 8B Instruct Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Meta Llama 3.1 8B Instruct zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Meta Llama 3.2 11B Instruct Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Meta Llama 3.2 11B Instruct zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Meta Llama 3.2 1B Instruct Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Meta Llama 3.2 1B Instruct zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Meta Llama 3.2 3B Instruct Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Meta Llama 3.2 3B Instruct zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Meta Llama 3.2 90B Instruct Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Meta Llama 3.2 90B Instruct zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Mistral Large 2407 Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Mistral Large 2407 zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Mistral Small Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Mistral Small zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für Stable Diffusion XL 0.8 Stability.ai Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Stability.ai Stable Diffusion XL 0.8 zugewiesen werden können
Modelleinheiten pro bereitgestelltem Modell für Stability.ai Stable Diffusion XL 1.0 Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für Stability.ai Stable Diffusion XL 1.0 zugewiesen werden können.
Modelleinheiten pro bereitgestelltem Modell für die Variante mit einer Kontextlänge von 128 k für Amazon Nova Micro Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für die Variante mit einer Kontextlänge von 128 k für Amazon Nova Micro zugewiesen werden können
Modelleinheiten pro bereitgestelltem Modell für die Variante mit einer Kontextlänge von 24k für Amazon Nova Lite Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für die Variante mit 24k Kontextlänge für Amazon Nova Lite zugewiesen werden können
Modelleinheiten pro bereitgestelltem Modell für die Variante mit 24k Kontextlänge für Amazon Nova Micro Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für die Variante mit 24k Kontextlänge für Amazon Nova Micro zugewiesen werden können
Modelleinheiten pro bereitgestelltem Modell für die Variante mit 24k Kontextlänge für Amazon Nova Pro Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für die Variante mit 24k Kontextlänge für Amazon Nova Pro zugewiesen werden können
Modelleinheiten pro bereitgestelltem Modell für die Variante mit 300.000 Kontextlängen für Amazon Nova Lite Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für die Variante mit 300.000 Kontextlängen für Amazon Nova Lite zugewiesen werden können
Modelleinheiten pro bereitgestelltem Modell für die Variante mit 300.000 Kontextlängen für Amazon Nova Pro Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem bereitgestellten Modell für die Variante mit 300.000 Kontextlängen für Amazon Nova Pro zugewiesen werden können.
Modelleinheiten mit Engagement für Provisioned Throughout, entwickelt für Meta Llama 4 Scout 17B Instruct 10M Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem Provisioned Throughput zugewiesen werden können, der für Meta Llama 4 Scout 17B Instruct 10M erstellt wurde, mit Engagement.
Modellieren Sie mit Engagement für Provisioned Throughout, das für Meta Llama 4 Scout 17B Instruct 128K entwickelt wurde Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem Provisioned Throughput zugewiesen werden können, der für Meta Llama 4 Scout 17B Instruct 128K erstellt wurde, mit verbindlicher Verpflichtung.
Modellieren Sie mit Engagement Einheiten für Provisioned Throughout, die für Meta Maverick 4 Scout 17B Instruct 128K erstellt wurden Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem Provisioned Throughput zugewiesen werden können, der für Meta Llama 4 Maverick 17B Instruct 128K erstellt wurde, mit Verpflichtung.
Modellieren Sie mit Engagement Einheiten für Provisioned Throughout, die für Meta Maverick 4 Scout 17B Instruct 1M entwickelt wurden Jede unterstützte Region: 0 Ja Die maximale Anzahl an Modelleinheiten, die einem Provisioned Throughput zugewiesen werden können, der für Meta Llama 4 Maverick 17B Instruct 1M erstellt wurde, mit Verpflichtung.
No-commitment Modelleinheiten für Provisioned Throughput, erstellt für das Basismodell Amazon Nova 2 Lite 256K V1.0 Jede unterstützte Region: 0 Nein Die maximale Anzahl an Modelleinheiten, die einem für das Basismodell Amazon Nova 2 Lite V1.0 256K erstellten Provisioned Throughput zugewiesen werden können, ohne dass eine Verpflichtung besteht
No-commitment Modelleinheiten für den bereitgestellten Durchsatz, die für das benutzerdefinierte Modell Amazon Nova 2 Lite 256K erstellt wurden V1.0 Jede unterstützte Region: 0 Nein Die maximale Anzahl an Modelleinheiten, die einem für das benutzerdefinierte Modell Amazon Nova 2 Lite V1.0 256K erstellten Provisioned Throughput zugewiesen werden können, ohne dass eine Verpflichtung besteht.
Anzahl der Router für benutzerdefinierte Eingabeaufforderungen pro Konto Jede unterstützte Region: 500 Nein Die maximale Anzahl von Routern für benutzerdefinierte Eingabeaufforderungen, die Sie pro Konto und Region erstellen können.
On-Demand, latenzoptimierte Modellinferenzanfragen pro Minute für Amazon Nova Pro V1 Jede unterstützte Region: 10 Nein Die maximale Anzahl latenzoptimierter On-Demand-Anfragen, die Sie für Amazon Nova Pro V1 innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe von Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-Demand, latenzoptimierte Modellinferenzanfragen pro Minute für Meta Llama 3.1 405B Instruct Jede unterstützte Region: 100 Nein Die maximale Anzahl latenzoptimierter On-Demand-Anfragen, die Sie für Meta Llama 3.1 405B Instruct innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe von Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-Demand, latenzoptimierte Modellinferenzanfragen pro Minute für Meta Llama 3.1 70B Instruct Jede unterstützte Region: 100 Nein Die maximale Anzahl latenzoptimierter On-Demand-Anfragen, die Sie für Meta Llama 3.1 70B Instruct innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe von Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-Demand, latenzoptimierte Modellinferenz-Token pro Minute für Amazon Nova Pro V1 Jede unterstützte Region: 40 000 Nein Die maximale Anzahl latenzoptimierter On-Demand-Token, die Sie innerhalb einer Minute für Amazon Nova Pro V1 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-Demand, latenzoptimierte Modellinferenz-Token pro Minute für Meta Llama 3.1 405B Instruct Jede unterstützte Region: 40 000 Nein Die maximale Anzahl latenzoptimierter On-Demand-Token, die Sie innerhalb einer Minute für Meta Llama 3.1 405B Instruct zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-Demand, latenzoptimierte Modellinferenz-Token pro Minute für Meta Llama 3.1 70B Instruct Jede unterstützte Region: 40 000 Nein Die maximale Anzahl latenzoptimierter On-Demand-Token, die Sie innerhalb einer Minute für Meta Llama 3.1 70B Instruct zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand InvokeModel asynchrone gleichzeitige Anfragen für Amazon Nova 2 Multimodal Embeddings V1 Jede unterstützte Region: 30 Nein Die maximale Anzahl von asynchronen gleichzeitigen Modellinferenzanforderungen, die Sie für Amazon Nova 2 Multimodal Embeddings V1 einreichen können. Das Kontingent berücksichtigt die Gesamtsumme von Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand InvokeModel asynchrone gleichzeitige Anfragen für TwelveLabs Marengo Embed 3.0 Jede unterstützte Region: 10 Yes (Ja) Die maximale Anzahl asynchroner gleichzeitiger Modellinferenzanforderungen, die Sie für Marengo Embed 3.0 einreichen können. TwelveLabs Das Kontingent berücksichtigt die Gesamtsumme von Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand InvokeModel gleichzeitige Anfragen für Amazon Nova 2 Sonic Jede unterstützte Region: 20 Nein Die maximale Anzahl gleichzeitiger Modellinferenzanfragen, die Sie für Amazon Nova 2 Sonic einreichen können. Das Kontingent berücksichtigt die Summe aus Converse, ConverseStream, InvokeModel und. InvokeModelWithResponseStream
On-demand InvokeModel gleichzeitige Anfragen für Amazon Nova Reel1.0 Jede unterstützte Region: 10 Nein Die maximale Anzahl gleichzeitiger Modellinferenzanfragen, die Sie für Amazon Nova Reel 1.0 einreichen können. Das Kontingent berücksichtigt die Summe von Converse,, und ConverseStream. InvokeModel InvokeModelWithResponseStream
On-demand InvokeModel gleichzeitige Anfragen für Amazon Nova Reel1.1 Jede unterstützte Region: 3 Nein Die maximale Anzahl gleichzeitiger Modellinferenzanfragen, die Sie für Amazon Nova Reel 1.1 einreichen können. Das Kontingent berücksichtigt die Summe von Converse,, und ConverseStream. InvokeModel InvokeModelWithResponseStream
On-demand InvokeModel gleichzeitige Anfragen für Amazon Nova Sonic Jede unterstützte Region: 20 Nein Die maximale Anzahl gleichzeitiger Anfragen, die Sie zur Modellinferenz für Amazon Nova Sonic einreichen können.
On-demand InvokeModel gleichzeitige Anfragen für Twelve Labs Marengo Jede unterstützte Region: 30 Nein Die maximale Anzahl gleichzeitiger InvokeModel Anfragen, die Sie für die Modellinferenz für Twelve Labs Marengo einreichen können.
On-demand InvokeModel gleichzeitige Anfragen für Twelve Labs Pegasus Jede unterstützte Region: 30 Yes (Ja) Die maximale Anzahl gleichzeitiger InvokeModel Anfragen, die Sie für die Modellinferenz für Twelve Labs Pegasus einreichen können.
On-demand latenzoptimierte Modellinferenzanfragen pro Minute für Anthropic Claude 3.5 Haiku Jede unterstützte Region: 100 Nein Die maximale Häufigkeit, mit der Sie die Modellinferenz innerhalb einer Minute aufrufen können. Das Kontingent berücksichtigt die Summe aus Converse InvokeModel und InvokeModelWithResponseStream für Anthropic Claude 3.5 Haiku ConverseStream, sofern die Latenzoptimierung konfiguriert ist.
On-demand latenzoptimierte Modellinferenz-Token pro Minute für Anthropic Claude 3.5 Haiku Jede unterstützte Region: 500 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse InvokeModel und InvokeModelWithResponseStream für Anthropic Claude 3.5 Haiku, sofern die Latenzoptimierung konfiguriert ist. ConverseStream
On-demand Modellieren Sie Inferenzanforderungen für Luma Ray V2 Jede unterstützte Region: 1 Nein Die maximale Anzahl gleichzeitiger Anfragen, die Sie für die Modellinferenz für Luma Ray V2 einreichen können. Das Kontingent berücksichtigt die Summe von Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanforderungen pro Minute für AI21 Labs Jamba 1.5 Large Jede unterstützte Region: 100 Nein Die maximale Häufigkeit, mit der Sie Modellinferenz innerhalb einer Minute für AI21 Labs Jamba 1.5 Large aufrufen können. Das Kontingent berücksichtigt die Summe der Anfragen für Converse und InvokeModel
On-demand Modellieren Sie Inferenzanforderungen pro Minute für AI21 Labs Jamba 1.5 Mini Jede unterstützte Region: 100 Nein Die maximale Häufigkeit, mit der Sie Modellinferenz innerhalb einer Minute für AI21 Labs Jamba 1.5 Mini aufrufen können. Das Kontingent berücksichtigt die Summe der Anfragen für Converse und InvokeModel
On-demand Modellieren Sie Inferenzanforderungen pro Minute für Amazon Nova 2 Multimodal Embeddings V1 Jede unterstützte Region: 2.000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Amazon Nova 2 Multimodal Embeddings V1 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Amazon Nova Canvas Jede unterstützte Region: 100 Nein Die maximale Anzahl von Anfragen, die Sie für Amazon Nova Canvas innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe von Converse, ConverseStream, InvokeModel und. InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanforderungen pro Minute für Amazon Nova Lite

us-east-1: 2 000

eu-west-2:2.000

Jede der anderen unterstützten Regionen: 200

Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Amazon Nova Lite innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse InvokeModel und InvokeModelWithResponseStream der ConverseStream Aktionen.
On-demand Modellieren Sie Inferenzanfragen pro Minute für Amazon Nova Micro

us-east-1: 2 000

eu-west-2:2.000

Jede der anderen unterstützten Regionen: 200

Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Amazon Nova Micro innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse InvokeModel und InvokeModelWithResponseStream der ConverseStream Aktionen.
On-demand Modellieren Sie Inferenzanfragen pro Minute für Amazon Nova Pro Jede unterstützte Region: 250 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Amazon Nova Pro innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse InvokeModel und InvokeModelWithResponseStream der ConverseStream Aktionen.
On-demand Modellieren Sie Inferenzanfragen pro Minute für Amazon Rerank 1.0 Jede unterstützte Region: 200 Nein Die maximale Häufigkeit, mit der Sie innerhalb einer Minute für Amazon Rerank 1.0 anrufen InvokeModel können.
On-demand Modellieren Sie Inferenzanfragen pro Minute für Amazon Titan Image Generator G1 Jede unterstützte Region: 60 Nein Die maximale Anzahl der Aufrufe, die Sie innerhalb einer Minute für Amazon Titan Image Generator G1 aufrufen InvokeModel können.
On-demand Modellieren Sie Inferenzanfragen pro Minute für Amazon Titan Image Generator G1 V2 Jede unterstützte Region: 60 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Amazon Titan Image Generator G1 V2 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse InvokeModel und InvokeModelWithResponseStream der ConverseStream Aktionen.
On-demand Modellieren Sie Inferenzanfragen pro Minute für Amazon Titan Multimodal Embeddings G1 Jede unterstützte Region: 2.000 Nein Die maximale Häufigkeit, mit der Sie innerhalb einer Minute Amazon Titan InvokeModel Multimodal Embeddings G1 anrufen können.
On-demand Modellieren Sie Inferenzanfragen pro Minute für Amazon Titan Text Embeddings Jede unterstützte Region: 2.000 Nein Die maximale Häufigkeit, mit der Sie innerhalb einer Minute Amazon Titan InvokeModel Text Embeddings anrufen können
On-demand Modellieren Sie Inferenzanfragen pro Minute für Amazon Titan Text Embeddings V2 Jede unterstützte Region: 6 000 Nein Die maximale Anzahl der Anrufe, die Sie innerhalb einer Minute für Amazon Titan Text Embeddings V2 aufrufen InvokeModel können
On-demand Modellieren Sie Inferenzanfragen pro Minute für Amazon Titan Text Express Jede unterstützte Region: 400 Nein Die maximale Häufigkeit, mit der Sie die Modellinferenz innerhalb einer Minute aufrufen können. Das Kontingent berücksichtigt die Summe aus Converse InvokeModel und InvokeModelWithResponseStream für Amazon Titan Text Express ConverseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Amazon Titan Text Premier Jede unterstützte Region: 100 Nein Die maximale Häufigkeit, mit der Sie die Modellinferenz innerhalb einer Minute aufrufen können. Das Kontingent berücksichtigt die Summe aus Converse InvokeModel und InvokeModelWithResponseStream Amazon Titan Text Premier ConverseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Anthropic Claude 3 Haiku

us-east-1: 1,000

us-west-2: 1,000

ap-nordost-1:200

ap-southeast-1:200

Jede der anderen unterstützten Regionen: 400

Nein Die maximale Häufigkeit, mit der Sie die Modellinferenz innerhalb einer Minute aufrufen können. Bei der Quote wird die Summe aus Converse InvokeModel und ConverseStream, und InvokeModelWithResponseStream für Anthropic Claude 3 Haiku berücksichtigt.
On-demand Modellieren Sie Inferenzanfragen pro Minute für Anthropic Claude 3 Opus Jede unterstützte Region: 50 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Anthropic Claude 3 Opus innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Anthropic Claude 3 Sonnet

us-east-1: 500

us-west-2: 500

Jede der anderen unterstützten Regionen: 100

Nein Die maximale Häufigkeit, mit der Sie die Modellinferenz innerhalb einer Minute aufrufen können. Bei der Quote wird die Summe aus Converse InvokeModel und ConverseStream, und InvokeModelWithResponseStream für Anthropic Claude 3 Sonnet berücksichtigt.
On-demand Modellieren Sie Inferenzanfragen pro Minute für Anthropic Claude 3.5 Haiku

US-West-1:400

Jede der anderen unterstützten Regionen: 1 000

Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Anthropic Claude 3.5 Haiku innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Anthropic Claude 3.5 Sonnet

US-West-2:250

ap-northeast-1:20

ap-southeast-1:20

eu-central-1:20

eu-west-1: 20

EU-West-3:20

Jede der anderen unterstützten Regionen: 50

Nein Die maximale Häufigkeit, mit der Sie Modellinferenz in einer Minute für Anthropic Claude 3.5 Sonnet aufrufen können. Die Quote berücksichtigt die Summe von Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanforderungen pro Minute für Anthropic Claude 3.5 Sonnet V2

US-West-2:250

Jede der anderen unterstützten Regionen: 50

Nein Die maximale Häufigkeit, mit der Sie Modellinferenz in einer Minute für Anthropic Claude 3.5 Sonnet V2 aufrufen können. Bei der Quote wird die Summe aus Converse, und berücksichtigt. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanforderungen pro Minute für Anthropic Claude 3.7 Sonnet V1 Jede unterstützte Region: 125 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie innerhalb einer Minute für Anthropic Claude 3.7 Sonnet V1 zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Anthropic Claude Opus 4.6 V1 Jede unterstützte Region: 5 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Anthropic Claude Opus 4.6 V1 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Anthropic Claude Sonnet 4.6 Jede unterstützte Region: 5 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Anthropic Claude Sonnet 4.6 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Cohere Command R Jede unterstützte Region: 400 Nein Die maximale Häufigkeit, mit der Sie die Modellinferenz innerhalb einer Minute aufrufen können. Das Kontingent berücksichtigt die Summe aus Converse InvokeModel und InvokeModelWithResponseStream für Cohere Command R 128k. ConverseStream
On-demand Modellieren Sie Inferenzanforderungen pro Minute für Cohere Command R Plus Jede unterstützte Region: 400 Nein Die maximale Häufigkeit, mit der Sie die Modellinferenz innerhalb einer Minute aufrufen können. Das Kontingent berücksichtigt die Summe aus Converse, ConverseStream, InvokeModel und InvokeModelWithResponseStream für Cohere Command R Plus 128k.
On-demand Modellieren Sie Inferenzanfragen pro Minute für Cohere Embed English Jede unterstützte Region: 2.000 Nein Die maximale Häufigkeit, mit der Sie innerhalb einer Minute Cohere InvokeModel Embed English anrufen können.
On-demand Modellieren Sie Inferenzanfragen pro Minute für Cohere Embed Multilingual Jede unterstützte Region: 2.000 Nein Die maximale Häufigkeit, mit der Sie innerhalb einer Minute Cohere InvokeModel Embed Multilingual anrufen können.
On-demand Modellieren Sie Inferenzanfragen pro Minute für Cohere Embed V4 Jede unterstützte Region: 1 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Cohere Embed V4 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen ConverseStream. InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Cohere Rerank 3.5 Jede unterstützte Region: 250 Nein Die maximale Häufigkeit, mit der Sie innerhalb einer Minute für Cohere InvokeModel Rerank 3.5 anrufen können.
On-demand Modellieren Sie Inferenzanforderungen pro Minute für V3 V1 DeepSeek Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Modellinferenz innerhalb einer Minute für DeepSeek V3 V1 einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse InvokeModel und InvokeModelWithResponseStream der ConverseStream Aktionen.
On-demand modellieren Sie Inferenzanfragen pro Minute für DeepSeek V3.2 Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, für die Sie innerhalb einer Minute eine Modellinferenz einreichen können. DeepSeek V3.2 Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse InvokeModel und InvokeModelWithResponseStream der ConverseStream Aktionen.
On-demand Modellieren Sie Inferenzanfragen pro Minute für GPT OSS Safeguard 120B Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für GPT OSS Safeguard 120B innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für GPT OSS Safeguard 20B Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für GPT OSS Safeguard 20B innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Gemma 3 12B Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Gemma 3 12B innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Gemma 3 27B Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Gemma 3 27B innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Gemma 3 4B Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie innerhalb einer Minute für Gemma 3 4B zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen ConverseStream. InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Kimi K2 Thinking Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Kimi K2 Thinking innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Magistral Small 1.2 Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Magistral Small 1.2 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Meta Llama 3 70B Instruct Jede unterstützte Region: 400 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie innerhalb einer Minute für Meta Llama 3 70B Instruct zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Meta Llama 3 8B Instruct Jede unterstützte Region: 800 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie innerhalb einer Minute für Meta Llama 3 8B Instruct zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Meta Llama 3.1 405B Instruct Jede unterstützte Region: 200 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie innerhalb einer Minute für Meta Llama 3.1 405B Instruct zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Meta Llama 3.1 70B Instruct Jede unterstützte Region: 400 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Meta Llama 3.1 70B Instruct innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Meta Llama 3.1 8B Instruct Jede unterstützte Region: 800 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie innerhalb einer Minute für Meta Llama 3.1 8B Instruct zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Meta Llama 3.2 11B Instruct Jede unterstützte Region: 400 Nein Die maximale Anzahl an Aufrufen der Modellinferenz innerhalb einer Minute für Meta Llama 3.2 11B Instruct. Das Kontingent berücksichtigt die Summe der Anfragen für InvokeModel, InvokeModelWithResponseStream, Converse und. ConverseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Meta Llama 3.2 1B Instruct Jede unterstützte Region: 800 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie innerhalb einer Minute für Meta Llama 3.2 1B Instruct zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Meta Llama 3.2 3B Instruct Jede unterstützte Region: 800 Nein Die maximale Häufigkeit, mit der Sie innerhalb einer Minute Modellinferenz für Meta Llama 3.2 3B Instruct aufrufen können. Das Kontingent berücksichtigt die Summe der Anfragen für InvokeModel, InvokeModelWithResponseStream, Converse und. ConverseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Meta Llama 3.2 90B Instruct Jede unterstützte Region: 400 Nein Die maximale Anzahl an Aufrufen der Modellinferenz innerhalb einer Minute für Meta Llama 3.2 90B Instruct. Das Kontingent berücksichtigt die Summe der Anfragen für InvokeModel, InvokeModelWithResponseStream, Converse und. ConverseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Meta Llama 3.3 70B Instruct Jede unterstützte Region: 400 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Meta Llama 3.3 70B Instruct innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand modellieren Sie Inferenzanfragen pro Minute für MiniMax M2.5 Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, für die Sie innerhalb einer Minute eine Modellinferenz einreichen können. MiniMax M2.5 Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse InvokeModel und InvokeModelWithResponseStream der ConverseStream Aktionen.
On-demand Modellieren Sie Inferenzanfragen pro Minute für Minimax M2 Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Minimax M2 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent stellt die Gesamtzahl der Anfragen an Converse InvokeModel und InvokeModelWithResponseStream Aktionen dar. ConverseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Minimax M2.1 Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Minimax innerhalb einer Minute zur Modellinferenz einreichen können. M2.1 Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen ConverseStream. InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Ministral 14B 3.0 Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Ministral 14B 3.0 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Ministral 3B 3.0 Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Ministral 3B 3.0 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an das Converse und ConverseStream der Aktionen. InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Ministral 8B 3.0 Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Ministral 8B 3.0 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Mistral 7B Instruct Jede unterstützte Region: 800 Nein Die maximale Anzahl der Anrufe, die Sie innerhalb einer Minute für Mistral mistral-7b-instruct-v0 aufrufen InvokeModel können
On-demand Modellieren Sie Inferenzanfragen pro Minute für Mistral AI Mistral Small Jede unterstützte Region: 400 Nein Die maximale Häufigkeit, mit der Sie Mistral AI Mistral Small anrufen können, InvokeModel und InvokeModelWithResponseStream innerhalb einer Minute
On-demand Modellieren Sie Inferenzanfragen pro Minute für Mistral Devstral 2 123b Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Mistral Devstral 2 123b innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Mistral Large Jede unterstützte Region: 400 Nein Die maximale Häufigkeit, mit der Sie Mistral Mistral-Large-2402-v1 anrufen können, InvokeModel und InvokeModelWithResponseStream innerhalb einer Minute
On-demand Modellieren Sie Inferenzanfragen pro Minute für Mistral Large 2407 Jede unterstützte Region: 400 Nein Die maximale Häufigkeit, mit der Sie Modellinferenz innerhalb einer Minute für Mistral Large 2407 aufrufen können. Das Kontingent berücksichtigt die Summe der Anfragen für InvokeModel,, Converse und InvokeModelWithResponseStream ConverseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Mistral Large 3 Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Mistral Large 3 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Mistral Mixtral 8x7b Instruct Jede unterstützte Region: 400 Nein Die maximale Anzahl der Anrufe, die Sie innerhalb einer Minute für Mistral mixtral-8x7b-v0 aufrufen können InvokeModel
On-demand Modellieren Sie Inferenzanfragen pro Minute für Moonshot AI Kimi K2.5 Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Moonshot AI Kimi innerhalb einer Minute zur Modellinferenz einreichen können. K2.5 Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für NVIDIA Nemotron 3 Super 120B A12B Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie innerhalb einer Minute zur Modellinferenz für NVIDIA Nemotron 3 Super 120B A12B einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen und Aktionen an das Converse. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für NVIDIA Nemotron Nano 2 Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie innerhalb einer Minute für NVIDIA Nemotron Nano 2 zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für NVIDIA Nemotron Nano 2 VL Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie innerhalb einer Minute für NVIDIA Nemotron Nano 2 VL zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Nemotron Nano 3 30B Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Nemotron Nano 3 30B innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für OpenAI GPT OSS 120B Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für OpenAI GPT OSS 120B innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für OpenAI GPT OSS 20B Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für OpenAI GPT OSS 20B innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Qwen3 235B a22b 2507 V1 Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie zur Modellinferenz innerhalb einer Minute für Qwen3 235B a22b 2507 V1 einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen und Aktionen an Converse. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Qwen3 32B V1 Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Qwen3 32B V1 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Qwen3 Coder 30B a3b V1 Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie innerhalb einer Minute zur Modellinferenz für Qwen3 Coder 30B a3b V1 einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen und Aktionen an Converse. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Qwen3 Coder 480B a35b V1 Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie innerhalb einer Minute zur Modellinferenz für Qwen3 Coder 480B a35b V1 einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Qwen3 Coder Next Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie innerhalb einer Minute für Qwen3 Coder Next zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Qwen3 Next 80B A3B Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie innerhalb einer Minute zur Modellinferenz für Qwen3 Next 80B A3B einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Qwen3 VL 235B A22B Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie zur Modellinferenz innerhalb einer Minute für Qwen3 VL 235B A22B einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen und Aktionen an Converse. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Stability.ai Stable Diffusion 3 Large Jede unterstützte Region: 15 Nein Die maximale Anzahl der Aufrufe, die Sie innerhalb einer Minute für Stability.ai Stable Diffusion 3 Large aufrufen InvokeModel können.
On-demand Modellieren Sie Inferenzanfragen pro Minute für Stability.ai Stable Diffusion 3 Medium Jede unterstützte Region: 60 Nein Die maximale Anzahl der Aufrufe, die Sie innerhalb einer Minute für Stability.ai Stable Diffusion 3 Medium aufrufen InvokeModel können
On-demand Modellieren Sie Inferenzanforderungen pro Minute für Stability.ai Stable Diffusion 3.5 Large Jede unterstützte Region: 15 Nein Die maximale Anzahl von Aufrufen InvokeModel , die Sie innerhalb einer Minute für Stability.ai Stable Diffusion 3.5 Large aufrufen können.
On-demand Modellieren Sie Inferenzanforderungen pro Minute für Stability.ai Stable Image Core Jede unterstützte Region: 90 Nein Die maximale Anzahl von Aufrufen InvokeModel für Stability.ai Stable Image Core innerhalb einer Minute.
On-demand Modellieren Sie Inferenzanforderungen pro Minute für Stability.ai Stable Image Ultra Jede unterstützte Region: 10 Nein Die maximale Häufigkeit, mit der Sie innerhalb einer Minute für Stability.ai Stable Image Ultra anrufen InvokeModel können.
On-demand Modellieren Sie Inferenzanforderungen pro Minute für Stable Image Conservative Upscale Jede unterstützte Region: 2 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Stable Image Conservative Upscale innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen und Aktionen an Converse. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Stable Image Control Sketch Jede unterstützte Region: 10 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Stable Image Control Sketch innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse InvokeModel und InvokeModelWithResponseStream der ConverseStream Aktionen.
On-demand Modellieren Sie Inferenzanforderungen pro Minute für eine stabile Image Control Structure Jede unterstützte Region: 10 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Stable Image Control Structure innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse InvokeModel und InvokeModelWithResponseStream der ConverseStream Aktionen.
On-demand Modellieren Sie Inferenzanfragen pro Minute für Stable Image Creative Upscale Jede unterstützte Region: 2 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Stable Image Creative Upscale innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen ConverseStream. InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Stable Image Erase Object Jede unterstützte Region: 10 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Stable Image Erase Object innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen InvokeModel und InvokeModelWithResponseStream Aktionen an Converse. ConverseStream
On-demand Modellieren Sie Inferenzanforderungen pro Minute für Stable Image Fast Upscale Jede unterstützte Region: 10 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Stable Image Fast Upscale innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen ConverseStream. InvokeModel InvokeModelWithResponseStream
On-demand Model-Inferenzanfragen pro Minute für Stable Image Inpaint Jede unterstützte Region: 10 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Stable Image Inpaint innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen ConverseStream. InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Stable Image Outpaint Jede unterstützte Region: 2 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Stable Image Outpaint innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen ConverseStream. InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Stable Image Remove Background Jede unterstützte Region: 10 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Stable Image Remove Background innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse InvokeModel und InvokeModelWithResponseStream der ConverseStream Aktionen.
On-demand Modellieren Sie Inferenzanfragen pro Minute für Stable Image Search und Recolor Jede unterstützte Region: 10 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Stable Image Search und Recolor innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen ConverseStream. InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für „Stable Image Search and Replace“ Jede unterstützte Region: 10 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie innerhalb einer Minute zur Modellinferenz für Stable Image Search and Replace einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse InvokeModel und InvokeModelWithResponseStream der ConverseStream Aktionen.
On-demand Modellieren Sie Inferenzanfragen pro Minute für den Stable Image Style Guide Jede unterstützte Region: 10 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie innerhalb einer Minute für den Stable Image Style Guide zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse InvokeModel und InvokeModelWithResponseStream der ConverseStream Aktionen.
On-demand Modellieren Sie Inferenzanfragen pro Minute für Stable Image Style Transfer Jede unterstützte Region: 10 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für die Übertragung von stabilen Bildstilen innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse InvokeModel und InvokeModelWithResponseStream der ConverseStream Aktionen.
On-demand Modellieren Sie Inferenzanfragen pro Minute für Twelve Labs Marengo Jede unterstützte Region: 100 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie innerhalb einer Minute für Twelve Labs Marengo zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Twelve Labs Pegasus Jede unterstützte Region: 60 Ja Die maximale Anzahl von On-Demand-Anfragen, die Sie innerhalb einer Minute für Twelve Labs Pegasus zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe von Converse,, und ConverseStream. InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für TwelveLabs Marengo Embed 3.0 Jede unterstützte Region: 500 Ja Die maximale Anzahl von On-Demand-Anfragen, die Sie für Marengo Embed 3.0 innerhalb einer Minute zur TwelveLabs Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen und Aktionen an Converse. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Voxtral Mini 1.0 Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Voxtral Mini 1.0 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Voxtral Small 1.0 Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Voxtral Small 1.0 innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für Writer Palmyra Vision 7B Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für Writer Palmyra Vision 7B innerhalb einer Minute zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenzanfragen pro Minute für GLM 5 Z.ai Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie für GLM 5 innerhalb einer Minute zur Z.ai Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse und der Aktionen ConverseStream. InvokeModel InvokeModelWithResponseStream
On-demand modellieren Sie Inferenzanfragen pro Minute für Z.ai GLM-4.7 Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, für die Sie innerhalb einer Minute eine Modellinferenz einreichen können. Z.ai GLM-4.7 Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse InvokeModel und InvokeModelWithResponseStream der ConverseStream Aktionen.
On-demand Modellieren Sie Inferenzanfragen pro Minute für Flash Z.ai GLM-4.7 Jede unterstützte Region: 10 000 Nein Die maximale Anzahl von On-Demand-Anfragen, die Sie innerhalb einer Minute für Z.ai GLM-4.7 Flash zur Modellinferenz einreichen können. Dieses Kontingent entspricht der Gesamtzahl der Anfragen an Converse InvokeModel und InvokeModelWithResponseStream der ConverseStream Aktionen.
On-demand Modellieren Sie Inferenz-Token pro Minute für AI21 Labs Jamba 1.5 Large Jede unterstützte Region: 300 000 Nein Die maximale Anzahl von Token, die Sie innerhalb einer Minute für AI21 Labs Jamba 1.5 Large zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse und. InvokeModel
On-demand Modellieren Sie Inferenz-Token pro Minute für AI21 Labs Jamba 1.5 Mini Jede unterstützte Region: 300 000 Nein Die maximale Anzahl von Token, die Sie innerhalb einer Minute für AI21 Labs Jamba 1.5 Mini zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse und. InvokeModel
On-demand Modellieren Sie Inferenz-Token pro Minute für Amazon Nova Lite

us-east-1:4.000.000

EU-West-2:4.000.000

Jede der anderen unterstützten Regionen: 200.000

Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Amazon Nova Lite zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse ConverseStream, InvokeModel und. InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Amazon Nova Micro

us-east-1:4.000.000

EU-West-2:4.000.000

Jede der anderen unterstützten Regionen: 200.000

Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Amazon Nova Micro zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse ConverseStream, InvokeModel und. InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Amazon Nova Pro Jede unterstützte Region: 1 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Amazon Nova Pro zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse ConverseStream, InvokeModel und. InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Amazon Titan Image Generator G1 V2 Jede unterstützte Region: 2.000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Amazon Titan Image Generator G1 V2 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse ConverseStream, InvokeModel und. InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Amazon Titan Multimodal Embeddings G1 Jede unterstützte Region: 300 000 Nein Die maximale Anzahl von Token, die Sie innerhalb einer Minute für Amazon Titan InvokeModel Multimodal Embeddings G1 bereitstellen können.
On-demand Modellieren Sie Inferenz-Token pro Minute für Amazon Titan Text Embeddings Jede unterstützte Region: 300 000 Nein Die maximale Anzahl an Tokens, die Sie innerhalb einer Minute für Amazon Titan Text Embeddings bereitstellen können. InvokeModel
On-demand Modellieren Sie Inferenz-Token pro Minute für Amazon Titan Text Embeddings V2 Jede unterstützte Region: 300 000 Nein Die maximale Anzahl an Token, die Sie innerhalb einer Minute für Amazon Titan Text Embeddings V2 bereitstellen können. InvokeModel
On-demand Modellieren Sie Inferenz-Token pro Minute für Amazon Titan Text Express Jede unterstützte Region: 300 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse InvokeModel und InvokeModelWithResponseStream für Amazon Titan Text Express. ConverseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Amazon Titan Text Premier Jede unterstützte Region: 300 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse InvokeModel und InvokeModelWithResponseStream für Amazon Titan Text Premier. ConverseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude 3 Haiku

us-east-1:2.000.000

us-west-2:2.000.000

ap-northeast-1:200.000

ap-southeast-1:200.000

Jede der anderen unterstützten Regionen: 300.000

Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse InvokeModel und InvokeModelWithResponseStream für Anthropic Claude 3 Haiku. ConverseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude 3 Opus Jede unterstützte Region: 400 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Anthropic Claude 3 Opus zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude 3 Sonnet

us-east-1:1.000.000

us-west-2:1.000.000

Jede der anderen unterstützten Regionen: 200.000

Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute zur Modellinferenz einreichen können. Die Quote berücksichtigt die kombinierte Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse InvokeModel und InvokeModelWithResponseStream für Anthropic Claude 3 Sonnet. ConverseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude 3.5 Haiku

us-west-1:300.000

Jede der anderen unterstützten Regionen: 2.000.000

Nein Die maximale Anzahl von On-Demand-Token, die Sie für Anthropic Claude 3.5 Haiku innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude 3.5 Sonnet

US-West-2:2.000.000

ap-northeast-1:200.000

ap-southeast-1:200.000

eu-central-1:200.000

EU-West-1:200.000

eu-west-3:200.000

Jede der anderen unterstützten Regionen: 400.000

Nein Die maximale Anzahl an Tokens, die Sie innerhalb einer Minute für Anthropic Claude 3.5 Sonnet zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe von Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude 3.5 Sonnet V2

US-West-2:2.000.000

Jede der anderen unterstützten Regionen: 400.000

Nein Die maximale Anzahl an Tokens, die Sie innerhalb einer Minute für Anthropic Claude 3.5 Sonnet V2 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe von Converse,, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude 3.7 Sonnet V1 Jede unterstützte Region: 500 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Anthropic Claude 3.7 Sonnet V1 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude Opus 4.6 V1 Jede unterstützte Region: 1 500 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Anthropic Claude Opus 4.6 V1 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Anthropic Claude Sonnet 4.6 Jede unterstützte Region: 3.000.000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Anthropic Claude Sonnet 4.6 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Cohere Command R Jede unterstützte Region: 300 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse InvokeModel und InvokeModelWithResponseStream für Cohere Command R 128k. ConverseStream
On-demand modellieren Sie Inferenz-Token pro Minute für Cohere Command R Plus Jede unterstützte Region: 300 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse InvokeModel und InvokeModelWithResponseStream für Cohere Command R Plus 128k. ConverseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Cohere Embed English Jede unterstützte Region: 300 000 Nein Die maximale Anzahl an Tokens, die Sie innerhalb einer Minute für Cohere Embed English bereitstellen können. InvokeModel
On-demand Modellieren Sie Inferenz-Token pro Minute für Cohere Embed Multilingual Jede unterstützte Region: 300 000 Nein Die maximale Anzahl an Token, die Sie innerhalb einer Minute für Cohere InvokeModel Embed Multilingual bereitstellen können.
On-demand Modellieren Sie Inferenz-Token pro Minute für Cohere Embed V4 Jede unterstützte Region: 150 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Cohere Embed V4 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, ConverseStream und. InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für DeepSeek V3 V1 Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie für DeepSeek V3 V1 innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse ConverseStream, InvokeModel und. InvokeModelWithResponseStream
On-demand modellieren Sie Inferenz-Token pro Minute für DeepSeek V3.2 Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, für die Sie innerhalb einer Minute zur Modellinferenz einreichen können. DeepSeek V3.2 Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, ConverseStream, InvokeModel und. InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für GPT OSS Safeguard 120B Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für GPT OSS Safeguard 120B zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für GPT OSS Safeguard 20B Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für GPT OSS Safeguard 20B zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Gemma 3 12B Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Gemma 3 12B zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Gemma 3 27B Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Gemma 3 27B zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Gemma 3 4B Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Gemma 3 4B zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, ConverseStream und. InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Kimi K2 Thinking Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Kimi K2 Thinking zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Magistral Small 1.2 Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Magistral Small 1.2 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Meta Llama 3 70B Instruct Jede unterstützte Region: 300 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Meta Llama 3 70B Instruct zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Meta Llama 3 8B Instruct Jede unterstützte Region: 300 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Meta Llama 3 8B Instruct zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Meta Llama 3.1 405B Instruct Jede unterstützte Region: 400 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Meta Llama 3.1 405B Instruct zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Meta Llama 3.1 70B Instruct Jede unterstützte Region: 300 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Meta Llama 3.1 70B Instruct zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Meta Llama 3.1 8B Instruct Jede unterstützte Region: 300 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Meta Llama 3.1 8B Instruct zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Meta Llama 3.2 11B Instruct Jede unterstützte Region: 300 000 Nein Die maximale Anzahl an Tokens, die Sie innerhalb einer Minute für Meta Llama 3.2 11B Instruct zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Tokens für InvokeModel, InvokeModelWithResponseStream, Converse und. ConverseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Meta Llama 3.2 1B Instruct Jede unterstützte Region: 300 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Meta Llama 3.2 1B Instruct zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Meta Llama 3.2 3B Instruct Jede unterstützte Region: 300 000 Nein Die maximale Anzahl an Tokens, die Sie innerhalb einer Minute für Meta Llama 3.2 3B Instruct zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Tokens für InvokeModel, InvokeModelWithResponseStream, Converse und. ConverseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Meta Llama 3.2 90B Instruct Jede unterstützte Region: 300 000 Nein Die maximale Anzahl an Tokens, die Sie innerhalb einer Minute für Meta Llama 3.2 90B Instruct zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Tokens für InvokeModel, InvokeModelWithResponseStream, Converse und. ConverseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Meta Llama 3.3 70B Instruct Jede unterstützte Region: 300 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Meta Llama 3.3 70B Instruct zur Modellinferenz einreichen können. Die Quote berücksichtigt die kombinierte Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, ConverseStream, InvokeModel und InvokeModelWithResponseStream.
On-demand modellieren Sie Inferenz-Token pro Minute für MiniMax M2.5 Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, für die Sie innerhalb einer Minute zur Modellinferenz einreichen können. MiniMax M2.5 Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, ConverseStream, InvokeModel und. InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Minimax M2 Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Minimax M2 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, ConverseStream und. InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Minimax M2.1 Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Minimax zur Modellinferenz einreichen können. M2.1 Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, ConverseStream und. InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Ministral 14B 3.0 Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Ministral 14B 3.0 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Ministral 3B 3.0 Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Ministral 3B 3.0 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, ConverseStream und. InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Ministral 8B 3.0 Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Ministral 8B 3.0 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Mistral AI Mistral 7B Instruct Jede unterstützte Region: 300 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse InvokeModel und InvokeModelWithResponseStream für Mistral AI Mistral 7B Instruct. ConverseStream
On-demand modellieren Sie Inferenz-Token pro Minute für Mistral AI Mistral Large Jede unterstützte Region: 300 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse InvokeModel und InvokeModelWithResponseStream für Mistral AI Mistral Large. ConverseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Mistral AI Mistral Small Jede unterstützte Region: 300 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse InvokeModel und InvokeModelWithResponseStream für Mistral AI Mistral Small. ConverseStream
On-demand modelliere Inferenz-Token pro Minute für Mistral AI Mixtral 8X7BB Instruct Jede unterstützte Region: 300 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse InvokeModel und InvokeModelWithResponseStream für Mistral AI Mixtral 8X7B Instruct. ConverseStream
On-demand modellieren Sie Inferenz-Token pro Minute für Mistral Devstral 2 123b Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie für Mistral Devstral 2 123b innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Mistral Large 2407 Jede unterstützte Region: 300 000 Nein Die maximale Anzahl von Token, die Sie innerhalb einer Minute für Mistral Large 2407 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Tokens für InvokeModel,, Converse und InvokeModelWithResponseStream ConverseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Mistral Large 3 Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Mistral Large 3 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Moonshot AI Kimi K2.5 Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Moonshot AI Kimi zur Modellinferenz einreichen können. K2.5 Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für NVIDIA Nemotron 3 Super 120B A12B Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für NVIDIA Nemotron 3 Super 120B A12B zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für NVIDIA Nemotron Nano 2 Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für NVIDIA Nemotron Nano 2 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für NVIDIA Nemotron Nano 2 VL Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für NVIDIA Nemotron Nano 2 VL zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Nemotron Nano 3 30B Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Nemotron Nano 3 30B zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für OpenAI GPT OSS 120B Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für OpenAI GPT OSS 120B zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für OpenAI GPT OSS 20B Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für OpenAI GPT OSS 20B zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Qwen3 235B a22b 2507 V1 Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Qwen3 235B a22b 2507 V1 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Qwen3 32B V1 Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie für Qwen3 32B V1 innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Qwen3 Coder 30B a3b V1 Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Qwen3 Coder 30B a3b V1 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Qwen3 Coder 480B a35b V1 Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Qwen3 Coder 480B a35b V1 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Qwen3 Coder Next Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Qwen3 Coder Next zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Qwen3 Next 80B A3B Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Qwen3 Next 80B A3B zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Qwen3 VL 235B A22B Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie für Qwen3 VL 235B A22B innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Voxtral Mini 1.0 Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie für Voxtral Mini 1.0 innerhalb einer Minute zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Voxtral Small 1.0 Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Voxtral Small 1.0 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Writer Palmyra Vision 7B Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Writer Palmyra Vision 7B zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, und. ConverseStream InvokeModel InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für GLM 5 Z.ai Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Z.ai GLM 5 zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, ConverseStream und. InvokeModel InvokeModelWithResponseStream
On-demand modellieren Sie Inferenz-Token pro Minute für Z.ai GLM-4.7 Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, für die Sie innerhalb einer Minute zur Modellinferenz einreichen können. Z.ai GLM-4.7 Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse, ConverseStream, InvokeModel und. InvokeModelWithResponseStream
On-demand Modellieren Sie Inferenz-Token pro Minute für Flash Z.ai GLM-4.7 Jede unterstützte Region: 100 000 000 Nein Die maximale Anzahl von On-Demand-Token, die Sie innerhalb einer Minute für Z.ai GLM-4.7 Flash zur Modellinferenz einreichen können. Das Kontingent berücksichtigt die Summe der Eingabe- und Ausgabetokens für alle Anfragen an Converse ConverseStream, InvokeModel und. InvokeModelWithResponseStream
Parameter pro Funktion Jede unterstützte Region: 5 Yes (Ja) Die maximale Anzahl von Parametern, die Sie in einer Aktionsgruppenfunktion haben können.
PrepareAgent Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von PrepareAgent API-Anfragen pro Sekunde.
Datensätze pro Batch-Inferenzauftrag für Amazon Nova 2 Multimodal Embeddings V1 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Amazon Nova 2 Multimodal Embeddings V1.
Datensätze pro Batch-Inferenzauftrag für Amazon Nova Premier Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Amazon Nova Premier.
Datensätze pro Batch-Inferenzauftrag für Claude 3 Haiku Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Claude 3-Haiku.
Datensätze pro Batch-Inferenzauftrag für Claude 3 Opus Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Claude 3 Opus.
Datensätze pro Batch-Inferenzauftrag für Claude 3 Sonnet Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Claude 3 Sonnet.
Datensätze pro Batch-Inferenzauftrag für Claude 3.5 Haiku Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Claude 3.5 Haiku.
Datensätze pro Batch-Inferenzauftrag für Claude 3.5 Sonnet Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Claude 3.5 Sonnet.
Datensätze pro Batch-Inferenzauftrag für Claude 3.5 Sonnet v2 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Claude 3.5 Sonnet v2.
Datensätze pro Batch-Inferenzauftrag für Claude 3.7 Sonnet Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Claude 3.7 Sonnet.
Datensätze pro Batch-Inferenzauftrag für Claude Haiku 4.5 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Claude Haiku 4.5.
Datensätze pro Batch-Inferenzauftrag für Claude Opus 4.5 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Claude Opus 4.5.
Datensätze pro Batch-Inferenzauftrag für Claude Opus 4.6 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Claude Opus 4.6.
Datensätze pro Batch-Inferenzauftrag für Claude Opus 5 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Claude Opus 5.
Datensätze pro Batch-Inferenzauftrag für Claude Sonnet 4 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Claude Sonnet 4.
Datensätze pro Batch-Inferenzauftrag für Claude Sonnet 4.5 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Claude Sonnet 4.5.
Datensätze pro Batch-Inferenzauftrag für Claude Sonnet 4.6 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Claude Sonnet 4.6.
Datensätze pro Batch-Inferenzauftrag für DeepSeek V3.2 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für. DeepSeek V3.2
Datensätze pro Batch-Inferenzauftrag für v3 DeepSeek Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Version 3. DeepSeek
Datensätze pro Batch-Inferenz-Job für Devstral 2 123B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenz-Job für Devstral 2 123B.
Datensätze pro Batch-Inferenzauftrag für GLM 4.7 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für GLM 4.7.
Datensätze pro Batch-Inferenzauftrag für GLM 4.7 Flash Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für GLM 4.7 Flash.
Datensätze pro Batch-Inferenz-Job für GLM 5 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für GLM 5.
Datensätze pro Batch-Inferenzauftrag für Gemma 3 12B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Gemma 3 12B.
Datensätze pro Batch-Inferenz-Job für Gemma 3 27B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Gemma 3 27B.
Datensätze pro Batch-Inferenzauftrag für Gemma 3 4B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Gemma 3 4B.
Datensätze pro Batch-Inferenzauftrag für Kimi K2 Thinking Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Kimi K2 Thinking.
Datensätze pro Batch-Inferenz-Job für Kimi K2.5 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Kimi. K2.5
Datensätze pro Batch-Inferenz-Job für Llama 3.1 405B Instruct Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Llama 3.1 405B Instruct.
Datensätze pro Batch-Inferenz-Job für Llama 3.1 70B Instruct Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Llama 3.1 70B Instruct.
Datensätze pro Batch-Inferenz-Job für Llama 3.1 8B Instruct Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Llama 3.1 8B Instruct.
Datensätze pro Batch-Inferenz-Job für Llama 3.2 11B Instruct Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Llama 3.2 11B Instruct.
Datensätze pro Batch-Inferenz-Job für Llama 3.2 1B Instruct Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob Llama 3.2 1B Instruct.
Datensätze pro Batch-Inferenz-Job für Llama 3.2 3B Instruct Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Llama 3.2 3B Instruct.
Datensätze pro Batch-Inferenz-Job für Llama 3.2 90B Instruct Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Llama 3.2 90B Instruct.
Datensätze pro Batch-Inferenz-Job für Llama 3.3 70B Instruct Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Llama 3.3 70B Instruct.
Datensätze pro Batch-Inferenz-Job für Llama 4 Maverick Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Llama 4 Maverick.
Datensätze pro Batch-Inferenz-Job für Llama 4 Scout Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Llama 4 Scout.
Datensätze pro Batch-Inferenz-Job für Magistral Small 2509 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Magistral Small 2509.
Datensätze pro Batch-Inferenzauftrag für M2 MiniMax Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für MiniMax M2.
Datensätze pro Batch-Inferenzauftrag für MiniMax M2.1 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für. MiniMax M2.1
Datensätze pro Batch-Inferenzauftrag für MiniMax M2.5 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für. MiniMax M2.5
Datensätze pro Batch-Inferenzauftrag für Ministral 3 14B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Ministral 3 14B.
Datensätze pro Batch-Inferenzauftrag für Ministral 3 8B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Ministral 3 8B.
Datensätze pro Batch-Inferenzauftrag für Ministral 3B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzauftrag für Ministral 3B.
Datensätze pro Batch-Inferenzauftrag für Mistral Large 2 (24,07) Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Mistral Large 2 (24,07).
Datensätze pro Batch-Inferenzauftrag für Mistral Large 3 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Mistral Large 3.
Datensätze pro Batch-Inferenzauftrag für Mistral Small Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Mistral Small.
Datensätze pro Batch-Inferenzauftrag für NVIDIA Nemotron 3 Super 120B A12B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für NVIDIA Nemotron 3 Super 120B A12B.
Datensätze pro Batch-Inferenzauftrag für NVIDIA Nemotron Nano 12B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für NVIDIA Nemotron Nano 12B.
Datensätze pro Batch-Inferenzauftrag für NVIDIA Nemotron Nano 3 30B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für NVIDIA Nemotron Nano 3 30B.
Datensätze pro Batch-Inferenzauftrag für NVIDIA Nemotron Nano 9B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für NVIDIA Nemotron Nano 9B.
Datensätze pro Batch-Inferenzauftrag für Nova 2 Lite Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Nova 2 Lite.
Datensätze pro Batch-Inferenzauftrag für Nova Lite V1 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Nova Lite V1.
Datensätze pro Batch-Inferenzauftrag für Nova Micro V1 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Nova Micro V1.
Datensätze pro Batch-Inferenzauftrag für Nova Pro V1 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Nova Pro V1.
Datensätze pro Batch-Inferenzauftrag für OpenAI GPT OSS 120b Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für OpenAI GPT OSS 120b.
Datensätze pro Batch-Inferenz-Job für OpenAI GPT OSS 20b Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für OpenAI GPT OSS 20b.
Datensätze pro Batch-Inferenzauftrag für OpenAI GPT OSS Safeguard 120b Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für OpenAI GPT OSS Safeguard 120b.
Datensätze pro Batch-Inferenzauftrag für OpenAI GPT OSS Safeguard 20b Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für OpenAI GPT OSS Safeguard 20b.
Datensätze pro Batch-Inferenz-Job für Qwen3 235B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Qwen3 235B.
Datensätze pro Batch-Inferenz-Job für Qwen3 32B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Qwen3 32B.
Datensätze pro Batch-Inferenz-Job für Qwen3 Coder 30B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenz-Job für Qwen3 Coder 30B.
Datensätze pro Batch-Inferenz-Job für Qwen3 Coder 480B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenz-Job für Qwen3 Coder 480B.
Datensätze pro Batch-Inferenz-Job für Qwen3 Coder Next Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenz-Job für Qwen3 Coder Next.
Datensätze pro Batch-Inferenz-Job für Qwen3 Next 80B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenz-Job für Qwen3 Next 80B.
Datensätze pro Batch-Inferenz-Job für Qwen3 VL 235B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Qwen3 VL 235B.
Datensätze pro Batch-Inferenz-Job für Titan Multimodal Embeddings G1 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Titan Multimodal Embeddings G1.
Datensätze pro Batch-Inferenzauftrag für Titan Text Embeddings V2 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenz-Job für Titan Text Embeddings V2.
Datensätze pro Batch-Inferenz-Job für Voxtral Mini 3B 2507 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Voxtral Mini 3B 2507.
Datensätze pro Batch-Inferenzauftrag für Voxtral Small 24B 2507 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Voxtral Small 24B 2507.
Datensätze pro Batch-Inferenz-Job für Writer Palmyra Vision 7B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in allen Eingabedateien in einem Batch-Inferenzjob für Writer Palmyra Vision 7B.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Amazon Nova 2 Multimodal Embeddings V1 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzauftrag für Amazon Nova 2 Multimodal Embeddings V1.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Amazon Nova Premier Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzauftrag für Amazon Nova Premier.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Claude 3 Haiku Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Claude 3-Haiku.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Claude 3 Opus Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzjob für Claude 3 Opus.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Claude 3 Sonnet Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Claude 3 Sonnet.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Claude 3.5 Haiku Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Claude 3.5 Haiku.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Claude 3.5 Sonnet Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Claude 3.5 Sonnet.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Claude 3.5 Sonnet v2 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Claude 3.5 Sonnet v2.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Claude 3.7 Sonnet Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Claude 3.7 Sonnet.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Claude Haiku 4.5 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Claude Haiku 4.5.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Claude Opus 4.5 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzjob für Claude Opus 4.5.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Claude Opus 4.6 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzjob für Claude Opus 4.6.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Claude Opus 5 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzjob für Claude Opus 5.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Claude Sonnet 4 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Claude Sonnet 4.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Claude Sonnet 4.5 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Claude Sonnet 4.5.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Claude Sonnet 4.6 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Claude Sonnet 4.6.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für DeepSeek V3.2 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzauftrag für. DeepSeek V3.2
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für v3 DeepSeek Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für DeepSeek v3.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Devstral 2 123B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Devstral 2 123B.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für GLM 4.7 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für GLM 4.7.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für GLM 4.7 Flash Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für GLM 4.7 Flash.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für GLM 5 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für GLM 5.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Gemma 3 12B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Gemma 3 12B.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Gemma 3 27B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Gemma 3 27B.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Gemma 3 4B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Gemma 3 4B.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Kimi K2 Thinking Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzjob für Kimi K2 Thinking.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Kimi K2.5 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzjob für Kimi. K2.5
Datensätze pro Eingabedatei pro Batch-Inferenzjob für Llama 3.1 405B Instruct Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Llama 3.1 405B Instruct.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Llama 3.1 70B Instruct Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Llama 3.1 70B Instruct.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Llama 3.1 8B Instruct Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Llama 3.1 8B Instruct.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Llama 3.2 11B Instruct Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Llama 3.2 11B Instruct.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Llama 3.2 1B Instruct Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzjob Llama 3.2 1B Instruct.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Llama 3.2 3B Instruct Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Llama 3.2 3B Instruct.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Llama 3.2 90B Instruct Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Llama 3.2 90B Instruct.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Llama 3.3 70B Instruct Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Llama 3.3 70B Instruct.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Llama 4 Maverick Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Llama 4 Maverick.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Llama 4 Scout Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Llama 4 Scout.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Magistral Small 2509 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzauftrag für Magistral Small 2509.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für M2 MiniMax Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzauftrag für MiniMax M2.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für MiniMax M2.1 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzauftrag für. MiniMax M2.1
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für MiniMax M2.5 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzauftrag für. MiniMax M2.5
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Ministral 3 14B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei bei einem Batch-Inferenzauftrag für Ministral 3 14B.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Ministral 3 8B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei bei einem Batch-Inferenzauftrag für Ministral 3 8B.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Ministral 3B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzauftrag für Ministral 3B.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Mistral Large 2 (24,07) Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Mistral Large 2 (24,07).
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Mistral Large 3 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Mistral Large 3.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Mistral Small Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzjob für Mistral Small.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für NVIDIA Nemotron 3 Super 120B A12B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für NVIDIA Nemotron 3 Super 120B A12B.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für NVIDIA Nemotron Nano 12B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für NVIDIA Nemotron Nano 12B.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für NVIDIA Nemotron Nano 3 30B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für NVIDIA Nemotron Nano 3 30B.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für NVIDIA Nemotron Nano 9B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für NVIDIA Nemotron Nano 9B.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Nova 2 Lite Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzjob für Nova 2 Lite.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Nova Lite V1 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzjob für Nova Lite V1.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Nova Micro V1 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzjob für Nova Micro V1.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Nova Pro V1 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzjob für Nova Pro V1.
Datensätze pro Eingabedatei pro Batch-Inferenzjob für OpenAI GPT OSS 120b Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzjob für OpenAI GPT OSS 120b.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für OpenAI GPT OSS 20b Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzjob für OpenAI GPT OSS 20b.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für OpenAI GPT OSS Safeguard 120b Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzjob für OpenAI GPT OSS Safeguard 120b.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für OpenAI GPT OSS Safeguard 20b Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzjob für OpenAI GPT OSS Safeguard 20b.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Qwen3 235B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Qwen3 235B.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Qwen3 32B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Qwen3 32B.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Qwen3 Coder 30B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Qwen3 Coder 30B.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Qwen3 Coder 480B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Qwen3 Coder 480B.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Qwen3 Coder Next Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Qwen3 Coder Next.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Qwen3 Next 80B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Qwen3 Next 80B.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Qwen3 VL 235B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Qwen3 VL 235B.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Titan Multimodal Embeddings G1 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Titan Multimodal Embeddings G1.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Titan Text Embeddings V2 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Titan Text Embeddings V2.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Voxtral Mini 3B 2507 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Voxtral Mini 3B 2507.
Datensätze pro Eingabedatei pro Batch-Inferenzauftrag für Voxtral Small 24B 2507 Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenz-Job für Voxtral Small 24B 2507.
Datensätze pro Eingabedatei pro Batch-Inferenz-Job für Writer Palmyra Vision 7B Jede unterstützte Region: 100 000 Ja Die maximale Anzahl von Datensätzen in einer Eingabedatei in einem Batch-Inferenzjob für Writer Palmyra Vision 7B.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Amazon Nova 2 Multimodal Embeddings V1 Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Amazon Nova 2 Multimodal Embeddings V1.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Amazon Nova Premier Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Amazon Nova Premier.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Claude 3 Haiku Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Claude 3-Haiku.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Claude 3 Opus Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Claude 3 Opus.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Claude 3 Sonnet Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Claude 3 Sonnet.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Claude 3.5 Haiku Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Claude 3.5 Haiku.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Claude 3.5 Sonnet Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Claude 3.5 Sonnet.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Claude 3.5 Sonnet v2 Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Claude 3.5 Sonnet v2.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Claude 3.7 Sonnet Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Claude 3.7 Sonnet.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Claude Haiku 4.5 Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Claude Haiku 4.5.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Claude Opus 4.5 Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Claude Opus 4.5.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Claude Opus 4.6 Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Claude Opus 4.6.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Claude Sonnet 4 Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Claude Sonnet 4.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Claude Sonnet 4.5. Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Claude Sonnet 4.5.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Claude Sonnet 4.6 Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Claude Sonnet 4.6.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für DeepSeek V3.2 Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für. DeepSeek V3.2
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für v3 DeepSeek Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Version 3. DeepSeek
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Devstral 2 123B Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Devstral 2 123B.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für GLM 4.7 Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für GLM 4.7.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für GLM 4.7 Flash Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für GLM 4.7 Flash.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für GLM 5 Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für GLM 5.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Gemma 3 12B Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Gemma 3 12B.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Gemma 3 27B Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Gemma 3 27B.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Gemma 3 4B Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Gemma 3 4B.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Kimi K2 Thinking Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Kimi K2 Thinking.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Kimi K2.5 Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Kimi. K2.5
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Llama 3.1 405B Instruct Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Llama 3.1 405B Instruct.
Summe der laufenden und übermittelten Batch-Inferenz-Jobs unter Verwendung eines Basismodells für Llama 3.1 70B Instruct Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Llama 3.1 70B Instruct.
Summe der laufenden und übermittelten Batch-Inferenz-Jobs unter Verwendung eines Basismodells für Llama 3.1 8B Instruct Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Llama 3.1 8B Instruct.
Summe der laufenden und übermittelten Batch-Inferenz-Jobs unter Verwendung eines Basismodells für Llama 3.2 11B Instruct Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Llama 3.2 11B Instruct.
Summe der laufenden und übermittelten Batch-Inferenz-Jobs unter Verwendung eines Basismodells für Llama 3.2 1B Instruct Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Llama 3.2 1B Instruct.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Llama 3.2 3B Instruct Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Llama 3.2 3B Instruct.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Llama 3.2 90B Instruct Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Llama 3.2 90B Instruct.
Summe der laufenden und übermittelten Batch-Inferenz-Jobs unter Verwendung eines Basismodells für Llama 3.3 70B Instruct Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Llama 3.3 70B Instruct.
Summe der laufenden und übermittelten Batch-Inferenz-Jobs unter Verwendung eines Basismodells für Llama 4 Maverick Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Llama 4 Maverick.
Summe der laufenden und übermittelten Batch-Inferenz-Jobs unter Verwendung eines Basismodells für Llama 4 Scout Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Llama 4 Scout.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Magistral Small 2509 Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Magistral Small 2509.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für M2 MiniMax Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für M2. MiniMax
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für MiniMax M2.1 Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für. MiniMax M2.1
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für MiniMax M2.5 Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für. MiniMax M2.5
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Ministral 3 14B Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Ministral 3 14B.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Ministral 3 8B Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Ministral 3 8B.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Ministral 3B Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Ministral 3B.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Mistral Large 2 (24,07) Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Mistral Large 2 (24,07).
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Mistral Large 3 Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Mistral Large 3.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Mistral Small Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Mistral Small.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für NVIDIA Nemotron 3 Super 120B A12B Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für NVIDIA Nemotron 3 Super 120B A12B.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für NVIDIA Nemotron Nano 12B Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für NVIDIA Nemotron Nano 12B.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für NVIDIA Nemotron Nano 3 30B Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für NVIDIA Nemotron Nano 3 30B.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für NVIDIA Nemotron Nano 9B Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für NVIDIA Nemotron Nano 9B.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Nova 2 Lite Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Nova 2 Lite.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Nova Lite V1 Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Nova Lite V1.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Nova Micro V1 Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Nova Micro V1.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Nova Pro V1 Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Nova Pro V1.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für OpenAI GPT OSS 120b Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für OpenAI GPT OSS 120b.
Summe der laufenden und übermittelten Batch-Inferenzjobs unter Verwendung eines Basismodells für OpenAI GPT OSS 20b Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für OpenAI GPT OSS 20b.
Summe der laufenden und übermittelten Batch-Inferenzjobs unter Verwendung eines Basismodells für OpenAI GPT OSS Safeguard 120b Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für OpenAI GPT OSS Safeguard 120b.
Summe der laufenden und übermittelten Batch-Inferenz-Jobs unter Verwendung eines Basismodells für OpenAI GPT OSS Safeguard 20b Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für OpenAI GPT OSS Safeguard 20b.
Summe der laufenden und übermittelten Batch-Inferenz-Jobs unter Verwendung eines Basismodells für Qwen3 235B Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Qwen3 235B.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Qwen3 32B Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Qwen3 32B.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Qwen3 Coder 30B Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Qwen3 Coder 30B.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Qwen3 Coder 480B Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Qwen3 Coder 480B.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Qwen3 Coder Next Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Qwen3 Coder Next.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Qwen3 Next 80B Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Qwen3 Next 80B.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Qwen3 VL 235B Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Qwen3 VL 235B.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Titan Multimodal Embeddings G1 Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Titan Multimodal Embeddings G1.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Titan Text Embeddings V2 Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Titan Text Embeddings V2.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Voxtral Mini 3B 2507 Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Voxtral Mini 3B 2507.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Voxtral Small 24B 2507 Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Voxtral Small 24B 2507.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines Basismodells für Writer Palmyra Vision 7B Jede unterstützte Region: 100 Yes (Ja) Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines Basismodells für Writer Palmyra Vision 7B.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines benutzerdefinierten Modells für Titan Multimodal Embeddings G1 Jede unterstützte Region: 3 Nein Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines benutzerdefinierten Modells für Titan Multimodal Embeddings G1.
Summe der laufenden und übermittelten Batch-Inferenzaufträge unter Verwendung eines benutzerdefinierten Modells für Titan Text Embeddings V2 Jede unterstützte Region: 3 Nein Die maximale Anzahl von laufenden und übermittelten Batch-Inferenzaufträgen unter Verwendung eines benutzerdefinierten Modells für Titan Text Embeddings V2
Drosselratenlimit für Bedrock Data Automation Runtime: ListTagsForResource Jede unterstützte Region: 25 pro Sekunde Nein Die maximale Anzahl von Bedrock Data Automation Runtime: ListTagsForResource Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenlimit für Bedrock Data Automation Runtime: TagResource Jede unterstützte Region: 25 pro Sekunde Nein Die maximale Anzahl von Bedrock Data Automation Runtime: TagResource Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenlimit für Bedrock Data Automation Runtime: UntagResource Jede unterstützte Region: 25 pro Sekunde Nein Die maximale Anzahl von Bedrock Data Automation Runtime: UntagResource Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenlimit für Bedrock Data Automation: ListTagsForResource Jede unterstützte Region: 25 pro Sekunde Nein Die maximale Anzahl von Bedrock Data Automation: ListTagsForResource Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenlimit für Bedrock Data Automation: TagResource Jede unterstützte Region: 25 pro Sekunde Nein Die maximale Anzahl von Bedrock Data Automation: TagResource Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenlimit für Bedrock Data Automation: UntagResource Jede unterstützte Region: 25 pro Sekunde Nein Die maximale Anzahl von Bedrock Data Automation: UntagResource Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenbegrenzung für CreateBlueprint Jede unterstützte Region: 5 pro Sekunde Nein Die maximale Anzahl von CreateBlueprint Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenbegrenzung für CreateBlueprintVersion Jede unterstützte Region: 5 pro Sekunde Nein Die maximale Anzahl von CreateBlueprintVersion Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenbegrenzung für CreateDataAutomationLibrary Jede unterstützte Region: 3 pro Sekunde Nein Die maximale Anzahl von CreateDataAutomationLibrary Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenbegrenzung für CreateDataAutomationProject Jede unterstützte Region: 5 pro Sekunde Nein Die maximale Anzahl von CreateDataAutomationProject Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenbegrenzung für DeleteBlueprint Jede unterstützte Region: 5 pro Sekunde Nein Die maximale Anzahl von DeleteBlueprint Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenbegrenzung für DeleteDataAutomationLibrary Jede unterstützte Region: 3 pro Sekunde Nein Die maximale Anzahl von DeleteDataAutomationLibrary Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenbegrenzung für DeleteDataAutomationProject Jede unterstützte Region: 5 pro Sekunde Nein Die maximale Anzahl von DeleteDataAutomationProject Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenbegrenzung für GetBlueprint Jede unterstützte Region: 5 pro Sekunde Nein Die maximale Anzahl von GetBlueprint Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenbegrenzung für GetDataAutomationLibrary Jede unterstützte Region: 5 pro Sekunde Nein Die maximale Anzahl von GetDataAutomationLibrary Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenbegrenzung für GetDataAutomationLibraryEntity Jede unterstützte Region: 5 pro Sekunde Nein Die maximale Anzahl von GetDataAutomationLibraryEntity Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenbegrenzung für GetDataAutomationLibraryIngestionJob Jede unterstützte Region: 5 pro Sekunde Nein Die maximale Anzahl von GetDataAutomationLibraryIngestionJob Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenbegrenzung für GetDataAutomationProject Jede unterstützte Region: 5 pro Sekunde Nein Die maximale Anzahl von GetDataAutomationProject Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenbegrenzung für GetDataAutomationStatus Jede unterstützte Region: 10 pro Sekunde Nein Die maximale Anzahl von GetDataAutomationStatus Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenbegrenzung für InvokeDataAutomationAsync Jede unterstützte Region: 10 pro Sekunde Nein Die maximale Anzahl von InvokeDataAutomationAsync Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenbegrenzung für InvokeDataAutomationLibraryIngestionJob Jede unterstützte Region: 5 pro Sekunde Nein Die maximale Anzahl von InvokeDataAutomationLibraryIngestionJob Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenbegrenzung für ListBlueprints Jede unterstützte Region: 5 pro Sekunde Nein Die maximale Anzahl von ListBlueprints Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenbegrenzung für ListDataAutomationLibraries Jede unterstützte Region: 5 pro Sekunde Nein Die maximale Anzahl von ListDataAutomationLibraries Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenbegrenzung für ListDataAutomationLibraryEntities Jede unterstützte Region: 5 pro Sekunde Nein Die maximale Anzahl von ListDataAutomationLibraryEntities Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenbegrenzung für ListDataAutomationLibraryIngestionJobs Jede unterstützte Region: 5 pro Sekunde Nein Die maximale Anzahl von ListDataAutomationLibraryIngestionJobs Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenbegrenzung für ListDataAutomationProjects Jede unterstützte Region: 5 pro Sekunde Nein Die maximale Anzahl von ListDataAutomationProjects Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenbegrenzung für UpdateBlueprint Jede unterstützte Region: 5 pro Sekunde Nein Die maximale Anzahl von UpdateBlueprint Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenbegrenzung für UpdateDataAutomationLibrary Jede unterstützte Region: 5 pro Sekunde Nein Die maximale Anzahl von UpdateDataAutomationLibrary Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
Drosselratenbegrenzung für UpdateDataAutomationProject Jede unterstützte Region: 5 pro Sekunde Nein Die maximale Anzahl von UpdateDataAutomationProject Anfragen, die Sie pro Sekunde pro Konto in der aktuellen Region stellen können
UpdateAgent Anfragen pro Sekunde Jede unterstützte Region: 4 Nein Die maximale Anzahl von UpdateAgent API-Anfragen pro Sekunde.
UpdateAgentActionGroup Anfragen pro Sekunde Jede unterstützte Region: 6 Nein Die maximale Anzahl von UpdateAgentActionGroup API-Anfragen pro Sekunde.
UpdateAgentAlias Anfragen pro Sekunde Jede unterstützte Region: 2 Nein Die maximale Anzahl von UpdateAgentAlias API-Anfragen pro Sekunde.
UpdateAgentKnowledgeBase Anfragen pro Sekunde Jede unterstützte Region: 4 Nein Die maximale Anzahl von UpdateAgentKnowledgeBase API-Anfragen pro Sekunde.
[Bedrock-Mantle-Endpunkt] Eingabe-Token pro Minute für Claude Fable 5 Jede unterstützte Region: 2.000.000 Ja [bedrock-mantle endpoint] Die maximale Anzahl an Eingabe-Token pro Minute, die Ihr Konto in dieser Region an Claude Fable 5 senden kann. Wird von allen APIs für dieses Modell gemeinsam genutzt.
[Bedrock-Mantle-Endpunkt] Eingabe-Token pro Minute für Claude Opus 4.7 Jede unterstützte Region: 20 000 000 Ja [bedrock-mantle endpoint] Die maximale Anzahl an Eingabe-Token pro Minute, die Ihr Konto in dieser Region an Claude Opus 4.7 senden kann. Wird von allen APIs für dieses Modell gemeinsam genutzt.
[Bedrock-Mantle-Endpunkt] Eingabe-Token pro Minute für Claude Opus 4.8 Jede unterstützte Region: 20 000 000 Ja [bedrock-mantle endpoint] Die maximale Anzahl an Eingabe-Token pro Minute, die Ihr Konto in dieser Region an Claude Opus 4.8 senden kann. Wird von allen APIs für dieses Modell gemeinsam genutzt.
[Bedrock-Mantle-Endpunkt] Eingabe-Token pro Minute für Claude Opus 5 Jede unterstützte Region: 20 000 000 Ja [bedrock-mantle endpoint] Die maximale Anzahl an Eingabe-Token pro Minute, die Ihr Konto in dieser Region an Claude Opus 5 senden kann. Wird von allen APIs für dieses Modell gemeinsam genutzt.
[Bedrock-Mantle-Endpunkt] Eingabe-Token pro Minute für Claude Sonnet 5 Jede unterstützte Region: 3.000.000 Ja [bedrock-mantle endpoint] Die maximale Anzahl an Eingabe-Token pro Minute, die Ihr Konto in dieser Region an Claude Sonnet 5 senden kann. Wird von allen APIs für dieses Modell gemeinsam genutzt.
[Bedrock-Mantle-Endpunkt] Eingabe-Token pro Minute für GPT-5.4 Jede unterstützte Region: 20 000 000 Ja [bedrock-mantle endpoint] Die maximale Anzahl an Eingabe-Token pro Minute, die Ihr Konto in dieser Region senden kann. GPT-5.4 Wird von allen APIs für dieses Modell gemeinsam genutzt.
[Bedrock-Mantle-Endpunkt] Eingabe-Token pro Minute für GPT-5.5 Jede unterstützte Region: 10 000 000 Ja [bedrock-mantle endpoint] Die maximale Anzahl an Eingabe-Token pro Minute, die Ihr Konto in dieser Region senden kann. GPT-5.5 Wird von allen APIs für dieses Modell gemeinsam genutzt.
[Bedrock-Mantle-Endpunkt] Eingabe-Token pro Minute für Luna GPT-5.6 Jede unterstützte Region: 20 000 000 Ja [bedrock-mantle endpoint] Die maximale Anzahl an Eingabe-Token pro Minute, die Ihr Konto in dieser Region an Luna senden kann. GPT-5.6 Wird von allen APIs für dieses Modell gemeinsam genutzt.
[Bedrock-Mantle-Endpunkt] Eingabe-Token pro Minute für Sol GPT-5.6 Jede unterstützte Region: 10 000 000 Ja [bedrock-mantle endpoint] Die maximale Anzahl an Eingabe-Token pro Minute, die Ihr Konto in dieser Region an Sol senden kann. GPT-5.6 Wird von allen APIs für dieses Modell gemeinsam genutzt.
[Bedrock-Mantle-Endpunkt] Eingabe-Token pro Minute für Terra GPT-5.6 Jede unterstützte Region: 20 000 000 Ja [bedrock-mantle endpoint] Die maximale Anzahl an Eingabe-Token pro Minute, die Ihr Konto in dieser Region an Terra senden kann. GPT-5.6 Wird von allen APIs für dieses Modell gemeinsam genutzt.
[Bedrock-Mantle-Endpunkt] Ausgabe-Tokens pro Minute für Claude Fable 5 Jede unterstützte Region: 200 000 Ja [bedrock-mantle endpoint] Die maximale Anzahl an Output-Token pro Minute, die Claude Fable 5 für Ihr Konto in dieser Region generieren kann. Wird von allen APIs für dieses Modell gemeinsam genutzt.
[Bedrock-Mantle-Endpunkt] Ausgabe-Tokens pro Minute für Claude Opus 4.7 Jede unterstützte Region: 2.000.000 Ja [bedrock-mantle endpoint] Die maximale Anzahl an Output-Token pro Minute, die Claude Opus 4.7 für Ihr Konto in dieser Region generieren kann. Wird von allen APIs für dieses Modell gemeinsam genutzt.
[Bedrock-Mantle-Endpunkt] Ausgabe-Tokens pro Minute für Claude Opus 4.8 Jede unterstützte Region: 2.000.000 Ja [bedrock-mantle endpoint] Die maximale Anzahl an Output-Token pro Minute, die Claude Opus 4.8 für Ihr Konto in dieser Region generieren kann. Wird von allen APIs für dieses Modell gemeinsam genutzt.
[Bedrock-Mantle-Endpunkt] Ausgabe-Tokens pro Minute für Claude Opus 5 Jede unterstützte Region: 2.000.000 Ja [bedrock-mantle endpoint] Die maximale Anzahl an Output-Token pro Minute, die Claude Opus 5 für Ihr Konto in dieser Region generieren kann. Wird von allen APIs für dieses Modell gemeinsam genutzt.
[Bedrock-Mantle-Endpunkt] Ausgabe-Tokens pro Minute für Claude Sonnet 5 Jede unterstützte Region: 300 000 Ja [bedrock-mantle endpoint] Die maximale Anzahl an Output-Token pro Minute, die Claude Sonnet 5 für Ihr Konto in dieser Region generieren kann. Wird von allen APIs für dieses Modell gemeinsam genutzt.
[Bedrock-Mantle-Endpunkt] Ausgabe-Tokens pro Minute für GPT-5.4 Jede unterstützte Region: 2.000.000 Ja [bedrock-mantle endpoint] Die maximale Anzahl an Output-Token pro Minute, die für Ihr Konto in dieser GPT-5.4 Region generiert werden kann. Wird von allen APIs für dieses Modell gemeinsam genutzt.
[Bedrock-Mantle-Endpunkt] Ausgabe-Tokens pro Minute für GPT-5.5 Jede unterstützte Region: 1 000 000 Ja [bedrock-mantle endpoint] Die maximale Anzahl an Output-Token pro Minute, die für Ihr Konto in dieser GPT-5.5 Region generiert werden kann. Wird von allen APIs für dieses Modell gemeinsam genutzt.
[Bedrock-Mantle-Endpunkt] Ausgabe-Token pro Minute für Luna GPT-5.6 Jede unterstützte Region: 2.000.000 Ja [bedrock-mantle endpoint] Die maximale Anzahl an Output-Token pro Minute, die GPT-5.6 Luna für dein Konto in dieser Region generieren kann. Wird von allen APIs für dieses Modell gemeinsam genutzt.
[Bedrock-Mantle-Endpunkt] Ausgabe-Token pro Minute für Sol GPT-5.6 Jede unterstützte Region: 1 000 000 Ja [bedrock-mantle endpoint] Die maximale Anzahl an Output-Token pro Minute, die GPT-5.6 Sol für Ihr Konto in dieser Region generieren kann. Wird von allen APIs für dieses Modell gemeinsam genutzt.
[Bedrock-Mantle-Endpunkt] Ausgabe-Tokens pro Minute für Terra GPT-5.6 Jede unterstützte Region: 2.000.000 Ja [bedrock-mantle endpoint] Die maximale Anzahl an Output-Token pro Minute, die GPT-5.6 Terra für dein Konto in dieser Region generieren kann. Wird von allen APIs für dieses Modell gemeinsam genutzt.
Anmerkung

Sie können eine Kontingenterhöhung für Ihr Konto anfordern, indem Sie die folgenden Schritte ausführen:

  • Wenn ein Kontingent mit Ja markiert ist, können Sie es anpassen, indem Sie die Schritte unter Anfordern einer Kontingenterhöhung im Benutzerhandbuch zu Service Quotas befolgen.

  • Wenn ein Kontingent mit Nein gekennzeichnet ist, können Sie über das Formular zur Erhöhung des Limits einen Antrag stellen, damit eine Erhöhung in Betracht gezogen wird.

  • Für jedes Modell können Sie eine Erhöhung für die folgenden Kontingente gemeinsam anfordern:

    • Cross-Region InvokeModel Tokens pro Minute für ${model}

    • Cross-Region InvokeModel Anfragen pro Minute für ${model}

    • On-demand InvokeModel Tokens pro Minute für ${model}

    • On-demand InvokeModel Anfragen pro Minute für ${model}

    Um eine Erhöhung für eine beliebige Kombination dieser Kontingente zu beantragen, fordern Sie eine Erhöhung der Cross-Region InvokeModel Tokens pro Minute für das ${model} Kontingent an, indem Sie die Schritte unter Anfordern einer Kontingenterhöhung im Servicekontingents-Benutzerhandbuch befolgen. Nachdem Sie dies getan haben, wird sich das Support-Team mit Ihnen in Verbindung setzen und Ihnen die Möglichkeit bieten, auch die anderen drei Kontingente zu erhöhen. Aufgrund der hohen Nachfrage werden Kunden bevorzugt behandelt, deren Datenverkehr das ihnen zugewiesene Kontingent überschreitet. Ihre Anfrage wird möglicherweise abgelehnt, wenn Sie diese Bedingung nicht erfüllen.