Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.
Was ist Amazon Nova?
Anmerkung
Diese Dokumentation bezieht sich auf Amazon Nova Version 1. Amazon Nova 2 ist jetzt mit neuen Modellen und erweiterten Funktionen erhältlich. Neue Funktionen und Dokumentationsaktualisierungen werden im Amazon Nova 2-Benutzerhandbuch veröffentlicht. Informationen zu den Neuerungen in Amazon Nova 2 finden Sie unter Was ist neu in Amazon Nova 2.
Die Grundlagenmodelle von Amazon Nova bieten bahnbrechende Intelligenz und ein branchenführendes Preis-Leistungs-Verhältnis. Organisationen können mit Amazon Nova generative KI-Anwendungen entwickeln und skalieren, die sicher, zuverlässig und kostengünstig sind. Amazon Nova beschleunigt KI-Innovationen über verschiedene Modalitäten und Anwendungsfälle hinweg – einschließlich Text, Bild, Video, Sprache, API-Aufrufe und agentenbasierte KI. Um mit der Entwicklung mit Amazon Nova zu beginnen, müssen Sie mithilfe von Amazon Bedrock über eine API auf die Modelle zugreifen.
Amazon Nova-Modellkategorien
Amazon Nova bietet leistungsstarke Basismodelle in drei Kategorien: Verständnis, Kreativität und Sprachfähigkeit.
Modell |
Kategorie |
Description |
Anwendungsfälle |
Regionen |
|---|---|---|---|---|
Amazon Nova Premier |
Verstehen |
Das leistungsfähigste multimodale Modell für komplexe Aufgaben. Umfasst verschiedene Eingaben wie Text, Bilder, Videos, Dokumente und Code. |
Interaktive Chat-Schnittstellen, Retrieval-Augmented Generationssysteme (RAG), Agentenanwendungen, Videoanalyse, UI-Workflow-Automatisierung |
USA Ost (Nord-Virginia) 1, AWS GovCloud () US-West |
Amazon Nova Pro |
Verstehen |
Hochleistungsfähiges multimodales Modell mit der besten Kombination aus Genauigkeit, Geschwindigkeit und Kosten für eine Vielzahl von Aufgaben. Umfasst verschiedene Eingaben wie Text, Bilder, Videos, Dokumente und Code. |
Interaktive Chat-Schnittstellen, Retrieval-Augmented Generationssysteme (RAG), Agentenanwendungen, Videoanalyse, UI-Workflow-Automatisierung |
USA Ost (Nord-Virginia) 1, Asien-Pazifik (Sydney) 1, Europa (London) 1, AWS GovCloud () US-West |
Amazon Nova Lite |
Verstehen |
Sehr kostengünstiges multimodales Modell mit blitzschneller Verarbeitung für Bild-, Video- und Texteingaben. Umfasst verschiedene Eingaben wie Text, Bilder, Video, Dokumente und Code. |
Interaktive Chat-Schnittstellen, Retrieval-Augmented Generationssysteme (RAG), Agentenanwendungen, Videoanalyse, UI-Workflow-Automatisierung |
USA Ost (Nord-Virginia) 1, Asien-Pazifik (Sydney) 1, Europa (London) 1, AWS GovCloud () US-West |
Amazon Nova Micro |
Verstehen |
Text-only Modell, das Antworten mit der niedrigsten Latenz zu sehr niedrigen Kosten liefert. |
Interaktive Chat-Schnittstellen, Retrieval-Augmented Generation (RAG) -Systeme, Agentenanwendungen |
USA Ost (Nord-Virginia) 1, Asien-Pazifik (Sydney) 1, Europa (London) 1, AWS GovCloud () US-West |
Amazon Nova Canvas |
Creative |
High-quality Modell zur Bildgenerierung mit Anpassung und Steuerung. Wandelt Text- und Bildeingaben in professionelle Bilder um. |
Medien, Unterhaltung, Einzelhandel, Marketing, Werbung, Erstellung anpassbarer visueller Inhalte |
USA Ost (Nord-Virginia), Europa (Irland) und Asien-Pazifik (Tokio) |
Amazon Nova Reel |
Creative |
Modell zur Videogenerierung zur Demokratisierung der Generierung kreativer Inhalte. Wandelt Text- und Bildeingaben in professionelle Videos um. |
Medien, Unterhaltung, Einzelhandel, Marketing, Werbung, Erstellung anpassbarer visueller Inhalte |
USA Ost (Nord-Virginia), Europa (Irland) und Asien-Pazifik (Tokio) |
Amazon Nova Sonic |
Sprache |
Grundmodell für das Verstehen und Generieren von Konversationssprachen in fünf Sprachen (Englisch (USA, Großbritannien), Französisch, Italienisch, Deutsch und Spanisch). Akzeptiert Sprache als Eingabe und liefert Sprache mit Texttranskriptionen als Ausgabe. Verfügt über bidirektionale Streaming-API-Funktionen für Echtzeit-Konversationen mit niedriger Latenz und mehreren Runden. |
Virtuelle Assistenten, Kundenservice-Lösungen, interaktive Spracherlebnisse, Sprachinteraktionen in Echtzeit |
USA Ost (Nord-Virginia), Europa (Stockholm) und Asien-Pazifik (Tokio) |
1 Durch regionsübergreifende Inferenz können Sie in weiteren Regionen auf dieses Modell zugreifen: USA Ost (Ohio), USA West (Oregon), Europa (Stockholm), Europa (Irland), Europa (Frankfurt), Europa (Paris), Asien-Pazifik (Tokio), Asien-Pazifik (Singapur), Asien-Pazifik (Sydney), Asien-Pazifik (Seoul) und Asien-Pazifik (Mumbai). Weitere Informationen finden Sie unter Verbesserung der Resilienz durch regionsübergreifende Inferenz.
Vollständige Informationen zur Modell- und Regionsunterstützung in Amazon Bedrock finden Sie unter Unterstützte Basismodelle in Amazon Bedrock.
Technische Daten des Modells
Die folgenden Tabellen enthalten detaillierte Spezifikationen für jede Amazon Nova-Modellfamilie.
Grundlegendes zu den Modellspezifikationen
Amazon Nova Premier |
Amazon Nova Pro |
Amazon Nova Lite |
Amazon Nova Micro |
|
|---|---|---|---|---|
Modell-ID |
amazon.nova-premier-v1:0 |
amazon.nova-pro-v1:0 |
amazon.nova-lite-v1:0 |
amazon.nova-micro-v1:0 |
Inferenzprofil-ID |
us.amazon.nova-premier-v1:0 |
us.amazon.nova-pro-v1:0 |
us.amazon.nova-lite-v1:0 |
us.amazon.nova-micro-v1:0 |
Eingabemodalitäten |
Text, Bild, Video |
Text, Bild, Video |
Text, Bild, Video |
Text |
Ausgabemodalitäten |
Text |
Text |
Text |
Text |
Kontextfenster |
1 Mio. |
300 000 |
300 000 |
128 000 |
Max. Ausgabe-Token |
10 K |
10 000 |
10 000 |
10 000 |
Unterstützte Sprachen |
200+1 |
200+1 |
200+1 |
200+1 |
Regionen |
USA Ost (Nord-Virginia)2 |
USA Ost (Nord-Virginia) 2, Asien-Pazifik (Tokio) 2, Asien-Pazifik (Sydney) 2, Europa (London) 2, AWS GovCloud (US-West) |
USA Ost (Nord-Virginia) 2, Asien-Pazifik (Tokio) 2, Asien-Pazifik (Sydney) 2, Europa (London) 2, AWS GovCloud (US-West) |
USA Ost (Nord-Virginia) 2, Asien-Pazifik (Tokio) 2, Asien-Pazifik (Sydney) 2, Europa (London) 2, AWS GovCloud (US-West) |
Dokument-Support |
PDF, CSV, DOC, DOCX, XLS, XLSX, HTML, TXT, MD |
PDF, CSV, DOC, DOCX, XLS, XLSX, HTML, TXT, MD |
PDF, CSV, DOC, DOCX, XLS, XLSX, HTML, TXT, MD |
Nein |
Converse-API |
Ja |
Ja |
Ja |
Ja |
InvokeAPI |
Ja |
Ja |
Ja |
Ja |
Streaming |
Ja |
Ja |
Ja |
Ja |
Batch-Inferenz |
Ja |
Ja |
Ja |
Ja |
Feinabstimmung |
Nein |
Ja |
Ja |
Ja |
Bereitgestellter Durchsatz |
Nein |
Ja |
Ja |
Ja |
Bedrock-Wissensdatenbanken |
Ja |
Ja |
Ja |
Ja |
Bedrock-Agenten |
Ja |
Ja |
Ja |
Ja |
Bedrock-Integritätsschutz |
Ja (nur Text) |
Ja (nur Text) |
Ja (nur Text) |
Ja |
Bedrock-Bewertungen |
Ja (nur Text) |
Ja (nur Text) |
Ja (nur Text) |
Ja |
Bedrock-Prompt-Abläufe |
Ja |
Ja |
Ja |
Ja |
Bedrock Studio |
Ja |
Ja |
Ja |
Ja |
1 Optimiert für diese 15 Sprachen: Englisch, Deutsch, Spanisch, Französisch, Italienisch, Japanisch, Koreanisch, Arabisch, vereinfachtes Chinesisch, Russisch, Hindi, Portugiesisch, Niederländisch, Türkisch und Hebräisch.
2 Sie können in den Regionen USA Ost (Ohio), USA West (Oregon), Europa (Stockholm), Europa (Irland), Europa (Frankfurt), Europa (Paris), Asien-Pazifik (Tokio), Asien-Pazifik (Tokio), Asien-Pazifik (Singapur), Asien-Pazifik (Sydney), Asien-Pazifik (Seoul) und Asien-Pazifik (Mumbai) über regionsübergreifende Inferenz zugreifen. Cross-region Inferenz ermöglicht es Ihnen, ungeplante Datenverkehrsschübe nahtlos zu verwalten, indem Sie Rechenleistung auf verschiedenen Ebenen einsetzen AWS-Regionen. Mit regionenübergreifender Inferenz können Sie den Datenverkehr auf mehrere AWS-Regionen verteilen. Weitere Informationen zur regionsübergreifenden Inferenz finden Sie unter Unterstützte Regionen und Modelle für Inferenzprofile und Verbessern der Widerstandsfähigkeit mit regionsübergreifender Inferenz im Amazon Bedrock-Benutzerhandbuch.
Spezifikationen für Kreativ- und Sprachmodelle
Amazon Nova Canvas |
Amazon Nova Reel |
Amazon Nova Sonic |
|
|---|---|---|---|
Modell-ID |
amazon.nova-canvas-v1:0 |
amazon.nova-reel-v1:1 |
amazon.nova-sonic-v1:0 |
Eingabemodalitäten |
Text, Bild |
Text, Bild |
Sprache |
Ausgabemodalitäten |
Image |
Video |
Sprache mit Transkription und Textantworten |
Max. Prompt-Länge |
1024 Zeichen |
||
Eingabekontextfenster |
512 Zeichen |
300K Kontext |
|
Ausgabeauflösung (Generierungsaufgaben) |
4,19 Millionen Pixel (d. h. 2 048x2 048, 2 816x1 536) |
1 280x720, 24 Bilder pro Sekunde |
|
Max. Ausgabeauflösung (Bearbeitungsaufgaben) |
Muss alle der folgenden Bedingungen erfüllen:
|
||
Max. Verbindungsdauer |
Verbindungs-Timeout von 8 Minuten, mit maximal 20 gleichzeitigen Verbindungen pro Kunde. 1 |
||
Unterstützte Eingabetypen |
PNG, JPEG |
PNG, JPEG |
|
Unterstützte Sprachen |
Englisch |
Englisch |
Englisch (USA, Großbritannien), Französisch, Italienisch, Deutsch und Spanisch 2 |
Regionen |
USA Ost (Nord-Virginia), Europa (Irland) und Asien-Pazifik (Tokio) |
USA Ost (Nord-Virginia), Europa (Irland) und Asien-Pazifik (Tokio) |
USA Ost (Nord-Virginia), Europa (Stockholm) und Asien-Pazifik (Tokio) |
API für asynchronen Modell-Aufruf |
Nein |
Ja |
|
Modell API aufrufen |
Ja |
Nein |
|
Support für bidirektionale Stream-API |
Ja |
||
Bedrock-Wissensdatenbanken |
Wird durch die Verwendung von Tools (Funktionsaufruf) unterstützt |
1 Standardmäßig beträgt das Verbindungslimit 8 Minuten. Sie können die Verbindung jedoch erneuern und die Konversation fortsetzen, indem Sie den Verlauf der vorherigen Konversation angeben.
2 Eine Liste der unterstützten Stimmen finden Sie unter Für Amazon Nova Sonic verfügbare Stimmen.