View a markdown version of this page

Was ist Amazon Nova? - Amazon Nova

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

Was ist Amazon Nova?

Anmerkung

Diese Dokumentation bezieht sich auf Amazon Nova Version 1. Amazon Nova 2 ist jetzt mit neuen Modellen und erweiterten Funktionen erhältlich. Neue Funktionen und Dokumentationsaktualisierungen werden im Amazon Nova 2-Benutzerhandbuch veröffentlicht. Informationen zu den Neuerungen in Amazon Nova 2 finden Sie unter Was ist neu in Amazon Nova 2.

Die Grundlagenmodelle von Amazon Nova bieten bahnbrechende Intelligenz und ein branchenführendes Preis-Leistungs-Verhältnis. Organisationen können mit Amazon Nova generative KI-Anwendungen entwickeln und skalieren, die sicher, zuverlässig und kostengünstig sind. Amazon Nova beschleunigt KI-Innovationen über verschiedene Modalitäten und Anwendungsfälle hinweg – einschließlich Text, Bild, Video, Sprache, API-Aufrufe und agentenbasierte KI. Um mit der Entwicklung mit Amazon Nova zu beginnen, müssen Sie mithilfe von Amazon Bedrock über eine API auf die Modelle zugreifen.

Amazon Nova-Modellkategorien

Amazon Nova bietet leistungsstarke Basismodelle in drei Kategorien: Verständnis, Kreativität und Sprachfähigkeit.

Modell

Kategorie

Description

Anwendungsfälle

Regionen

Amazon Nova Premier

Verstehen

Das leistungsfähigste multimodale Modell für komplexe Aufgaben. Umfasst verschiedene Eingaben wie Text, Bilder, Videos, Dokumente und Code.

Interaktive Chat-Schnittstellen, Retrieval-Augmented Generationssysteme (RAG), Agentenanwendungen, Videoanalyse, UI-Workflow-Automatisierung

USA Ost (Nord-Virginia) 1, AWS GovCloud () US-West

Amazon Nova Pro

Verstehen

Hochleistungsfähiges multimodales Modell mit der besten Kombination aus Genauigkeit, Geschwindigkeit und Kosten für eine Vielzahl von Aufgaben. Umfasst verschiedene Eingaben wie Text, Bilder, Videos, Dokumente und Code.

Interaktive Chat-Schnittstellen, Retrieval-Augmented Generationssysteme (RAG), Agentenanwendungen, Videoanalyse, UI-Workflow-Automatisierung

USA Ost (Nord-Virginia) 1, Asien-Pazifik (Sydney) 1, Europa (London) 1, AWS GovCloud () US-West

Amazon Nova Lite

Verstehen

Sehr kostengünstiges multimodales Modell mit blitzschneller Verarbeitung für Bild-, Video- und Texteingaben. Umfasst verschiedene Eingaben wie Text, Bilder, Video, Dokumente und Code.

Interaktive Chat-Schnittstellen, Retrieval-Augmented Generationssysteme (RAG), Agentenanwendungen, Videoanalyse, UI-Workflow-Automatisierung

USA Ost (Nord-Virginia) 1, Asien-Pazifik (Sydney) 1, Europa (London) 1, AWS GovCloud () US-West

Amazon Nova Micro

Verstehen

Text-only Modell, das Antworten mit der niedrigsten Latenz zu sehr niedrigen Kosten liefert.

Interaktive Chat-Schnittstellen, Retrieval-Augmented Generation (RAG) -Systeme, Agentenanwendungen

USA Ost (Nord-Virginia) 1, Asien-Pazifik (Sydney) 1, Europa (London) 1, AWS GovCloud () US-West

Amazon Nova Canvas

Creative

High-quality Modell zur Bildgenerierung mit Anpassung und Steuerung. Wandelt Text- und Bildeingaben in professionelle Bilder um.

Medien, Unterhaltung, Einzelhandel, Marketing, Werbung, Erstellung anpassbarer visueller Inhalte

USA Ost (Nord-Virginia), Europa (Irland) und Asien-Pazifik (Tokio)

Amazon Nova Reel

Creative

Modell zur Videogenerierung zur Demokratisierung der Generierung kreativer Inhalte. Wandelt Text- und Bildeingaben in professionelle Videos um.

Medien, Unterhaltung, Einzelhandel, Marketing, Werbung, Erstellung anpassbarer visueller Inhalte

USA Ost (Nord-Virginia), Europa (Irland) und Asien-Pazifik (Tokio)

Amazon Nova Sonic

Sprache

Grundmodell für das Verstehen und Generieren von Konversationssprachen in fünf Sprachen (Englisch (USA, Großbritannien), Französisch, Italienisch, Deutsch und Spanisch). Akzeptiert Sprache als Eingabe und liefert Sprache mit Texttranskriptionen als Ausgabe. Verfügt über bidirektionale Streaming-API-Funktionen für Echtzeit-Konversationen mit niedriger Latenz und mehreren Runden.

Virtuelle Assistenten, Kundenservice-Lösungen, interaktive Spracherlebnisse, Sprachinteraktionen in Echtzeit

USA Ost (Nord-Virginia), Europa (Stockholm) und Asien-Pazifik (Tokio)

1 Durch regionsübergreifende Inferenz können Sie in weiteren Regionen auf dieses Modell zugreifen: USA Ost (Ohio), USA West (Oregon), Europa (Stockholm), Europa (Irland), Europa (Frankfurt), Europa (Paris), Asien-Pazifik (Tokio), Asien-Pazifik (Singapur), Asien-Pazifik (Sydney), Asien-Pazifik (Seoul) und Asien-Pazifik (Mumbai). Weitere Informationen finden Sie unter Verbesserung der Resilienz durch regionsübergreifende Inferenz.

Vollständige Informationen zur Modell- und Regionsunterstützung in Amazon Bedrock finden Sie unter Unterstützte Basismodelle in Amazon Bedrock.

Technische Daten des Modells

Die folgenden Tabellen enthalten detaillierte Spezifikationen für jede Amazon Nova-Modellfamilie.

Grundlegendes zu den Modellspezifikationen

Amazon Nova Premier

Amazon Nova Pro

Amazon Nova Lite

Amazon Nova Micro

Modell-ID

amazon.nova-premier-v1:0

amazon.nova-pro-v1:0

amazon.nova-lite-v1:0

amazon.nova-micro-v1:0

Inferenzprofil-ID

us.amazon.nova-premier-v1:0

us.amazon.nova-pro-v1:0

us.amazon.nova-lite-v1:0

us.amazon.nova-micro-v1:0

Eingabemodalitäten

Text, Bild, Video

Text, Bild, Video

Text, Bild, Video

Text

Ausgabemodalitäten

Text

Text

Text

Text

Kontextfenster

1 Mio.

300 000

300 000

128 000

Max. Ausgabe-Token

10 K

10 000

10 000

10 000

Unterstützte Sprachen

200+1

200+1

200+1

200+1

Regionen

USA Ost (Nord-Virginia)2

USA Ost (Nord-Virginia) 2, Asien-Pazifik (Tokio) 2, Asien-Pazifik (Sydney) 2, Europa (London) 2, AWS GovCloud (US-West)

USA Ost (Nord-Virginia) 2, Asien-Pazifik (Tokio) 2, Asien-Pazifik (Sydney) 2, Europa (London) 2, AWS GovCloud (US-West)

USA Ost (Nord-Virginia) 2, Asien-Pazifik (Tokio) 2, Asien-Pazifik (Sydney) 2, Europa (London) 2, AWS GovCloud (US-West)

Dokument-Support

PDF, CSV, DOC, DOCX, XLS, XLSX, HTML, TXT, MD

PDF, CSV, DOC, DOCX, XLS, XLSX, HTML, TXT, MD

PDF, CSV, DOC, DOCX, XLS, XLSX, HTML, TXT, MD

Nein

Converse-API

Ja

Ja

Ja

Ja

InvokeAPI

Ja

Ja

Ja

Ja

Streaming

Ja

Ja

Ja

Ja

Batch-Inferenz

Ja

Ja

Ja

Ja

Feinabstimmung

Nein

Ja

Ja

Ja

Bereitgestellter Durchsatz

Nein

Ja

Ja

Ja

Bedrock-Wissensdatenbanken

Ja

Ja

Ja

Ja

Bedrock-Agenten

Ja

Ja

Ja

Ja

Bedrock-Integritätsschutz

Ja (nur Text)

Ja (nur Text)

Ja (nur Text)

Ja

Bedrock-Bewertungen

Ja (nur Text)

Ja (nur Text)

Ja (nur Text)

Ja

Bedrock-Prompt-Abläufe

Ja

Ja

Ja

Ja

Bedrock Studio

Ja

Ja

Ja

Ja

1 Optimiert für diese 15 Sprachen: Englisch, Deutsch, Spanisch, Französisch, Italienisch, Japanisch, Koreanisch, Arabisch, vereinfachtes Chinesisch, Russisch, Hindi, Portugiesisch, Niederländisch, Türkisch und Hebräisch.

2 Sie können in den Regionen USA Ost (Ohio), USA West (Oregon), Europa (Stockholm), Europa (Irland), Europa (Frankfurt), Europa (Paris), Asien-Pazifik (Tokio), Asien-Pazifik (Tokio), Asien-Pazifik (Singapur), Asien-Pazifik (Sydney), Asien-Pazifik (Seoul) und Asien-Pazifik (Mumbai) über regionsübergreifende Inferenz zugreifen. Cross-region Inferenz ermöglicht es Ihnen, ungeplante Datenverkehrsschübe nahtlos zu verwalten, indem Sie Rechenleistung auf verschiedenen Ebenen einsetzen AWS-Regionen. Mit regionenübergreifender Inferenz können Sie den Datenverkehr auf mehrere AWS-Regionen verteilen. Weitere Informationen zur regionsübergreifenden Inferenz finden Sie unter Unterstützte Regionen und Modelle für Inferenzprofile und Verbessern der Widerstandsfähigkeit mit regionsübergreifender Inferenz im Amazon Bedrock-Benutzerhandbuch.

Spezifikationen für Kreativ- und Sprachmodelle

Amazon Nova Canvas

Amazon Nova Reel

Amazon Nova Sonic

Modell-ID

amazon.nova-canvas-v1:0

amazon.nova-reel-v1:1

amazon.nova-sonic-v1:0

Eingabemodalitäten

Text, Bild

Text, Bild

Sprache

Ausgabemodalitäten

Image

Video

Sprache mit Transkription und Textantworten

Max. Prompt-Länge

1024 Zeichen

Eingabekontextfenster

512 Zeichen

300K Kontext

Ausgabeauflösung (Generierungsaufgaben)

4,19 Millionen Pixel (d. h. 2 048x2 048, 2 816x1 536)

1 280x720, 24 Bilder pro Sekunde

Max. Ausgabeauflösung (Bearbeitungsaufgaben)

Muss alle der folgenden Bedingungen erfüllen:

  • 4 096 Pixel an der längsten Seite

  • Seitenverhältnis zwischen 1:4 und 4:1

  • Gesamtpixelzahl von 4,19 Millionen oder weniger

Max. Verbindungsdauer

Verbindungs-Timeout von 8 Minuten, mit maximal 20 gleichzeitigen Verbindungen pro Kunde. 1

Unterstützte Eingabetypen

PNG, JPEG

PNG, JPEG

Unterstützte Sprachen

Englisch

Englisch

Englisch (USA, Großbritannien), Französisch, Italienisch, Deutsch und Spanisch 2

Regionen

USA Ost (Nord-Virginia), Europa (Irland) und Asien-Pazifik (Tokio)

USA Ost (Nord-Virginia), Europa (Irland) und Asien-Pazifik (Tokio)

USA Ost (Nord-Virginia), Europa (Stockholm) und Asien-Pazifik (Tokio)

API für asynchronen Modell-Aufruf

Nein

Ja

Modell API aufrufen

Ja

Nein

Support für bidirektionale Stream-API

Ja

Bedrock-Wissensdatenbanken

Wird durch die Verwendung von Tools (Funktionsaufruf) unterstützt

1 Standardmäßig beträgt das Verbindungslimit 8 Minuten. Sie können die Verbindung jedoch erneuern und die Konversation fortsetzen, indem Sie den Verlauf der vorherigen Konversation angeben.

2 Eine Liste der unterstützten Stimmen finden Sie unter Für Amazon Nova Sonic verfügbare Stimmen.