View a markdown version of this page

Leitfaden zur Kompatibilität von Datenformaten - Amazon SageMaker KI

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

Leitfaden zur Kompatibilität von Datenformaten

Anmerkung

Amazon SageMaker Clarify steht neuen Kunden nicht mehr offen. Bestehende Kunden können den Service weiterhin wie gewohnt nutzen. AWS investiert weiterhin in Sicherheits- und Verfügbarkeitsverbesserungen für Clarify, aber wir planen nicht, neue Funktionen einzuführen. Weitere Informationen finden Sie unter Klären Sie die Verfügbarkeit, ändern.

In diesem Handbuch werden die Datenformattypen beschrieben, die mit SageMaker Clarify-Verarbeitungsaufträgen kompatibel sind. Zu den unterstützten Datenformattypen gehören die Dateierweiterungen, die Datenstruktur und spezifische Anforderungen oder Einschränkungen für Tabellen-, Bild- und Zeitreihendatensätze. In diesem Leitfaden erfahren Sie auch, wie Sie überprüfen können, ob Ihr Datensatz diesen Anforderungen entspricht.

Im Großen und Ganzen folgt der SageMaker Clarify-Verarbeitungsauftrag dem Eingabe-Prozess-Ausgabe-Modell zur Berechnung von Bias-Metriken und Feature-Attributionen. Einzelheiten finden Sie in den folgenden Beispielen.

Die Eingabe für den Clarify-Verarbeitungsauftrag SageMaker besteht aus den folgenden Elementen:

  • Der zu analysierende Datensatz.

  • Die Analysekonfiguration. Weitere Informationen darüber, wie Sie diese Analyse konfigurieren, finden Sie unter Analyse-Konfigurationsdateien.

Während der Verarbeitungsphase berechnet SageMaker Clarify Bias-Metriken und Merkmalsattribute. Der SageMaker Clarify-Verarbeitungsjob führt die folgenden Schritte im Backend durch:

  • Der SageMaker Clarify-Verarbeitungsjob analysiert Ihre Analysekonfiguration und lädt Ihren Datensatz.

  • Um Messwerte und Featureszuschreibungen nach dem Training zu berechnen, benötigt der Auftrag Modellvorhersagen aus Ihrem Modell. Der SageMaker Clarify-Verarbeitungsauftrag serialisiert Ihre Daten und sendet sie als Anfrage an Ihr Modell, das auf einem SageMaker KI-Echtzeit-Inferenzendpunkt bereitgestellt wird. Danach extrahiert der SageMaker Clarify-Verarbeitungsjob Vorhersagen aus der Antwort.

  • Der SageMaker Clarify-Verarbeitungsjob führt die Verzerrungs- und Erklärbarkeitsanalyse durch und gibt anschließend die Ergebnisse aus.

Weitere Informationen finden Sie unter So funktionieren SageMaker Clarify Processing-Jobs.

Der Parameter, mit dem Sie das Format der Daten angeben, hängt wie folgt davon ab, wo die Daten im Verarbeitungsablauf verwendet werden:

  • Verwenden Sie für einen Eingabedatensatz den dataset_type Parameter, um das Format oder den MIME-Typ anzugeben.

  • Verwenden Sie bei einer Anfrage an einen Endpunkt den content_type Parameter, um das Format anzugeben.

  • Verwenden Sie für eine Antwort von einem Endpunkt den accept_type Parameter, um das Format anzugeben.

Der Eingabedatensatz, die Anfrage und die Antwort an und vom Endpunkt benötigen nicht dasselbe Format. Sie können beispielsweise einen Parquet-Datensatz mit einer CSV Anforderungsnutzlast und einer JSON Lines Antwortnutzlast unter den folgenden Bedingungen verwenden.

  • Ihre Analyse ist korrekt konfiguriert.

  • Ihr Modell unterstützt die Anforderungs- und Antwortformate.

Anmerkung

Wenn content_type oder nichtaccept_type, leitet der SageMaker Clarify-Container das und ab. content_type accept_type