View a markdown version of this page

Verbinden einer Datenquelle - Amazon Bedrock

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

Verbinden einer Datenquelle

Nachdem Sie die Konfigurationen für Ihre Wissensdatenbank abgeschlossen haben, verbinden Sie eine unterstützte Datenquelle mit der Wissensdatenbank.

Von Amazon Bedrock verwaltete Wissensdatenbanken unterstützen die Verbindung zu unstrukturierten Datenquellen. Wählen Sie ein Thema aus, um zu erfahren, wie Sie eine Verbindung zu dieser Art von Datenquelle herstellen können:

Anmerkung

Bei verwalteten Wissensdatenbanken ist der CreateDataSource Vorgang asynchron. Der Status der Datenquelle wechselt von CREATING zu, AVAILABLE wenn der Vorgang abgeschlossen ist.

Um zu erfahren, wie Sie mithilfe der Amazon-Bedrock-Konsole eine Verbindung zu einer Datenquelle herstellen, wählen Sie unten auf dieser Seite das Thema für Ihren Datenquellentyp aus:

Um mithilfe der Amazon Bedrock-API eine Verbindung zu einer Datenquelle herzustellen, senden Sie eine CreateDataSource Anfrage an einen Laufzeitendpunkt von Agents for Amazon Bedrock.

Erforderliche Felder:

Feld Description
knowledgeBaseId Die Kennung der Wissensdatenbank.
name Ein Name für die Datenquelle.
dataSourceConfiguration Geben Sie den Datenquellentyp in dem type Feld an und fügen Sie die entsprechende Konfiguration hinzu. Weitere Informationen zu Connector-spezifischen Konfigurationen erhalten Sie, indem Sie das Thema für den Connector aus den Themen unten auf dieser Seite auswählen.

Darin dataSourceConfiguration müssen Sie Folgendes angeben:

  • type – Der Wert muss MANAGED_KNOWLEDGE_BASE_CONNECTOR sein.

  • managedKnowledgeBaseConnectorConfiguration— Konfiguration für den Connector. Enthält die folgenden Felder:

    • connectorParameters(erforderlich) — Enthält ein type Feld, das den Konnektortyp angibt, und ein erforderliches version Feld mit der Einstellung1. Unterstützte Typwerte sind S3 ONEDRIVECONFLUENCE,SHAREPOINT,WEB_CRAWLER, undGOOGLE_DRIVE. Die übrigen Felder connectorParameters unterscheiden sich je nach Konnektortyp. Weitere Informationen finden Sie auf den einzelnen Datenkonnektorseiten.

    • deletionProtectionConfiguration(optional) — Ein Schutz vor versehentlichem Massenlöschen indizierter Inhalte. Enthält deletionProtectionStatus (ENABLEDoderDISABLED) und, wenn aktiviert, ein optionales deletionProtectionThreshold (0—100, Standardeinstellung 15). Der Schwellenwert ist der maximale Prozentsatz der Dokumente, die ein Synchronisierungsauftrag aus Ihrem Index löschen kann. Wenn bei einer Synchronisierung mehr als dieser Prozentsatz gelöscht werden würde, überspringt die Synchronisierung die Löschphase, sodass Ihre indizierten Dokumente erhalten bleiben. Wird für den benutzerdefinierten Connector nicht unterstützt.

    • mediaExtractionConfiguration(optional) — Konfiguration zum Extrahieren von Medien (Bilder, Audio, Video) aus Datenquellendateien. Enthält drei Unterkonfigurationen, die Sie unabhängig voneinander aktivieren können:

      • imageExtractionConfiguration(optional) — Verarbeitet, extrahiert und indexiert Inhalte aus eigenständigen Bilddateien (.png, .jpg, .jpeg, .jpe, .tif, .tiff, .gif, .bmp, .webp, .svg, .jp2, .heic) und eingebetteten Grafiken in .pdf-, .docx-, .ppt-, .pptx-Dateien.

      • audioExtractionConfiguration(optional) — Verarbeitet, extrahiert und indexiert Inhalte aus unterstützten Audiodateien (.mp3, .wav, .m4a, .flac, .ogg).

      • videoExtractionConfiguration(optional) — Verarbeitet, extrahiert und indexiert Inhalte aus unterstützten Videodateien (.mp4, .mov, .m4v).

      Die vollständige Feldreferenz finden Sie MediaExtractionConfiguration in der Amazon Bedrock API-Referenz.

Optionale Felder:

Feld Description
description Geben Sie eine Beschreibung für die Datenquelle ein.
vectorIngestionConfiguration Enthält Konfigurationen zum Anpassen des Erfassungsprozesses. Weitere Informationen finden Sie unter So passen Sie die Aufnahme für eine Datenquelle an.
clientToken Zur Sicherstellung, dass die API-Anfrage nur einmal durchgeführt wird. Weitere Informationen finden Sie unter Sicherstellen von Idempotenz.

Das folgende Beispiel zeigt eine CreateDataSource Anfrage mit einem S3-Connector:

{ "knowledgeBaseId": "your-knowledge-base-id", "name": "my-s3-data-source", "description": "S3 data source for my managed knowledge base", "dataSourceConfiguration": { "type": "MANAGED_KNOWLEDGE_BASE_CONNECTOR", "managedKnowledgeBaseConnectorConfiguration": { "mediaExtractionConfiguration": { "imageExtractionConfiguration": { "imageExtractionStatus": "ENABLED" } }, "deletionProtectionConfiguration": { "deletionProtectionStatus": "ENABLED", "deletionProtectionThreshold": 15 }, "connectorParameters": { "type": "S3", "version": "1", "connectionConfiguration": { "bucketName": "my-bucket-name", "bucketOwnerAccountId": "123456789012" }, "filterConfiguration": { "maxFileSizeInMegaBytes": "50" } } } } }

Um mehr über einen bestimmten Connector und seine Konfiguration zu erfahren, wählen Sie unten ein Thema aus.