Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.
Verbinden einer Datenquelle
Nachdem Sie die Konfigurationen für Ihre Wissensdatenbank abgeschlossen haben, verbinden Sie eine unterstützte Datenquelle mit der Wissensdatenbank.
Von Amazon Bedrock verwaltete Wissensdatenbanken unterstützen die Verbindung zu unstrukturierten Datenquellen. Wählen Sie ein Thema aus, um zu erfahren, wie Sie eine Verbindung zu dieser Art von Datenquelle herstellen können:
Anmerkung
Bei verwalteten Wissensdatenbanken ist der CreateDataSource Vorgang asynchron. Der Status der Datenquelle wechselt von CREATING zu, AVAILABLE wenn der Vorgang abgeschlossen ist.
Um zu erfahren, wie Sie mithilfe der Amazon-Bedrock-Konsole eine Verbindung zu einer Datenquelle herstellen, wählen Sie unten auf dieser Seite das Thema für Ihren Datenquellentyp aus:
Um mithilfe der Amazon Bedrock-API eine Verbindung zu einer Datenquelle herzustellen, senden Sie eine CreateDataSource Anfrage an einen Laufzeitendpunkt von Agents for Amazon Bedrock.
Erforderliche Felder:
| Feld | Description |
|---|---|
knowledgeBaseId |
Die Kennung der Wissensdatenbank. |
name |
Ein Name für die Datenquelle. |
dataSourceConfiguration |
Geben Sie den Datenquellentyp in dem type Feld an und fügen Sie die entsprechende Konfiguration hinzu. Weitere Informationen zu Connector-spezifischen Konfigurationen erhalten Sie, indem Sie das Thema für den Connector aus den Themen unten auf dieser Seite auswählen. |
Darin dataSourceConfiguration müssen Sie Folgendes angeben:
-
type– Der Wert mussMANAGED_KNOWLEDGE_BASE_CONNECTORsein. -
managedKnowledgeBaseConnectorConfiguration— Konfiguration für den Connector. Enthält die folgenden Felder:-
connectorParameters(erforderlich) — Enthält eintypeFeld, das den Konnektortyp angibt, und ein erforderlichesversionFeld mit der Einstellung1. Unterstützte Typwerte sindS3ONEDRIVECONFLUENCE,SHAREPOINT,WEB_CRAWLER, undGOOGLE_DRIVE. Die übrigen FelderconnectorParametersunterscheiden sich je nach Konnektortyp. Weitere Informationen finden Sie auf den einzelnen Datenkonnektorseiten. -
deletionProtectionConfiguration(optional) — Ein Schutz vor versehentlichem Massenlöschen indizierter Inhalte. EnthältdeletionProtectionStatus(ENABLEDoderDISABLED) und, wenn aktiviert, ein optionalesdeletionProtectionThreshold(0—100, Standardeinstellung 15). Der Schwellenwert ist der maximale Prozentsatz der Dokumente, die ein Synchronisierungsauftrag aus Ihrem Index löschen kann. Wenn bei einer Synchronisierung mehr als dieser Prozentsatz gelöscht werden würde, überspringt die Synchronisierung die Löschphase, sodass Ihre indizierten Dokumente erhalten bleiben. Wird für den benutzerdefinierten Connector nicht unterstützt. -
mediaExtractionConfiguration(optional) — Konfiguration zum Extrahieren von Medien (Bilder, Audio, Video) aus Datenquellendateien. Enthält drei Unterkonfigurationen, die Sie unabhängig voneinander aktivieren können:-
imageExtractionConfiguration(optional) — Verarbeitet, extrahiert und indexiert Inhalte aus eigenständigen Bilddateien (.png, .jpg, .jpeg, .jpe, .tif, .tiff, .gif, .bmp, .webp, .svg, .jp2, .heic) und eingebetteten Grafiken in .pdf-, .docx-, .ppt-, .pptx-Dateien. -
audioExtractionConfiguration(optional) — Verarbeitet, extrahiert und indexiert Inhalte aus unterstützten Audiodateien (.mp3, .wav, .m4a, .flac, .ogg). -
videoExtractionConfiguration(optional) — Verarbeitet, extrahiert und indexiert Inhalte aus unterstützten Videodateien (.mp4, .mov, .m4v).
Die vollständige Feldreferenz finden Sie MediaExtractionConfiguration in der Amazon Bedrock API-Referenz.
-
-
Optionale Felder:
| Feld | Description |
|---|---|
description |
Geben Sie eine Beschreibung für die Datenquelle ein. |
vectorIngestionConfiguration |
Enthält Konfigurationen zum Anpassen des Erfassungsprozesses. Weitere Informationen finden Sie unter So passen Sie die Aufnahme für eine Datenquelle an. |
clientToken |
Zur Sicherstellung, dass die API-Anfrage nur einmal durchgeführt wird. Weitere Informationen finden Sie unter Sicherstellen von Idempotenz. |
Das folgende Beispiel zeigt eine CreateDataSource Anfrage mit einem S3-Connector:
{ "knowledgeBaseId": "your-knowledge-base-id", "name": "my-s3-data-source", "description": "S3 data source for my managed knowledge base", "dataSourceConfiguration": { "type": "MANAGED_KNOWLEDGE_BASE_CONNECTOR", "managedKnowledgeBaseConnectorConfiguration": { "mediaExtractionConfiguration": { "imageExtractionConfiguration": { "imageExtractionStatus": "ENABLED" } }, "deletionProtectionConfiguration": { "deletionProtectionStatus": "ENABLED", "deletionProtectionThreshold": 15 }, "connectorParameters": { "type": "S3", "version": "1", "connectionConfiguration": { "bucketName": "my-bucket-name", "bucketOwnerAccountId": "123456789012" }, "filterConfiguration": { "maxFileSizeInMegaBytes": "50" } } } } }
Um mehr über einen bestimmten Connector und seine Konfiguration zu erfahren, wählen Sie unten ein Thema aus.