View a markdown version of this page

Connettere un’origine dati - Amazon Bedrock

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

Connettere un’origine dati

Dopo aver completato le configurazioni per la knowledge base, connettere alla knowledge base un’origine dati supportata.

Le knowledge base gestite di Amazon Bedrock supportano la connessione a fonti di dati non strutturate. Selezionare un argomento per scoprire come connettersi a quel tipo di origine dati:

Nota

Per le knowledge base gestite, l'CreateDataSourceoperazione è asincrona. Lo stato dell'origine dati passa da CREATING a AVAILABLE quando l'operazione viene completata.

Per informazioni su come connettersi a un’origine dati utilizzando la console Amazon Bedrock, selezionare l’argomento corrispondente al tipo di origine dati in fondo a questa pagina:

Per connetterti a un'origine dati utilizzando l'API Amazon Bedrock, invia una CreateDataSource richiesta con un endpoint di runtime Agents for Amazon Bedrock.

Campi obbligatori:

Campo Description
knowledgeBaseId L’ID della knowledge base.
name Un nome per l'origine dati.
dataSourceConfiguration Specifica il tipo di origine dati nel type campo e includi la configurazione corrispondente. Per maggiori dettagli sulle configurazioni specifiche del connettore, seleziona l'argomento relativo al connettore dagli argomenti in fondo a questa pagina.

All'internodataSourceConfiguration, è necessario specificare quanto segue:

  • type — Deve essere MANAGED_KNOWLEDGE_BASE_CONNECTOR.

  • managedKnowledgeBaseConnectorConfiguration— Configurazione del connettore. Contiene i seguenti campi:

    • connectorParameters(obbligatorio) — Contiene un type campo che specifica il tipo di connettore e un version campo obbligatorio impostato 1 su. I valori di tipo supportati sono S3ONEDRIVE,CONFLUENCE, SHAREPOINTWEB_CRAWLER, eGOOGLE_DRIVE. I campi rimanenti connectorParameters differiscono in base al tipo di connettore: consulta la pagina di ciascun connettore dati per maggiori dettagli.

    • deletionProtectionConfiguration(opzionale): protezione contro l'eliminazione accidentale in blocco dei contenuti indicizzati. Contiene deletionProtectionStatus (ENABLEDoDISABLED) e, se abilitato, un valore opzionale deletionProtectionThreshold (0—100, il valore predefinito è 15). La soglia è la percentuale massima di documenti che un processo di sincronizzazione può eliminare dall'indice. Se una sincronizzazione elimina più di questa percentuale, la sincronizzazione salta la fase di eliminazione, lasciando i documenti indicizzati al loro posto. Non supportato per il connettore personalizzato.

    • mediaExtractionConfiguration(opzionale): configurazione per l'estrazione di file multimediali (immagini, audio, video) dai file di origine dati. Contiene tre sottoconfigurazioni che puoi abilitare indipendentemente:

      • imageExtractionConfiguration(opzionale) — Elabora, estrae e indicizza il contenuto da file di immagine autonomi (.png, .jpg, .jpeg, .jpe, .tif, .tiff, .gif, .bmp, .webp, .svg, .jp2, .heic) e immagini incorporate nei file .pdf, .docx, .ppt, .pptx.

      • audioExtractionConfiguration(opzionale) — Elabora, estrae e indicizza il contenuto dai file audio supportati (.mp3, .wav, .m4a, .flac, .ogg).

      • videoExtractionConfiguration(opzionale) — Elabora, estrae e indicizza il contenuto dai file video supportati (.mp4, .mov, .m4v).

      Per il riferimento completo sul campo, consulta Amazon Bedrock API Reference. MediaExtractionConfiguration

    • syncSchedule(opzionale): imposta una pianificazione ricorrente in base alla quale Amazon Bedrock sincronizza automaticamente l'origine dati. Specifica esattamente una delle seguenti opzioni:

      • daily— Un oggetto vuoto. Si sincronizza una volta al giorno in un orario non di punta scelto dal sistema.

      • weekly— Contiene un dayOfWeek campo obbligatorio, con un valore compreso tra e. SUNDAY SATURDAY

      • monthly— Contiene un dayOfMonth campo obbligatorio, che contiene un valore dayNumber compreso tra 1 e 28 o un lastDayOfMonth oggetto vuoto.

      Ometti syncSchedule di sincronizzare solo su richiesta. Per ulteriori informazioni, consulta Impostare una pianificazione di sincronizzazione per un'origine dati.

Campi opzionali:

Campo Description
description Fornisci una descrizione per l'origine dati.
vectorIngestionConfiguration Contiene configurazioni per personalizzare il processo di ingestione. Per ulteriori informazioni, consulta Personalizzare l’importazione per un’origine dati.
clientToken Per garantire che la richiesta API venga completata solo una volta. Per ulteriori informazioni, consulta Garanzia di idempotenza.

L'esempio seguente mostra una CreateDataSource richiesta con un connettore S3:

{ "knowledgeBaseId": "your-knowledge-base-id", "name": "my-s3-data-source", "description": "S3 data source for my managed knowledge base", "dataSourceConfiguration": { "type": "MANAGED_KNOWLEDGE_BASE_CONNECTOR", "managedKnowledgeBaseConnectorConfiguration": { "mediaExtractionConfiguration": { "imageExtractionConfiguration": { "imageExtractionStatus": "ENABLED" } }, "deletionProtectionConfiguration": { "deletionProtectionStatus": "ENABLED", "deletionProtectionThreshold": 15 }, "syncSchedule": { "weekly": { "dayOfWeek": "MONDAY" } }, "connectorParameters": { "type": "S3", "version": "1", "connectionConfiguration": { "bucketName": "my-bucket-name", "bucketOwnerAccountId": "123456789012" }, "filterConfiguration": { "maxFileSizeInMegaBytes": "50" } } } } }

Per saperne di più su un connettore specifico e sulla sua configurazione, seleziona un argomento di seguito.

Per le origini dati di terze parti che supportano la configurazione gestita dall'utente (3LO)SharePoint, ad esempioOneDrive, eConfluence, sono necessarie AWS Identity and Access Management autorizzazioni specifiche per accedere. Per ulteriori informazioni, consulta Autorizzazioni IAM per la configurazione gestita dall'utente (3LO).