Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.
Buat basis pengetahuan untuk konten multimodal
Anda dapat membuat basis pengetahuan multimodal menggunakan konsol atau API. Pilih pendekatan Anda berdasarkan kebutuhan pemrosesan multimodal Anda.
penting
Dukungan multimodal hanya tersedia saat membuat basis pengetahuan dengan sumber data tidak terstruktur. Sumber data terstruktur tidak mendukung pemrosesan konten multimodal.
- Console
-
Untuk membuat basis pengetahuan multimodal dari konsol
-
Masuk ke Konsol Manajemen AWS dengan identitas IAM yang memiliki izin untuk menggunakan konsol Amazon Bedrock. Kemudian, buka konsol Amazon Bedrock di https://console.aws.amazon.com/bedrock
. -
Di panel navigasi kiri, pilih Bas is pengetahuan.
-
Di bagian Basis pengetahuan, pilih Buat, lalu pilih Pangkalan Pengetahuan dengan penyimpanan vektor.
-
(Opsional) Di bawah Detail Pangkalan Penget ahuan, ubah nama default dan berikan deskripsi untuk basis pengetahuan Anda.
-
Di bawah izin IAM, pilih peran IAM yang memberikan izin Amazon Bedrock untuk mengakses lainnya yang diperlukan. Layanan AWS Anda dapat meminta Amazon Bedrock membuat peran layanan untuk Anda, atau Anda dapat memilih untuk menggunakan peran khusus Anda sendiri. Untuk izin multimodal, lihatIzin untuk konten multimodal.
-
Pilih Amazon S3 sebagai sumber data Anda dan pilih Ber ikutnya untuk mengonfigurasi sumber data Anda.
catatan
Anda dapat menambahkan hingga 5 sumber data Amazon S3 selama pembuatan basis pengetahuan. Sumber data tambahan dapat ditambahkan setelah basis pengetahuan dibuat.
-
Berikan URI S3 dari bucket yang berisi konten multimodal Anda dan konfigurasikan awalan inklusi jika diperlukan. Awalan inklusi adalah jalur folder yang dapat digunakan untuk membatasi konten apa yang dicerna.
-
Di bawah konfigurasi Chunking dan parsing, pilih strategi penguraian Anda:
-
Pengurai default Bedrock: Direkom endasikan untuk pemrosesan konten hanya teks. Parser ini memproses format teks umum sambil mengabaikan file multimodal. Mendukung dokumen teks termasuk file Word, Excel, HTML, Markdown, TXT, dan CSV.
-
Bedrock Data Automation (BDA): Meng konversi konten multimodal ke representasi teks yang dapat dicari. Memproses file PDF, gambar, audio, dan video untuk mengekstrak teks, menghasilkan deskripsi untuk konten visual, dan membuat transkripsi untuk konten audio dan video.
-
Parser model dasar: Men yediakan kemampuan parsing lanjutan untuk struktur dokumen yang kompleks. Memproses PDF, gambar, dokumen terstruktur, tabel, dan konten yang kaya secara visual untuk mengekstrak teks dan menghasilkan deskripsi untuk elemen visual.
-
-
Pilih Berikutnya dan pilih model embedding dan pendekatan pemrosesan multimodal Anda.
-
Amazon Nova Multimodal Embeddings V1.0: Pilih penyematan Amazon Nova V1.0 untuk pencarian kesamaan visual dan audio langsung. Konfigurasikan durasi potongan audio dan video (1-30 detik, default 5 detik) untuk mengontrol bagaimana konten tersegmentasi.
catatan
Parameter pemotongan audio dan video dikonfigurasi pada tingkat model penyematan, bukan pada tingkat sumber data. Pengecualian validasi terjadi jika Anda menyediakan konfigurasi ini untuk model penyematan non-multimodal. Konfigurasikan durasi potongan audio dan video (default: 5 detik, rentang: 1-30 detik) untuk mengontrol bagaimana konten tersegmentasi. Potongan yang lebih pendek memungkinkan pengambilan konten yang tepat sementara potongan yang lebih panjang mempertahankan konteks semantik yang lebih banyak.
penting
Amazon Nova embedding v1.0 memiliki dukungan terbatas untuk mencari konten ucapan dalam audio/video data. Jika Anda perlu mendukung ucapan, gunakan Bedrock Data Automation sebagai parser.
-
Penyematan teks dengan BDA: Pilih model penyematan teks (seperti Titan Text Embeddings v2) saat menggunakan pemrosesan BDA. Model penyematan teks membatasi pengambilan ke konten teks saja, tetapi Anda dapat mengaktifkan pengambilan multimodal dengan memilih Otomasi Amazon Bedrock Data atau Model Dasar sebagai parser.
catatan
Jika Anda menggunakan parser BDA dengan Nova Multimodal Embeddings, Amazon Bedrock Knowledge Bases akan menggunakan penguraian BDA terlebih dahulu. Dalam hal ini, model embedding tidak akan menghasilkan penyematan multimodal asli untuk gambar, audio, dan video karena BDA mengonversinya menjadi representasi teks.
-
-
Jika menggunakan Nova Multimodal Embeddings, konfigurasikan tujuan penyimpanan Multimodal dengan menentukan bucket Amazon S3 tempat file yang diproses akan disimpan untuk diambil. Basis Pengetahuan akan menyimpan gambar yang diurai ke dalam satu bucket Amazon S3 dengan folder yang dibuat .bda untuk akses mudah.
Rekomendasi kebijakan siklus hidup
Saat menggunakan Nova Multimodal Embeddings, Amazon Bedrock menyimpan data sementara di tujuan penyimpanan multimodal Anda dan mencoba menghapusnya setelah pemrosesan selesai. Sebaiknya terapkan kebijakan siklus hidup pada jalur data sementara untuk memastikan pembersihan yang tepat. Untuk petunjuk mendetail, lihat Mengelola data transien dengan kebijakan siklus hidup Amazon S3.
-
Di bagian database vektor, pilih metode penyimpanan vektor Anda dan konfigurasikan dimensi yang sesuai berdasarkan model penyematan yang Anda pilih.
-
Pilih Berikutnya dan tinjau detail konfigurasi basis pengetahuan Anda, lalu pilih Buat basis pengetahuan.
-
- CLI
-
Untuk membuat basis pengetahuan multimodal menggunakan AWS CLI
-
Buat basis pengetahuan dengan Nova Multimodal Embeddings. Kirim
CreateKnowledgeBasepermintaan:aws bedrock-agent create-knowledge-base \ --cli-input-json file://kb-nova-mme.jsonIsi
kb-nova-mme.json(ganti nilai placeholder dengan konfigurasi spesifik Anda):{ "knowledgeBaseConfiguration": { "vectorKnowledgeBaseConfiguration": { "embeddingModelArn": "arn:aws:bedrock:us-east-1::foundation-model/amazon.nova-2-multimodal-embeddings-v1:0", "supplementalDataStorageConfiguration": { "storageLocations": [ { "type": "S3", "s3Location": { "uri": "s3://<multimodal-storage-bucket>/" } } ] } }, "type": "VECTOR" }, "storageConfiguration": { "opensearchServerlessConfiguration": { "collectionArn": "arn:aws:aoss:us-east-1:<account-id>:collection/<collection-id>", "vectorIndexName": "<index-name>", "fieldMapping": { "vectorField": "<vector-field>", "textField": "<text-field>", "metadataField": "<metadata-field>" } }, "type": "OPENSEARCH_SERVERLESS" }, "name": "<knowledge-base-name>", "description": "Multimodal knowledge base with Nova Multimodal Embeddings" }Ganti placeholder berikut:
-
<multimodal-storage-bucket>- Bucket S3 untuk menyimpan file multimodal -
<account-id>- ID AWS akun Anda -
<collection-id>- OpenSearch ID koleksi tanpa server -
<index-name>- Nama indeks vektor dalam OpenSearch koleksi Anda (dikonfigurasi dengan dimensi yang sesuai untuk model penyematan pilihan Anda) -
<vector-field>- Nama bidang untuk menyimpan embeddings -
<text-field>- Nama bidang untuk menyimpan konten teks -
<metadata-field>- Nama bidang untuk menyimpan metadata
-
-