View a markdown version of this page

Considerações sobre armazenamento para índices vetoriais - Amazon DynamoDB

Considerações sobre armazenamento para índices vetoriais

Um índice vetorial consome armazenamento separadamente da tabela de base. O armazenamento usado por um índice vetorial é determinado pelos seguintes fatores:

  • Dados vetoriais: cada item indexado armazena o vetor como valores de ponto flutuante de 32 bits (f32). O armazenamento da parte vetorial de um item é dimensionado com o número de dimensões no índice. Por exemplo, um vetor de 1.536 dimensões usa aproximadamente quatro vezes o armazenamento vetorial de um vetor de 384 dimensões.

  • Atributos projetados: a projeção que você escolhe controla quais atributos da tabela de base são copiados para o índice. KEYS_ONLY armazena o mínimo de dados, INCLUDE armazena os atributos-chave mais os atributos não essenciais que você nomeia e ALL armazena todos os atributos. Uma projeção mais ampla aumenta o armazenamento de índices.

  • Número de itens indexados: somente itens que contêm um atributo vetorial válido (e, se o índice definir uma chave de partição, esse atributo de chave de partição) são replicados para o índice. Itens sem o atributo vetorial não consomem armazenamento de índices vetoriais.

Para controlar o armazenamento de índices vetoriais, escolha o menor número de dimensões que satisfaça suas necessidades de relevância e projete somente os atributos que seu aplicativo lê diretamente dos resultados da pesquisa. Para obter os preços de armazenamento atuais, consulte os preços do Amazon DynamoDB no site da AWS.