Monitoramento da capacidade do índice vetorial
Para monitorar o consumo de capacidade para operações de índice vetorial, defina o parâmetro ReturnConsumedCapacity como INDEXES ou TOTAL em suas solicitações de SearchVectors, ou como INDEXES em suas solicitações de API de gravação.
As operações de índice vetorial são medidas em duas unidades, separadas das unidades de capacidade de leitura e gravação usadas pela tabela de base:
-
Pesquisa vetorial (VS): a unidade que mede as operações de
SearchVectors. O consumo de VS é relatado comoVectorSearchRequestBytese é dimensionado de acordo com o tamanho dos dados vetoriais que a pesquisa examina e retorna. -
Gravação vetorial (VWR): a unidade que mede as gravações replicadas em um índice vetorial. O consumo da VWR é relatado como
VectorWriteRequestBytese é dimensionado de acordo com o tamanho dos dados replicados no índice.
O exemplo a seguir mostra a ConsumedCapacity retornada por uma solicitação de SearchVectors.
{ "ConsumedCapacity": { "VectorSearchRequestBytes": 41714.0 } }
Para operações de gravação (PutItem, UpdateItem, DeleteItem, BatchWriteItem, TransactWriteItems), a resposta inclui um mapa VectorIndexes em ConsumedCapacity, indexado pelo nome do índice. Cada entrada relata VectorWriteRequestBytes para a capacidade consumida ao replicar as alterações em cada índice vetorial.
{ "ConsumedCapacity": { "TableName": "Products", "CapacityUnits": 5.0, "Table": { "CapacityUnits": 5.0 }, "VectorIndexes": { "ProductEmbeddingIndex": { "VectorWriteRequestBytes": 4125.0 } } } }
A capacidade do índice vetorial é medida em bytes processados, relatada separadamente da capacidade de leitura e gravação da tabela de base. Use esses campos para entender o que impulsiona o custo do índice vetorial:
-
O custo da pesquisa (
VectorSearchRequestBytes) é dimensionado principalmente com o tamanho dos vetores que a pesquisa deve examinar, o que aumenta com o número de dimensões no índice e a quantidade de dados retornados. Restringir uma pesquisa a um único valor de chave de partição reduz a quantidade de dados examinados. Retornar o atributo vetorial nos resultados aumenta ainda mais o custo porque a resposta inclui os dados vetoriais completos. -
O custo de gravação (
VectorWriteRequestBytes) ocorre toda vez que você grava, atualiza ou exclui um item que altera um atributo indexado por vetores e é dimensionado de acordo com o tamanho dos dados replicados no índice. As gravações que não alteram um atributo indexado não incorrem na capacidade de gravação vetorial.
Incorporações de maior dimensão aumentam o custo de pesquisa e gravação porque cada vetor carrega mais dados. Para obter os preços atuais, consulte os preços do Amazon DynamoDB
O DynamoDB também publica a capacidade do índice vetorial no CloudWatch como as métricas VectorSearchRequestBytes e VectorWriteRequestBytes, dimensionadas por TableName e VectorIndexName. Use essas métricas para criar gráficos e alertas sobre o uso do índice vetorial ao longo do tempo. Para obter definições de métricas, consulte VectorSearchRequestBytes e VectorWriteRequestBytes.