View a markdown version of this page

Supervisión de la capacidad de índices vectoriales - Amazon DynamoDB

Supervisión de la capacidad de índices vectoriales

Para supervisar el consumo de capacidad de las operaciones de indexación vectorial, defina el parámetro ReturnConsumedCapacity en INDEXES o TOTAL en las solicitudes SearchVectors, o en INDEXES en las solicitudes de API de escritura.

Las operaciones de indexación vectorial se miden en dos unidades, independientes de las unidades de capacidad de lectura y escritura que utiliza la tabla base:

  • Búsqueda vectorial (VS): la unidad que mide las operaciones SearchVectors. El consumo de VS se notifica como VectorSearchRequestBytes y se escala en función del tamaño de los datos vectoriales que examina y devuelve la búsqueda.

  • Escritura vectorial (VWR): la unidad que mide las escrituras replicadas en un índice vectorial. El consumo de VWR se notifica como VectorWriteRequestBytes y se escala en función del tamaño de los datos replicados en el índice.

En el ejemplo siguiente, se muestra la ConsumedCapacity devuelta por una solicitud SearchVectors.

{ "ConsumedCapacity": { "VectorSearchRequestBytes": 41714.0 } }

Para las operaciones de escritura (PutItem, UpdateItem, DeleteItem, BatchWriteItem, TransactWriteItems), la respuesta incluye un mapa de VectorIndexes en ConsumedCapacity, con clave por nombre de índice. Cada entrada informa de VectorWriteRequestBytes para la capacidad consumida al replicar los cambios en cada índice vectorial.

{ "ConsumedCapacity": { "TableName": "Products", "CapacityUnits": 5.0, "Table": { "CapacityUnits": 5.0 }, "VectorIndexes": { "ProductEmbeddingIndex": { "VectorWriteRequestBytes": 4125.0 } } } }

La capacidad del índice vectorial se mide en bytes procesados y se notifica de forma independiente de la capacidad de lectura y escritura de la tabla base. Utilice estos campos para entender qué es lo que determina el costo del índice vectorial:

  • El costo de búsqueda (VectorSearchRequestBytes) se escala principalmente en función del tamaño de los vectores que debe examinar la búsqueda, que aumenta con el número de dimensiones del índice y la cantidad de datos devueltos. Restringir una búsqueda a un único valor de clave de partición reduce la cantidad de datos examinados. La devolución del atributo vectorial en los resultados aumenta aún más el costo, ya que la respuesta incluye todos los datos vectoriales.

  • Se incurre en costos de escritura (VectorWriteRequestBytes) cada vez que se escribe, actualiza o elimina un elemento que cambia un atributo indexado por vectores y se escala en función del tamaño de los datos replicados en el índice. Las escrituras que no modifican un atributo indexado no generan capacidad de escritura vectorial.

Las incrustaciones de dimensiones más altas aumentan los costos de búsqueda y escritura porque cada vector contiene más datos. Para conocer los precios actuales, consulte los precios de Amazon DynamoDB en el sitio web de AWS.

DynamoDB también publica la capacidad de índices vectoriales en CloudWatch como las métricas VectorSearchRequestBytes y VectorWriteRequestBytes, dimensionadas por TableName y VectorIndexName. Utilice estas métricas para crear gráficos y generar alarmas sobre el uso de los índices vectoriales a lo largo del tiempo. Para ver las definiciones de métricas, consulte VectorSearchRequestBytes y VectorWriteRequestBytes.