Consideraciones de almacenamiento para los índices vectoriales
Un índice vectorial consume almacenamiento de forma independiente de su tabla base. El almacenamiento que utiliza un índice vectorial viene determinado por los siguientes factores:
-
Datos vectoriales: cada elemento indexado almacena su vector como valores de punto flotante de 32 bits (f32). El almacenamiento de la parte vectorial de un elemento se escala con el número de dimensiones del índice. Por ejemplo, un vector de 1536 dimensiones utiliza aproximadamente cuatro veces el almacenamiento vectorial de un vector de 384 dimensiones.
-
Atributos proyectados: la proyección que elija controla qué atributos de la tabla base que se copian en el índice.
KEYS_ONLYalmacena la menor cantidad de datos,INCLUDEalmacena los atributos de claves más los atributos que no son de claves que indique yALLalmacena todos los atributos. Una proyección más amplia aumenta el almacenamiento de índices. -
Número de elementos indexados: solo los elementos que contienen un atributo vectorial válido (y, si el índice define una clave de partición, ese atributo de clave de partición) se replican en el índice. Los elementos a los que les falta el atributo vectorial no consumen el almacenamiento del índice vectorial.
Para controlar el almacenamiento de índices vectoriales, elija el menor número de dimensiones que se adapte a sus necesidades de relevancia y proyecte solo los atributos que la aplicación lea directamente de los resultados de búsqueda. Para conocer los precios de almacenamiento actuales, consulte los precios de Amazon DynamoDB