벡터 인덱스 용량 모니터링
벡터 인덱스 작업의 용량 소비를 모니터링하려면 ReturnConsumedCapacity 파라미터를 SearchVectors 요청에서 INDEXES 또는 TOTAL로 설정하거나 쓰기 API 요청에서 INDEXES로 설정합니다.
벡터 인덱스 작업은 기본 테이블에서 사용하는 읽기 및 쓰기 용량 단위와 별도로 두 단위로 측정됩니다.
-
벡터 검색(VS) –
SearchVectors작업을 측정하는 단위입니다. VS 소비는VectorSearchRequestBytes로 보고되며 검색이 검사 및 반환하는 벡터 데이터의 크기에 따라 달라집니다. -
벡터 쓰기(VWR) – 벡터 인덱스에 복제된 쓰기를 측정하는 단위입니다. VWR 소비는
VectorWriteRequestBytes로 보고되며 인덱스에 복제된 데이터의 크기에 따라 달라집니다.
다음 예제는 SearchVectors 요청에 의해 반환된 ConsumedCapacity를 보여줍니다.
{ "ConsumedCapacity": { "VectorSearchRequestBytes": 41714.0 } }
쓰기 작업(PutItem, UpdateItem, DeleteItem, BatchWriteItem, TransactWriteItems)의 경우 응답에는 인덱스 이름을 키로 하는 ConsumedCapacity의 VectorIndexes 맵이 포함됩니다. 각 항목은 각 벡터 인덱스에 대한 변경 사항을 복제할 때 사용된 용량에 대해 VectorWriteRequestBytes를 보고합니다.
{ "ConsumedCapacity": { "TableName": "Products", "CapacityUnits": 5.0, "Table": { "CapacityUnits": 5.0 }, "VectorIndexes": { "ProductEmbeddingIndex": { "VectorWriteRequestBytes": 4125.0 } } } }
벡터 인덱스 용량은 처리된 바이트 단위로 측정되며 기본 테이블 읽기 및 쓰기 용량과 별도로 보고됩니다. 다음 필드를 사용하여 벡터 인덱스 비용의 요인을 파악합니다.
-
검색 비용(
VectorSearchRequestBytes)은 기본적으로 검색이 검사해야 하는 벡터의 크기에 따라 달라지며, 인덱스의 차원 수와 반환되는 데이터의 양에 따라 증가합니다. 검색을 단일 파티션 키 값으로 제한하면 검사되는 데이터의 양이 줄어듭니다. 결과에서 벡터 속성을 반환하면 응답에 전체 벡터 데이터가 포함되므로 비용이 증가합니다. -
쓰기 비용(
VectorWriteRequestBytes)은 벡터 인덱스 속성을 변경하는 항목을 작성, 업데이트 또는 삭제할 때마다 발생하며, 인덱스에 복제된 데이터의 크기에 따라 달라집니다. 인덱싱된 속성을 변경하지 않는 쓰기에는 벡터 쓰기 용량이 발생하지 않습니다.
고차원 임베딩은 각 벡터에 더 많은 데이터가 포함되어 있으므로 검색 및 쓰기 비용이 모두 증가합니다. 현재 요금은 AWS 웹 사이트의 Amazon DynamoDB 요금
또한 DynamoDB는 벡터 인덱스 용량을 TableName 및 VectorIndexName 차원의 VectorSearchRequestBytes 및 VectorWriteRequestBytes 지표로 CloudWatch에 게시합니다. 이러한 지표를 사용하여 시간 경과에 따른 벡터 인덱스 사용량을 차트로 표시하고 경보를 설정합니다. 지표 정의는 VectorSearchRequestBytes 및 VectorWriteRequestBytes 섹션을 참조하세요.