View a markdown version of this page

벡터 인덱스 용량 모니터링 - Amazon DynamoDB

벡터 인덱스 용량 모니터링

벡터 인덱스 작업의 용량 소비를 모니터링하려면 ReturnConsumedCapacity 파라미터를 SearchVectors 요청에서 INDEXES 또는 TOTAL로 설정하거나 쓰기 API 요청에서 INDEXES로 설정합니다.

벡터 인덱스 작업은 기본 테이블에서 사용하는 읽기 및 쓰기 용량 단위와 별도로 두 단위로 측정됩니다.

  • 벡터 검색(VS)SearchVectors 작업을 측정하는 단위입니다. VS 소비는 VectorSearchRequestBytes로 보고되며 검색이 검사 및 반환하는 벡터 데이터의 크기에 따라 달라집니다.

  • 벡터 쓰기(VWR) – 벡터 인덱스에 복제된 쓰기를 측정하는 단위입니다. VWR 소비는 VectorWriteRequestBytes로 보고되며 인덱스에 복제된 데이터의 크기에 따라 달라집니다.

다음 예제는 SearchVectors 요청에 의해 반환된 ConsumedCapacity를 보여줍니다.

{ "ConsumedCapacity": { "VectorSearchRequestBytes": 41714.0 } }

쓰기 작업(PutItem, UpdateItem, DeleteItem, BatchWriteItem, TransactWriteItems)의 경우 응답에는 인덱스 이름을 키로 하는 ConsumedCapacityVectorIndexes 맵이 포함됩니다. 각 항목은 각 벡터 인덱스에 대한 변경 사항을 복제할 때 사용된 용량에 대해 VectorWriteRequestBytes를 보고합니다.

{ "ConsumedCapacity": { "TableName": "Products", "CapacityUnits": 5.0, "Table": { "CapacityUnits": 5.0 }, "VectorIndexes": { "ProductEmbeddingIndex": { "VectorWriteRequestBytes": 4125.0 } } } }

벡터 인덱스 용량은 처리된 바이트 단위로 측정되며 기본 테이블 읽기 및 쓰기 용량과 별도로 보고됩니다. 다음 필드를 사용하여 벡터 인덱스 비용의 요인을 파악합니다.

  • 검색 비용(VectorSearchRequestBytes)은 기본적으로 검색이 검사해야 하는 벡터의 크기에 따라 달라지며, 인덱스의 차원 수와 반환되는 데이터의 양에 따라 증가합니다. 검색을 단일 파티션 키 값으로 제한하면 검사되는 데이터의 양이 줄어듭니다. 결과에서 벡터 속성을 반환하면 응답에 전체 벡터 데이터가 포함되므로 비용이 증가합니다.

  • 쓰기 비용(VectorWriteRequestBytes)은 벡터 인덱스 속성을 변경하는 항목을 작성, 업데이트 또는 삭제할 때마다 발생하며, 인덱스에 복제된 데이터의 크기에 따라 달라집니다. 인덱싱된 속성을 변경하지 않는 쓰기에는 벡터 쓰기 용량이 발생하지 않습니다.

고차원 임베딩은 각 벡터에 더 많은 데이터가 포함되어 있으므로 검색 및 쓰기 비용이 모두 증가합니다. 현재 요금은 AWS 웹 사이트의 Amazon DynamoDB 요금을 참조하세요.

또한 DynamoDB는 벡터 인덱스 용량을 TableNameVectorIndexName 차원의 VectorSearchRequestBytesVectorWriteRequestBytes 지표로 CloudWatch에 게시합니다. 이러한 지표를 사용하여 시간 경과에 따른 벡터 인덱스 사용량을 차트로 표시하고 경보를 설정합니다. 지표 정의는 VectorSearchRequestBytesVectorWriteRequestBytes 섹션을 참조하세요.