View a markdown version of this page

Almacenamiento - Amazon Neptune

Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.

Almacenamiento

Los datos de Neptune se almacenan en un volumen de clúster, que es un volumen virtual único que utiliza unidades Non-Volatile Memory Express (NVMe) SSD-based . El volumen del clúster se compone de un conjunto de bloques lógicos conocidos como segmentos. A cada uno de estos segmentos se le asignan 10 gigabytes (GB) de almacenamiento. Los datos de cada segmento se replican en tres zonas de disponibilidad (AZ) de una sola AWS región en la que reside el clúster de base de datos.

Cuando se crea un clúster de base de datos de Neptune, se le asigna un único segmento de 10 GB. A medida que el volumen de datos aumenta y supera el almacenamiento asignado actualmente, Neptune amplía automáticamente el volumen del clúster añadiendo nuevos segmentos. El volumen de un clúster de Neptune puede crecer hasta un tamaño máximo de 128 tebibytes (TiB) en todas las regiones compatibles, excepto en las regiones de China y las regiones AWS GovCloud (EE. UU.), donde está limitado a 64 TiB.

El volumen del clúster de base de datos contiene todos los datos de usuario, índices y diccionarios (que se describen en la Modelo de datos de gráficos de Neptune. sección), así como los metadatos internos, como los registros de transacciones internos. Todos estos datos de gráficos, incluidos índices y registros internos, no pueden superar el tamaño máximo del volumen del clúster.

I/O—Opción de almacenamiento optimizada

Neptune ofrece dos modelos de precios para el almacenamiento:

  • Almacenamiento estándar: el almacenamiento estándar proporciona almacenamiento de bases de datos rentable para aplicaciones con un I/O uso moderado o bajo.

  • I/O—Almacenamiento optimizado: con el almacenamiento I/O optimizado, solo paga por el almacenamiento que utiliza, a un costo mayor que el del almacenamiento estándar, y no paga nada por el I/O que usa.

    Con el I/O almacenamiento optimizado, obtiene costos predecibles, baja I/O latencia y un I/O rendimiento uniforme para cargas de trabajo gráficas intensivas I/O.

    Para obtener más información, consulte I/O —Almacenamiento optimizado.

Asignación de almacenamiento de Neptune

Si bien el volumen de un clúster de Neptune puede llegar a 128 TiB (o 64 TiB en algunas regiones), se le cobrará por el espacio asignado. El espacio total asignado lo determina el límite máximo de almacenamiento, que es la cantidad máxima asignada al volumen del clúster en cualquier momento de su existencia.

Esto significa que, aunque elimines datos de usuario de un volumen de clúster, por ejemplo, mediante una consulta de borradog.V().drop(), el espacio total asignado sigue siendo el mismo. Neptune optimiza automáticamente el espacio asignado no utilizado para reutilizarlo en el futuro.

Además de los datos de los usuarios, los datos del diccionario y los registros de transacciones internos también consumen espacio de almacenamiento. Los datos del diccionario se conservan incluso después de eliminar los datos gráficos compatibles, aunque Neptune puede volver a utilizar esas entradas si se vuelven a introducir los datos. Para borrar las entradas del diccionario no utilizadas, puede habilitarlas. Recopilación de elementos no utilizados en el diccionario Los registros internos utilizan un espacio de almacenamiento independiente con su propio límite máximo. Los registros caducados se reutilizan solo para otros registros, no para datos gráficos. El espacio asignado a los registros se incluye en el total indicado por la VolumeBytesUsed CloudWatch métrica.

Compruebe en Prácticas recomendadas de almacenamiento las formas de reducir al mínimo el almacenamiento asignado y de reutilizar el espacio.

Facturación del almacenamiento de Neptune

Los costos de almacenamiento se facturan en función del límite máximo de almacenamiento, tal como se describe en la sección anterior. Amazon Neptune replica sus datos en varias zonas de disponibilidad, pero usted paga solo por una copia de los datos.

Puede determinar cuál es el nivel máximo de almacenamiento actual de su clúster de base de datos monitorizando la VolumeBytesUsed CloudWatch métrica (consulteSupervisión de Neptune con Amazon CloudWatch).

Otros factores que pueden afectar a los costos de almacenamiento de Neptune son las copias de seguridad y las instantáneas de bases de datos, que se facturan por separado como almacenamiento de respaldo y se basan en los costos de almacenamiento de Neptune (consulte). CloudWatch métricas que son útiles para administrar el almacenamiento de copias de seguridad de Neptune

Sin embargo, si crea un clon de la base de datos, ese clon apunta al mismo volumen de clúster que utiliza el propio clúster de base de datos, por lo que no se cobrará ningún cargo adicional por el almacenamiento de los datos originales. Los cambios posteriores en el clon utilizan el protocolo de copia al escribir, lo que conlleva costos de almacenamiento adicionales.

Para obtener más información sobre los precios de Neptune, consulte los precios de Amazon Neptune en el sitio web. AWS

Prácticas recomendadas de almacenamiento de Neptune

Dado que ciertos tipos de datos consumen almacenamiento permanente en Neptune, utilice estas prácticas recomendadas para evitar grandes picos en el crecimiento del almacenamiento:

  • Al diseñar su modelo de datos de gráficos, evite en la medida de lo posible utilizar claves de propiedad y valores orientados al usuario que sean de naturaleza temporal.

  • Si tiene pensado realizar cambios en su modelo de datos, no cargue datos en un clúster de base de datos existente con el nuevo modelo hasta que haya borrado los datos de ese clúster de base de datos mediante la API de restablecimiento rápido. Lo mejor suele ser cargar los datos que utilizan un modelo nuevo en un clúster de base de datos nuevo.

  • Las transacciones que funcionan con grandes cantidades de datos generan registros internos proporcionalmente grandes, lo que puede aumentar permanentemente el límite máximo del espacio de registros interno. Por ejemplo, una sola transacción que borre todos los datos de su clúster de base de datos puede generar un registro interno de gran tamaño. Este registro requiere la asignación de una gran cantidad de almacenamiento interno, lo que reduce permanentemente el espacio disponible para los datos del gráfico.

    Para evitarlo, divida las transacciones grandes en otras más pequeñas y deje pasar tiempo entre ellas para que los registros internos asociados tengan la posibilidad de caducar y liberar su almacenamiento interno para que se reutilice en los registros posteriores.

  • Para monitorear el crecimiento del volumen de su clúster de Neptuno, puede configurar una CloudWatch alarma en la VolumeBytesUsed CloudWatch métrica. Esto puede resultar especialmente útil si los datos alcanzan el tamaño máximo del volumen del clúster. Para obtener más información, consulte Uso de CloudWatch las alarmas de Amazon.

Si su clúster de base de datos tiene una gran cantidad de espacio asignado sin usar, puede reducir su almacenamiento. Para ello, exporte todos los datos del gráfico y, a continuación, vuelva a cargarlos en un nuevo clúster de base de datos. Consulte el servicio y la utilidad de exportación de datos de Neptune para obtener una forma sencilla de exportar datos de un clúster de base de datos, y el cargador masivo de Neptune para volver a importar datos a Neptune de forma sencilla.

nota

La creación y restauración de una instantánea no reduce la cantidad de almacenamiento asignada al clúster de base de datos, ya que la instantánea conserva la imagen original del almacenamiento subyacente del clúster. Si no se está utilizando una cantidad sustancial del almacenamiento asignado, la única forma de reducirlo es exportar los datos de sus gráficos y volver a cargarlos en un nuevo clúster de base de datos.

Fiabilidad y alta disponibilidad del almacenamiento de Neptune

Amazon Neptune se ha diseñado para ofrecer fiabilidad, durabilidad y tolerancia a errores.

Dado que las copias de los datos de Neptune se mantienen en tres zonas de disponibilidad (AZ), el almacenamiento de los datos es muy duradero y la probabilidad de pérdida de datos es muy baja. Amazon Neptune replica los datos automáticamente en todas las zonas de disponibilidad, independientemente de si hay instancias de base de datos en ellas. La cantidad de réplicas es independiente del número de instancias de base de datos de su clúster.

Esto significa que puede añadir una réplica de lectura rápidamente, ya que Neptune no hace una nueva copia de los datos de los gráficos. En su lugar, la réplica de lectura se conecta al volumen del clúster que ya contiene sus datos. Del mismo modo, al eliminar una réplica de lectura, no se elimina ninguno de los datos subyacentes.

Puede eliminar el volumen del clúster y sus datos solo después de eliminar todas sus instancias de base de datos.

Neptune también detecta automáticamente los errores de los segmentos que integran el volumen de clúster. Cuando una copia de los datos de un segmento está dañada, Neptune repara inmediatamente ese segmento y utiliza otras copias de los datos dentro del mismo segmento para garantizar que los datos reparados estén actualizados. Como resultado, Neptune evita la pérdida de datos y reduce la necesidad de realizar restauraciones puntuales para recuperarse de una falla en el disco.