View a markdown version of this page

Cos’è Amazon Data Firehose? - Amazon Data Firehose

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

Cos’è Amazon Data Firehose?

Amazon Data Firehose è un servizio completamente gestito per la distribuzione di dati in streaming in tempo reale verso destinazioni come Amazon Simple Storage Service (Amazon S3), Amazon Redshift, Amazon OpenSearch Service, Amazon OpenSearch Serverless, Splunk, Apache Iceberg Tables e qualsiasi endpoint HTTP personalizzato o endpoint HTTP di proprietà di fornitori di servizi di terze parti supportati, tra cui Datadog, Dynatrace, MongoDB, New Relic, Coralogix ed Elastic. LogicMonitor Con Amazon Data Firehose, non è necessario scrivere applicazioni o gestire risorse. Tu configuri i tuoi produttori di dati per inviare dati ad Amazon Data Firehose, che li consegna automaticamente alla destinazione specificata. Puoi anche configurare Amazon Data Firehose per trasformare i tuoi dati prima di consegnarli.

Per ulteriori informazioni sulle soluzioni per i AWS big data, consulta Big Data on AWS. Per ulteriori informazioni sulle soluzioni AWS per i dati in streaming, consulta Cosa sono i dati in streaming?

Scopri i concetti chiave

Quando inizi a usare Amazon Data Firehose, puoi trarre vantaggio dalla comprensione dei seguenti concetti.

Flusso Firehose

L'entità sottostante di Amazon Data Firehose. Utilizzi Amazon Data Firehose creando uno stream Firehose e quindi inviandogli dati. Per ulteriori informazioni, consulta Tutorial: Creare uno stream Firehose dalla console e Inviare dati a uno stream Firehose.

Registra

I dati di interesse che il produttore di dati invia a uno stream Firehose. Un record può avere una dimensione massima di 1.000 KB.

Produttore di dati

I produttori inviano i record agli stream Firehose. Ad esempio, un server Web che invia dati di registro a uno stream Firehose è un produttore di dati. Puoi anche configurare il tuo stream Firehose per leggere automaticamente i dati da un flusso di dati Kinesis esistente e caricarli nelle destinazioni. Per ulteriori informazioni, consulta Inviare dati a uno stream Firehose.

Dimensione del buffer e intervallo del buffer

Amazon Data Firehose memorizza nel buffer i dati in streaming in entrata fino a una determinata dimensione o per un determinato periodo di tempo prima di inviarli alle destinazioni. Buffer Sizeè in MB ed Buffer Interval è in secondi.

Comprendi il flusso di dati in Amazon Data Firehose

Per le destinazioni Amazon S3, i dati in streaming vengono distribuiti sul bucket S3. Se è abilitata la trasformazione dei dati, puoi scegliere di eseguire il backup dei dati di origine su un altro bucket Amazon S3.

Un diagramma che mostra il flusso di dati di Amazon Data Firehose per Amazon S3.

Per le destinazioni Amazon Redshift, i dati in streaming vengono distribuiti prima sul bucket S3. Amazon Data Firehose emette quindi un COPY comando Amazon Redshift per caricare i dati dal bucket S3 al cluster Amazon Redshift. Se è abilitata la trasformazione dei dati, puoi scegliere di eseguire il backup dei dati di origine su un altro bucket Amazon S3.

Un diagramma che mostra il flusso di dati di Amazon Data Firehose per Amazon Redshift.

Per le destinazioni di OpenSearch servizio, i dati in streaming vengono inviati al cluster OpenSearch di servizi e, facoltativamente, possono essere sottoposti a backup contemporaneamente nel bucket S3.

Un diagramma che mostra il flusso di dati di Amazon Data Firehose per Service. OpenSearch

Per le destinazioni Splunk, i dati in streaming vengono distribuiti su Splunk e se ne può eseguire contemporaneamente il backup sul bucket S3.

Un diagramma che mostra il flusso di dati di Amazon Data Firehose per Splunk.