

Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.

# aplikasi HBase spesifik untuk versi AMI sebelumnya dari Amazon EMR
<a name="emr-3x-hbase"></a>

## Versi HBase yang didukung
<a name="emr-3x-hbase-versions"></a>


| Versi HBase | Versi AMI | AWS CLI parameter konfigurasi | Detail versi HBase | 
| --- | --- | --- | --- | 
| [0.94.18 ](https://svn.apache.org/repos/asf/hbase/branches/0.94/CHANGES.txt) | 3.1.0 dan versi yang lebih baru | `--ami-version 3.1`<br />`--ami-version 3.2`<br />`--ami-version 3.3`<br />`--applications Name=HBase` |  +  Perbaikan bug dan penyempurnaan.   | 
| [0.94.7 ](https://svn.apache.org/repos/asf/hbase/branches/0.94/CHANGES.txt) | 3,0-3,0,4 | `--ami-version 3.0`<br />`--applications Name=HBase` | 
| [0.92 ](https://svn.apache.org/repos/asf/hbase/branches/0.92/CHANGES.txt) | 2.2 dan versi yang lebih baru | `--ami-version 2.2 or later`<br />`--applications Name=HBase` | 

## Prasyarat kluster HBase
<a name="emr-3x-hbase-prerequisites"></a>

Sebuah cluster dibuat menggunakan Amazon EMR AMI versi 2.x dan 3.x harus memenuhi persyaratan berikut untuk HBase.
+  AWS CLI (opsional) —Untuk berinteraksi dengan HBase menggunakan baris perintah, unduh dan instal versi terbaru dari. AWS CLI Untuk informasi selengkapnya, lihat [Menginstal AWS Command Line Interface](https://docs.aws.amazon.com/cli/latest/userguide/installing.html) dalam *AWS Command Line Interface Panduan Pengguna *.
+ Setidaknya dua contoh (opsional) —The cluster master node menjalankan HBase master server dan Zookeeper, dan node tugas menjalankan server wilayah HBase. Untuk kinerja terbaik, cluster HBase harus berjalan pada setidaknya dua contoh EC2, tetapi Anda dapat menjalankan HBase pada node tunggal untuk tujuan evaluasi. 
+ Long-running Cluster—HBase hanya berjalan pada cluster yang berjalan lama. Secara default, konsol CLI dan Amazon EMR membuat cluster lama berjalan. 
+ Sebuah key pair Amazon EC2 set (disarankan) -Untuk menggunakan protokol jaringan Secure Shell (SSH) untuk terhubung dengan node master dan menjalankan perintah shell HBase, Anda harus menggunakan key pair Amazon EC2 ketika Anda membuat cluster. 
+ Benar AMI dan Hadoop versi-HBase cluster saat ini didukung hanya pada Hadoop 20.205 atau kemudian. 
+ Ganglia (opsional) -Untuk memantau metrik kinerja HBase, instal Ganglia saat Anda membuat cluster. 
+ Sebuah bucket Amazon S3 untuk log (opsional)—Log untuk HBase tersedia pada simpul utama. Jika Anda ingin log ini disalin ke Amazon S3, tentukan bucket S3 untuk menerima file log saat Anda membuat kluster. 

## Membuat cluster dengan HBase
<a name="emr-3x-hbase-launch"></a>

Tabel berikut mencantumkan pilihan yang tersedia saat menggunakan konsol untuk membuat sebuah cluster dengan HBase menggunakan versi rilis Amazon EMR AMI.


| Bidang | Tindakan | 
| --- | --- | 
| Pulihkan dari cadangan  | Tentukan apakah akan pre-load klaster HBase dengan data yang disimpan di Amazon S3. | 
| Lokasi cadangan  | Tentukan URI mana cadangan dari yang untuk mengembalikan berada di Amazon S3.  | 
| Versi cadangan  | Opsional, tentukan nama versi cadangan di Lokasi Backup untuk digunakan. Jika Anda membiarkan bidang ini kosong, Amazon EMR menggunakan cadangan terbaru di Lokasi Backup untuk mengisi cluster HBase baru.  | 
| Jadwalkan Cadangan Reguler  | Menentukan apakah untuk menjadwalkan backup tambahan otomatis. Cadangan pertama adalah cadangan penuh untuk membuat baseline untuk masa depan tambahan backup. | 
| Pencadangan yang konsisten  | Menentukan apakah backup harus konsisten. Cadangan konsisten adalah salah satu yang berhenti menulis operasi selama tahap cadangan awal, sinkronisasi di node. Setiap operasi tulis dengan demikian dijeda ditempatkan dalam antrian dan dilanjutkan saat sinkronisasi selesai. | 
| Frekuensi cadangan  | Jumlah days/hours /menit antara pencadangan terjadwal. | 
| Lokasi cadangan  | Amazon S3 URI dimana backup disimpan. Lokasi cadangan untuk setiap cluster HBase harus berbeda untuk memastikan bahwa backup diferensial tetap benar.  | 
| Waktu mulai cadangan  | Tentukan kapan cadangan pertama harus terjadi. Anda dapat mengatur ini ke now, yang menyebabkan cadangan pertama untuk memulai segera setelah cluster berjalan, atau masukkan tanggal dan waktu di [Format ISO](http://www.w3.org/TR/NOTE-datetime). Misalnya, 2012-06-15 T20:00Z akan mengatur waktu mulai ke 15 Juni 2012 pukul 8 malam UTC.  | 

Berikut contoh AWS CLI perintah meluncurkan cluster dengan HBase dan aplikasi lainnya:

**catatan**  
Karakter lanjutan baris Linux (\\) disertakan agar mudah dibaca Karakter ini bisa dihapus atau digunakan dalam perintah Linux. Untuk Windows, hapus atau ganti dengan tanda sisipan (^).

```
aws emr create-cluster --name "{{Test cluster}}" --ami-version {{3.3}} \
               --applications Name={{Hue}} Name={{Hive}} Name={{Pig}} Name={{HBase}} \
               --use-default-roles --ec2-attributes KeyName={{myKey}} \
               --instance-type {{c1.xlarge}} --instance-count {{3}} --termination-protected
```

Setelah hubungan antara cluster Hive dan HBase telah dibuat (seperti yang ditunjukkan dalam prosedur sebelumnya), Anda dapat mengakses data yang disimpan pada cluster HBase dengan membuat tabel eksternal di Hive. 

Contoh berikut, ketika dijalankan dari prompt Hive, menciptakan tabel eksternal yang referensi data yang disimpan dalam tabel HBase disebut `inputTable`. Anda kemudian dapat referensi `inputTable` dalam pernyataan Hive untuk query dan memodifikasi data yang disimpan dalam cluster HBase. 

**catatan**  
Contoh berikut menggunakan **protobuf-java-2.4.0a.jar** di AMI 2.3.3, tetapi Anda harus memodifikasi contoh untuk mencocokkan versi Anda. Untuk memeriksa versi Protokol Buffer JAR Anda memiliki, jalankan perintah pada prompt perintah Hive: `! ls /home/hadoop/lib;`. 

```
add jar lib/emr-metrics-1.0.jar ;
               add jar lib/protobuf-java-2.4.0a.jar ;
               
               set hbase.zookeeper.quorum=ec2-107-21-163-157.compute-1.amazonaws.com ;
               
               create external table inputTable (key string, value string)
                    stored by 'org.apache.hadoop.hive.hbase.HBaseStorageHandler'
                     with serdeproperties ("hbase.columns.mapping" = ":key,f1:col1")
                     tblproperties ("hbase.table.name" = "t1");
               
               select count(*) from inputTable ;
```

## Menyesuaikan konfigurasi HBase
<a name="emr-3x-hbase-customize"></a>

Meskipun pengaturan default harus bekerja untuk sebagian besar aplikasi, Anda memiliki fleksibilitas untuk memodifikasi pengaturan konfigurasi HBase Anda. Untuk melakukannya, jalankan salah satu dari dua skrip tindakan bootstrap: 
+ **mengkonfigurasi-hbase-daemon**—Mengkonfigurasi properti daemon master, regionserver, dan zookeeper. Properti ini termasuk ukuran tumpukan dan pilihan untuk lolos ke Java Virtual Machine (JVM) ketika daemon HBase dimulai. Anda mengatur properti ini sebagai argumen dalam tindakan bootstrap. Tindakan bootstrap ini memodifikasi file konfigurasihome/hadoop//conf/hbase-user-env.sh pada cluster HBase. 
+ **mengonfigurasi hbase**-Mengkonfigurasi pengaturan situs HBase khusus seperti port master HBase harus mengikat dan jumlah maksimum kali klien CLI klien harus mencoba lagi tindakan. Anda dapat mengatur ini satu-per-satu, sebagai argumen dalam tindakan bootstrap, atau Anda dapat menentukan lokasi file konfigurasi XML di Amazon S3. Tindakan bootstrap ini memodifikasi file konfigurasihome/hadoop//conf/hbase-site.xml pada cluster HBase. 

**catatan**  
Skrip ini, seperti tindakan bootstrap lainnya, hanya dapat dijalankan ketika cluster dibuat; Anda tidak dapat menggunakannya untuk mengubah konfigurasi cluster HBase yang sedang berjalan. 

Ketika Anda menjalankan **mengonfigurasi hbase** atau **mengkonfigurasi-hbase-daemon** tindakan bootstrap, nilai yang Anda tentukan menimpa nilai default. Setiap nilai yang Anda tidak secara eksplisit mengatur menerima nilai default. 

Konfigurasi HBase dengan tindakan bootstrap ini analog dengan menggunakan tindakan bootstrap di Amazon EMR untuk mengkonfigurasi pengaturan Hadoop dan Hadoop properti daemon. Perbedaannya adalah bahwa HBase tidak memiliki pilihan memori per-proses. Sebagai gantinya, opsi memori diatur menggunakan `--{{daemon}}-opts` argumen, di {{daemon}} mana diganti dengan nama daemon untuk mengkonfigurasi. 

### Konfigurasi daemon HBase
<a name="emr-3x-hbase-configure-daemons"></a>

 Amazon EMR menyediakan tindakan bootstrap,`s3://{{region}}.elasticmapreduce/bootstrap-actions/configure-hbase-daemons`, yang dapat Anda gunakan untuk mengubah konfigurasi daemon HBase, di mana {{region}} wilayah tempat Anda meluncurkan cluster HBase Anda. 

Untuk mengkonfigurasi daemon HBase menggunakan AWS CLI, tambahkan tindakan `configure-hbase-daemons` bootstrap saat Anda meluncurkan cluster untuk mengonfigurasi satu atau lebih daemon HBase. Anda dapat mengatur properti berikut. 


| Properti | Deskripsi | 
| --- | --- | 
| hbase-master-opts | Pilihan yang mengontrol bagaimana JVM menjalankan daemon master. Jika diatur, ini menimpa variabel default HBASE\_MASTER\_OPTS.  | 
| regionserver-opts | Pilihan yang mengontrol bagaimana JVM menjalankan daemon server daerah. Jika diatur, ini menimpa variabel HBASE\_REGIONSERVER\_OPTS default. | 
| zookeeper-opts | Pilihan yang mengontrol bagaimana JVM berjalan daemon zookeeper. Jika diatur, ini menimpa variabel HBASE\_ZOOKEEPER\_OPTS default.  | 

Untuk informasi selengkapnya tentang opsi ini, lihat: [hbase-env.sh](https://hbase.apache.org/book.html#hbase.env.sh) dalam dokumentasi HBase. 

Sebuah tindakan bootstrap untuk mengkonfigurasi nilai-nilai untuk `zookeeper-opts` dan `hbase-master-opts` ditunjukkan dalam contoh berikut.

**catatan**  
Karakter kelanjutan baris Linux (\\) disertakan untuk memudahkan pembacaan. Karakter ini bisa dihapus atau digunakan dalam perintah Linux. Untuk Windows, hapus atau ganti dengan tanda sisipan (^).

```
aws emr create-cluster --name "{{Test cluster}}" --ami-version {{3.3}} \
--applications Name={{Hue}} Name={{Hive}} Name={{Pig}} Name={{HBase}} \
--use-default-roles --ec2-attributes KeyName={{myKey}} \
--instance-type {{c1.xlarge}} --instance-count {{3}} --termination-protected \
--bootstrap-actions Path={{s3://elasticmapreduce/bootstrap-actions/configure-hbase-daemons}},\
Args=[{{"--hbase-zookeeper-opts=-Xmx1024m -XX:GCTimeRatio=19","--hbase-master-opts=-Xmx2048m","--hbase-regionserver-opts=-Xmx4096m"}}]
```

### Mengkonfigurasi pengaturan situs HBase
<a name="emr-3x-hbase-configure-site"></a>

Amazon EMR memberikan tindakan bootstrap, `s3://elasticmapreduce/bootstrap-actions/configure-hbase`, yang dapat Anda gunakan untuk mengubah konfigurasi HBase. Anda dapat mengatur nilai konfigurasi satu-per-satu, sebagai argumen dalam tindakan bootstrap, atau Anda dapat menentukan lokasi file konfigurasi XML di Amazon S3. Menetapkan nilai konfigurasi satu-per-satu berguna jika Anda hanya perlu mengatur beberapa pengaturan konfigurasi. Pengaturan mereka menggunakan file XML berguna jika Anda memiliki banyak perubahan untuk membuat, atau jika Anda ingin menyimpan pengaturan konfigurasi Anda untuk digunakan kembali. 

**catatan**  
Anda dapat menawali nama bucket Amazon S3 dengan awalan wilayah`s3://{{region}}.elasticmapreduce/bootstrap-actions/configure-hbase`, seperti, di {{region}} mana wilayah tempat Anda meluncurkan cluster HBase Anda. 

Tindakan bootstrap ini memodifikasi `/home/hadoop/conf/hbase-site.xml` file konfigurasi pada cluster HBase. Tindakan bootstrap hanya dapat dijalankan ketika cluster HBase diluncurkan.

Untuk informasi selengkapnya tentang pengaturan situs HBase yang dapat Anda konfigurasikan, lihat [Konfigurasi default](http://hbase.apache.org/book.html#config.files) dalam dokumentasi HBase. 

Mengatur `configure-hbase` tindakan bootstrap ketika Anda meluncurkan cluster HBase dan menentukan nilai-nilai dalam `hbase-site.xml` Untuk mengubah.

**Untuk menentukan pengaturan situs HBase individual menggunakan AWS CLI**
+ Untuk mengubah `hbase.hregion.max.filesize` pengaturan, ketik perintah berikut dan ganti {{myKey}} dengan nama pasangan kunci Amazon EC2 Anda.
**catatan**  
Karakter lanjutan baris Linux (\\) disertakan agar mudah dibaca Karakter ini bisa dihapus atau digunakan dalam perintah Linux. Untuk Windows, hapus atau ganti dengan tanda sisipan (^).

  ```
  aws emr create-cluster --name "{{Test cluster}}" --ami-version {{3.3}} \
  --applications Name={{Hue}} Name={{Hive}} Name={{Pig}} Name={{HBase}} \
  --use-default-roles --ec2-attributes KeyName={{myKey}} \
  --instance-type {{c1.xlarge}} --instance-count {{3}} --termination-protected \
  --bootstrap-actions Path={{s3://elasticmapreduce/bootstrap-actions/configure-hbase}},Args=[{{"-s","hbase.hregion.max.filesize=52428800"}}]
  ```

**Untuk menentukan pengaturan situs HBase dengan file XML menggunakan AWS CLI**

1. Buat versi khusus `hbase-site.xml`. File kustom Anda harus XML yang valid. Untuk mengurangi kemungkinan terjadinya kesalahan, mulailah dengan salinan default `hbase-site.xml`, terletak di simpul utama HBase Amazon EMR di `/home/hadoop/conf/hbase-site.xml`, dan edit salinan file tersebut alih-alih membuat file dari awal. Anda dapat memberikan nama baru pada file baru, atau meninggalkannya sebagai `hbase-site.xml`. 

1. Unggah file pembuangan `hbase-site.xml` ke bucket Amazon S3 Anda. Itu harus memiliki izin yang ditetapkan sehingga AWS akun yang meluncurkan cluster dapat mengakses file. Jika AWS akun yang meluncurkan cluster juga memiliki bucket Amazon S3, ia memiliki akses. 

1. Mengatur **mengonfigurasi hbase** bootstrap tindakan ketika Anda meluncurkan cluster HBase, dan termasuk lokasi kustom Anda `hbase-site.xml` file. Contoh berikut menetapkan nilai konfigurasi situs HBase untuk yang ditentukan dalam file `s3://amzn-s3-demo-bucket/my-hbase-site.xml`. Ketik perintah berikut, ganti {{myKey}} dengan nama pasangan kunci EC2 Anda, dan ganti {{amzn-s3-demo-bucket}} dengan nama bucket Amazon S3 Anda.
**catatan**  
Karakter lanjutan baris Linux (\\) disertakan agar mudah dibaca Karakter ini bisa dihapus atau digunakan dalam perintah Linux. Untuk Windows, hapus atau ganti dengan tanda sisipan (^).

   ```
   aws emr create-cluster --name "{{Test cluster}}" --ami-version {{3.3}} \
           --applications Name={{Hue}} Name={{Hive}} Name={{Pig}} Name={{HBase}} \
           --use-default-roles --ec2-attributes KeyName={{myKey}} \
           --instance-type {{c1.xlarge}} --instance-count {{3}} --termination-protected \
           --bootstrap-actions Path={{s3://elasticmapreduce/bootstrap-actions/configure-hbase}},Args=[{{"--site-config-file","s3://amzn-s3-demo-bucket/config.xml"}}]
   ```

   Jika Anda menentukan lebih dari satu pilihan untuk menyesuaikan operasi HBase, Anda harus menambahkan setiap pasangan kunci-nilai dengan `-s` Opsi switch, seperti yang ditunjukkan dalam contoh berikut:

   ```
          --bootstrap-actions {{s3://elasticmapreduce/bootstrap-actions/configure-hbase}},Args=[{{"-s","zookeeper.session.timeout=60000"}}]
   ```

Dengan set proxy dan koneksi SSH terbuka, Anda dapat melihat UI HBase dengan membuka jendela browser dengan http://{{master-public-dns-name}}: 60010/master -status, di {{master-public-dns-name}} mana alamat DNS publik dari node master di cluster HBase. 

Anda dapat melihat log HBase saat ini dengan menggunakan SSH untuk terhubung ke simpul utama, dan menavigasi ke `mnt/var/log/hbase` direktori. Log ini tidak tersedia setelah gugus dihentikan kecuali Anda mengaktifkan penebangan ke Amazon S3 ketika cluster diluncurkan.

## Membuat cadangan dan memulihkan HBase
<a name="emr-3x-hbase-backup-restore"></a>

Amazon EMR menyediakan kemampuan untuk membuat cadangan data HBase Anda ke Amazon S3, baik secara manual atau pada jadwal otomatis. Anda dapat melakukan backup penuh dan inkremental. Setelah Anda memiliki versi cadangan HBase data, Anda dapat memulihkan versi untuk cluster HBase. Anda dapat memulihkan ke cluster HBase yang sedang berjalan, atau meluncurkan cluster baru pra-diisi dengan cadangan data. 

Selama proses backup, HBase terus mengeksekusi menulis perintah. Meskipun ini memastikan bahwa cluster Anda tetap tersedia di seluruh cadangan, ada risiko inkonsistensi antara data yang didukung dan operasi tulis dijalankan secara paralel. Untuk memahami inkonsistensi yang mungkin timbul, Anda harus mempertimbangkan bahwa HBase mendistribusikan menulis operasi di node dalam cluster. Jika operasi menulis terjadi setelah node tertentu disurvei, data yang tidak termasuk dalam arsip cadangan. Anda bahkan mungkin menemukan bahwa sebelumnya menulis ke cluster HBase (dikirim ke node yang telah disurvei) mungkin tidak dalam arsip cadangan, sedangkan kemudian menulis (dikirim ke node sebelum itu disurvei) disertakan. 

Jika cadangan konsisten diperlukan, Anda harus jeda menulis ke HBase selama bagian awal dari proses backup, sinkronisasi di node. Anda dapat melakukannya dengan menentukan parameter `--consistent` ketika meminta cadangan. Dengan parameter ini, menulis selama periode ini antri dan dijalankan segera setelah sinkronisasi selesai. Anda juga dapat menjadwalkan pencadangan berulang, yang menyelesaikan inkonsistensi dari waktu ke waktu, karena data yang terlewatkan pada suatu pencadangan akan dicadangkan pada sesi berikutnya. 

Ketika Anda membuat cadangan data HBase, Anda harus menentukan direktori cadangan yang berbeda untuk setiap cluster. Cara mudah untuk melakukannya adalah dengan menggunakan pengidentifikasi cluster sebagai bagian dari jalan yang ditentukan untuk direktori cadangan. Misalnya, `s3://amzn-s3-demo-bucket/backups/j-3AEXXXXXX16F2`. Hal ini memastikan bahwa setiap backup tambahan masa depan referensi cluster HBase benar. 

Ketika Anda siap untuk menghapus file cadangan lama yang tidak lagi diperlukan, kami sarankan Anda terlebih dahulu melakukan backup penuh data HBase Anda. Hal ini memastikan bahwa semua data dipertahankan dan menyediakan dasar untuk backup tambahan masa depan. Setelah backup penuh selesai, Anda dapat menavigasi ke lokasi cadangan dan secara manual menghapus file cadangan lama. 

Proses pencadangan HBase digunakan S3DistCp untuk operasi penyalinan, yang memiliki batasan tertentu mengenai ruang penyimpanan file sementara. 

### Membuat cadangan dan mengembalikan HBase menggunakan konsol
<a name="emr-3x-hbase-backup-restore-console"></a>

Konsol menyediakan kemampuan untuk meluncurkan cluster baru dan mengisinya dengan data dari cadangan HBase sebelumnya. Hal ini juga memberikan Anda kemampuan untuk menjadwalkan backup inkremental periodik data HBase. Fungsi cadangan dan pemulihan tambahan, seperti kemampuan untuk memulihkan data ke cluster yang sudah berjalan, melakukan backup manual, dan jadwal backup penuh otomatis, tersedia menggunakan CLI.

**Untuk mengisi cluster baru dengan data HBase diarsipkan menggunakan konsol**

1. Arahkan ke konsol Amazon EMR baru dan pilih Ber ** alih ke konsol lama ** dari navigasi samping. Untuk informasi selengkapnya tentang apa yang diharapkan saat Anda beralih ke konsol lama, lihat [ Menggunakan konsol lama](https://docs.aws.amazon.com/emr/latest/ManagementGuide/whats-new-in-console.html#console-opt-in).

1. Pilih **Buat kluster**.

1. Di **Pengaturan perangkat lunak** Bagian, untuk **Aplikasi tambahan** Pilih **HBase** dan **Konfigurasikan dan tambahkan**.

1. Pada **Tambahkan Aplikasi** kotak dialog, periksa **Pulihkan dari Backup**. 

1. Untuk **Lokasi Backup**, menentukan lokasi cadangan yto beban ke cluster HBase baru. Ini harus menjadi URL Amazon S3 formulir `s3://amzn-s3-demo-bucket/backups/`. 

1. Untuk **Versi Backup**, Anda memiliki pilihan untuk menentukan nama versi cadangan untuk dimuat dengan menetapkan nilai. Jika Anda tidak menetapkan nilai untuk **Versi Backup**, Amazon EMR memuat cadangan terbaru di lokasi yang ditentukan. 

1. Pilih **Tambahkan** dan lanjutkan untuk membuat cluster dengan pilihan lain seperti yang diinginkan.

**Untuk menjadwalkan backup otomatis data HBase menggunakan konsol**

1. Di **Pengaturan perangkat lunak** Bagian, untuk **Aplikasi tambahan** Pilih **HBase** dan **Konfigurasikan dan tambahkan**.

1. Pilih **Jadwalkan Backup reguler**.

1. Menentukan apakah backup harus konsisten. Cadangan konsisten adalah salah satu yang berhenti menulis operasi selama tahap cadangan awal, sinkronisasi di node. Setiap operasi tulis sehingga berhenti ditempatkan dalam antrian dan melanjutkan ketika sinkronisasi selesai. 

1. Mengatur seberapa sering backup harus terjadi dengan memasukkan nomor untuk **Frekuensi Backup** dan memilih **hari**, **Jam**, atau **Menit**. Cadangan otomatis pertama yang berjalan adalah cadangan penuh; setelah itu, Amazon EMR menyimpan backup tambahan berdasarkan jadwal yang Anda tentukan. 

1. Tentukan lokasi di Amazon S3 tempat backup harus disimpan. Setiap cluster HBase harus didukung ke lokasi yang terpisah di Amazon S3 untuk memastikan bahwa backup inkremental dihitung dengan benar. 

1. Tentukan kapan cadangan pertama harus terjadi dengan menetapkan nilai untuk **Waktu Mulai Backup**. Anda dapat mengatur ini ke`now`, yang menyebabkan cadangan pertama untuk memulai segera setelah cluster berjalan, atau masukkan tanggal dan waktu di [Format ISO](http://www.w3.org/TR/NOTE-datetime). Misalnya, 2013-09-26T20:00Z, menetapkan waktu mulai ke 26 September 2013 pukul 8 malam UTC. 

1. Pilih **Tambahkan**.

1. Lanjutkan dengan menciptakan cluster dengan pilihan lain seperti yang diinginkan.

## Memantau HBase dengan CloudWatch
<a name="emr-3x-hbase-cloudwatch"></a>

Amazon EMR melaporkan tiga metrik CloudWatch yang dapat Anda gunakan untuk memantau cadangan HBase Anda. Metrik ini didorong ke CloudWatch interval lima menit, dan disediakan tanpa biaya.


| Metrik | Deskripsi | 
| --- | --- | 
| HBaseBackupFailed | Apakah cadangan terakhir gagal. Ini diatur ke 0 secara default dan diperbarui ke 1 jika upaya cadangan sebelumnya gagal. Metrik ini hanya dilaporkan untuk kluster HBase.<br />Kasus penggunaan: Monitor backup HBase<br />Unit: *Jumlah* | 
| HBaseMostRecentBackupDuration | Jumlah waktu yang dibutuhkan cadangan sebelumnya untuk menyelesaikan. Metrik ini diatur terlepas dari apakah cadangan terakhir selesai berhasil atau gagal. Saat cadangan sedang berlangsung, metrik ini akan mengembalikan jumlah menit setelah pencadangan dimulai. Metrik ini hanya dilaporkan untuk kluster HBase.<br />Kasus penggunaan: Monitor HBase Backup<br />Unit: *Menit* | 
| HBaseTimeSinceLastSuccessfulBackup | Jumlah menit berlalu setelah cadangan HBase sukses terakhir dimulai pada cluster Anda. Metrik ini hanya dilaporkan untuk kluster HBase.<br />Kasus penggunaan: Monitor backup HBase<br />Unit: *Menit* | 

## Configurar Ganglia para H
<a name="emr-3x-ganglia-for-hbase"></a>

Anda mengkonfigurasi Ganglia untuk HBase menggunakan **configurre-hbase-untuk-ganglia** Tindakan bootstrap. Tindakan bootstrap ini mengkonfigurasi HBase untuk mempublikasikan metrik ke Ganglia. 

Anda harus mengkonfigurasi HBase dan Ganglia ketika Anda meluncurkan cluster; Ganglia pelaporan tidak dapat ditambahkan ke cluster berjalan. 

Ganglia juga menyimpan file log di server di `/mnt/var/log/ganglia/rrds`. Jika Anda mengonfigurasi kluster Anda untuk menahan file log ke bucket Amazon S3, log file Ganglia akan tetap berada di sana juga. 

Untuk memulai sebuah cluster dengan Ganglia untuk HBase, gunakan **configurre-hbase-untuk-ganglia** Tindakan bootstrap seperti yang ditunjukkan dalam contoh berikut.

**catatan**  
Karakter kelanjutan baris Linux (\\) disertakan untuk memudahkan pembacaan. Karakter ini bisa dihapus atau digunakan dalam perintah Linux. Untuk Windows, hapus atau ganti dengan tanda sisipan (^).

```
aws emr create-cluster --name "{{Test cluster}}" --ami-version {{3.3}} \
--applications Name={{Hue}} Name={{Hive}} Name={{Pig}} Name={{HBase}} Name={{Ganglia}} \
--use-default-roles --ec2-attributes KeyName={{myKey}} \
--instance-type {{c1.xlarge}} --instance-count {{3}} --termination-protected \
--bootstrap-actions Path={{s3://elasticmapreduce/bootstrap-actions/configure-hbase-for-ganglia}}
```

Setelah cluster diluncurkan dengan Ganglia dikonfigurasi, Anda dapat mengakses grafik Ganglia dan laporan menggunakan antarmuka grafis yang berjalan pada node master. 