Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.
Pertimbangan dan batasan saat menggunakan konektor Spark
-
Kami menyarankan Anda mengaktifkan SSL untuk koneksi JDBC dari Spark di Amazon EMR ke Amazon Redshift.
-
Kami menyarankan Anda mengelola kredenSIAL untuk cluster Amazon Redshift AWS Secrets Manager sebagai praktik terbaik. Lihat Menggunakan AWS Secrets Manager untuk mengambil kredenSIAL untuk menghubungkan ke Amazon Redshift untuk contoh.
-
Sebaiknya Anda meneruskan peran IAM dengan parameter
aws_iam_roleuntuk parameter otentikasi Amazon Redshift. -
tempdirURI menunjuk ke lokasi Amazon S3. Direktori temp ini tidak dibersihkan secara otomatis dan karenanya dapat menambah biaya tambahan. -
Pertimbangkan rekomendasi berikut untuk Amazon Redshift:
-
Kami menyarankan Anda memblokir akses publik ke cluster Amazon Redshift.
-
Sebaiknya aktifkan pencatatan audit Amazon Redshift.
-
Kami menyarankan Anda mengaktifkan enkripsi Amazon Redshift at-rest.
-
-
Pertimbangkan rekomendasi berikut untuk Amazon S3:
-
Kami menyarankan Anda memblokir akses publik ke bucket Amazon S3.
-
Sebaiknya gunakan enkripsi sisi server Amazon S3 untuk mengenkripsi bucket Amazon S3 yang digunakan.
-
Sebaiknya gunakan kebijakan siklus hidup Amazon S3 untuk menentukan aturan retensi untuk bucket Amazon S3.
-
Amazon EMR selalu memverifikasi kode yang diimpor dari sumber terbuka ke dalam gambar. Demi keamanan, kami tidak mendukung metode otentikasi berikut dari Spark ke Amazon S3:
-
Meng AWS atur kunci akses dalam klasifikasi
hadoop-envkonfigurasi -
Meng AWS kodekan kunci akses di
tempdirURI
-
-
Untuk informasi selengkapnya tentang menggunakan konektor dan parameter yang didukungnya, lihat sumber daya berikut:
-
Integrasi Amazon Redshift untuk Apache Spark di Panduan Manajemen Amazon Redshift
-
Repositori
spark-redshiftkomunitasdi Github