View a markdown version of this page

Pertimbangan dan batasan saat menggunakan konektor Spark - Amazon EMR

Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.

Pertimbangan dan batasan saat menggunakan konektor Spark

  • Kami menyarankan Anda mengaktifkan SSL untuk koneksi JDBC dari Spark di Amazon EMR ke Amazon Redshift.

  • Kami menyarankan Anda mengelola kredenSIAL untuk cluster Amazon Redshift AWS Secrets Manager sebagai praktik terbaik. Lihat Menggunakan AWS Secrets Manager untuk mengambil kredenSIAL untuk menghubungkan ke Amazon Redshift untuk contoh.

  • Sebaiknya Anda meneruskan peran IAM dengan parameter aws_iam_role untuk parameter otentikasi Amazon Redshift.

  • tempdirURI menunjuk ke lokasi Amazon S3. Direktori temp ini tidak dibersihkan secara otomatis dan karenanya dapat menambah biaya tambahan.

  • Pertimbangkan rekomendasi berikut untuk Amazon Redshift:

  • Pertimbangkan rekomendasi berikut untuk Amazon S3:

    • Kami menyarankan Anda memblokir akses publik ke bucket Amazon S3.

    • Sebaiknya gunakan enkripsi sisi server Amazon S3 untuk mengenkripsi bucket Amazon S3 yang digunakan.

    • Sebaiknya gunakan kebijakan siklus hidup Amazon S3 untuk menentukan aturan retensi untuk bucket Amazon S3.

    • Amazon EMR selalu memverifikasi kode yang diimpor dari sumber terbuka ke dalam gambar. Demi keamanan, kami tidak mendukung metode otentikasi berikut dari Spark ke Amazon S3:

      • Meng AWS atur kunci akses dalam klasifikasi hadoop-env konfigurasi

      • Meng AWS kodekan kunci akses di tempdir URI

Untuk informasi selengkapnya tentang menggunakan konektor dan parameter yang didukungnya, lihat sumber daya berikut: