Amazon Redshift tidak akan lagi mendukung penggunaan Python UDF setelah 30 Juni 2026. Kami akan mulai menegakkannya secara bertahap. Untuk informasi lebih lanjut tentang detail opsi akhir masa pakai dan migrasi Python, lihat posting blog
Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.
Berbagi data di Amazon Redshift
Dengan Amazon Redshift, Anda dapat berbagi data dengan aman di seluruh cluster Amazon Redshift atau dengan layanan lain AWS . Dengan berbagi data, Anda dapat berbagi data langsung, tanpa harus membuat salinan atau memindahkannya. Administrator database dan insinyur data dapat menggunakan berbagi data untuk menyediakan akses baca-saja yang aman ke data untuk tujuan analitik, sambil mempertahankan kontrol atas data. Analis data, profesional intelijen bisnis, dan ilmuwan data dapat memanfaatkan data bersama untuk mendapatkan wawasan tanpa menduplikasi atau memindahkan data. Kasus penggunaan umum termasuk berbagi data dengan mitra, memungkinkan analisis lintas fungsi, dan memfasilitasi demokratisasi data dalam suatu organisasi. Bagian berikut mencakup detail konfigurasi dan pengelolaan berbagi data di Amazon Redshift.
Dengan berbagi data Amazon Redshift, Anda dapat dengan aman berbagi akses ke data langsung di seluruh cluster Amazon Redshift, grup kerja Akun AWS, dan Wilayah AWS tanpa memindahkan atau menyalin data secara manual. Karena data aktif, semua pengguna dapat melihat informasi terbaru dan konsisten di Amazon Redshift segera setelah diperbarui.
Anda dapat berbagi data di seluruh cluster yang disediakan, grup kerja tanpa server, Zona Ketersediaan, dan. Akun AWS Wilayah AWS Anda dapat berbagi antar tipe cluster serta antara cluster yang disediakan dan tanpa server.
Anda dapat berbagi objek database untuk membaca dan menulis di berbagai cluster Amazon Redshift atau grup kerja Amazon Redshift Serverless dalam kelompok kerja yang sama Akun AWS, atau dari satu ke yang lain. Akun AWS Anda juga dapat membaca dan menulis data di seluruh Wilayah. Anda dapat memberikan izin seperti SELECT, INSERT, dan UPDATE untuk tabel yang berbeda dan USAGE dan CREATE untuk skema yang berbeda. Data langsung dan tersedia untuk semua gudang segera setelah transaksi penulisan dilakukan.
Kasus penggunaan berbagi data untuk Amazon Redshift
Berbagi data Amazon Redshift sangat berguna untuk kasus penggunaan berikut:
-
Mendukung berbagai jenis beban kerja kritis bisnis — Gunakan cluster ekstrak, transformasi, dan muat (ETL) pusat yang berbagi data dengan beberapa business intelligence (BI) atau cluster analitik. Pendekatan ini menyediakan isolasi beban kerja baca dan tagihan balik untuk beban kerja individual. Anda dapat mengukur dan menskalakan komputasi beban kerja individu sesuai dengan persyaratan harga dan kinerja khusus beban kerja.
-
Mengaktifkan kolaborasi lintas kelompok — Aktifkan kolaborasi yang mulus di seluruh tim dan grup bisnis untuk analisis yang lebih luas, ilmu data, dan analisis dampak lintas produk.
-
Menyampaikan data sebagai layanan — Bagikan data sebagai layanan di seluruh organisasi Anda.
-
Berbagi data antar lingkungan — Berbagi data di antara lingkungan pengembangan, pengujian, dan produksi. Anda dapat meningkatkan kelincahan tim dengan berbagi data pada tingkat perincian yang berbeda.
-
Lisensi akses ke data di Amazon Redshift — Daftar kumpulan data Amazon Redshift di AWS Data Exchange katalog yang dapat ditemukan, berlangganan, dan kueri pelanggan dalam hitungan menit.
Kasus penggunaan akses tulis berbagi data
Berbagi data untuk menulis memiliki beberapa kasus penggunaan penting:
-
Memperbarui data sumber bisnis pada produsen — Anda dapat berbagi data sebagai layanan di seluruh organisasi Anda, tetapi kemudian konsumen juga dapat melakukan tindakan pada data sumber. Misalnya, mereka dapat mengomunikasikan kembali nilai-nilai terbaru atau mengakui penerimaan data. Ini hanya beberapa kemungkinan kasus penggunaan bisnis.
-
Masukkan catatan tambahan pada produsen — Konsumen dapat menambahkan catatan ke data sumber asli. Ini dapat ditandai sebagai dari konsumen, jika diperlukan.
Untuk informasi khusus mengenai cara melakukan operasi penulisan pada datashare, lihat Berbagi akses tulis ke data.
Berbagi data di berbagai tingkat di Amazon Redshift
Dengan Amazon Redshift, Anda dapat berbagi data di berbagai tingkat. Level ini mencakup database, skema, tabel, tampilan (termasuk tampilan reguler, pengikatan terlambat, dan terwujud), dan fungsi yang ditentukan pengguna SQL (UDF). Anda dapat membuat beberapa datashares untuk database tertentu. Sebuah datashare dapat berisi objek dari beberapa skema dalam database tempat berbagi dibuat.
Dengan memiliki fleksibilitas dalam berbagi data, Anda mendapatkan kontrol akses yang halus. Anda dapat menyesuaikan kontrol ini untuk pengguna dan bisnis yang berbeda yang memerlukan akses ke data Amazon Redshift.
Manajemen konsistensi untuk berbagi data di Amazon Redshift
Amazon Redshift memberikan konsistensi transaksional pada semua cluster produsen dan konsumen dan berbagi pandangan data terkini dan konsisten dengan semua konsumen.
Anda dapat terus memperbarui data pada cluster produsen. Semua kueri pada cluster konsumen dalam transaksi membaca status yang sama dari data bersama. Amazon Redshift tidak mempertimbangkan data yang diubah oleh transaksi lain pada cluster produsen yang dilakukan setelah dimulainya transaksi pada cluster konsumen. Setelah perubahan data dilakukan pada cluster produsen, transaksi baru pada cluster konsumen dapat segera menanyakan data yang diperbarui.
Konsistensi yang kuat menghilangkan risiko laporan bisnis dengan fidelitas rendah yang mungkin berisi hasil yang tidak valid selama berbagi data. Faktor ini sangat penting untuk analisis keuangan atau di mana hasilnya dapat digunakan untuk menyiapkan kumpulan data yang digunakan untuk melatih model pembelajaran mesin.