

Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.

# Menggunakan pelatihan tambahan di AWS Clean Rooms ML
<a name="use-incremental-training"></a>

Prasyarat: 
+ An Akun AWS dengan akses ke AWS Clean Rooms
+ Model terlatih yang ada dalam kolaborasi 
+ Dataset baru atau diperbarui untuk pelatihan tambahan 
+ Izin yang sesuai untuk membuat dan mengelola model ML dalam kolaborasi
+ Keakraban dengan hyperparameter dan konfigurasi model yang ada 

Dengan pelatihan tambahan, Anda dapat menggunakan artefak dari model yang ada dan dataset yang diperbarui untuk melatih model baru. Pelatihan tambahan menghemat waktu dan sumber daya.

Gunakan pelatihan tambahan untuk:
+ Latih model baru menggunakan dataset yang diperluas yang memiliki pola dasar yang tidak diperhitungkan dalam pelatihan sebelumnya.
+ Latih beberapa varian model, baik dengan hyperparameter yang berbeda atau menggunakan kumpulan data yang berbeda.

------
#### [ Console ]

**Untuk menjalankan tugas pelatihan tambahan (konsol)**

1. Masuk ke Konsol Manajemen AWS dan buka AWS Clean Rooms konsol di [ https://console.aws.amazon.com/cleanrooms](https://console.aws.amazon.com/cleanrooms/home).

1. Di panel navigasi kiri, pilih Kolabor ** asi**.

1. Pada ** halaman ** Kolaborasi, pilih kolaborasi di mana artefak model yang ingin Anda gunakan untuk pelatihan tambahan ada.

1. Setelah kolaborasi terbuka, pilih ** tab Model ** ML.

1. Di bawah Model ML K ** ustom**, di ** bagian Model ** terlatih, pilih tombol radio di sebelah model terlatih yang ingin Anda latih secara bertahap.

1. Pada ** halaman I ** khtisar, di bawah ** Versi**, 

   1. Pilih tombol radio di sebelah model terlatih yang ingin Anda latih secara bertahap.

   1. Pilih ** Kereta dari versi**. 

1. Pada ** halaman ** Buat model terlatih dari versi, untuk Versi model ** terlatih**, pilih versinya.

   Versi model dasar dipilih secara otomatis. Anda dapat mengubah versi ini jika ada versi lain.

1. Untuk detail model ** terlatih**, masukkan yang berikut ini:

   1. Untuk ** Nama**, masukkan nama unik untuk model dalam kolaborasi.

   1. (Opsional) Untuk ** Deskripsi**, masukkan deskripsi model terlatih.

   1. Untuk mode input data ** pelatihan**, pilih salah satu dari berikut ini:
      + Pilih ** File ** jika Anda memiliki kumpulan data yang lebih kecil yang dapat muat pada volume penyimpanan ML dan Anda lebih suka akses sistem file tradisional untuk skrip pelatihan Anda.
      + Pilih ** Pi ** pe untuk kumpulan data besar untuk mengalirkan data langsung dari S3, menghindari kebutuhan untuk mengunduh semuanya ke disk, yang dapat meningkatkan kecepatan pelatihan dan mengurangi kebutuhan penyimpanan.
      + Pilih ** FastFile ** jika Anda ingin menggabungkan manfaat streaming dari S3 dengan akses sistem file, terutama untuk membaca data secara berurutan atau ketika berurusan dengan lebih sedikit file untuk waktu startup yang lebih cepat.

   1. Untuk ** nama saluran pelatihan tambahan**, masukkan nama untuk saluran pelatihan tambahan 
**catatan**  
Jika Anda menentukan ** nama saluran pelatihan tambahan ** tanpa ID versi, sistem menggunakan model dasar untuk pelatihan tambahan. 

1. Untuk detail saluran input ** ML**, lakukan hal berikut: 

   1. Untuk saluran input ** ML**, tentukan saluran input ML yang menyediakan data ke algoritma model. 

      Untuk menambahkan saluran lain, pilih ** Tambahkan saluran input ML lainnya**. Anda dapat menambahkan hingga 19 saluran input ML tambahan. 

   1. Untuk Nama ** saluran**, masukkan nama saluran input ML.

   1. Untuk jenis distribusi data ** Amazon S3**, pilih salah satu dari berikut ini:
      + Pilih ** Sepenuhnya direplikasi ** untuk memberikan salinan lengkap kumpulan data Anda pada setiap contoh pelatihan. Ini bekerja paling baik ketika kumpulan data Anda cukup kecil untuk muat dalam memori atau ketika setiap instans memerlukan akses ke semua data.
      + Pilih ** Sharded by S3 key ** untuk membagi dataset Anda di seluruh instance pelatihan berdasarkan kunci S3. Setiap instance menerima sekitar 1/n dari total objek S3, di mana 'n' adalah jumlah instance. Ini bekerja paling baik untuk kumpulan data besar yang ingin Anda proses secara paralel.
**catatan**  
Pertimbangkan ukuran dataset dan persyaratan pelatihan Anda saat memilih jenis distribusi. **Sepenuhnya direplikasi ** menyediakan akses data lengkap tetapi membutuhkan lebih banyak penyimpanan, sementara ** Sharded by S3 key ** memungkinkan pemrosesan terdistribusi dari kumpulan data besar.

1. Untuk Durasi pelatihan ** maksimum**, pilih jumlah waktu maksimum yang Anda inginkan untuk melatih model Anda.

1. Untuk ** Hyperparameter**, tentukan parameter spesifik algoritma dan nilai yang dimaksudkan. Hyperparameter khusus untuk model yang dilatih dan digunakan untuk menyempurnakan pelatihan model.

1. Untuk variabel ** Lingkungan**, tentukan variabel spesifik algoritma apa pun dan nilai yang dimaksudkan. Variabel lingkungan diatur dalam wadah Docker.

1. Untuk ** Enkripsi**, untuk menggunakan kustom AWS KMS key, pilih kotak ** centang ** Enkripsi rahasia dengan kunci KMS khusus.

1. Untuk konfigurasi ** Sumber Daya EC2**, tentukan informasi tentang sumber daya komputasi yang digunakan untuk pelatihan model. 

   1. Untuk ** Jenis Inst ** ance, pilih jenis instance yang ingin Anda jalankan.

   1. Untuk ** Jumlah Inst ** ance, masukkan jumlah instance.

   1. Untuk Ukuran ** volume dalam GB**, masukkan ukuran volume penyimpanan ML.

1. Pilih ** Buat model terlatih dari versi**. 

------
#### [ API ]

Untuk menjalankan tugas pelatihan tambahan (API)

Jalankan kode berikut dengan parameter spesifik Anda:

```
import boto3 
acr_ml_client= boto3.client('cleanroomsml')
 
acr_ml_client.create_trained_model(
    membershipIdentifier= '{{membership_id}}',
    configuredModelAlgorithmAssociationArn = 'arn:aws:cleanrooms-ml:{{region:account:membership}}/membershipIdentifier/configured-model-algorithm-association/{{identifier}}',
    name='{{trained_model_name}}',
    resourceConfig={
        'instanceType': 'ml.m5.xlarge',
        'volumeSizeInGB': 1
    },
    incrementalTrainingDataChannels=[
        {
            'trainedModelArn': trained_model_arn,
            'channelName': '{{channel_name}}'
        },
    ]
    dataChannels=[
        {
            'mlInputChannelArn': channel_arn_1,
            'channelName': '{{channel_name}}'
        },
        {
            'mlInputChannelArn': channel_arn_2,
            'channelName': '{{channel_name}}'
        }
    ]
)
```

**catatan**  
Batas: Maksimum total 20 saluran (termasuk keduanya `dataChannels` dan`incrementalTrainingDataChannels`).

------

**catatan**  
Setelah model terlatih dibuat, Anda tidak dapat mengeditnya. Untuk membuat perubahan, hapus model terlatih dan buat yang baru.