Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.
Pembuatan fungsi konsolidasi anotasi
catatan
Amazon SageMaker Ground Truth tidak lagi terbuka untuk pelanggan baru. Pelanggan yang sudah ada dapat terus menggunakan layanan seperti biasa. AWS terus berinvestasi dalam peningkatan keamanan dan ketersediaan untuk Ground Truth, tetapi kami tidak berencana untuk memperkenalkan fitur baru.
Anda dapat memilih untuk menggunakan fungsi konsolidasi anotasi Anda sendiri untuk menentukan label akhir untuk objek berlabel Anda. Ada banyak pendekatan yang mungkin untuk menulis fungsi dan pendekatan yang Anda ambil tergantung pada sifat anotasi untuk dikonsolidasikan. Secara umum, fungsi konsolidasi melihat anotasi dari pekerja, mengukur kesamaan di antara mereka, dan kemudian menggunakan beberapa bentuk penilaian probabilistik untuk menentukan label apa yang paling mungkin seharusnya.
Jika Anda ingin menggunakan algoritma lain untuk membuat fungsi konsolidasi anotasi, Anda dapat menemukan respons pekerja di folder bucket Amazon S3 tempat Anda mengarahkan output pekerjaan.[project-name]/annotations/worker-response
Menilai kesamaan
Untuk menilai kesamaan antar label, Anda dapat menggunakan salah satu strategi berikut, atau Anda dapat menggunakan strategi yang memenuhi kebutuhan pelabelan data Anda:
-
Untuk ruang label yang terdiri dari kategori diskrit dan saling eksklusif, seperti klasifikasi multi-kelas, menilai kesamaan bisa mudah. Label diskrit cocok atau tidak cocok.
-
Untuk ruang label yang tidak memiliki nilai diskrit, seperti anotasi kotak pembatas, temukan ukuran kesamaan yang luas. Untuk kotak pembatas, salah satu ukuran tersebut adalah indeks Jaccard. Ini mengukur rasio persimpangan dua kotak dengan penyatuan kotak untuk menilai seberapa mirip mereka. Misalnya, jika ada tiga anotasi, maka bisa ada fungsi yang menentukan anotasi mana yang mewakili objek yang sama dan harus dikonsolidasikan.
Menilai label yang paling mungkin
Dengan mempertimbangkan salah satu strategi yang dirinci di bagian sebelumnya, buat semacam penilaian probabilistik tentang apa yang seharusnya menjadi label konsolidasi. Dalam kasus kategori diskrit dan saling eksklusif, ini bisa langsung. Salah satu cara paling umum untuk melakukan ini adalah dengan mengambil hasil suara mayoritas di antara anotasi. Ini memberi bobot anotasi secara merata.
Beberapa pendekatan mencoba memperkirakan keakuratan anotator yang berbeda dan menimbang anotasi mereka sebanding dengan probabilitas kebenaran. Contohnya adalah metode Expectation Maximization, yang digunakan dalam fungsi konsolidasi Ground Truth default untuk anotasi multi-kelas.
Untuk informasi selengkapnya tentang membuat fungsi konsolidasi anotasi, lihatMemproses data dalam alur kerja pelabelan khusus dengan AWS Lambda.