Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.
Memahami alur kerja pencarian pembicara untuk Amazon Chime SDK
Di bagian ini, kami menunjukkan contoh aliran data dan program untuk analisis pencarian speaker Amazon Chime SDK.
Fungsi pencarian speaker melibatkan pembuatan penyematan suara, yang dapat digunakan membandingkan suara penelepon dengan data suara yang disimpan sebelumnya. Pengumpulan, penggunaan, penyimpanan, dan penyimpanan pengenal biometrik dan informasi biometrik dalam bentuk cetak suara digital mungkin memerlukan persetujuan penelepon melalui rilis tertulis. Persetujuan tersebut diperlukan berdasarkan berbagai undang-undang negara bagian, termasuk undang-undang biometrik di Illinois, Texas, Washington, dan undang-undang privasi negara bagian lainnya. Sebelum menggunakan fitur pencarian pembicara, Anda harus memberikan semua pemberitahuan, dan mendapatkan semua persetujuan sebagaimana diwajibkan oleh hukum yang berlaku, dan berdasarkan ketentuan layanan AWS
Diagram berikut menunjukkan contoh aliran data melalui tugas analisis pencarian pembicara. Deskripsi bernomor di bawah diagram menggambarkan setiap langkah proses. Diagram mengasumsikan Anda telah mengonfigurasi Konektor Suara Amazon Chime SDK dengan konfigurasi analisis panggilan yang memilikiVoiceAnalyticsProcessor. Untuk informasi selengkapnya, lihat Merekam panggilan Konektor Suara.
-
Anda atau administrator sistem membuat domain profil suara untuk menyimpan penyematan suara dan profil suara. Untuk informasi selengkapnya tentang membuat domain profil suara, lihat Membuat domain profil suara, di Panduan Administrator Amazon Chime SDK. Anda juga dapat menggunakan CreateVoiceProfileDomain API.
-
Penelepon memanggil menggunakan nomor telepon yang ditetapkan ke Konektor Suara Amazon Chime SDK. Atau, agen menggunakan nomor Konektor Suara untuk melakukan panggilan keluar.
-
Layanan Amazon Chime SDK Voice Connector membuat ID transaksi dan mengaitkannya dengan panggilan.
-
Dengan asumsi aplikasi Anda berlangganan EventBridge acara, aplikasi Anda memanggil CreateMediaInsightsPipeline API dengan konfigurasi pipeline wawasan media dan ARN Stream Video Kinesis untuk panggilan Konektor Suara.
Untuk informasi lebih lanjut tentang penggunaan EventBridge, lihatMemahami alur kerja untuk analitik berbasis pembelajaran mesin untuk Amazon Chime SDK.
-
Aplikasi Anda—seperti sistem Respons Suara Interaktif—atau agen memberikan pemberitahuan kepada penelepon mengenai perekaman panggilan dan penggunaan penyematan suara untuk analisis suara dan meminta persetujuan mereka untuk berpartisipasi.
-
Setelah penelepon memberikan persetujuan, aplikasi atau agen Anda dapat memanggil StartSpeakerSearchTask API melalui Voice SDK jika Anda memiliki Konektor Suara dan ID transaksi. Atau, jika Anda memiliki ID pipeline wawasan media alih-alih ID transaksi, Anda memang StartSpeakerSearchTask gil API di Media pipeline SDK.
Setelah penelepon memberikan persetujuan, aplikasi atau agen Anda memanggil
StartSpeakerSearchTaskAPI. Anda harus meneruskan ID Konektor Suara, ID transaksi, dan ID domain profil suara ke API. ID tugas pencarian pembicara dikembalikan untuk mengidentifikasi tugas asinkron.catatan
Sebelum memanggil
StartSpeakerSearchTaskAPI di salah satu SDK, Anda harus memberikan pemberitahuan yang diperlukan, dan mendapatkan persetujuan yang diperlukan, sebagaimana diwajibkan oleh hukum dan berdasarkan persyaratan layanan AWS. -
Sistem mengakumulasi 10 detik suara penelepon. Penelepon harus berbicara setidaknya selama jumlah waktu itu. Sistem tidak menangkap atau menganalisis keheningan.
-
Pipeline wawasan media membandingkan pidato dengan profil suara di domain dan mencantumkan 10 kecocokan kepercayaan tinggi teratas. Jika tidak menemukan kecocokan, Konektor Suara membuat profil suara.
-
Layanan pipeline wawasan media mengirimkan peristiwa notifikasi ke target notifikasi yang dikonfigurasi.
-
Penelepon terus berbicara dan memberikan tambahan 10 detik pidato tanpa diam.
-
Pipeline wawasan media menghasilkan penyematan suara pendaftaran yang dapat Anda gunakan untuk membuat profil suara atau memperbarui profil suara yang ada.
-
Pipeline wawasan media mengirimkan
VoiceprintGenerationSuccessfulpemberitahuan ke target notifikasi yang dikonfigurasi. -
Aplikasi Anda memanggil UpdateVoiceProfile API CreateVoiceProfile or untuk membuat atau memperbarui profil.
-
Aplikasi Anda memanggil GetSpeakerSearchTask API sesuai kebutuhan untuk mendapatkan status terbaru dari tugas pencarian pembicara.