View a markdown version of this page

Informazioni sul flusso di lavoro di ricerca degli altoparlanti per l'SDK Amazon Chime - SDK Amazon Chime

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

Informazioni sul flusso di lavoro di ricerca degli altoparlanti per l'SDK Amazon Chime

In questa sezione, ti mostriamo un esempio di flusso di dati e programmi per un'analisi della ricerca degli altoparlanti di Amazon Chime SDK.

La funzione di ricerca degli altoparlanti prevede la creazione di un'integrazione vocale, che può essere utilizzata per confrontare la voce di un chiamante con i dati vocali memorizzati in precedenza. La raccolta, l'uso, l'archiviazione e la conservazione di identificatori biometrici e informazioni biometriche sotto forma di impronta vocale digitale possono richiedere il consenso informato del chiamante tramite una dichiarazione scritta. Tale consenso è richiesto da varie leggi statali, comprese le leggi sulla biometria in Illinois, Texas, Washington e altre leggi statali sulla privacy. Prima di utilizzare la funzione di ricerca degli altoparlanti, è necessario fornire tutte le notifiche e ottenere tutti i consensi, come richiesto dalla legge applicabile e in base ai termini del servizio AWS che regolano l'utilizzo della funzionalità.

Il diagramma seguente mostra un esempio di flusso di dati attraverso un'attività di analisi di Speaker Search. Le descrizioni numerate sotto il diagramma descrivono ogni fase del processo. Il diagramma presuppone che tu abbia già configurato un Amazon Chime SDK Voice Connector con una configurazione di analisi delle chiamate con un. VoiceAnalyticsProcessor Per ulteriori informazioni, consulta Registrazione delle chiamate con Voice Connector.

Un diagramma che mostra il flusso di dati attraverso un'analisi di ricerca degli altoparlanti.
  1. Tu o un amministratore di sistema create un dominio di profilo vocale per archiviare incorporamenti vocali e profili vocali. Per ulteriori informazioni sulla creazione di domini di profilo vocale, consulta Creazione di domini per profili vocali, nella Amazon Chime SDK Administrator Guide. Puoi anche utilizzare l'API. CreateVoiceProfileDomain

  2. Un chiamante effettua l'accesso utilizzando un numero di telefono assegnato a un Amazon Chime SDK Voice Connector. Oppure, un agente utilizza un numero di Voice Connector per effettuare una chiamata in uscita.

  3. Il servizio Amazon Chime SDK Voice Connector crea un ID di transazione e lo associa alla chiamata.

  4. Supponendo che l'applicazione sia abbonata agli EventBridge eventi, l'applicazione chiama l'CreateMediaInsightsPipelineAPI con la configurazione della pipeline with the media insights e gli ARN Kinesis Video Stream per la chiamata Voice Connector.

    Per ulteriori informazioni sull'utilizzo, fare riferimento a. EventBridge Comprendere i flussi di lavoro per l'analisi basata sull'apprendimento automatico per l'SDK Amazon Chime

  5. L'applicazione, ad esempio un sistema di risposta vocale interattiva, o l'agente informa il chiamante in merito alla registrazione delle chiamate e all'uso degli incorporamenti vocali per l'analisi vocale e richiede il suo consenso per partecipare.

  6. Una volta che il chiamante ha fornito il consenso, l'applicazione o l'agente può chiamare l'StartSpeakerSearchTaskAPI tramite Voice SDK se disponi di un Voice Connector e di un ID di transazione. Oppure, se disponi di un ID della pipeline di Media Insights anziché di un ID di transazione, puoi chiamare l'StartSpeakerSearchTaskAPI nel Media pipelines SDK.

    Una volta che il chiamante fornisce il consenso, l'applicazione o l'agente chiama l'API. StartSpeakerSearchTask È necessario passare l'ID Voice Connector, l'ID della transazione e l'ID del dominio del profilo vocale all'API. Viene restituito un ID dell'attività di ricerca vocale per identificare l'attività asincrona.

    Nota

    Prima di richiamare l'StartSpeakerSearchTaskAPI in uno degli SDK, devi fornire tutte le notifiche necessarie e ottenere i consensi necessari, come richiesto dalla legge e dai termini del servizio AWS. https://aws.amazon.com/service-terms/

  7. Il sistema accumula 10 secondi di voce del chiamante. Il chiamante deve parlare per almeno quel periodo di tempo. Il sistema non acquisisce né analizza il silenzio.

  8. La pipeline di media insights confronta il parlato con i profili vocali del dominio ed elenca le 10 principali corrispondenze ad alta confidenza. Se non trova una corrispondenza, Voice Connector crea un profilo vocale.

  9. Il servizio media insights pipeline invia un evento di notifica alle destinazioni di notifica configurate.

  10. Il chiamante continua a parlare e fornisce altri 10 secondi di discorso senza silenzio.

  11. La pipeline di media insights genera un incorporamento vocale per l'iscrizione che puoi utilizzare per creare un profilo vocale o aggiornare un profilo vocale esistente.

  12. La pipeline di media insights invia una VoiceprintGenerationSuccessful notifica agli obiettivi di notifica configurati.

  13. L'applicazione chiama le UpdateVoiceProfile API CreateVoiceProfile o per creare o aggiornare il profilo.

  14. L'applicazione richiama l'GetSpeakerSearchTaskAPI in base alle esigenze per ottenere lo stato più recente dell'attività di ricerca degli altoparlanti.