View a markdown version of this page

Esempio di flusso di lavoro di analisi del tono vocale per l'SDK Amazon Chime - SDK Amazon Chime

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

Esempio di flusso di lavoro di analisi del tono vocale per l'SDK Amazon Chime

Importante

L'analisi del tono vocale implica la formulazione di previsioni sul sentimento di chi parla sulla base di informazioni linguistiche e tonali. Non è consentito utilizzare l'analisi del sentiment in alcun modo proibito dalla legge, anche in relazione all'assunzione di decisioni su un individuo che potrebbero produrre impatti legali o altrettanto significativi su tali individui (ad esempio, in relazione all'occupazione, all'alloggio, al merito di credito o alle offerte finanziarie, ecc.).

L'analisi del tono vocale analizza le voci delle persone che partecipano a una chiamata e prevede il loro sentimento, o, o. positive negative neutral

Il diagramma seguente mostra un esempio di flusso di lavoro per l'analisi del tono vocale. Gli elementi numerati sotto l'immagine descrivono ogni fase del processo.

Nota

Il diagramma presuppone che tu abbia già configurato un Amazon Chime SDK Voice Connector con una configurazione di analisi delle chiamate con un. VoiceAnalyticsProcessor Per ulteriori informazioni, consulta Registrazione delle chiamate con Voice Connector.

Un diagramma che mostra il flusso di dati attraverso un'analisi del tono vocale.

Nel diagramma:

  1. Un chiamante effettua l'accesso utilizzando un numero di telefono assegnato a un Amazon Chime SDK Voice Connector. Oppure, un agente utilizza un numero di Voice Connector per effettuare una chiamata in uscita.

  2. Il servizio Voice Connector crea un ID di transazione e lo associa alla chiamata.

  3. L'applicazione, ad esempio un sistema di risposta vocale interattiva, o l'agente informa il chiamante in merito alla registrazione delle chiamate e all'uso degli incorporamenti vocali per l'analisi vocale e richiede il suo consenso per partecipare.

  4. Supponendo che l'applicazione sia abbonata agli EventBridge eventi, l'applicazione chiama l'CreateMediaInsightsPipelineAPI con la configurazione della pipeline with the media insights e gli ARN Kinesis Video Stream per la chiamata Voice Connector.

    Per ulteriori informazioni sull'utilizzo, fare riferimento a. EventBridge Comprendere i flussi di lavoro per l'analisi basata sull'apprendimento automatico per l'SDK Amazon Chime

  5. Una volta che il chiamante fornisce il consenso, l'applicazione o l'agente può chiamare l'StartSpeakerSearchTaskAPI tramite Voice SDK se disponi di un Voice Connector e di un ID di transazione. Oppure, se disponi di un ID della pipeline di Media Insights anziché di un ID di transazione, puoi chiamare l'StartSpeakerSearchTaskAPI nel Media pipelines SDK.

    Una volta che il chiamante fornisce il consenso, l'applicazione o l'agente chiama l'API. StartSpeakerSearchTask È necessario passare l'ID Voice Connector, l'ID della transazione e l'ID del dominio del profilo vocale all'API. Viene restituito un ID dell'attività di ricerca vocale per identificare l'attività asincrona.

  6. L'utente parla durante tutta la chiamata.

  7. L'agente parla durante tutta la chiamata.

  8. Ogni 5 secondi, la pipeline di Media Insights utilizza un modello di machine learning per analizzare gli ultimi 30 secondi di discorso e prevedere il tono del chiamante per quell'intervallo e per l'intera chiamata dal momento in cui StartVoiceToneAnalysisTask è stata chiamata per la prima volta.

  9. La pipeline di media insights invia una notifica con tali informazioni alle destinazioni di notifica configurate. Puoi identificare la notifica in base all'ARN dello stream e all'ID del canale. Per ulteriori informazioni, consulta più avanti in questa sezione. Informazioni sulle notifiche per l'SDK Amazon Chime

  10. Ripetere i passaggi 9 e 10 fino al termine della chiamata.

  11. Al termine della chiamata, la pipeline di Media Insights invia un'ultima notifica con la previsione attuale del tono medio per gli ultimi 30 secondi, più il tono medio dell'intera chiamata.

  12. L'applicazione richiama l'GetVoiceToneAnalysisTaskAPI in base alle esigenze per ottenere lo stato più recente dell'attività di analisi del tono vocale.

    Nota

    L'GetVoiceToneAnalysisTaskAPI non trasmette in streaming i dati del tono.

Nota

L'GetVoiceToneAnalysisTaskAPI non restituisce i dati relativi ai toni vocali.