View a markdown version of this page

Beispiel für einen Workflow zur Sprachtonanalyse für das Amazon Chime SDK - Amazon Chime SDK

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

Beispiel für einen Workflow zur Sprachtonanalyse für das Amazon Chime SDK

Wichtig

Bei der Stimmtonanalyse werden anhand sprachlicher und tonaler Informationen Vorhersagen über die Stimmung eines Sprechers getroffen. Sie dürfen die Stimmungsanalyse nicht in einer gesetzlich verbotenen Weise verwenden, auch nicht im Zusammenhang mit Entscheidungen über eine Person, die rechtliche oder ähnlich erhebliche Auswirkungen auf diese Personen haben würden (z. B. in Bezug auf Beschäftigung, Wohnen, Kreditwürdigkeit oder finanzielle Angebote usw.).

Die Stimmentonanalyse analysiert die Stimmen der Gesprächsteilnehmer und sagt deren Stimmungslage entweder, oder positive voraus. negative neutral

Das folgende Diagramm zeigt einen beispielhaften Arbeitsablauf für eine Sprachtonanalyse. Nummerierte Elemente unter dem Bild beschreiben jeden Schritt des Prozesses.

Anmerkung

In der Abbildung wird davon ausgegangen, dass Sie bereits einen Amazon Chime SDK Voice Connector mit einer Anrufanalysekonfiguration konfiguriert haben, die über eine VoiceAnalyticsProcessor verfügt. Weitere Informationen finden Sie unter Aufzeichnen von Voice Connector-Anrufen.

Ein Diagramm, das den Datenfluss durch eine Sprachtonanalyse zeigt.

In dem Diagramm:

  1. Ein Anrufer wählt sich mit einer Telefonnummer ein, die einem Amazon Chime SDK Voice Connector zugewiesen ist. Oder ein Agent verwendet eine Voice Connector-Nummer, um einen ausgehenden Anruf zu tätigen.

  2. Der Voice Connector-Dienst erstellt eine Transaktions-ID und ordnet sie dem Anruf zu.

  3. Ihre Anwendung (z. B. ein interaktives Sprachantwortsystem) oder Ihr Agent informiert den Anrufer über die Anrufaufzeichnung und die Verwendung von Spracheinbettungen für Sprachanalysen und bittet ihn um seine Zustimmung zur Teilnahme.

  4. Angenommen, Ihre Anwendung abonniert EventBridge Ereignisse, ruft Ihre Anwendung die CreateMediaInsightsPipeline API mit der Konfiguration der Media Insights-Pipeline und den Kinesis Video Stream-ARNs für den Voice Connector-Anruf auf.

    Weitere Informationen zur Verwendung EventBridge finden Sie unter. Grundlegendes zu Workflows für auf maschinellem Lernen basierende Analysen für das Amazon Chime SDK

  5. Sobald der Anrufer seine Zustimmung erteilt hat, kann Ihre Anwendung oder Ihr Agent die StartSpeakerSearchTask API über das Voice SDK aufrufen, sofern Sie über einen Voice Connector und eine Transaktions-ID verfügen. Oder, wenn Sie eine Media Insights-Pipeline-ID anstelle einer Transaktions-ID haben, rufen Sie die StartSpeakerSearchTask API im Media Pipelines SDK auf.

    Sobald der Anrufer seine Zustimmung erteilt hat, ruft Ihre Anwendung oder Ihr Agent die API aufStartSpeakerSearchTask. Sie müssen die Voice Connector-ID, die Transaktions-ID und die Sprachprofil-Domänen-ID an die API übergeben. Zur Identifizierung der asynchronen Aufgabe wird eine Aufgaben-ID für die Sprechersuche zurückgegeben.

  6. Der Benutzer spricht während des gesamten Anrufs.

  7. Der Agent spricht während des gesamten Anrufs.

  8. Alle 5 Sekunden analysiert die Media Insights Pipeline mithilfe eines Machine-Learning-Modells die letzten 30 Sekunden des Gesprächs und sagt den Ton des Anrufers für dieses Intervall und für den gesamten Anruf ab dem StartVoiceToneAnalysisTask Zeitpunkt des ersten Anrufs voraus.

  9. Die Media Insights-Pipeline sendet eine Benachrichtigung mit diesen Informationen an die konfigurierten Benachrichtigungsziele. Sie können die Benachrichtigung anhand ihres Stream-ARN und ihrer Kanal-ID identifizieren. Weitere Informationen finden Sie weiter Grundlegendes zu Benachrichtigungen für das Amazon Chime SDK unten in diesem Abschnitt.

  10. Wiederholen Sie die Schritte 9 und 10, bis der Anruf beendet ist.

  11. Am Ende des Anrufs sendet die Media Insights Pipeline eine letzte Benachrichtigung mit der aktuellen durchschnittlichen Tonprognose für die letzten 30 Sekunden sowie dem durchschnittlichen Ton des gesamten Anrufs.

  12. Ihre Anwendung ruft die GetVoiceToneAnalysisTask API nach Bedarf auf, um den aktuellen Status der Aufgabe zur Analyse des Sprachtons abzurufen.

    Anmerkung

    Die GetVoiceToneAnalysisTask API streamt die Tondaten nicht.

Anmerkung

Die GetVoiceToneAnalysisTask API gibt keine Sprachtondaten zurück.