View a markdown version of this page

Grundlegendes zu Workflows für auf maschinellem Lernen basierende Analysen für das Amazon Chime SDK - Amazon Chime SDK

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

Grundlegendes zu Workflows für auf maschinellem Lernen basierende Analysen für das Amazon Chime SDK

In den folgenden Abschnitten wird beschrieben, wie Sie die Analysefunktionen für maschinelles Lernen verwenden, die von der Amazon Chime SDK-Anrufanalyse bereitgestellt werden.

Anmerkung

Wenn Sie vorhaben, mehrere maschinelle Lernanalysen auf demselben Kinesis-Videostream auszuführen, müssen Sie möglicherweise das Limit auf Verbindungsebene für und für den Videostream erhöhen. GetMedia GetMediaForFragmentList Weitere Informationen finden Sie im Kinesis Video Streams-Entwicklerhandbuch unter Grenzwerte für Kinesis Video Streams.

Verwenden Sie diesen Workflow, wenn:

  • Sie möchten ein konsolengesteuertes Setup.

  • Sie verwenden bereits einen Voice Connector oder planen, dies zu tun, um SIP-Medien in die Anrufanalyse einzubeziehen. Voice Connectors unterstützen sowohl SIP als auch SIPREC. Weitere Informationen zur Konfiguration von Voice Connectors finden Sie unter Amazon Chime SDK Voice Connector verwalten.

  • Sie möchten dieselbe Media Insights-Konfiguration auf jeden Voice Connector-Anruf anwenden.

  • Sie müssen die Amazon Chime SDK-Sprachanalyse verwenden, für die ein Voice Connector oder eine Media Insights Pipeline erforderlich ist.

Um diesen Workflow in der Amazon Chime SDK-Konsole zu aktivieren, folgen Sie den Schritten zum Erstellen einer Aufzeichnungskonfiguration in Configuring Voice Connectors to use call analytics.

Um diesen Workflow programmgesteuert zu aktivieren, verwenden Sie die folgenden APIs: CreateMediaInsightsPipelineConfiguration API, um eine Anrufanalysekonfiguration zu erstellen, und verknüpfen Sie die Konfiguration dann mithilfe der PutVoiceConnectorStreamingConfiguration API mit einem Voice Connector. Weitere Informationen finden Sie unter Konfiguration von Voice Connectors für die Verwendung von Sprachanalysen im Amazon Chime SDK-Administratorhandbuch.

Das folgende Diagramm zeigt den Datenfluss, wenn ein Voice Connector eine Anrufanalysesitzung initiiert. Die Zahlen im Diagramm entsprechen dem nummerierten Text unten.

Image showing the flow of data when a Voice Connector initiates a call.

In der Abbildung:

  1. Sie verwenden die Amazon Chime SDK-Konsole oder die CreateMediaInsightsPipelineConfiguration API, um eine Media Insights-Pipeline-Konfiguration zu erstellen.

  2. Sie verwenden die Amazon Chime SDK-Konsole oder die PutVoiceConnectorStreamingConfiguration API, um die Konfiguration einem Voice Connector zuzuordnen. Informationen zum Zuordnen einer vorhandenen Konfiguration zu einem Voice Connector finden Sie unter Configuring Voice Connectors to use call analytics im Amazon Chime SDK-Administratorhandbuch.

  3. Während eines ausgehenden Anrufs empfängt der Voice Connector das Audio jedes Gesprächsteilnehmers.

  4. Aufgrund der integrierten Integration mit der Anrufanalyse initiiert der Voice Connector-Dienst eine Anrufanalysesitzung mithilfe des Media Pipeline-Dienstes, wenn eine Anrufanalysekonfiguration an einen Voice Connector angehängt ist.

  5. Der Media Pipeline-Dienst ruft einen oder mehrere Medienprozessoren auf, wie in der Konfiguration angegeben.

  6. Der Media Pipeline-Dienst sendet die Ausgabedaten je nach Konfiguration an ein oder mehrere Ziele. Sie können beispielsweise Echtzeitanalysen über einen Amazon Kinesis Data Stream senden. Falls konfiguriert, können Sie die Metadaten und Analysen des Anrufs an ein Amazon S3-Data Warehouse senden.

  7. Der Media Pipeline-Service sendet die Pipeline-Statusereignisse an das standardmäßige Amazon EventBridge. Wenn Sie Regeln konfiguriert haben, werden die entsprechenden Benachrichtigungen EventBridge ebenfalls an Amazon gesendet. Weitere Informationen finden Sie unter EventBridge Benachrichtigungen verwenden.

Anmerkung

Sie können Voice Connector-Anrufdaten in Kinesis Video Streams für unterschiedliche Zeiträume speichern, von Stunden bis zu Jahren. Wenn Sie sich dafür entscheiden, keine Daten aufzubewahren, wird die Nutzbarkeit der Anrufdaten für den sofortigen Zugriff eingeschränkt. Die Kosten für Kinesis Video Streams werden auf der Grundlage der verwendeten Bandbreite und des insgesamt genutzten Speichers bestimmt. Sie können die Aufbewahrungsdauer der Daten jederzeit anpassen, indem Sie die Streaming-Konfiguration Ihres Voice Connectors bearbeiten. Um die Aufzeichnung von Anrufanalysen zu aktivieren, müssen Sie sicherstellen, dass der Kinesis Video Stream Daten speichert, bis die Anrufanalyse abgeschlossen ist. Dazu geben Sie einen geeigneten Zeitraum für die Datenspeicherung an.

Sie können eine Media Insights-Pipeline-Konfiguration mit beliebig vielen Voice Connectors verknüpfen. Sie können auch für jeden Voice Connector eine andere Konfiguration erstellen. Voice Connectors verwenden das AWSServiceRoleForAmazonChimeVoiceConnector , um die CreateMediaInsightsPipeline API in Ihrem Namen einmal pro Transaktions-ID aufzurufen. Informationen zur Rolle finden Sie im Amazon Chime SDK-Administratorhandbuch unter Verwenden der serviceverknüpften Amazon Chime SDK-Rolle für Amazon Chime SDK Voice Connectors.

Verwenden Sie diesen Workflow, wenn Sie einen Voice Connector verwenden, aber kontrollieren müssen, wann Sie eine Konfiguration für die Anrufanalyse anwenden und auf welchen Anruf die Konfiguration angewendet werden soll.

Um diese Methode zu verwenden, müssen Sie ein EventBridge Ziel für Ereignisse erstellen, die der Voice Connector veröffentlicht, und dann die Ereignisse verwenden, um die APIs der Anrufanalyse-Pipeline auszulösen. Weitere Informationen finden Sie unter Automatisieren des Amazon Chime SDK mit EventBridge im Amazon Chime SDK-Administratorhandbuch.

Das folgende Diagramm zeigt, wie eine detailliertere Steuerung bei der Verwendung von Anrufanalysen mit Voice Connector implementiert werden kann. Die Zahlen im Diagramm entsprechen den Zahlen im folgenden Text.

Das Bild zeigt den Datenfluss bei der Verwendung von API-Aufrufen mit Voice Connectors.

Im Diagramm:

  1. Sie verwenden die Amazon Chime SDK-Konsole oder die CreateMediaInsightsPipelineConfiguration API, um eine Media Insights-Pipeline-Konfiguration zu erstellen.

  2. Während eines ausgehenden Anrufs empfängt der Voice Connector die Audiodaten der Teilnehmer.

  3. Der Voice Connector sendet das Gesprächsaudio an den Kinesis Video Stream und die entsprechenden Ereignisse an den EventBridge. Diese Ereignisse verfügen über Stream- und Anrufmetadaten.

  4. Ihre Anwendung wurde EventBridge über ein EventBridge Target abonniert.

  5. Ihre Anwendung ruft die Amazon Chime SDK-API auf. CreateMediaInsightsPipeline

  6. Der Media Pipeline-Service ruft einen oder mehrere Medienprozessoren auf der Grundlage der Prozessorelemente in der Media Insights-Pipeline-Konfiguration auf.

  7. Der Media Pipeline-Dienst sendet die Ausgabedaten je nach Konfiguration an ein oder mehrere Ziele. Die Amazon Chime SDK-Anrufanalyse bietet Echtzeitanalysen über Amazon Kinesis Data Stream und ruft, sofern konfiguriert, Metadatenanalysen an ein Amazon S3-Data Warehouse auf.

  8. Der Media Pipeline-Service sendet die Ereignisse an Amazon. EventBridge Wenn Sie Regeln konfiguriert haben, werden die entsprechenden Benachrichtigungen EventBridge ebenfalls an Amazon gesendet.

  9. Sie können die Anruf-Analysesitzung unterbrechen oder fortsetzen, indem Sie die UpdateMediaInsightsPipelineStatus API aufrufen.

    Anmerkung

    Die Anrufaufzeichnung unterstützt das Anhalten und Wiederaufnehmen von Anrufen nicht. Außerdem werden Sprachanalyseaufgaben, die für den Anruf gestartet wurden, ebenfalls beendet, wenn Sie eine Sitzung unterbrechen. Um sie neu zu starten, müssen Sie die StartSpeakerSearchTask oder StartVoiceToneAnalyisTask APIs aufrufen.

  10. Wenn Sie bei der Konfiguration die Sprachtonanalyse auswählen, starten Sie die Sprachanalyse, indem Sie die StartSpeakerSearchTask oder StartVoiceToneAnalyisTask -APIs aufrufen.

Um diese Option verwenden zu können, müssen Sie Audiodaten in Kinesis Video Streams (KVS) veröffentlichen und dann die CreateMediaInsightsPipeline API mit den KVS-Stream-Kanalinformationen aufrufen.

Anmerkung

Die Anrufanalyse-APIs unterstützen maximal zwei Audiokanäle.

Beim Aufruf der CreateMediaInsightsPipeline API können Sie Fragmentnummern für jede KVS-Stream-Kanaldefinition angeben. Wenn Sie eine Fragmentnummer angeben, beginnt Call Analytics mit der Verarbeitung des Streams an diesem Fragment. Andernfalls beginnt Call Analytics mit der Verarbeitung des Streams ab dem neuesten verfügbaren Fragment.

Die Anrufanalyse unterstützt PCM-Audio (nur signierte 16-Bit-Little-Endian-Audioformate, die WAV nicht enthalten) mit einer Audio-Sample-Rate zwischen 8 kHz und 48 kHz. Low-quality Audio, wie z. B. Telefonie-Audio, liegt in der Regel bei etwa 8.000 Hz. High-quality Audio reicht in der Regel von 16.000 Hz bis 48.000 Hz. Die von Ihnen angegebene Samplerate muss mit der Ihres Audios übereinstimmen. Weitere Informationen finden Sie KinesisVideoStreamSourceRuntimeConfiguration in der Amazon Chime SDK API-Referenz.

Das Kinesis Video Streams Producer SDK bietet eine Reihe von Bibliotheken, mit denen Sie Audiodaten in einen Kinesis Video Stream streamen können. Weitere Informationen finden Sie unter Kinesis Video Streams Producer Libraries im Amazon Kinesis Video Streams Developer Guide.

Das folgende Diagramm zeigt den Datenfluss bei der Verwendung von Anrufanalysen mit einem benutzerdefinierten Kinesis Video Stream-Producer. Die Zahlen im Diagramm entsprechen dem nummerierten Text unten.

Das Bild zeigt den Datenfluss bei der Verwendung von Anrufanalysen mit einem Kinesis Video Stream-Producer.
  1. Sie verwenden die AWS Konsole oder die CreateMediaInsightsPipelineConfiguration API, um eine Media Insights-Pipeline-Konfiguration zu erstellen.

  2. Sie verwenden einen Kinesis Video Stream Producer, um Audio in Kinesis Video Streams zu schreiben.

  3. Ihre Anwendung ruft die API auf. CreateMediaInsightsPipeline

  4. Der Media Pipeline-Service liest Audio aus den Kinesis Video Streams des Kunden.

  5. Der Media Pipeline-Service sendet die Ereignisse an Amazon EventBridge. Wenn Sie Regeln konfiguriert haben, werden die entsprechenden Benachrichtigungen EventBridge ebenfalls an Amazon gesendet.

  6. Der Media Pipeline-Dienst ruft ein oder mehrere Prozessorelemente auf.

  7. Der Media Pipeline-Dienst sendet Ausgabedaten an ein oder mehrere Senkenelemente.

  8. Sie können die Call-Analytics-Sitzung unterbrechen oder fortsetzen, indem Sie die UpdateMediaInsightsPipelineStatus API aufrufen.

    Anmerkung

    Die Anrufaufzeichnung unterstützt das Anhalten und Fortsetzen nicht.

  9. Ihre Anwendung kann die EventBridge Amazon-Ereignisse verarbeiten, um benutzerdefinierte Geschäftsabläufe auszulösen.

  10. Wenn Sie beim Erstellen einer Konfiguration Sprachanalyse auswählen, kann Ihre Anwendung die Sprachanalyse starten, indem sie die StartSpeakerSearchTask oder StartVoiceToneAnalyisTask -APIs aufruft.