View a markdown version of this page

Details zu den Testergebnissen in Test Workbench - Amazon Lex

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

Details zu den Testergebnissen in Test Workbench

Die Testergebnisse zeigen die Details des Testsatzes, die verwendeten Absichten und die verwendeten Slots. Es enthält auch die Aufschlüsselung der Gesamteingaben für den Testsatz, einschließlich der Gesamtergebnisse, der Konversationsergebnisse, der Absicht und der Slot-Ergebnisse.

Die Testergebnisse umfassen alle testbezogenen Informationen wie:

  • Metadaten zu den Testdetails

  • Gesamtergebnisse

  • Ergebnisse der Konversation

  • Absicht und Slot-Ergebnisse

  • Detaillierte Ergebnisse

Registerkarte „Gesamtergebnisse“:

Das Testset gibt mithilfe der Test Workbench ein Aufschlüsselungsdiagramm in die Testergebnisse ein.

Aufschlüsselung der Testset-Eingaben — Dieses Diagramm zeigt die Aufschlüsselung der Anzahl der Konversationen und einzelner Eingabeäußerungen im Testsatz.

Das Diagramm zur Aufschlüsselung einzelner Eingaben in den Testergebnissen mithilfe der Test Workbench.

Aufschlüsselung nach einer Eingabe — Zeigt zwei Diagramme an, die Konversationen von Anfang bis Ende und Sprachtranskriptionen enthalten. Die Anzahl der bestandenen und fehlgeschlagenen Eingaben ist in jedem Diagramm angegeben. Hinweis: Das Diagramm zur Sprachtranskription ist nur für das Audiotest-Set sichtbar.

Das Diagramm zur Aufschlüsselung der Konversation in den Testergebnissen mithilfe der Test Workbench.

Aufschlüsselung der Konversation — Zeigt zwei Diagramme an, die komplette Konversationen und Sprachtranskriptionen enthalten. Die Anzahl der bestandenen und fehlgeschlagenen Eingaben ist in jedem Diagramm angegeben. Hinweis: Das Diagramm zur Sprachtranskription ist nur für das Audiotest-Set sichtbar.

Registerkarte „Konversationsergebnisse“:

Die Erfolgsquoten der Konversation werden in den Testergebnissen mithilfe der Test Workbench angezeigt.

Quoten für erfolgreiche Konversationen — Anhand der Tabelle mit den Quoten für erfolgreiche Konversationen wird ermittelt, welche Absichten und Zeiträume in den einzelnen Konversationen im Testsatz verwendet werden. Du kannst dir vorstellen, an welchen Stellen die Konversation gescheitert ist, indem du dir überprüfst, welche Absicht oder welcher Abschnitt nicht bestanden wurde. Außerdem kannst du dir die Erfolgsquote jeder Absicht und jedes Gesprächs ansehen.

Die Metriken zum Scheitern der Konversationsabsicht werden in den Testergebnissen mithilfe der Test Workbench dargestellt.

Metriken zum Scheitern der Konversationsabsicht — Diese Metrik zeigt die 5 Absichten mit der schlechtesten Leistung im Testsatz. In diesem Bereich wird anhand der Konversationsprotokolle oder der Transkription des Bots ein Diagramm angezeigt, das zeigt, wie viel Prozent oder wie viele Intents erfolgreich waren oder nicht. Eine erfolgreiche Absicht bedeutet nicht, dass die gesamte Konversation erfolgreich war. Diese Kennzahlen beziehen sich nur auf den Wert der Absichten, unabhängig davon, welche Absicht davor oder danach kam.

Die Fehlermetriken für den Conversation-Slot werden mithilfe der Test Workbench in den Testergebnissen dargestellt.

Metriken zum Ausfall von Konversations-Slots — Diese Metrik zeigt die 5 Slots mit der schlechtesten Leistung im Testset. Gibt die Erfolgsquote für jeden Slot in der Absicht an. Das Balkendiagramm zeigt sowohl die Sprachtranskription als auch die Konversationen von Anfang bis Ende für jeden Abschnitt in der Absicht.

Registerkarte „Absicht“ und „Slot-Ergebnisse“:

Die Metriken zur Absichtserkennung werden mithilfe der Test Workbench in den Testergebnissen dargestellt.

Metriken zur Absichtserkennung — Zeigt eine Tabelle an, aus der hervorgeht, wie viele Absichten erfolgreich erkannt wurden. Zeigt die Erfolgsquote von Sprachtranskriptionen und Konversationen von Anfang bis Ende an.

Die Metriken für die Slot-Auflösung werden in den Testergebnissen mithilfe der Test Workbench dargestellt.

Metriken für die Slot-Auflösung — Zeigt die Intents und Slots getrennt an und zeigt die Erfolgs- und Misserfolgsrate jedes Slots für jeden Intent an, der in der Konversation oder bei einer einzelnen Eingabe verwendet wurde. Zeigt die Erfolgsquote der Sprachtranskription und der Konversationen von Anfang bis Ende an.

Registerkarte „Detaillierte Ergebnisse“:

Die detaillierten Ergebnisse in Testergebnissen mit der Test Workbench.

Detaillierte Ergebnisse — Zeigt eine detaillierte Tabelle im Konversationsprotokoll mit den Äußerungen von Benutzern und Agenten sowie der erwarteten Ausgabe und erwarteten Transkription für jeden Slot. Sie können diesen Bericht herunterladen, indem Sie auf die Schaltfläche Herunterladen klicken.

In der folgenden Tabelle sind die daraus resultierenden Fehlermeldungen mit Szenarien aufgeführt.

Szenario Fehlermeldung Action
Absicht stimmt nicht überein Erwartete BookFlight Absicht, aber es war BookHotel Absicht.

Überspringen Sie andere Runden in der Konversation

Slot-Auslösung stimmt nicht überein Es wurde erwartet, dass der Slot „Abreisetag“ ermittelt wird, aber es war CabinType. Überspringe andere Runden in der Konversation
Slot-Werte stimmen nicht überein Der erwartete und der tatsächliche Slot-Wert stimmen nicht überein. Fahren Sie mit anderen Gesprächsrunden fort
Back-to-back Die Agentenaufforderung fehlt Es wurde erwartet, dass der Bot in diesem Zug eine Agentenaufforderung zurückgibt, aber sie wurde nicht empfangen. Überspringen Sie andere Runden in der Konversation
Die Transkription stimmt nicht überein Die erwartete Transkription stimmte nicht mit der tatsächlichen Transkription überein. Fahren Sie mit anderen Gesprächsrunden fort
Optionaler Steckplatz wurde nicht ausgewählt Es wird erwartet, dass der CabinType-Slot in der nächsten Runde ausgelöst wird, aber die aktuelle Absicht davor wurde erfüllt. Überspringe andere Runden in der Konversation
Steckplatz wurde nicht erkannt Der Slot mit dem voraussichtlichen Abflugdatum wurde in diesem Zug nicht erkannt. Überspringe andere Runden in der Konversation
Zusätzliche aufeinanderfolgende Agentenaufforderung Ich habe erwartet, dass der Benutzer an die Reihe kommt, aber es war eine Agentenauff Überspringen Sie andere Runden in der Konversation