Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.
Details zu den Testergebnissen in Test Workbench
Die Testergebnisse zeigen die Details des Testsatzes, die verwendeten Absichten und die verwendeten Slots. Es enthält auch die Aufschlüsselung der Gesamteingaben für den Testsatz, einschließlich der Gesamtergebnisse, der Konversationsergebnisse, der Absicht und der Slot-Ergebnisse.
Die Testergebnisse umfassen alle testbezogenen Informationen wie:
-
Metadaten zu den Testdetails
-
Gesamtergebnisse
-
Ergebnisse der Konversation
-
Absicht und Slot-Ergebnisse
-
Detaillierte Ergebnisse
Registerkarte „Gesamtergebnisse“:
Aufschlüsselung der Testset-Eingaben — Dieses Diagramm zeigt die Aufschlüsselung der Anzahl der Konversationen und einzelner Eingabeäußerungen im Testsatz.
Aufschlüsselung nach einer Eingabe — Zeigt zwei Diagramme an, die Konversationen von Anfang bis Ende und Sprachtranskriptionen enthalten. Die Anzahl der bestandenen und fehlgeschlagenen Eingaben ist in jedem Diagramm angegeben. Hinweis: Das Diagramm zur Sprachtranskription ist nur für das Audiotest-Set sichtbar.
Aufschlüsselung der Konversation — Zeigt zwei Diagramme an, die komplette Konversationen und Sprachtranskriptionen enthalten. Die Anzahl der bestandenen und fehlgeschlagenen Eingaben ist in jedem Diagramm angegeben. Hinweis: Das Diagramm zur Sprachtranskription ist nur für das Audiotest-Set sichtbar.
Registerkarte „Konversationsergebnisse“:
Quoten für erfolgreiche Konversationen — Anhand der Tabelle mit den Quoten für erfolgreiche Konversationen wird ermittelt, welche Absichten und Zeiträume in den einzelnen Konversationen im Testsatz verwendet werden. Du kannst dir vorstellen, an welchen Stellen die Konversation gescheitert ist, indem du dir überprüfst, welche Absicht oder welcher Abschnitt nicht bestanden wurde. Außerdem kannst du dir die Erfolgsquote jeder Absicht und jedes Gesprächs ansehen.
Metriken zum Scheitern der Konversationsabsicht — Diese Metrik zeigt die 5 Absichten mit der schlechtesten Leistung im Testsatz. In diesem Bereich wird anhand der Konversationsprotokolle oder der Transkription des Bots ein Diagramm angezeigt, das zeigt, wie viel Prozent oder wie viele Intents erfolgreich waren oder nicht. Eine erfolgreiche Absicht bedeutet nicht, dass die gesamte Konversation erfolgreich war. Diese Kennzahlen beziehen sich nur auf den Wert der Absichten, unabhängig davon, welche Absicht davor oder danach kam.
Metriken zum Ausfall von Konversations-Slots — Diese Metrik zeigt die 5 Slots mit der schlechtesten Leistung im Testset. Gibt die Erfolgsquote für jeden Slot in der Absicht an. Das Balkendiagramm zeigt sowohl die Sprachtranskription als auch die Konversationen von Anfang bis Ende für jeden Abschnitt in der Absicht.
Registerkarte „Absicht“ und „Slot-Ergebnisse“:
Metriken zur Absichtserkennung — Zeigt eine Tabelle an, aus der hervorgeht, wie viele Absichten erfolgreich erkannt wurden. Zeigt die Erfolgsquote von Sprachtranskriptionen und Konversationen von Anfang bis Ende an.
Metriken für die Slot-Auflösung — Zeigt die Intents und Slots getrennt an und zeigt die Erfolgs- und Misserfolgsrate jedes Slots für jeden Intent an, der in der Konversation oder bei einer einzelnen Eingabe verwendet wurde. Zeigt die Erfolgsquote der Sprachtranskription und der Konversationen von Anfang bis Ende an.
Registerkarte „Detaillierte Ergebnisse“:
Detaillierte Ergebnisse — Zeigt eine detaillierte Tabelle im Konversationsprotokoll mit den Äußerungen von Benutzern und Agenten sowie der erwarteten Ausgabe und erwarteten Transkription für jeden Slot. Sie können diesen Bericht herunterladen, indem Sie auf die Schaltfläche Herunterladen klicken.
In der folgenden Tabelle sind die daraus resultierenden Fehlermeldungen mit Szenarien aufgeführt.
| Szenario | Fehlermeldung | Action |
|---|---|---|
| Absicht stimmt nicht überein | Erwartete BookFlight Absicht, aber es war BookHotel Absicht. | Überspringen Sie andere Runden in der Konversation |
| Slot-Auslösung stimmt nicht überein | Es wurde erwartet, dass der Slot „Abreisetag“ ermittelt wird, aber es war CabinType. | Überspringe andere Runden in der Konversation |
| Slot-Werte stimmen nicht überein | Der erwartete und der tatsächliche Slot-Wert stimmen nicht überein. | Fahren Sie mit anderen Gesprächsrunden fort |
| Back-to-back Die Agentenaufforderung fehlt | Es wurde erwartet, dass der Bot in diesem Zug eine Agentenaufforderung zurückgibt, aber sie wurde nicht empfangen. | Überspringen Sie andere Runden in der Konversation |
| Die Transkription stimmt nicht überein | Die erwartete Transkription stimmte nicht mit der tatsächlichen Transkription überein. | Fahren Sie mit anderen Gesprächsrunden fort |
| Optionaler Steckplatz wurde nicht ausgewählt | Es wird erwartet, dass der CabinType-Slot in der nächsten Runde ausgelöst wird, aber die aktuelle Absicht davor wurde erfüllt. | Überspringe andere Runden in der Konversation |
| Steckplatz wurde nicht erkannt | Der Slot mit dem voraussichtlichen Abflugdatum wurde in diesem Zug nicht erkannt. | Überspringe andere Runden in der Konversation |
| Zusätzliche aufeinanderfolgende Agentenaufforderung | Ich habe erwartet, dass der Benutzer an die Reihe kommt, aber es war eine Agentenauff | Überspringen Sie andere Runden in der Konversation |