Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.
Dettagli dei risultati del test in Test Workbench
I risultati del test mostrano i dettagli del set di test, gli intenti utilizzati e gli slot utilizzati. Fornisce inoltre la suddivisione complessiva degli input del set di test che include i risultati complessivi, i risultati della conversazione, l'intento e i risultati degli slot.
I risultati dei test comprendono tutte le informazioni relative ai test, come:
-
Dettagli del test, metadati
-
Risultati complessivi
-
Risultati della conversazione
-
Risultati relativi all'intento e allo slot
-
Risultati dettagliati
Scheda dei risultati complessivi:
Suddivisione degli input del set di test: questo grafico mostra la suddivisione del numero di conversazioni e delle singole espressioni di input nel set di test.
Suddivisione a input singolo: visualizza due grafici che includevano conversazioni end-to-end e trascrizioni vocali. Il numero di input passati e non riusciti è indicato su ciascun grafico. Nota: il grafico di trascrizione vocale sarà visibile solo per il set di test audio.
Suddivisione delle conversazioni: visualizza due grafici che includevano conversazioni end-to-end e trascrizioni vocali. Il numero di input passati e non riusciti è indicato su ciascun grafico. Nota: il grafico di trascrizione vocale sarà visibile solo per il set di test audio.
Scheda dei risultati della conversazione:
Percentuali di superamento delle conversazioni: la tabella delle percentuali di superamento delle conversazioni viene utilizzata per vedere quali intenti e slot vengono utilizzati in ciascuna conversazione del set di test. Puoi visualizzare dove la conversazione è fallita esaminando quale intento o slot non è riuscito, insieme alla percentuale di superamento di ogni intento e slot.
Metriche di fallimento delle intenzioni di conversazione: questa metrica mostra i 5 intenti con le prestazioni peggiori nel set di test. Questo pannello mostra un grafico della percentuale o del numero di intenti riusciti o falliti in base ai registri delle conversazioni o alla trascrizione del bot. Un intento riuscito non significa che l'intera conversazione abbia avuto successo. Queste metriche si applicano solo al valore degli intenti, indipendentemente dall'intento precedente o successivo.
Metriche relative agli errori relativi agli slot di conversazione: questa metrica mostra i 5 slot con le prestazioni peggiori del set di test. Ha indicato la percentuale di successo per ogni slot nell'intento. Il grafico a barre mostra sia la trascrizione vocale che le conversazioni end-to-end per ogni slot dell'intento.
Scheda dei risultati dell'intento e dello slot:
Metriche di riconoscimento degli intenti: mostra una tabella con il numero di intenti che sono stati riconosciuti con successo. Visualizza la velocità di trasmissione della trascrizione vocale e delle conversazioni end-to-end.
Metriche di risoluzione degli slot: mostra gli intenti e gli slot separatamente e la percentuale di successo e fallimento di ogni slot per ogni intento utilizzato nella conversazione o nel singolo input. Visualizza la velocità di trasmissione della trascrizione vocale e delle conversazioni end-to-end.
Scheda dettagliata dei risultati:
Risultati dettagliati: mostra una tabella dettagliata sul registro delle conversazioni con gli enunciati dell'utente e dell'agente e l'output e la trascrizione previsti per ogni slot. È possibile scaricare questo rapporto selezionando il pulsante Download.
La tabella seguente elenca i messaggi di errore risultanti dall'errore con scenari.
| Scenario | Messaggio di errore | Azione |
|---|---|---|
| Mancata corrispondenza degli intenti | BookFlight Intento previsto ma era intento. BookHotel | Salta gli altri turni della conversazione |
| Mancata corrispondenza tra slot e elicitation | L'intervallo previsto per la data di partenza era stato ottenuto, ma era CabinType. | Salta gli altri turni della conversazione |
| Mancata corrispondenza del valore dello slot | Mancata corrispondenza tra il valore dello slot previsto e quello effettivo. | Continua con gli altri turni delle conversazioni |
| Back-to-back manca il prompt dell'agente | Ci si aspettava che il bot restituisse un prompt all'agente in questo turno, ma non è stato ricevuto. | Salta gli altri turni della conversazione |
| Mancata corrispondenza della trascrizione | La trascrizione prevista non corrispondeva alla trascrizione effettiva. | Continua con altri turni delle conversazioni |
| Slot opzionale non ottenuto | Si prevede di ottenere lo slot CabinType nel prossimo turno, ma l'intento attuale è stato soddisfatto prima. | Salta gli altri turni della conversazione |
| Slot non riconosciuto | Lo slot previsto per la data di partenza non è stato riconosciuto in questo turno. | Salta gli altri turni della conversazione |
| Richiesta aggiuntiva consecutiva per gli agenti | Era previsto il turno di un utente, ma è stato richiesto dall'agente | Salta gli altri turni della conversazione |