一次性洞見報告
使用 StartBatchEvaluation對代理程式的工作階段執行隨需洞見分析。當您想要調查部署之後的客服人員行為、失敗激增或定期手動檢查時,此功能非常有用。
開始分析
範例
輪詢結果
範例
檢閱失敗分析問題清單
if "failureAnalysisResult" in result: for category in result["failureAnalysisResult"]["failures"]: print(f"\nCategory: {category['name']} ({category['affectedSessionCount']} sessions)") for sub in category.get("subCategories", []): print(f" Subcategory: {sub['name']} ({sub['affectedSessionCount']} sessions)") for rc in sub.get("rootCauses", []): print(f" Root cause: {rc['name']}") print(f" Recommendation: {rc['recommendation']}") print(f" Affected sessions: {rc['affectedSessionCount']}")
| 欄位 | Type | Description |
|---|---|---|
|
|
String |
失敗類別名稱 (例如「執行錯誤」、「Hallucinations」)。 |
|
|
Integer |
受此類別影響的工作階段數量。 |
|
|
String |
子類別名稱 (例如「速率限制」、「工具結構描述違規」)。 |
|
|
Integer |
受此子類別影響的工作階段數量。 |
|
|
String |
根本原因叢集名稱。 |
|
|
String |
此根本原因的建議修正。 |
|
|
Integer |
受此根本原因影響的工作階段數量。 |
|
|
清單 |
此叢集中的工作階段,每個工作階段都有 |
使用者意圖結果
userIntentResult 欄位包含叢集使用者意圖:
if "userIntentResult" in result: for cluster in result["userIntentResult"]["userIntents"]: print(f" {cluster['name']} ({cluster['affectedSessionCount']} sessions)") print(f" {cluster['description']}")
| 欄位 | Type | 說明 |
|---|---|---|
|
|
Integer |
叢集識別符。 |
|
|
String |
描述常見意圖的叢集名稱。 |
|
|
String |
意圖模式的詳細描述。 |
|
|
Integer |
具有此意圖的工作階段數量。 |
|
|
清單 |
此叢集中的工作階段,每個工作階段都有 |
執行摘要結果
executionSummaryResult 欄位包含叢集執行模式:
| 欄位 | Type | 說明 |
|---|---|---|
|
|
Integer |
叢集識別符。 |
|
|
String |
描述執行模式的叢集名稱。 |
|
|
String |
模式的詳細描述。 |
|
|
Integer |
此模式的工作階段數量。 |
|
|
清單 |
此叢集中的工作階段,每個工作階段都有 |
解譯結果
-
從失敗分析開始:專注於具有最高 的類別
affectedSessionCount。這些代表最有影響力的問題。 -
深入了解根本原因:在每個子類別中,根本原因叢集會確切告訴您發生了什麼問題,以及如何修正它。每個叢集都包含
recommendation欄位。 -
使用使用者意圖來排定優先順序:具有使用者意圖叢集的交互參考失敗類別。影響您最常見使用者意圖的失敗應該是最高優先順序。
-
追蹤執行模式:執行摘要顯示代理程式如何處理問題 — 有助於了解失敗是否來自代理程式的策略與工具/環境問題。
驗證規則
-
insights和evaluators互斥 — 提供其中一個,而不是兩者。 -
每個請求最多 10 個洞見。
-
dataSourceConfig是必要項目,且必須包含至少一個日誌群組和一個服務名稱。 -
如果使用
onlineEvaluationConfigSource,請勿提供insights或evaluators(組態會繼承)。 -
如果指定
filterConfig.timeRange,則startTime必須早於endTime。 -
時間戳記必須是有效的 ISO 8601 格式。
-
每個帳戶一次只能啟用一個批次評估。
-
每個洞察執行最多分析 500 個工作階段。