View a markdown version of this page

AgentCore dati di osservabilità del gateway generati - Fondamento Amazon AgentCore

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

AgentCore dati di osservabilità del gateway generati

Le sezioni seguenti descrivono le metriche, i log e gli intervalli del gateway inviati AgentCore ad Amazon. CloudWatch Queste metriche non sono disponibili nella pagina di osservabilità dell'IA CloudWatch generativa. Le metriche del gateway vengono raggruppate a intervalli di un minuto. Per ulteriori informazioni sulla visualizzazione delle metriche del gateway, consulta Visualizzare i dati di osservabilità per i tuoi agenti Amazon Bedrock. AgentCore

Nota

Per abilitare i log forniti dal servizio per i AgentCore gateway, devi configurare le risorse necessarie. CloudWatch Per saperne di più, consulta Abilitazione dell'osservabilità per AgentCore runtime, memory, gateway, strumenti integrati e risorse di identità.

Metriche fornite

Gateway pubblica le metriche di richiamo e utilizzo su. CloudWatch Puoi visualizzare queste metriche e anche impostare allarmi per avvisarti quando determinate metriche superano le soglie. Per saperne di più, seleziona un argomento:

Parametri di invocazione

Queste metriche forniscono informazioni sulle chiamate alle API, sulle prestazioni e sugli errori.

Per queste metriche, vengono utilizzate le seguenti dimensioni:

  • Operazione: il nome dell'operazione API (es. InvokeGateway).

  • Protocollo: il nome del protocollo (es. MCP).

  • Metodo: rappresenta l'operazione MCP richiamata (es. tools/list).

  • Risorsa: rappresenta l'identificatore della risorsa (ad es. gateway ARN).

  • Nome: rappresenta il nome dello strumento.

Metrica Description Statistiche Unità

Invocazioni

Il numero totale di richieste effettuate a ciascuna API Data Plane. Ogni chiamata API conta come una chiamata indipendentemente dallo stato della risposta.

Somma

Conteggio

Throttles

Il numero di richieste limitate (codice di stato 429) dal servizio.

Somma

Conteggio

SystemErrors

Il numero di richieste non riuscite con il codice di stato 5xx.

Somma

Conteggio

UserErrors

Il numero di richieste non riuscite con il codice di stato 4xx tranne 429.

Somma

Conteggio

Latenza

Il tempo trascorso tra il momento in cui il servizio riceve la richiesta e l'inizio dell'invio del primo token di risposta. In altre parole, tempo di risposta iniziale.

Medio, minimo, massimo, p50, p90, p99

Millisecondi

Durata

Il tempo totale trascorso tra la ricezione della richiesta e l'invio del token di risposta finale. Rappresenta il tempo completo di elaborazione end-to-end della richiesta.

Medio, minimo, massimo, p50, p90, p99

Millisecondi

TargetExecutionTime

Il tempo totale impiegato per eseguire il target su Lambda/OpenAPI/ecc. Questo aiuta a determinare il contributo del target alla latenza totale.

Media, minima, massima, p50, p90, p99

Millisecondi

Parametri di utilizzo

Queste metriche forniscono informazioni su come viene utilizzato il gateway.

Metrica Description Statistiche Unità

TargetType

Il numero totale di richieste servite da ciascun tipo di destinazione (MCP, Lambda, OpenAPI).

Somma

Conteggio

Visualizza le metriche del gateway CloudWatch

Per ulteriori informazioni sulla visualizzazione delle CloudWatch metriche, consulta Visualizza le metriche disponibili nella Amazon CloudWatch User Guide. La procedura seguente mostra come visualizzare le metriche per i tuoi gateway:

Per visualizzare le metriche del gateway nella console

  1. Apri la CloudWatch console all'indirizzo. https://console.aws.amazon.com/cloudwatch/

  2. Nel riquadro di navigazione a sinistra, scegli Tutte le metriche nella sezione Metriche.

  3. In Sfoglia, dal menu a discesa che mostra la AWS regione corrente, seleziona la regione per la quale desideri le metriche.

  4. Scegli il namespace AWS/Bedrock-AgentCore.

  5. Scegli una dimensione (es. Funzionamento) o combinazione di dimensioni (es. Metodo, operazione, protocollo) per visualizzarne le relative metriche.

  6. Per aggiungere una metrica al CloudWatch grafico, seleziona la casella di controllo accanto ad essa.

Impostazione degli allarmi CloudWatch

Puoi utilizzare l'operazione PutMetricAlarm API per impostare CloudWatch allarmi che ti avvisino quando determinate metriche superano le soglie. Ad esempio, potresti voler ricevere una notifica quando il tasso di errore supera il 5% o quando la latenza supera 1 secondo.

L'esempio seguente mostra come creare un allarme per tassi di errore elevati utilizzando la CLI: AWS

aws cloudwatch put-metric-alarm \ --alarm-name "HighErrorRate" \ --alarm-description "Alarm when error rate exceeds 5%" \ --metric-name "SystemErrors" \ --namespace "AWS/Bedrock-AgentCore" \ --statistic "Sum" \ --dimensions "Name=Resource,Value=my-gateway-arn" \ --period 300 \ --evaluation-periods 1 \ --threshold 5 \ --comparison-operator "GreaterThanThreshold" \ --alarm-actions "arn:aws:sns:us-west-2:123456789012:my-topic"

Questo allarme si attiva quando il numero di errori di sistema supera 5 in un periodo di 5 minuti. Quando l'allarme si attiva, invierà una notifica all'argomento SNS specificato.

Dati di registro forniti

AgentCore fornisce registri che consentono di monitorare e risolvere i problemi relativi alle principali risorse del AgentCore gateway. Per abilitare questi dati di registro, è necessario creare una destinazione di registro.

AgentCore può inviare i CloudWatch log a Logs, Amazon S3 o Firehose stream. Se utilizzi una destinazione CloudWatch Logs, questi log vengono archiviati nel gruppo di log predefinito /aws/vendedlogs/bedrock-agentcore/gateway/APPLICATION_LOGS/{gateway_id} o in un gruppo di log personalizzato che inizia con. /aws/vendedlogs/ Per saperne di AgentCore più, consulta Abilitazione dell'osservabilità per runtime, memory, gateway, strumenti integrati e risorse di identità.

AgentCore registra le seguenti informazioni per le risorse del gateway:

  • Avvio e completamento dell'elaborazione delle richieste del gateway

  • Messaggi di errore per le configurazioni di Target

  • Richieste MCP con intestazioni di autorizzazione mancanti o errate

  • Richieste MCP con parametri di richiesta errati (strumenti, metodo)

Puoi anche visualizzare gli organi di richiesta e risposta come parte della tua integrazione con Vended Logs quando una qualsiasi delle operazioni MCP viene eseguita sul Gateway. Possono effettuare ulteriori analisi su questi log, utilizzando i trace_id campi span_id and per collegare gli intervalli di distribuzione e i log emessi. Per ulteriori informazioni sulla crittografia dei gateway con chiavi KMS gestite dal cliente, consulta Funzionalità e argomenti avanzati per Amazon Bedrock Gateway. AgentCore

Esempio di registro:

{ "resource_arn": "arn:aws:bedrock-agentcore:us-east-1:123456789012:gateway/<gatewayid>", "event_timestamp": 1759370851622, "body": { "isError": false, "log": "Started processing request with requestId: 1", "requestBody": "{id=1, jsonrpc=2.0, method=tools/call, params={name=target-quick-start-f9scus___LocationTool, arguments={location=seattle}}}", "id": "1" }, "account_id": "123456789012", "request_id": "12345678-1234-1234-1234-123456789012", "trace_id": "160fc209c3befef4857ab1007d041db0", "span_id": "81346de89c725310" }

Esempio di registro con corpo della risposta:

{ "resource_arn": "arn:aws:bedrock-agentcore:us-east-1:123456789012:gateway/<gatewayid>", "event_timestamp": 1759370853807, "body": { "isError": false, "responseBody": "{jsonrpc=2.0, id=1, result={isError=false, content=[{type=text, text=\"good\"}]}}", "log": "Successfully processed request with requestId: 2", "id": "1" }, "account_id": "123456789012", "request_id": "12345678-1234-1234-1234-123456789012", "trace_id": "160fc209c3befef4857ab1007d041db0", "span_id": "81346de89c725310" }

Intervalli forniti

AgentCore supporta gli intervalli vended conformi a OTEL che è possibile utilizzare per tenere traccia delle invocazioni su diverse primitive utilizzate.

Esempi di intervalli forniti per Tool Invocation:

  • kind:SERVER- tiene traccia dei dettagli complessivi di esecuzione, dello strumento richiamato, dei dettagli del gateway, dell'ID della AWS richiesta, dell'ID di traccia e dell'ID di estensione.

  • kind:CLIENT- copre il target specifico che è stato richiamato e i relativi dettagli come il tipo di target, il tempo di esecuzione del target, l'ora di inizio e fine dell'esecuzione del target, ecc.

Per altre chiamate al metodo MCP, viene emesso solo l'kind:SERVERintervallo.

Sebbene questi intervalli emettano metriche, per capire perché si è verificato un errore per un intervallo specifico, un utente del Gateway deve controllare i log che vengono inviati. Vari campi, ad esempio, aws.request.id possono aiutare spanId a unire questi intervalli e i log.

Operation Attributi Span Description

Strumenti di elenco

aws.operation.name, aws.resource.arn, aws.request.id, aws.account.id, gateway.id, aws.xray.origin, aws.resource.type, aws.region, latency_ms, error_type, jsonrpc.error.code, http.method, http.response.status_code, gateway.name, url.path, overhead_latency_ms

Elenca gli strumenti collegati a un gateway

Strumento di chiamata

aws.operation.name, aws.resource.arn, aws.request.id, aws.account.id, gateway.id, aws.xray.origin, aws.resource.type, aws.region, latency_ms, error_type, jsonrpc.error.code, http.method, http.response.status_code, gateway.name, url.path, overhead_latency_ms, nome.strumento

Chiama uno strumento specifico. Vengono emesse due campate: 1. kind:SERVERche tiene traccia dei dettagli complessivi dell'esecuzione (riuscita o no), dello strumento richiamato, dei dettagli del gateway, dell'ID della AWS richiesta, dell'ID di traccia e dell'ID di estensione. 2. kind:CLIENTche copre il target specifico che è stato richiamato e i relativi dettagli come il tipo di target, il tempo di esecuzione del target, l'ora di inizio e fine dell'esecuzione del target, ecc.

Strumenti di ricerca

aws.operation.name, aws.resource.arn, aws.request.id, aws.account.id, gateway.id, aws.xray.origin, aws.resource.type, aws.region, latency_ms, error_type, jsonrpc.error.code, http.method, http.response.status_code, gateway.name, url.path, overhead_latency_ms, nome.strumento

Cerca i dieci strumenti più pertinenti in base a una richiesta di input