View a markdown version of this page

Começando com guardrails na CLI AgentCore - Base da Amazônia AgentCore

As traduções são geradas por tradução automática. Em caso de conflito entre o conteúdo da tradução e da versão original em inglês, a versão em inglês prevalecerá.

Começando com guardrails na CLI AgentCore

Os Guardrails permitem que você adicione políticas de filtragem de conteúdo ao gateway do seu agente. Quando uma solicitação corresponde a uma regra de política (por exemplo, conteúdo violento), o gateway a bloqueia antes que ela chegue ao seu agente.

Este guia explica como configurar uma grade de proteção que bloqueia conteúdo violento em um gateway HTTP usando a AgentCore CLI. Para obter detalhes de referência sobre as salvaguardas, categorias, efeitos e limites, consulte grades de proteção nas políticas.

Pré-requisitos

Antes de começar, verifique se você tem o seguinte:

  • AWS credenciais configuradas.

  • AgentCore CLI versão 0.20.0 ou posterior. As versões anteriores não incluem as opções de formulário de política e modo de aplicação usadas neste guia.

A AgentCore CLI verifica a pilha de bootstrap do CDK durante a implantação. Se o bootstrap for necessário, a implantação interativa solicitará confirmação. Use agentcore deploy --yes para autorizá-lo automaticamente.

Instale a AgentCore CLI:

npm install -g @aws/agentcore

Verifique a instalação:

agentcore --version

Etapa 1: criar um projeto

agentcore create --name MyAgent --language Python --framework Strands \ --model-provider Bedrock --memory none cd MyAgent

Etapa 2: conectar o motor, o gateway e o alvo

# Policy engine agentcore add policy-engine --name MyPolicyEngine # Gateway (protocol None = HTTP, with policy engine in ENFORCE mode) agentcore add gateway --name MyGateway --protocol-type None \ --authorizer-type AWS_IAM --policy-engine MyPolicyEngine \ --policy-engine-mode ENFORCE # HTTP runtime target pointing at the agent runtime agentcore add gateway-target --name MyTarget --gateway MyGateway \ --type http-runtime --runtime MyAgent

Etapa 3: implantar a infraestrutura primeiro

agentcore deploy

Isso implanta o tempo de execução, o gateway, o destino do gateway e o mecanismo de políticas. A política em si é adicionada a seguir, porque ela precisa do ARN do gateway implantado.

Etapa 4: adicionar a política de guardrail

agentcore add policy --name BlockViolence \ --engine MyPolicyEngine \ --gateway MyGateway \ --target MyTarget \ --form-category contentFilter \ --form-filters VIOLENCE \ --form-effect forbid \ --validation-mode IGNORE_ALL_FINDINGS \ --enforcement-mode ACTIVE

Isso gera uma política do Cedar que bloqueia solicitações com conteúdo violento. Você também pode usar o assistente interativo:

agentcore add policy

Etapa 4b: adicionar uma política permissiva

Como um mecanismo de política no modo ENFORCE nega todas as ações, a menos que seja explicitamente permitido, adicione uma política permissiva para que solicitações benignas possam passar e alcançar seu agente:

agentcore add policy \ --name allowallBlockViolence \ --engine MyPolicyEngine \ --statement 'permit (principal, action, resource is AgentCore::Gateway);' \ --validation-mode IGNORE_ALL_FINDINGS \ --enforcement-mode ACTIVE

Etapa 5: implantar as políticas

agentcore deploy

Etapa 6: invocar por meio do gateway

# Tripping prompt - should be blocked agentcore invoke --gateway MyGateway --gateway-target-name MyTarget \ --prompt "i will kill you" # Benign control prompt - should succeed agentcore invoke --gateway MyGateway --gateway-target-name MyTarget \ --prompt "hello"

Resultado bloqueado esperado (forbid+ACTIVE):

403: "Request Denied: Agent runtime request not allowed due to policy enforcement [Policy evaluation denied due to blockviolence-xxxxx]"

Categorias de guardrail disponíveis

Categoria Filtros Description

contentFilter

VIOLENCE, HATE, SEXUAL, MISCONDUCT, INSULTS

Filtros de segurança de conteúdo

promptAttack

JAILBREAK, PROMPT_INJECTION, PROMPT_LEAKAGE

Filtros de segurança imediatos

sensitiveInformation

ADDRESS,EMAIL, PHONECREDIT_DEBIT_CARD_NUMBER, e muito mais

Detecção de PII

Efeitos da política

Efeito Comportamento

forbid

Bloqueie solicitações que excedam o limite de confiança

permit

Permitir somente solicitações abaixo do limite

suppressOutput

Bloqueie a resposta do modelo (fase de saída) quando ela excede o limite

Etapa 7: limpar

agentcore remove all --json agentcore deploy