View a markdown version of this page

Solicitação e reposta - Amazon Bedrock

As traduções são geradas por tradução automática. Em caso de conflito entre o conteúdo da tradução e da versão original em inglês, a versão em inglês prevalecerá.

Solicitação e reposta

O corpo da solicitação é passado no body campo de uma solicitação para InvokeModel ou InvokeModelWithResponseStream.

nota

As restrições se aplicam às seguintes operações: InvokeModel InvokeModelWithResponseStreamConverse,, ConverseStream e. Consulte as restrições da API para obter detalhes.

Atenção

Claude Sonnet 4.5e Claude Haiku 4.5 suporte para especificar o top_p parâmetro temperature ou, mas não ambos. Isso não se aplica aos modelos mais antigos.

Request

O Claude da Anthropic tem os parâmetros de inferência a seguir para uma chamada de inferência de mensagens.

{ "anthropic_version": "bedrock-2023-05-31", "anthropic_beta": ["computer-use-2024-10-22"] "max_tokens": int, "system": string | [{"type": "text", "text": string}], "messages": [ { "role": string, "content": [ { "type": "image", "source": { "type": "base64", "media_type": "image/jpeg", "data": "content image bytes" } }, { "type": "text", "text": "content text" } ] } ], "temperature": float, "top_p": float, "top_k": int, "tools": [ { "type": "custom", "name": string, "description": string, "input_schema": json }, { "type": "computer_20241022", "name": "computer", "display_height_px": int, "display_width_px": int, "display_number": 0 int }, { "type": "bash_20241022", "name": "bash" }, { "type": "text_editor_20241022", "name": "str_replace_editor" } ], "tool_choice": { "type" : string, "name" : string, }, "stop_sequences": [string] }

Veja a seguir os parâmetros necessários.

  • anthropic_version: (obrigatório) a versão da Anthropic. O valor deve ser bedrock-2023-05-31.

  • max_tokens: (obrigatório) o número máximo de tokens a serem gerados antes de parar.

    Observe que os modelos Claude da Anthropic podem parar de gerar tokens antes de atingir o valor de max_tokens. Modelos diferentes do Claude da Anthropic têm valores máximos diferentes para esse parâmetro. Para obter mais informações, consulte Model comparison.

  • messages: (obrigatório) as mensagens de entrada.

    • role: o perfil do turno da conversa. Os valores válidos são user e assistant.

      Mínimo Máximo

      0

      2000

    • content: (obrigatório) o conteúdo do turno da conversa, como uma matriz de objetos. Cada objeto contém um campo de tipo, no qual você pode especificar um dos seguintes valores:

      • text: se você especificar esse tipo, deverá incluir um campo de texto e especificar o prompt de texto como o respectivo valor. Se outro objeto na matriz for uma imagem, esse prompt de texto se aplicará às imagens.

      • image: se você especificar esse tipo, deverá incluir um campo de origem associado a um objeto com os seguintes campos:

        • type: (obrigatório) o tipo de codificação da imagem. Você pode especificar base64.

        • media_type: (obrigatório) o tipo da imagem. Você pode especificar os seguintes formatos de imagem:

          • image/jpeg

          • image/png

          • image/webp

          • image/gif

        • data: (obrigatório) os bytes de imagem codificados em base64 para a imagem. O tamanho máximo da imagem é 3,75 MB. O valor da altura e da largura máximas de uma imagem é 8.000 pixels.

Veja a seguir os parâmetros opcionais.

  • system: (opcional) o prompt do sistema para a solicitação. Você pode fornecer o prompt do sistema como uma string ou como uma matriz de blocos de conteúdo (por exemplo,[{"type": "text", "text": "your prompt"}]).

    Um prompt do sistema é uma maneira de contextualizar e dar instruções para o Claude da Anthropic, como especificar uma meta ou função específica. Para obter mais informações, consulte System prompts na documentação da Anthropic.

    nota

    Você pode usar os prompts do sistema com o Claude versão 2.1 ou posterior da Anthropic.

  • anthropic_beta: (opcional) o parâmetro anthropic_beta é uma lista de strings de cabeçalhos beta usados para indicar a aceitação de um conjunto específico de recursos beta.

    nota

    A variante de tamanho de contexto de 1 milhão de tokens Claude Sonnet 4 está disponível para você em AWS regiões selecionadas como um “Serviço Beta”, conforme definido nos Termos do AWS Serviço. Está sujeito ao seu Contrato AWS e aos Termos AWS de Serviço e ao modelo de EULA aplicável. Consulte a página Preços do Amazon Bedrock para ter mais informações sobre os preços para solicitações de contexto mais longas. Para solicitações que excedam 200 mil tokens de entrada, a taxa de contexto longa se aplica a toda a solicitação, não apenas aos tokens acima do limite. Cotas de serviço separadas se aplicam (para obter mais informações, consulte Cotas de serviço no Console de gerenciamento da AWS).

    Os cabeçalhos beta disponíveis incluem os seguintes:

    Atributo beta

    Cabeçalho beta

    Observações

    Computer Use

    computer-use-2025-01-24

    Compatível o Claude 3.7 Sonnet.

    Uso de ferramentas

    token-efficient-tools-2025-02-19

    Compatível com o Claude 3.7 Sonnet e o Claude 4+.

    Pensamento intercalado

    Interleaved-thinking-2025-05-14

    Compatível com os modelos Claude 4+.

    Permite tokens de saída de até 128 mil

    output-128k-2025-02-19

    Compatível o Claude 3.7 Sonnet.

    Modo de desenvolvedor para raciocínio bruto no modelos Claude 4+

    dev-full-thinking-2025-05-14

    Compatível somente com os modelos Claude 4+. Entre em contato com a equipe da conta para acessar esta versão beta.

    1 milhão de tokens

    context-1m-2025-08-07

    Compatível com Claude Sonnet 4Claude Sonnet 4.6, Claude Opus 4.6 e.

    Gerenciamento de contexto

    context-management-2025-06-27

    Compatível com o Claude Sonnet 4.5 e o Claude Haiku 4.5

    Esforço

    effort-2025-11-24

    Compatível com Claude Opus 4.5

    Ferramenta de busca de ferramentas

    tool-search-tool-2025-10-19

    Compatível com Claude Opus 4.5

    Exemplos de uso de ferramentas

    tool-examples-2025-10-29

    Compatível com Claude Opus 4.5

  • stop_sequences: (opcional) sequências de texto personalizadas que fazem com que o modelo deixe de gerar. Os modelos Claude da Anthropic normalmente param quando completam a vez naturalmente; nesse caso, o valor do campo de resposta stop_reason é end_turn. Se quiser que o modelo deixe de ser gerado ao encontrar strings de texto personalizadas, você poderá usar o parâmetro stop_sequences. Se o modelo encontrar uma das strings de texto personalizadas, o valor do campo de resposta stop_reason será stop_sequence e o valor de stop_sequence conterá a sequência de parada correspondente.

    O número máximo de entradas é 8.191.

  • temperature: (opcional) a randomização injetada na resposta.

    Padrão Mínimo Máximo

    1

    0

    1

  • top_p: (opcional) use amostragem de núcleo.

    Na amostragem de núcleo, Anthropic Claude calcula a distribuição cumulativa de todas as opções para cada token subsequente em ordem de probabilidade decrescente. Ele corta a distribuição depois de atingir a probabilidade especificada portop_p. Ao ajustar os parâmetros de amostragem, modifique temperature ou top_p. Não modifique ambos ao mesmo tempo.

    Padrão Mínimo Máximo

    0,999

    0

    1

  • top_k: (opcional) somente um exemplo das opções K principais para cada token subsequente.

    Use top_k para remover respostas de baixa probabilidade de cauda longa.

    Padrão Mínimo Máximo

    Desabilitado por padrão.

    0

    500

  • tools: (opcional) definições de ferramentas que o modelo pode usar.

    nota

    Exige um modelo Claude 3 da Anthropic.

    Se você incluir tools na solicitação, o modelo poderá retornar blocos de conteúdo tool_use que representam o uso dessas ferramentas do modelo. É possível executar essas ferramentas usando a entrada de ferramenta gerada pelo modelo e, opcionalmente, retornar os resultados ao modelo usando blocos de conteúdo de tool_result.

    Você pode passar os seguintes tipos de ferramenta:

    Personalizada

    Definição de uma ferramenta personalizada.

    • (opcional) type: o tipo da ferramenta. Se definido, use o valor custom.

    • name: o nome da ferramenta.

    • description: (opcional, mas altamente recomendado) a descrição da ferramenta.

    • input_schema: o esquema JSON da ferramenta.

    Computação

    Definição da ferramenta de computação usada por você com a API Computer Use.

    • type: o valor deve ser computer_20241022.

    • name: o valor deve ser computer.

    • (Obrigatório) display_height_px: a altura da tela que está sendo controlada pelo modelo, em pixels.

      Padrão Mínimo Máximo

      Nenhum

      1

      Sem máximo

    • (Obrigatório) display_width_px: a largura da tela que está sendo controlada pelo modelo, em pixels.

      Padrão Mínimo Máximo

      Nenhum

      1

      Sem máximo

    • (Opcional) display_number: o número de exibição a ser controlado (só relevante para ambientes X11). Se especificada, a ferramenta receberá um número de exibição na definição da ferramenta.

      Padrão Mínimo Máximo

      Nenhum

      0

      N

    bash

    Definição da ferramenta de bash usada por você com a API Computer Use.

    • (opcional) type: o valor deve ser bash_20241022.

    • name: o valor deve ser bash.

    text editor

    Definição da ferramenta de edição de texto usada por você com a API Computer Use.

    • (opcional) type: o valor deve ser text_editor_20241022.

    • name: o valor deve ser str_replace_editor.

  • tool_choice: (opcional) especifica como o modelo deve usar as ferramentas fornecidas. O modelo pode usar uma ferramenta específica, qualquer ferramenta disponível ou decidir por conta própria.

    nota

    Exige um modelo Claude 3 da Anthropic.

    • type: o tipo de opção de ferramenta. Os valores possíveis são any (use qualquer ferramenta disponível), auto (o modelo decide) e tool (use a ferramenta especificada).

    • name: (opcional) o nome da ferramenta a ser usada. Obrigatório se você especificar tool no campo type.

Response

O modelo Claude da Anthropic exibe os campos a seguir para uma chamada de inferência de mensagens.

{ "id": string, "model": string, "type" : "message", "role" : "assistant", "content": [ { "type": string, "text": string, "image" :json, "id": string, "name":string, "input": json } ], "stop_reason": string, "stop_sequence": string, "usage": { "input_tokens": integer, "output_tokens": integer } }

Exemplos de resposta com novos valores stop_reason:

// Example with refusal { "stop_reason": "refusal", "stop_details": { "type": "refusal", "category": "cyber", "explanation": "This request triggered restrictions on violative cyber content and was blocked under Anthropic's Usage Policy." }, "content": [], "usage": { "input_tokens": 106, "output_tokens": 1 } } // Example with tool_use { "stop_reason": "tool_use", "content": [ { "type": "tool_use", "id": "toolu_123", "name": "calculator", "input": {"expression": "2+2"} } ] } // Example with model_context_window_exceeded (Claude Sonnet 4.5) { "stop_reason": "model_context_window_exceeded", "content": [ { "type": "text", "text": "The response was truncated due to context window limits..." } ] }
  • id: o identificador exclusivo da resposta. O formato e o tamanho do ID podem mudar com o passar do tempo.

  • model: o ID do modelo Claude da Anthropic que fez a solicitação.

  • stop_reason: o motivo pelo qual o Claude da Anthropic deixou de gerar a resposta.

    • end_turn: o modelo atingiu um ponto de parada natural

    • max_tokens: o texto gerado excedeu o valor do campo de entrada max_tokens ou eo número máximo de tokens que o modelo permite.

    • stop_sequence: o modelo gerou uma das sequências de parada especificadas por você no campo de entrada stop_sequences.

    • recusa — O modelo foi bloqueado por um classificador de conteúdo antes de completar sua resposta. A resposta pode conter conteúdo parcial se o classificador for acionado no meio do fluxo. Consulte stop_details para obter informações adicionais sobre a restrição. Esse motivo de parada ocorre em uma taxa materialmente mais alta no Claude Fable 5 devido aos seus classificadores de conteúdo de uso duplo.

    • tool_use: o claude está chamando uma ferramenta e espera que você a execute.

    • model_context_window_exceeded: o modelo interrompeu a geração devido ao limite da janela de contexto.

      • Novo no Claude Sonnet 4.5

  • stop_sequence: a sequência de parada que encerrou a geração.

  • stop_details (object | null) — Informações adicionais sobre por que a resposta foi interrompida. Presente quando stop_reason é"refusal". Pode ser nulo mesmo em caso de recusa.

    • type (string) — Sempre "refusal" quando presente.

    • categoria (string ou null) — A categoria de conteúdo que acionou a restrição (por exemplo,"cyber","bio"). Nulo quando a recusa não é mapeada para uma categoria nomeada.

    • explicação (string ou null) — Human-readable explicação da restrição. Não é garantido que seja estável em todas as solicitações — não analise programaticamente.

    nota

    Ramifique emstop_reason, não em cimastop_details. O stop_details campo é informativo e pode ser nulo mesmo quando estástop_reason. "refusal" As recusas também podem ocorrer no meio da transmissão: o classificador pode ser acionado após algum conteúdo já ter sido transmitido. No modo de streaming, a recusa chega como o message_delta evento final comstop_reason: "refusal"; quaisquer blocos de conteúdo transmitidos antes da recusa são uma saída parcial válida.

  • type: o tipo de resposta. O valor é sempre message.

  • role: a função conversacional da mensagem gerada. O valor é sempre assistant.

  • content: o conteúdo gerado pelo modelo. Retornado como uma matriz. Há três tipos de conteúdo: text, tool_use e image.

    • text: uma resposta em texto.

      • type: o tipo do conteúdo. Este valor é text.

      • text: se o valor de type for text, conterá o texto do conteúdo.

    • tool_use: uma solicitação do modelo para usar uma ferramenta.

      • type: o tipo do conteúdo. Este valor é tool_use.

      • id: o ID da ferramenta cujo uso o modelo está solicitando.

      • name: contém o nome da ferramenta solicitada.

      • input: os parâmetros de entrada a serem passados para a ferramenta.

    • image: uma solicitação do modelo para usar uma ferramenta.

      • type: o tipo do conteúdo. Este valor é image.

      • source: contém a imagem. Para obter mais informações, consulte Prompts multimodais.

  • usage: contêiner para o número de tokens fornecidos por você na solicitação e o número de tokens que o modelo gerou na resposta.

    • input_tokens: o número de tokens de entrada na solicitação.

    • output_tokens: o número de tokens gerados pelo modelo na resposta.

    • stop_sequence: o modelo gerou uma das sequências de parada especificadas por você no campo de entrada stop_sequences.

Parâmetro de esforço (beta)

O effort parâmetro é uma alternativa para pensar em orçamentos simbólicos para Claude Opus 4.5. Esse parâmetro indica com Claude que liberalidade ele deve gastar tokens para produzir o melhor resultado, ajustando o uso de tokens no pensamento, nas chamadas de ferramentas e na comunicação com o usuário. Ele pode ser usado com ou sem o modo de pensamento estendido.

O parâmetro de esforço pode ser definido como:

  • high(padrão) — Claude gasta quantos tokens forem necessários para obter o melhor resultado

  • medium— Uso balanceado de tokens

  • low— Uso conservador de tokens

Para usar esse recurso, você deve passar o cabeçalho betaeffort-2025-11-24.

Exemplo de solicitação:

{ "anthropic_version": "bedrock-2023-05-31", "anthropic_beta": [ "effort-2025-11-24" ], "max_tokens": 4096, "output_config": { "effort": "medium" }, "messages": [{ "role": "user", "content": "Analyze this complex dataset and provide insights" }] }