View a markdown version of this page

GPT-5.4 - Amazon Bedrock

As traduções são geradas por tradução automática. Em caso de conflito entre o conteúdo da tradução e da versão original em inglês, a versão em inglês prevalecerá.

GPT-5.4

Ícone mostrando um padrão circular com segmentos curvos entrelaçados formando um design de cata-vento. Inteligência artificial aberta — GPT-5.4

Detalhes do modelo

GPT-5.4 traz raciocínio de fronteira, codificação, uso de computadores, fluxos de trabalho de longo contexto e uso de ferramentas para o Amazon Bedrock. Ele ajuda os desenvolvedores a criar aplicativos de IA e fluxos de trabalho de produção que podem interpretar o contexto, interagir com ferramentas, operar ambientes de software e verificar resultados em várias etapas. GPT-5.4 é adequado para fluxos de trabalho profissionais que exigem raciocínio e ação confiáveis em sistemas de negócios complexos. Para obter mais informações sobre desenvolvimento e desempenho do modelo, consulte o model/service cartão.

Modalidades de entrada Modalidades de saída
Red circle with white X icon indicating error, cancel, or close action.ÁudioRed circle with white X icon indicating error, cancel, or close action.Incorporação
Green circle with white checkmark icon.ImagemRed circle with white X icon indicating error, cancel, or close action.Imagem
Red circle with white X icon indicating error, cancel, or close action.DiscursoRed circle with white X icon indicating error, cancel, or close action.Discurso
Green circle with white checkmark icon.TextoGreen circle with white checkmark icon.Texto
Red circle with white X icon indicating error, cancel, or close action.VídeoRed circle with white X icon indicating error, cancel, or close action.Vídeo

Endpoints e APIs suportados

As tabelas a seguir mostram quais endpoints e APIs são compatíveis. GPT-5.4 Para obter mais informações, consulte APIs suportadas pelo Amazon Bedrock e Endpoints compatíveis com o Amazon Bedrock.

Suporte para terminais

Endpoint Suportado
bedrock-runtime not-supported
bedrock-mantle supported

APIs suportadas no bedrock-runtime endpoint

Mensagens Respostas Conclusões de bate-papos Converse Invoke
not-supported not-supported not-supported not-supported not-supported

APIs suportadas no bedrock-mantle endpoint

Mensagens Respostas Conclusões de bate-papos Converse Invoke
not-supported supported supported not-supported not-supported
nota

Ativadobedrock-mantle, ambas as APIs usam o caminho /openai/v1 base, não/v1. Use qualquer uma das APIs com este modelo:

  • Para respostas, use/openai/v1/responses.

  • Para concluir o bate-papo, use/openai/v1/chat/completions.

Capacidades e características

Características do Bedrock

Recursos compatíveis com o uso do bedrock-mantle endpoint

Preços

Todos os preços estão em USD por 1 milhão de tokens para o nível Standard.

In-Region Os preços comerciais incluem uma taxa de 10% sobre as tarifas da OpenAI. Você não precisa adicionar essa taxa.

Long-context as taxas se aplicam a todos os tokens de entrada e saída, não apenas aos tokens acima de 272K.

Os níveis Priority e Flex não são compatíveis com esse modelo.

Regiões comerciais — contexto curto (272 mil tokens de entrada ou menos)

Opção de inferência Entrada Entrada — gravação em cache de 30 m Entrada — leitura de cache Saída
In-Region$2,75$0,275$16,50

Regiões comerciais — contexto longo (mais de 272 mil tokens de entrada)

Opção de inferência Entrada Entrada — gravação em cache de 30 m Entrada — leitura de cache Saída
In-Region$5,50$0,55$24,75

AWS GovCloud (US-West) — contexto curto (272 mil tokens de entrada ou menos)

Opção de inferência Entrada Entrada — gravação em cache de 30 m Entrada — leitura de cache Saída
In-Region$3,30$0,33$19,80

Acesso programático

Use os seguintes IDs de modelo e URLs de endpoint para acessar esse modelo de forma programática. Para obter mais informações sobre as APIs e endpoints disponíveis, consulte APIs suportadas e Endpoints suportados.

Endpoint ID do modelo In-Region URL do endpoint ID de inferência geográfica ID de inferência global
bedrock-mantle openai.gpt-5.4 https://bedrock-mantle.{region}.api.aws/openai/v1 Sem compatibilidade Sem compatibilidade

Por exemplo, se a região for us-east-2 (Ohio), a URL do endpoint bedrock-mantle será "”. https://bedrock-mantle.us-east-2.api.aws/openai/v1

Níveis de serviço

O Amazon Bedrock oferece vários níveis de serviço para atender às suas necessidades de carga de trabalho. O Standard fornece acesso pago por token sem compromisso (defina "service_tier": "default" ou omita o campo). O Priority oferece os tempos de resposta mais rápidos por um preço premium (conjunto"service_tier": "priority"). O Flex fornece acesso de baixo custo para cargas de trabalho flexíveis e não sensíveis ao tempo (conjunto). "service_tier": "flex" O Reserved fornece uma taxa de transferência dedicada com um compromisso de prazo para cargas de trabalho previsíveis; ela é definida no nível da conta e não por solicitação (entre em contato com sua equipe de contas da AWS para habilitar). Para obter mais informações, consulte níveis service-tiers-inference.html de serviço.

Padrão Priority Flexionar Reservado
Green circle with white checkmark icon. Red circle with white X icon indicating error, cancel, or close action. Red circle with white X icon indicating error, cancel, or close action. Red circle with white X icon indicating error, cancel, or close action.

Disponibilidade regional

Visão geral da disponibilidade regional

O Amazon Bedrock oferece três opções de inferência: In-Region mantém as solicitações em uma única região para conformidade estrita, Cross-Region rotas geográficas entre regiões dentro de uma geografia (como EUA, UE e APAC), respeitando a residência de dados, e Cross-Region rotas globais em qualquer lugar do mundo, quando não há restrições de residência. Consulte a Disponibilidade regional por modelos página para obter mais detalhes.

A disponibilidade difere de acordo com o endpoint.

Disponibilidade usando o bedrock-mantle endpoint

Região In-Region Geo Global
us-east-1(Norte da Virgínia)Green circle with white checkmark icon.Red circle with white X icon indicating error, cancel, or close action.Red circle with white X icon indicating error, cancel, or close action.
us-east-2(Ohio)Green circle with white checkmark icon.Red circle with white X icon indicating error, cancel, or close action.Red circle with white X icon indicating error, cancel, or close action.
us-west-2(Oregon)Green circle with white checkmark icon.Red circle with white X icon indicating error, cancel, or close action.Red circle with white X icon indicating error, cancel, or close action.
us-gov-west-1 (GovCloud)Green circle with white checkmark icon.Red circle with white X icon indicating error, cancel, or close action.Red circle with white X icon indicating error, cancel, or close action.

Cotas e limites

Sua AWS conta tem cotas padrão para manter o desempenho do serviço e garantir o uso adequado do Amazon Bedrock. As cotas padrão atribuídas a uma conta podem ser atualizadas dependendo de fatores regionais, histórico de pagamentos, uso fraudulento e and/or aprovação de uma solicitação de aumento de cota. Para obter mais informações, consulte a Cotas do Amazon Bedrock documentação e os limites do modelo.

Código de exemplo

Etapa 1 - AWS Conta: Se você já tem uma AWS conta, pule esta etapa. Se você não conhece AWS, cadastre-se em uma conta da AWS.

Etapa 2 - Chave de API: acesse o console do Amazon Bedrock e gere uma chave de API de longo prazo.

Etapa 3 - Obtenha o SDK: para usar este guia de introdução, você deve ter o Python já instalado. Em seguida, instale o software relevante, dependendo das APIs que você está usando.

Para ambas as APIs, escolha a guia OpenAI SDK.

OpenAI SDK
pip install openai

Etapa 4 - Definir variáveis de ambiente

Configure seu ambiente para usar a chave de API para autenticação.

bedrock-mantle
OPENAI_API_KEY="<provide your Bedrock API key>" OPENAI_BASE_URL="https://bedrock-mantle.us-west-2.api.aws/openai/v1"

Etapa 5 - Execute sua primeira solicitação de inferência

Salve o arquivo como bedrock-first-request.py

manto rochoso

Use as configurações da Etapa 4 - Definir variáveis de ambiente. Escolha a guia bedrock-mantle. A guia Chat usa a API Chat Complements.

Responses API
from openai import OpenAI client = OpenAI() response = client.responses.create( model="openai.gpt-5.4", input="Can you explain the features of Amazon Bedrock?" ) print(response)
Chat
from openai import OpenAI client = OpenAI() response = client.chat.completions.create( model="openai.gpt-5.4", messages=[{"role": "user", "content": "Can you explain the features of Amazon Bedrock?"}] ) print(response)