View a markdown version of this page

Compatibilidade com APIs - Amazon Bedrock

As traduções são geradas por tradução automática. Em caso de conflito entre o conteúdo da tradução e da versão original em inglês, a versão em inglês prevalecerá.

Compatibilidade com APIs

O Amazon Bedrock oferece suporte a quatro famílias de APIs de tempo de execução, cada uma projetada para diferentes padrões de integração e casos de uso.

Família Invoke: InvokeModel lida com chamadas síncronas de resposta única. InvokeModelWithResponseStreamretorna as respostas como um fluxo em tempo real. InvokeModelWithBidirectionalStreampermite streaming full-duplex para aplicativos interativos. AsyncInvokeenvia solicitações de longa duração de forma assíncrona, armazenando a saída no Amazon S3.

Família Converse: Converse fornece uma interface unificada e independente de modelo para conversas síncronas de vários turnos. ConverseStreamoferece a mesma experiência com a saída de streaming.

OpenAI-compatible família: ChatCompletions implementa a interface OpenAI Chat Completions, permitindo que as OpenAI-based integrações existentes sejam executadas no Bedrock com o mínimo de alterações. Responses A API implementa a interface OpenAI Responses, suportando interações ativas e dinâmicas com o uso de ferramentas incorporadas e o gerenciamento do histórico de conversas.

Família de mensagens: Messages implementa a interface Anthropic Messages no bedrock-mantle endpoint, permitindo que as SDK-based integrações Anthropic existentes sejam executadas no Bedrock com o mínimo de alterações.

Agora, veremos a lista de APIs suportadas por cada modelo.

AI21

Nome do modelo Invocar Converse Conclusões de bate-papos Respostas Mensagens
Jamba 1.5 Large* supported supported not-supported not-supported not-supported
Jamba 1.5 Mini* supported supported not-supported not-supported not-supported

Amazon

Anthropic

Cohere

Nome do modelo Invocar Converse Conclusões de bate-papos Respostas Mensagens
Comando R* supported supported not-supported not-supported not-supported
Command R+* supported supported not-supported not-supported not-supported
Embed em inglês supported not-supported not-supported not-supported not-supported
Embed multilíngue supported not-supported not-supported not-supported not-supported
Incorporar v4 supported not-supported not-supported not-supported not-supported
Rerank 3.5 supported not-supported not-supported not-supported not-supported

DeepSeek

Nome do modelo Invocar Converse Conclusões de bate-papos Respostas Mensagens
DeepSeek V3.2* supported supported supported not-supported not-supported
DeepSeek-R1* supported supported not-supported not-supported not-supported
DeepSeek-V3.1* supported supported supported not-supported not-supported

Google

Nome do modelo Invocar Converse Conclusões de bate-papos Respostas Mensagens
Gemma 3 12B IT* supported supported supported not-supported not-supported
Gemma 3 27B PT* supported supported supported not-supported not-supported
Gemma 3 4B IT* supported supported supported not-supported not-supported

Meta

MiniMax

Nome do modelo Invocar Converse Conclusões de bate-papos Respostas Mensagens
MiniMax M2* supported supported supported not-supported not-supported
MiniMax M2.1* supported supported supported not-supported not-supported
MiniMax M2.5* supported supported supported not-supported

Mistral

Moonshot

Nome do modelo Invocar Converse Conclusões do chat Respostas Mensagens
Pensando em Kimi K2* supported supported not-supported not-supported not-supported
Kimi K2.5* supported supported supported not-supported not-supported

NVIDIA

Nome do modelo Invocar Converse Conclusões de bate-papos Respostas Mensagens
NVIDIA Nemotron Nano 9B v2* supported supported supported not-supported not-supported
NVIDIA Nemotron Nano 12 GB v2 VL BF16* supported supported supported not-supported not-supported
Nemotron Nano 3 30B* supported supported supported not-supported not-supported
NVIDIA Nemotron 3 Super 120B* supported supported supported not-supported

OpenAI

Você pode usar todos os modelos desta página com a API de respostas e a API de conclusão de bate-papo ativadas. bedrock-mantle Consulte cada modelo de cartão para obter detalhes.

Qwen

Estabilidade

TwelveLabs

Nome do modelo Invocar Converse Conclusões de bate-papos Respostas Mensagens
Marengo Incorporar 3.0 supported not-supported not-supported not-supported not-supported
Marengo Embed v2.7 not-supported not-supported not-supported not-supported not-supported
Pegasus v1.2 supported not-supported not-supported not-supported not-supported

Gravador

Nome do modelo Invocar Converse Conclusões de bate-papos Respostas Mensagens
Palmyra Vision 7B supported supported supported not-supported
Palmyra X4* supported supported not-supported not-supported not-supported
Palmyra X5* supported supported not-supported not-supported not-supported

AxI

Nome do modelo Invocar Converse Conclusões do chat Respostas Mensagens
Grok 4.3 not-supported not-supported supported supported not-supported
Grok 4.6 supported supported supported supported not-supported

Z.AI

Nome do modelo Invocar Converse Conclusões de bate-papos Respostas Mensagens
GLM 4,7* supported supported supported not-supported not-supported
GLM 4.7 Flash* supported supported supported not-supported not-supported
GLM 5* supported supported supported not-supported not-supported
nota

* Suporte de streaming: modelos marcados com um asterisco (*) também oferecem suporteInvokeModelWithResponseStream, o que retorna as respostas como um fluxo em tempo real.

Modelos que suportam StartAsyncInvoke

StartAsyncInvoke é uma API Amazon Bedrock Runtime que permite que os chamadores enviem uma solicitação de invocação de modelo e recebam imediatamente de volta um InvocationARN sem esperar que o modelo termine o processamento. O trabalho é executado em segundo plano e a saída é gravada em um bucket do S3 especificado pelo chamador quando concluído. Os chamadores podem então pesquisar o status do trabalho usando o complemento GetAsyncInvoke e ListAsyncInvokes as APIs. O padrão foi criado especificamente para cargas de trabalho que envolvem entradas grandes ou insensíveis à latência, especialmente vídeo, áudio e geração de incorporação em massa, onde manter uma conexão síncrona aberta seria impraticável.

Em termos de quais modelos o suportam, os seguintes modelos suportam StartAsyncInvoke:

  • TwelveLabs Marengo Embed 2.7 (twelvelabs.marengo-embed-2-7-v 1:0) — necessário para entrada de vídeo e áudio; lida apenas com texto e imagem InvokeModel

  • TwelveLabs Marengo Embed 3.0 (twelvelabs.marengo-embed-3-0-v 1:0) — mesmo padrão; assíncrono necessário para em grande escala video/audio

  • Amazon Nova Reel (amazon.nova-reel-v 1:0 e v 1:1) — a geração de vídeo é exclusivamente assíncrona; a saída chega ao S3

  • Amazon Nova Multimodal Embeddings (amazon.nova-2-multimodal-embeddings-v 1:0) — a sincronização é necessária para entradas de vídeo maiores que 25 MB codificadas em base64; a sincronização está disponível para entradas de texto, imagem e documentos

InvokeModelWithBidirectionalStream

InvokeModelWithBidirectionalStreamé uma API Amazon Bedrock Runtime que estabelece um canal persistente e full-duplex entre o chamador e o modelo, permitindo que os dados de áudio fluam em ambas as direções simultaneamente e continuamente. Diferentemente das InvokeModelWithResponseStream APIs padrão InvokeModel ou mesmo das APIs, que seguem um padrão de solicitação e resposta, essa API mantém a conexão aberta durante a sessão para que o modelo possa processar o áudio recebido à medida que ele chega e transmitir a fala gerada quase em tempo real, sem esperar que uma declaração completa termine. A interação é estruturada em três fases: inicialização da sessão (em que o cliente envia eventos de configuração para configurar o fluxo), streaming de áudio (em que o áudio capturado é codificado e enviado como um fluxo contínuo de eventos) e streaming de resposta (em que o modelo retorna simultaneamente transcrições de texto da fala do usuário e da saída de áudio sintetizada). InvokeModelWithBidirectionalStreamnão pode ser usado com chaves de API do Amazon Bedrock e exige autenticação padrão baseada em credenciais da AWS, refletindo seu ciclo de vida de sessão mais complexo em comparação com outras operações do Bedrock Runtime.

Os modelos a seguir oferecem suporte a essa API:

  • Família Amazon Nova Sonic: tanto amazon.nova-sonic-v 1:0 quanto amazon.nova-2-sonic-v 1:0 a usam como seu único caminho de invocação, já que a arquitetura de fala para fala exige fundamentalmente um canal bidirecional ao vivo que nem a Converse podem fornecer. InvokeModel