View a markdown version of this page

Compatibilità API - Amazon Bedrock

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

Compatibilità API

Amazon Bedrock supporta quattro famiglie di API di runtime, ciascuna progettata per diversi modelli di integrazione e casi d'uso.

Famiglia Invoke: InvokeModel gestisce chiamate sincrone a risposta singola. InvokeModelWithResponseStreamrestituisce le risposte come stream in tempo reale. InvokeModelWithBidirectionalStreamconsente lo streaming full-duplex per applicazioni interattive. AsyncInvokeinvia richieste di lunga durata in modo asincrono, archiviando l'output su Amazon S3.

Famiglia Converse: Converse fornisce un'interfaccia unificata e indipendente dal modello per conversazioni sincrone a più turni. ConverseStreamoffre la stessa esperienza con l'output di streaming.

OpenAI-compatible famiglia: ChatCompletions implementa l'interfaccia OpenAI Chat Completions, consentendo l'esecuzione delle OpenAI-based integrazioni esistenti su Bedrock con modifiche minime. Responses L'API implementa l'interfaccia OpenAI Responses, supportando interazioni stateful e agentiche con l'uso degli strumenti integrati e la gestione della cronologia delle conversazioni.

Famiglia Messages: Messages implementa l'interfaccia Anthropic Messages sull'bedrock-mantleendpoint, consentendo l'esecuzione delle integrazioni Anthropic SDK-based esistenti su Bedrock con modifiche minime.

Ora esamineremo l'elenco delle API supportate da ciascun modello.

AI21

Nome modello Invoke Converse Completamenti delle chat Risposte Messaggi
Jamba 1.5 Large* supported supported not-supported not-supported not-supported
Jamba 1.5 Mini* supported supported not-supported not-supported not-supported

Amazon

Anthropic

Cohere

Nome modello Invoke Converse Completamenti delle chat Risposte Messaggi
Comando R* supported supported not-supported not-supported not-supported
Comando R* supported supported not-supported not-supported not-supported
Embed English supported not-supported not-supported not-supported not-supported
Embed Multilingual supported not-supported not-supported not-supported not-supported
Incorpora v4 supported not-supported not-supported not-supported not-supported
Rerank 3.5 supported not-supported not-supported not-supported not-supported

DeepSeek

Nome modello Invoke Converse Completamenti delle chat Risposte Messaggi
DeepSeek V3.2* supported supported supported not-supported not-supported
DeepSeek-R1* supported supported not-supported not-supported not-supported
DeepSeek-V3.1* supported supported supported not-supported not-supported

Google

Nome modello Invoke Converse Completamenti delle chat Risposte Messaggi
Gemma 3 12B IT* supported supported supported not-supported not-supported
Gemma 3 27B PT* supported supported supported not-supported not-supported
Gemma 3 4B IT* supported supported supported not-supported not-supported

Meta

MiniMax

Nome modello Invoke Converse Completamenti delle chat Risposte Messaggi
MiniMax M2* supported supported supported not-supported not-supported
MiniMax M2.1* supported supported supported not-supported not-supported
MiniMax M2.5* supported supported supported not-supported

Mistral

Moonshot

Nome modello Invoke Converse Completamenti delle chat Risposte Messaggi
Il pensiero di Kimi K2* supported supported not-supported not-supported not-supported
Kimi K2.5* supported supported supported not-supported not-supported

NVIDIA

Nome modello Invoke Converse Completamenti delle chat Risposte Messaggi
NVIDIA Nemotron Nano 9B v2* supported supported supported not-supported not-supported
NVIDIA Nemotron Nano 12B v2 VL BF16* supported supported supported not-supported not-supported
Nemotron Nano 3 30B* supported supported supported not-supported not-supported
NVIDIA Nemotron 3 Super 120B* supported supported supported not-supported

OpenAI

Puoi utilizzare tutti i modelli in questa pagina con l'API Responses e l'API Chat Completions attive. bedrock-mantle Vedi ogni modello di scheda per i dettagli.

Qwen

Stabilità

TwelveLabs

Nome modello Invoke Converse Completamenti delle chat Risposte Messaggi
Marengo Embed 3.0 supported not-supported not-supported not-supported not-supported
Marengo Embed v2.7 not-supported not-supported not-supported not-supported not-supported
Pegasus v1.2 supported not-supported not-supported not-supported not-supported

Istanza di scrittura

Nome modello Invoke Converse Completamenti delle chat Risposte Messaggi
Palmyra Vision 7B supported supported supported not-supported
Palmyra X4* supported supported not-supported not-supported not-supported
Palmyra X5* supported supported not-supported not-supported not-supported

xAI

Nome modello Invoke Converse Completamenti delle chat Risposte Messaggi
Grok 4.3 not-supported not-supported supported supported not-supported
Grok 4.6 supported supported supported supported not-supported

Z.AI

Nome modello Invoke Converse Completamenti delle chat Risposte Messaggi
GLM 4.7* supported supported supported not-supported not-supported
GLM 4.7 Flash* supported supported supported not-supported not-supported
GLM 5* supported supported supported not-supported not-supported
Nota

* Supporto per lo streaming: supporta anche i modelli contrassegnati con un asterisco (*)InvokeModelWithResponseStream, che restituisce le risposte come streaming in tempo reale.

Modelli che supportano StartAsyncInvoke

StartAsyncInvoke è un'API Amazon Bedrock Runtime che consente ai chiamanti di inviare una richiesta di richiamo del modello e ricevere immediatamente un InvocationARN senza attendere che il modello termini l'elaborazione. Il processo viene eseguito in background e l'output viene scritto in un bucket S3 specificato dal chiamante una volta completato. I chiamanti possono quindi verificare lo stato del lavoro utilizzando il compagno e le API. GetAsyncInvoke ListAsyncInvokes Lo schema è stato creato appositamente per carichi di lavoro che coinvolgono ingressi di grandi dimensioni o non sensibili alla latenza, in particolare la generazione di video, audio e incorporamento di massa, per i quali mantenere una connessione sincrona aperta non sarebbe pratico.

Per quanto riguarda i modelli che lo supportano, sono supportati i seguenti modelli: StartAsyncInvoke

  • TwelveLabs Marengo Embed 2.7 (twelvelabs.marengo-embed-2-7-v 1:0): richiesto per l'input video e audio; gestisce solo testo e immagini InvokeModel

  • TwelveLabs Marengo Embed 3.0 (twelvelabs.marengo-embed-3-0-v 1:0) — stesso modello; asincrono richiesto per at scale video/audio

  • Amazon Nova Reel (amazon.nova-reel-v 1:0 e v 1:1): la generazione di video è esclusivamente asincrona; l'output arriva in S3

  • Amazon Nova Multimodal Embeddings (amazon.nova-2-multimodal-embeddings-v 1:0): è richiesto l'asincrono per gli ingressi video di dimensioni superiori a 25 MB con codifica base64; la sincronizzazione è disponibile per gli input di testo, immagini e documenti

InvokeModelWithBidirectionalStream

InvokeModelWithBidirectionalStreamè un'API Amazon Bedrock Runtime che stabilisce un canale full duplex persistente tra il chiamante e il modello, consentendo ai dati audio di fluire in entrambe le direzioni contemporaneamente e continuamente. A differenza delle API standard InvokeModel o addirittura delle InvokeModelWithResponseStream API, che seguono uno schema di richiesta e risposta, questa API mantiene la connessione aperta per tutta la durata di una sessione in modo che il modello possa elaborare l'audio in ingresso non appena arriva e trasmettere in streaming il parlato generato quasi in tempo reale, senza attendere il completamento dell'enunciato completo. L'interazione è strutturata in tre fasi: inizializzazione della sessione (in cui il client invia eventi di configurazione per impostare lo stream), streaming audio (in cui l'audio acquisito viene codificato e inviato come flusso di eventi continuo) e streaming di risposta (in cui il modello restituisce simultaneamente trascrizioni testuali del parlato dell'utente e dell'output audio sintetizzato). InvokeModelWithBidirectionalStreamnon può essere utilizzato con le chiavi API di Amazon Bedrock e richiede l'autenticazione standard basata su credenziali AWS, che riflette il ciclo di vita della sessione più complesso rispetto ad altre operazioni di Bedrock Runtime.

I seguenti modelli supportano questa API:

  • Famiglia Amazon Nova Sonic: sia amazon.nova-sonic-v 1:0 che amazon.nova-2-sonic-v 1:0 la utilizzano come unico percorso di chiamata, poiché l'architettura speech-to-speech richiede fondamentalmente un canale bidirezionale live che né Converse sono in grado di fornire. InvokeModel