Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.
Jamba 1.5 Large
AI21 Labs — Jamba 1.5 Large
Dettagli del modello
Jamba 1.5 Large è il SSM-Transformer modello ibrido di AI21 Labs con 398 B di parametri totali e una finestra di contesto di 256K, ottimizzato per attività di ragionamento complesse su documenti lunghi. Per ulteriori informazioni sullo sviluppo e sulle prestazioni del modello, consulta la scheda. model/service
Data di lancio del modello: 22 agosto 2024
Data EOL del modello: non prima del 2025 9/23
Contratti di licenza con l'utente finale e condizioni d'uso: Visualizza https://www.ai21.com/jamba-open-model-license/
Ciclo di vita del modello: attivo
Finestra contestuale: 256.000 token
Token di uscita massimi: 4K
Chiusura delle conoscenze: marzo 2024
ID prodotto Marketplace:
prod-evcp4w4lurj26
| Modalità di immissione | Modalità di output | API supportate | Endpoint supportati |
|---|---|---|---|
Responses | bedrock-runtime | ||
Chat Completions | bedrock-mantle | ||
Invoke | |||
Converse | |||
Suggerimento
Quando possibile, consigliamo di utilizzare l'bedrock-runtimeendpoint per nuove applicazioni. Per informazioni dettagliate, vedi Endpoint supportati da Amazon Bedrock.
Funzionalità e caratteristiche
Caratteristiche di Bedrock
Funzionalità supportate tramite endpoint bedrock-runtime
| Supportato | Non supportato |
|---|---|
Prezzi
Per informazioni sui prezzi, consulta la pagina dei prezzi di
Accesso programmatico
Utilizzate i seguenti ID del modello e URL degli endpoint per accedere a questo modello a livello di codice. Per ulteriori informazioni sulle API e sugli endpoint disponibili, consulta API supportate ed Endpoint supportati. bedrock/latest/userguide/endpoints.html
| Endpoint | ID del modello | In-Region URL dell'endpoint | ID di geo-inferenza | ID di inferenza globale |
|---|---|---|---|---|
bedrock-runtime |
ai21.jamba-1-5-large-v1:0 |
https://bedrock-runtime.{region}.amazonaws.com |
Non supportata | Non supportata |
Ad esempio, se la regione è us-east-1 (Virginia settentrionale), l'URL dell'endpoint bedrock-runtime sarà "" e per bedrock-mantle sarà "»https://bedrock-runtime.us-east-1.amazonaws.com. https://bedrock-mantle.us-east-1.api.aws/v1
Livelli di servizio
Amazon Bedrock offre diversi livelli di servizio per soddisfare i requisiti del carico di lavoro. Standard fornisce l'accesso pay-per-token senza impegno (imposta o ometti il campo). "service_tier": "default" Priority offre i tempi di risposta più rapidi a un prezzo superiore (impostato). "service_tier": "priority" Flex offre un accesso a basso costo per carichi di lavoro flessibili e non sensibili al fattore tempo (set). "service_tier": "flex" Reserved offre un throughput dedicato con un impegno a termine per carichi di lavoro prevedibili; è impostato a livello di account anziché su richiesta (contatta il team del tuo account AWS per abilitare). Per ulteriori informazioni, consulta i livelli di servizio.
| Standard | Priorità | Flex | Riservato |
|---|---|---|---|
Disponibilità regionale
La disponibilità regionale a colpo d'occhio
Amazon Bedrock offre tre opzioni di inferenza: In-Region mantiene le richieste all'interno di una singola regione per garantire una conformità rigorosa, le Cross-Region rotte geografiche tra le regioni all'interno di un'area geografica (come Stati Uniti, UE e APAC) rispettando la residenza dei dati e le Cross-Region rotte globali in qualsiasi parte del mondo quando non ci sono vincoli di residenza. Per maggiori dettagli, consulta la pagina. Disponibilità regionale per modelli
| Region | In-Region | Geo | Globale |
|---|---|---|---|
us-east-1(Virginia del Nord) |
Quote e limiti
Il tuo AWS account ha delle quote predefinite per mantenere le prestazioni del servizio e garantire un uso appropriato di Amazon Bedrock. Le quote predefinite assegnate a un account potrebbero essere aggiornate in base a fattori regionali, alla cronologia dei pagamenti, all'uso fraudolento, all' and/or approvazione di una richiesta di aumento delle quote. bedrock/latest/userguide/quotas-increase.html Per ulteriori informazioni, consulta Quote per Amazon Bedrock la documentazione e consulta i limiti del modello.
Codice di esempio
Passaggio 1 - AWS Account: se hai già un AWS account, salta questo passaggio. Se non conosci AWS, crea un account https://portal.aws.amazon.com/billing/signup
Passaggio 2 - Chiave API: accedi alla console Amazon Bedrock
Passaggio 3 - Scarica l'SDK: per utilizzare questa guida introduttiva, devi avere Python già installato. Quindi installa il software pertinente in base alle API che stai utilizzando.
pip install boto3
Passaggio 4 - Impostazione delle variabili di ambiente: configura il tuo ambiente per utilizzare la chiave API per l'autenticazione.
AWS_BEARER_TOKEN_BEDROCK="<provide your Bedrock API key>"
Fase 5 - Esegui la tua prima richiesta di inferenza: salva il file con nome bedrock-first-request.py