Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.
Jamba 1.5 Besar
AI21 Labs — Jamba 1.5 Besar
Rincian Model
Jamba 1.5 Large adalah SSM-Transformer model hybrid AI21 Labs dengan parameter total 398B dan jendela konteks 256K, dioptimalkan untuk tugas penalaran kompleks di seluruh dokumen panjang. Untuk informasi lebih lanjut tentang pengembangan model dan kinerja, lihat model/service kartu
Tanggal peluncuran model: 22 Agustus 2024
EOL tidak lebih cepat dari: 22 Agustus 2025
Periode warisan: minimal 6 bulan
Kebijakan siklus hidup model: Siklus hidup model (Untuk Model yang Diluncurkan Sebelum 7 September 2026)
Tanggal Model EOL: 26 November 2026
Perjanjian Lisensi Pengguna Akhir dan Ketentuan Penggunaan: Lihat
Siklus hidup model: Legacy
Jendela konteks: 256K token
Token keluaran maksimum: 4K
Pemutusan pengetahuan: Mar 2024
ID produk pasar:
prod-evcp4w4lurj26
| Modalitas Input | Modalitas Output |
|---|---|
Titik akhir dan API didukung
Tabel berikut menunjukkan titik akhir dan API mana yang didukung untuk Jamba 1.5 Large. Untuk informasi selengkapnya, lihat API yang didukung oleh Amazon Bedrock dan Titik akhir didukung oleh Amazon Bedrock.
Dukungan titik akhir
| Titik akhir | Didukung |
|---|---|
bedrock-runtime |
|
bedrock-mantle |
API didukung pada bedrock-runtime titik akhir
| Pesan | Tanggapan | Penyelesaian Obrolan | Converse | Memanggil |
|---|---|---|---|---|
API didukung pada bedrock-mantle titik akhir
| Pesan | Tanggapan | Penyelesaian Obrolan | Converse | Memanggil |
|---|---|---|---|---|
Tip
Jika memungkinkan, kami sarankan menggunakan titik bedrock-runtime akhir untuk aplikasi baru. Lihat Titik akhir didukung oleh Amazon Bedrock untuk detail.
Kemampuan dan Fitur
Fitur Bedrock
Fitur yang didukung menggunakan bedrock-runtime titik akhir
| Didukung | Tidak Didukung |
|---|---|
Harga
Model ini adalah model pihak ketiga yang ditawarkan dan ditagih melalui AWS Marketplace. Biaya muncul di AWS tagihan Anda dan di Pen AWS jelajah Biaya di bawah penyedia model (bukan di bawah Amazon Bedrock). Untuk harga, lihat halaman
Akses Terprogram
Gunakan ID model dan URL titik akhir berikut untuk mengakses model ini secara terprogram. Untuk informasi selengkapnya tentang API dan titik akhir yang tersedia, lihat API yang didukung dan T itik Akhir didukung.
| Titik akhir | Model ID | In-Region URL titik akhir | ID inferensi geografis | ID inferensi global |
|---|---|---|---|---|
bedrock-runtime |
ai21.jamba-1-5-large-v1:0 |
https://bedrock-runtime.{region}.amazonaws.com |
Tidak didukung | Tidak didukung |
Misalnya, jika wilayah adalah us-east-1 (Virginia Utara), maka URL endpoint bedrock-runtime akan menjadi "" dan untuk bedrock-mantle adalah https://bedrock-runtime.us-east-1.amazonaws.com "”. https://bedrock-mantle.us-east-1.api.aws/v1
Tingkat Layanan
Amazon Bedrock menawarkan beberapa tingkatan layanan untuk memenuhi persyaratan beban kerja Anda. Standar menyediakan akses bayar per token tanpa komitmen (atur "service_tier": "default" atau hilangkan bidang). Priority memberikan waktu respons tercepat untuk premi harga (set"service_tier": "priority"). Flex menyediakan akses berbiaya lebih rendah untuk beban kerja yang fleksibel dan tidak peka waktu (set). "service_tier": "flex" Reserved menyediakan throughput khusus dengan komitmen jangka untuk beban kerja yang dapat diprediksi; ini ditetapkan pada tingkat akun, bukan per permintaan (hubungi tim akun AWS Anda untuk mengaktifkan). Untuk informasi selengkapnya, lihat tingkatan layanan.
| Standar | Prioritas | Fleksibel | Dipesan |
|---|---|---|---|
Ketersediaan Wilayah
Sekilas tentang ketersediaan regional
Amazon Bedrock menawarkan tiga opsi inferensi: In-Region menyimpan permintaan dalam satu Wilayah untuk kepatuhan yang ketat, Cross-Region rute Geo melintasi Wilayah dalam geografi (seperti AS, UE, dan APAC) sambil menghormati residensi data, dan Cross-Region rute Global di mana pun di seluruh dunia ketika tidak ada batasan residensi. Lihat Ketersediaan regional berdasarkan model halaman untuk lebih jelasnya.
Ketersediaan berbeda berdasarkan titik akhir.
Ketersediaan menggunakan titik bedrock-runtime akhir
| Wilayah | In-Region | Geo | Global |
|---|---|---|---|
us-east-1(Virginia Utara) |
Kuota dan Batas
AWS Akun Anda memiliki kuota default untuk mempertahankan kinerja layanan dan untuk memastikan penggunaan Amazon Bedrock yang tepat. Kuota default yang ditetapkan ke akun mungkin diperbarui tergantung pada faktor regional, riwayat pembayaran, penggunaan penipuan, and/or persetujuan permintaan peningkatan kuota. Untuk informasi selengkapnya, lihat Kuota untuk Amazon Bedrock dokumentasi dan lihat batasan untuk model.
Kode Sampel
Langkah 1 - AWS Akun: Jika Anda sudah memiliki AWS akun, lewati langkah ini. Jika Anda baru mengenal AWS, daftar untuk akun AWS
Langkah 2 - Kunci API: Buka konsol Amazon Bedrock
Langkah 3 - Dapatkan SDK: Untuk menggunakan panduan memulai ini, Anda harus sudah menginstal Python. Kemudian instal perangkat lunak yang relevan tergantung pada API yang Anda gunakan.
pip install boto3
Langkah 4 - Mengatur variabel lingkungan: Konfigurasikan lingkungan Anda untuk menggunakan kunci API untuk otentikasi.
AWS_BEARER_TOKEN_BEDROCK="<provide your Bedrock API key>"
Langkah 5 - Jalankan permintaan inferensi pertama Anda: Simpan file sebagai bedrock-first-request.py