Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.
Big 4.3
Xai — Grok 4.3
Detail Model
Grok 4.3 adalah model penalaran pertama yang menawarkan upaya penalaran yang selalu aktif dan dapat dikonfigurasi (tidak ada, rendah, sedang, tinggi). Karena penalaran selalu aktif daripada opsional, penalaran berperilaku lebih konsisten di loop agen multi-langkah daripada model yang dapat melewatkan pemikiran. Ini juga menawarkan penggunaan alat yang kuat dan kemampuan mengikuti instruksi untuk membangun agen multi-langkah, dan efisiensi token untuk membantu menjaga inferensi volume tinggi tetap hemat biaya. Grok 4.3 sangat cocok untuk beban kerja perusahaan seperti tinjauan kontrak, penelitian hukum kasus, analisis perjanjian kredit, dan Tanya Jawab dokumen keuangan, sambil memberikan hasil yang konsisten dan berkualitas tinggi di seluruh AI percakapan, pencarian, obrolan, dan alur kerja multi-putaran. Grok 4.3 berjalan di Mantle, mesin inferensi baru di Amazon Bedrock yang dirancang untuk kinerja harga, dengan dukungan untuk panggilan alat, output terstruktur, dan streaming respons.
Tanggal peluncuran model: 15 Juni 2026
Tanggal model EOL: N/A
Perjanjian Lisensi Pengguna Akhir dan Ketentuan Penggunaan: Lihat
Siklus hidup model: Aktif
Jendela konteks: 1M token
Penalaran: Di dukung (dapat dikonfigurasi: rendah, sedang, tinggi)
| Modalitas Input | Modalitas Output | API didukung | Titik akhir didukung |
|---|---|---|---|
Chat Completions | bedrock-runtime | ||
Responses | bedrock-mantle | ||
Invoke | |||
Converse | |||
Padabedrock-mantle, model ini disajikan di/openai/v1/responses, bukan default/v1/responses.
Kemampuan dan Fitur
Fitur Bedrock
Fitur yang didukung menggunakan bedrock-mantle titik akhir
| Didukung | Tidak Didukung |
|---|---|
|
— |
Harga
Untuk informasi harga, lihat halaman
Akses Terprogram
Gunakan ID model dan URL titik akhir berikut untuk mengakses model ini secara terprogram. Untuk informasi selengkapnya tentang API dan titik akhir yang tersedia, lihat API yang didukung dan T itik Akhir didukung.
| Titik akhir | Model ID | In-Region URL titik akhir | ID inferensi geografis | ID inferensi global |
|---|---|---|---|---|
bedrock-mantle |
xai.grok-4.3 |
https://bedrock-mantle.{region}.api.aws/openai/v1 |
Tidak didukung | Tidak didukung |
Misalnya, jika wilayah adalah us-west-2 (Oregon), maka URL titik akhir landrock-mantle akan menjadi "”. https://bedrock-mantle.us-west-2.api.aws/openai/v1
Tingkat Layanan
Amazon Bedrock menawarkan beberapa tingkatan layanan untuk memenuhi persyaratan beban kerja Anda. Standar menyediakan akses bayar per token tanpa komitmen (atur "service_tier": "default" atau hilangkan bidang). Priority memberikan waktu respons tercepat untuk premi harga (set"service_tier": "priority"). Flex menyediakan akses berbiaya lebih rendah untuk beban kerja yang fleksibel dan tidak peka waktu (set). "service_tier": "flex" Reserved menyediakan throughput khusus dengan komitmen jangka untuk beban kerja yang dapat diprediksi; ini ditetapkan pada tingkat akun, bukan per permintaan (hubungi tim akun AWS Anda untuk mengaktifkan). Untuk informasi selengkapnya, lihat tingkatan layanan.
| Standar | Prioritas | Fleksibel | Dicadangkan |
|---|---|---|---|
Ketersediaan Wilayah
Sekilas tentang ketersediaan regional
Amazon Bedrock menawarkan tiga opsi inferensi: In-Region menyimpan permintaan dalam satu Wilayah untuk kepatuhan yang ketat, Cross-Region rute Geo melintasi Wilayah dalam geografi (seperti AS, UE, dan APAC) sambil menghormati residensi data, dan Cross-Region rute Global di mana pun di seluruh dunia ketika tidak ada batasan residensi. Lihat Ketersediaan regional berdasarkan model halaman untuk lebih jelasnya.
| Wilayah | In-Region | Geo | Global |
|---|---|---|---|
us-west-2(Oregon) | |||
us-east-1(Virginia Utara) | |||
us-east-2(Ohio) |
Kuota dan Batas
AWS Akun Anda memiliki kuota default untuk mempertahankan kinerja layanan dan untuk memastikan penggunaan Amazon Bedrock yang tepat. Kuota default yang ditetapkan ke akun mungkin diperbarui tergantung pada faktor regional, riwayat pembayaran, penggunaan penipuan, and/or persetujuan permintaan peningkatan kuota. Untuk informasi selengkapnya, lihat Kuota untuk Amazon Bedrock dokumentasi dan lihat batasan untuk model.
Saat menggunakan throughput sesuai permintaan pada bedrock-mantle titik akhir, throughput yang tersedia akan berskala dari waktu ke waktu. Tidak semua permintaan dalam kuota Anda dijamin berhasil selama periode permintaan tinggi, jadi meningkatkan secara bertahap adalah penting. Untuk model ini, batas default tidak muncul secara langsung melalui Kuota Layanan, jadi sebaiknya ikuti ramp sebagai panduan Anda.
Kode Sampel
Langkah 1 - AWS Akun: Jika Anda sudah memiliki AWS akun, lewati langkah ini. Jika Anda baru mengenal AWS, daftar untuk akun AWS
Langkah 2 - Kunci API: Buka konsol Amazon Bedrock
Langkah 3 - Dapatkan SDK: Untuk menggunakan panduan memulai ini, Anda harus sudah menginstal Python. Kemudian instal perangkat lunak yang relevan tergantung pada API yang Anda gunakan.
Langkah 4 - Mengatur variabel lingkungan: Konfigurasikan lingkungan Anda untuk menggunakan kunci API untuk otentikasi.
Langkah 5 - Jalankan permintaan inferensi pertama Anda: Simpan file sebagai bedrock-first-request.py
Pertimbangan dan Batasan Penggunaan
Upaya penalaran — Penalaran selalu aktif secara default. Anda dapat mengonfigurasi upaya melalui
reasoningparameter:{"effort": "none"}(menonaktifkan penalaran),"low"(default),"medium", atau"high". Konten penalaran dienkripsi dan dapat dikembalikan denganinclude: ["reasoning.encrypted_content"]meneruskan permintaan API Tanggapan. Anda dapat mengirim konten terenkripsi kembali pada giliran berikutnya untuk memberikan konteks penalaran untuk percakapan multi-putaran. API Penyelesaian Obrolan tidak mengembalikan token penalaran.response = client.responses.create( model="xai.grok-4.3", reasoning={"effort": "high"}, include=["reasoning.encrypted_content"], input="Explain quantum entanglement simply." ) print(response.output_text)Parameter default — Grok 4.3 menggunakan default yang berbeda dari spesifikasi OpenAI API standar:
temperaturedefault ke (not), default ke0.7(not1), dantop_pdefault ke0.95.1max_completion_tokens131072Sesuaikan nilai-nilai ini secara eksplisit jika aplikasi Anda memerlukan perilaku yang berbeda.