Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.
GPT-5.6 Luna
OpenAI — Bulan GPT-5.6
Detail Model
GPT-5.6 Luna adalah model cepat dan terjangkau dari OpenAI. Gunakan Luna untuk tugas inferensi volume tinggi seperti klasifikasi, ringkasan, perutean, dan aplikasi real-time di mana latensi dan biaya per token paling penting. Untuk informasi lebih lanjut tentang pengembangan model dan kinerja, lihat model/service kartu
Tanggal peluncuran model: 13 Juli 2026
EOL tidak lebih cepat dari: 13 Juli 2027
Periode warisan: minimal 6 bulan
Kebijakan siklus hidup model: Siklus hidup model (Untuk Model yang Diluncurkan Sebelum 7 September 2026)
Tanggal model EOL: N/A
Perjanjian Lisensi Pengguna Akhir dan Ketentuan Penggunaan: Lihat
Siklus hidup model: Aktif
Jendela konteks: 1M token
ID produk pasar:
prod-bpeu2ptegwjfa
| Modalitas Input | Modalitas Output |
|---|---|
Titik akhir dan API didukung
Tabel berikut menunjukkan titik akhir dan API mana yang didukung untuk GPT-5.6 Luna. Untuk informasi selengkapnya, lihat API yang didukung oleh Amazon Bedrock dan Titik akhir didukung oleh Amazon Bedrock.
Dukungan titik akhir
| Titik akhir | Didukung |
|---|---|
bedrock-runtime |
|
bedrock-mantle |
API didukung pada bedrock-runtime titik akhir
| Pesan | Tanggapan | Penyelesaian Obrolan | Converse | Memanggil |
|---|---|---|---|---|
API didukung pada bedrock-mantle titik akhir
| Pesan | Tanggapan | Penyelesaian Obrolan | Converse | Memanggil |
|---|---|---|---|---|
catatan
Aktifbedrock-mantle, kedua API menggunakan jalur /openai/v1 dasar, tidak/v1. Gunakan salah satu API dengan model ini:
Untuk Tanggapan, gunakan
/openai/v1/responses.Untuk Penyelesaian Obrolan, gunakan.
/openai/v1/chat/completions
Tip
Jika memungkinkan, kami sarankan menggunakan titik bedrock-runtime akhir untuk aplikasi baru. Lihat Titik akhir didukung oleh Amazon Bedrock untuk detail.
Kemampuan dan Fitur
Fitur Bedrock
Fitur yang didukung menggunakan bedrock-runtime titik akhir
| Didukung | Tidak Didukung |
|---|---|
|
Fitur yang didukung menggunakan bedrock-mantle titik akhir
| Didukung | Tidak Didukung |
|---|---|
|
|
Harga
Semua harga dalam USD per 1 juta token untuk tingkat Standar.
In-Region Harga komersial termasuk biaya 10% di atas tarif OpenAI. Anda tidak perlu menambahkan biaya ini.
Tingkat Prioritas dan Flex tidak didukung untuk model ini.
Wilayah Komersional — konteks pendek (token input 272K atau kurang)
| Opsi inferensi | Masukan | Input - tulis cache 30m | Input - cache dibaca | Keluaran |
|---|---|---|---|---|
| In-Region | $0.22 | $0.275 | $0.022 | $1,32 |
| Geo CRIS | $0.22 | $0.275 | $0.022 | $1,32 |
| CRIS global | $0.20 | $0.25 | $0.02 | $1,20 |
Wilayah komersial — konteks panjang (lebih dari 272K token input)
| Opsi inferensi | Masukan | Input - tulis cache 30m | Input - cache dibaca | Keluaran |
|---|---|---|---|---|
| In-Region | $0,44 | $0,55 | $0.044 | $1,98 |
| Geografis CRIS | $0,44 | $0,55 | $0.044 | $1,98 |
| CRIS global | $0,40 | $0,50 | $0,04 | $1,80 |
AWS GovCloud (US-East dan US-West)
Konteks pendek (token input 272K atau kurang)
| Opsi inferensi | Masukan | Input - tulis cache 30m | Input - cache dibaca | Keluaran |
|---|---|---|---|---|
| In-Region | $0.264 | $0,33 | $0.0264 | $1.584 |
Konteks panjang (lebih dari 272K token input)
| Opsi inferensi | Masukan | Input - tulis cache 30m | Input - cache dibaca | Keluaran |
|---|---|---|---|---|
| In-Region | $0.528 | $0.66 | $0.0528 | $2.376 |
Akses Terprogram
Gunakan ID model dan URL titik akhir berikut untuk mengakses model ini secara terprogram. Untuk informasi selengkapnya tentang API dan titik akhir yang tersedia, lihat API yang didukung dan T itik Akhir didukung.
| Titik akhir | Model ID | In-Region URL titik akhir | ID inferensi geografis | ID inferensi global |
|---|---|---|---|---|
bedrock-mantle |
openai.gpt-5.6-luna |
https://bedrock-mantle.{region}.api.aws/openai/v1 |
Tidak didukung | Tidak didukung |
bedrock-runtime |
openai.gpt-5.6-luna |
Tidak didukung | us.openai.gpt-5.6-lunadalam komersial Wilayah AWS, in.openai.gpt-5.6-luna di Wilayah India |
global.openai.gpt-5.6-luna |
Misalnya, jika wilayah adalah us-east-1 (Virginia Utara), maka URL titik akhir landrock-mantle akan menjadi "”. https://bedrock-mantle.us-east-1.api.aws/openai/v1 Padabedrock-runtime, URL dasarnya adalah "https://bedrock-runtime.{region} .amazonaws. com/openai/v1 "dan permintaan harus memberi nama ID inferensi lintas wilayah geografis us.openai.gpt-5.6-luna sebagai model.
Tingkat Layanan
Amazon Bedrock menawarkan beberapa tingkatan layanan untuk memenuhi persyaratan beban kerja Anda. Standar menyediakan akses bayar per token tanpa komitmen (atur "service_tier": "default" atau hilangkan bidang). Priority memberikan waktu respons tercepat untuk premi harga (set"service_tier": "priority"). Flex menyediakan akses berbiaya lebih rendah untuk beban kerja yang fleksibel dan tidak peka waktu (set). "service_tier": "flex" Reserved menyediakan throughput khusus dengan komitmen jangka untuk beban kerja yang dapat diprediksi; ini ditetapkan pada tingkat akun, bukan per permintaan (hubungi tim akun AWS Anda untuk mengaktifkan). Untuk informasi selengkapnya, lihat tingkatan layanan.
| Standar | Prioritas | Fleksibel | Dipesan |
|---|---|---|---|
Ketersediaan Wilayah
Sekilas tentang ketersediaan regional
Amazon Bedrock menawarkan tiga opsi inferensi: In-Region menyimpan permintaan dalam satu Wilayah untuk kepatuhan yang ketat, Cross-Region rute Geo melintasi Wilayah dalam geografi (seperti AS, UE, dan APAC) sambil menghormati residensi data, dan Cross-Region rute Global di mana pun di seluruh dunia ketika tidak ada batasan residensi. Lihat Ketersediaan regional berdasarkan model halaman untuk lebih jelasnya.
Ketersediaan berbeda berdasarkan titik akhir.
Ketersediaan menggunakan titik bedrock-mantle akhir
| Wilayah | In-Region | Geo | Global |
|---|---|---|---|
us-east-1(Virginia Utara) | |||
us-east-2(Ohio) | |||
us-west-2(Oregon) | |||
us-gov-west-1(GovCloud Barat) | |||
us-gov-east-1(GovCloud Timur) |
Ketersediaan menggunakan titik bedrock-runtime akhir
| Wilayah | In-Region | Geo | Global |
|---|---|---|---|
us-east-1(Virginia Utara) | |||
us-east-2(Ohio) | |||
us-west-1(California Utara) | |||
us-west-2(Oregon) | |||
ca-central-1(Kanada) | |||
ca-west-1(Calgary) | |||
eu-central-1(Frankfurt) | |||
eu-central-2(Zurich) | |||
eu-north-1(Stockholm) | |||
eu-south-1(Milan) | |||
eu-south-2(Spanyol) | |||
eu-west-1(Irlandia) | |||
eu-west-2(London) | |||
eu-west-3(Paris) | |||
ap-east-2(Taipei) | |||
ap-northeast-1(Tokio) | |||
ap-northeast-2(Seoul) | |||
ap-northeast-3(Sendai) | |||
ap-south-1(Mumbai) | |||
ap-south-2(Haiderabad) | |||
ap-southeast-1(Singapura) | |||
ap-southeast-2(Sydney) | |||
ap-southeast-3(Jakarta) | |||
ap-southeast-4(Melbourne) | |||
ap-southeast-5(Indonesia) | |||
ap-southeast-6(Selandia Baru) | |||
ap-southeast-7(Thailand) | |||
il-central-1(Tel Aviv) | |||
me-central-1(UEA) | |||
me-south-1(Bahrain) | |||
af-south-1(Cape Town) | |||
sa-east-1(Sao Paulo) |
Kuota dan Batas
AWS Akun Anda memiliki kuota default untuk mempertahankan kinerja layanan dan untuk memastikan penggunaan Amazon Bedrock yang tepat. Kuota default yang ditetapkan ke akun mungkin diperbarui tergantung pada faktor regional, riwayat pembayaran, penggunaan penipuan, and/or persetujuan permintaan peningkatan kuota. Untuk informasi selengkapnya, lihat Kuota untuk Amazon Bedrock dokumentasi dan lihat batasan untuk model.
Pada bedrock-runtime titik akhir, batas dikelola sebagai token per menit (TPM) dengan tingkat pembakaran 10x, di mana 1 token keluaran mengkonsumsi 10 token.
Kode Sampel
Langkah 1 - AWS Akun: Jika Anda sudah memiliki AWS akun, lewati langkah ini. Jika Anda baru mengenal AWS, daftar untuk akun AWS
Langkah 2 - Kunci API: Buka konsol Amazon Bedrock
Langkah 3 - Dapatkan SDK: Untuk menggunakan panduan memulai ini, Anda harus sudah menginstal Python. Kemudian instal perangkat lunak yang relevan tergantung pada API yang Anda gunakan.
Untuk kedua API, pilih tab OpenAI SDK.
Langkah 4 - Tetapkan variabel lingkungan
Konfigurasikan lingkungan Anda untuk menggunakan kunci API untuk otentikasi.
catatan
Aktifbedrock-runtime, beri nama profil inferensi lintas wilayah sebagai model — us.openai.gpt-5.6-luna atau. global.openai.gpt-5.6-luna Model ini tidak tersedia untuk inferensi In-region pada titik akhir tersebut. Identitas IAM Anda juga perlu bedrock:InvokeModel di project default akun Anda (arn:aws:bedrock:{region}:{account-id}:project/default) selain profil inferensi.
Langkah 5 - Jalankan permintaan inferensi pertama Anda
Simpan file sebagai bedrock-first-request.py
mantel batuan dasar
Gunakan pengaturan dari Langkah 4 - Mengatur variabel lingkungan. Pilih bedrock-mantle tab. Tab Obrolan menggunakan API Penyelesaian Obrolan.
runtime dasar: OpenAI SDK
Gunakan pengaturan dari Langkah 4 - Mengatur variabel lingkungan. Pilih bedrock-runtime tab. Kirim permintaan Anda dengan Responses API.