View a markdown version of this page

Permintaan dan Tanggapan - Amazon Bedrock

Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.

Permintaan dan Tanggapan

Badan permintaan diteruskan di body bidang permintaan ke InvokeModel atau InvokeModelWithResponseStream.

catatan

Pembatasan berlaku untuk operasi berikut:InvokeModel,InvokeModelWithResponseStream,Converse, danConverseStream. Lihat batasan API untuk detailnya.

Awas

Claude Sonnet 4.5dan Claude Haiku 4.5 mendukung menentukan top_p parameter temperature atau, tetapi tidak keduanya. Ini tidak berlaku untuk model lama.

Request

AnthropicClaudememiliki parameter inferensi berikut untuk panggilan inferensi pesan.

{ "anthropic_version": "bedrock-2023-05-31", "anthropic_beta": ["computer-use-2024-10-22"] "max_tokens": int, "system": string | [{"type": "text", "text": string}], "messages": [ { "role": string, "content": [ { "type": "image", "source": { "type": "base64", "media_type": "image/jpeg", "data": "content image bytes" } }, { "type": "text", "text": "content text" } ] } ], "temperature": float, "top_p": float, "top_k": int, "tools": [ { "type": "custom", "name": string, "description": string, "input_schema": json }, { "type": "computer_20241022", "name": "computer", "display_height_px": int, "display_width_px": int, "display_number": 0 int }, { "type": "bash_20241022", "name": "bash" }, { "type": "text_editor_20241022", "name": "str_replace_editor" } ], "tool_choice": { "type" : string, "name" : string, }, "stop_sequences": [string] }

Berikut ini adalah parameter yang diperlukan.

  • anthropic_version — (Diperlukan) Versi antropik. Nilainya harusbedrock-2023-05-31.

  • max_tokens — (Diperlukan) Jumlah maksimum token yang dihasilkan sebelum berhenti.

    Perhatikan bahwa Anthropic Claude model mungkin berhenti menghasilkan token sebelum mencapai nilaimax_tokens. AnthropicClaudeModel yang berbeda memiliki nilai maksimum yang berbeda untuk parameter ini. Untuk informasi selengkapnya, lihat Perbandingan model.

  • pesan — (Diperlukan) Pesan masukan.

    • Per an — Peran pergantian percakapan. Nilai yang valid adalah user dan assistant.

      Minimum Maksimum

      0

      2000

    • konten — (wajib) Isi percakapan berubah, sebagai array objek. Setiap objek berisi bidang tipe, di mana Anda dapat menentukan salah satu nilai berikut:

      • text- Jika Anda menentukan jenis ini, Anda harus menyertakan bidang teks dan menentukan prompt teks sebagai nilainya. Jika objek lain dalam array adalah gambar, prompt teks ini berlaku untuk gambar.

      • image- Jika Anda menentukan jenis ini, Anda harus menyertakan bidang sumber yang dipetakan ke objek dengan bidang berikut:

        • tipe — (wajib) Jenis pengkodean untuk gambar. Anda dapat menentukanbase64.

        • media_type — (wajib) Jenis gambar. Anda dapat menentukan format gambar berikut.

          • image/jpeg

          • image/png

          • image/webp

          • image/gif

        • data — (wajib) Byte gambar yang dikodekan base64 untuk gambar. Ukuran gambar maksimum adalah 3,75MB. Tinggi dan lebar maksimum gambar adalah 8000 piksel.

Berikut ini adalah parameter opsional.

  • sistem — (Opsional) Sistem prompt untuk permintaan. Anda dapat memberikan prompt sistem sebagai string atau sebagai array blok konten (misalnya,[{"type": "text", "text": "your prompt"}]).

    Prompt sistem adalah cara untuk memberikan konteks dan instruksi untuk AnthropicClaude, seperti menentukan tujuan atau peran tertentu. Untuk informasi selengkapnya, lihat Permintaan sistem dalam Anthropic dokumentasi.

    catatan

    Anda dapat menggunakan perintah sistem dengan Anthropic Claude versi 2.1 atau lebih tinggi.

  • anthropic_beta — (Opsional) Parameter beta antropik adalah daftar string header beta yang digunakan untuk menunjukkan opt-in ke serangkaian fitur beta tertentu.

    catatan

    Varian panjang konteks token 1 juta Claude Sonnet 4 tersedia untuk Anda di Wil AWS ayah tertentu sebagai “Layanan Beta” sebagaimana didefinisikan dalam Ket AWS entuan Layanan. Ini tunduk pada Perjanjian Anda dengan AWS dan Ketentuan AWS Layanan, dan model EULA yang berlaku. Silakan lihat halaman Harga Amazon Bedrock untuk informasi selengkapnya tentang harga untuk permintaan konteks yang lebih panjang. Untuk permintaan melebihi token input 200K, tingkat konteks panjang berlaku untuk seluruh permintaan, bukan hanya token di atas ambang batas. Kuota layanan terpisah berlaku (untuk informasi selengkapnya, lihat Kuota Layanan di Konsol Manajemen AWS).

    Header beta yang tersedia meliputi yang berikut:

    Fitur beta

    Header beta

    Catatan

    Penggunaan komputer

    computer-use-2025-01-24

    Kompatibel denganClaude 3.7 Sonnet.

    Penggunaan alat

    token-efficient-tools-2025-02-19

    Kompatibel dengan Claude 3.7 Sonnet dan Claude 4+.

    Pemikiran yang terjalin

    Interleaved-thinking-2025-05-14

    Kompatibel dengan Claude 4+ model.

    Mengaktifkan token keluaran hingga 128K

    output-128k-2025-02-19

    Kompatibel denganClaude 3.7 Sonnet.

    Mode pengembang untuk pemikiran mentah pada Claude 4+ model

    dev-full-thinking-2025-05-14

    Kompatibel dengan model Claude 4+ saja. Hubungi tim akun Anda untuk mengakses versi beta ini.

    1 juta token

    context-1m-2025-08-07

    Kompatibel denganClaude Sonnet 4,Claude Sonnet 4.6, danClaude Opus 4.6.

    Manajemen konteks

    context-management-2025-06-27

    Kompatibel dengan Claude Sonnet 4.5 dan Claude Haiku 4.5

    Upaya

    effort-2025-11-24

    Kompatibel dengan Claude Opus 4.5

    Alat pencarian alat

    tool-search-tool-2025-10-19

    Kompatibel dengan Claude Opus 4.5

    Contoh penggunaan alat

    tool-examples-2025-10-29

    Kompatibel dengan Claude Opus 4.5

  • stop_sequences — (Opsional) Urutan teks kustom yang menyebabkan model berhenti menghasilkan. AnthropicClaudemodel biasanya berhenti ketika mereka secara alami menyelesaikan giliran mereka, dalam hal ini nilai bidang stop_reason respons adalahend_turn. Jika Anda ingin model berhenti menghasilkan ketika menemukan string teks khusus, Anda dapat menggunakan stop_sequences parameter. Jika model menemukan salah satu string teks khusus, nilai bidang stop_reason respons adalah stop_sequence dan nilainya stop_sequence berisi urutan berhenti yang cocok.

    Jumlah maksimum entri adalah 8191.

  • suhu — (Opsional) Jumlah keacakan yang disuntikkan ke dalam respons.

    Default Minimum Maksimum

    1

    0

    1

  • top_p — (Opsional) Gunakan sampling nukleus.

    Dalam sampling inti, Anthropic Claude menghitung distribusi kumulatif di semua opsi untuk setiap token berikutnya dalam urutan probabilitas menurun. Ini memotong distribusi setelah mencapai probabilitas yang ditentukan olehtop_p. Saat menyesuaikan parameter pengambilan sampel, ubah salah temperature satu atautop_p. Jangan memodifikasi keduanya secara bersamaan.

    Default Minimum Maksimum

    0.999

    0

    1

  • top_k — (Opsional) Hanya sampel dari opsi K teratas untuk setiap token berikutnya.

    Gunakan top_k untuk menghapus respons probabilitas rendah ekor panjang.

    Default Minimum Maksimum

    Dinonaktifkan secara default

    0

    500

  • alat — (Opsional) Definisi alat yang dapat digunakan model.

    catatan

    Membutuhkan model Anthropic Claude 3.

    Jika Anda menyertakan tools dalam permintaan Anda, model dapat mengembalikan blok tool_use konten yang mewakili penggunaan alat tersebut oleh model. Anda kemudian dapat menjalankan alat-alat tersebut menggunakan input alat yang dihasilkan oleh model dan kemudian secara opsional mengembalikan hasil kembali ke model menggunakan blok tool_result konten.

    Anda dapat melewati jenis alat berikut:

    Khusus

    Definisi untuk alat khusus.

    • (opsional) tipe — Jenis alat. Jika didefinisikan, gunakan nilainyacustom.

    • nama — Nama alat.

    • deskripsi — (opsional, tetapi sangat disarankan) Deskripsi alat.

    • input_schema — Skema JSON untuk alat.

    Komputer

    Definisi untuk alat komputer yang Anda gunakan dengan API penggunaan komputer.

    • type — Nilai haruscomputer_20241022.

    • Nama — Nilai harus computer

    • (Wajib) display_height_px — Ketinggian layar yang dikendalikan oleh model, dalam piksel..

      Default Minimum Maksimum

      Tidak ada

      1

      Tidak ada maksimum

    • (Diperlukan) display_width_px — Lebar tampilan yang dikendalikan oleh model, dalam piksel.

      Default Minimum Maksimum

      Tidak ada

      1

      Tidak ada maksimum

    • (Opsional) display_number — Nomor tampilan untuk mengontrol (hanya relevan untuk lingkungan X11). Jika ditentukan, alat akan diberikan nomor tampilan dalam definisi alat.

      Default Minimum Maksimum

      Tidak ada

      0

      T

    bash

    Definisi untuk alat bash yang Anda gunakan dengan API penggunaan komputer.

    • (opsional) type — Nilai harusbash_20241022.

    • nama — Nilai haruslahbash. alat.

    editor teks

    Definisi untuk alat editor teks yang Anda gunakan dengan API penggunaan komputer.

    • (opsional) type — Nilai harustext_editor_20241022.

    • nama — Nilai haruslahstr_replace_editor. alat.

  • tool_choice — (Opsional) Menentukan bagaimana model harus menggunakan alat yang disediakan. Model dapat menggunakan alat tertentu, alat apa pun yang tersedia, atau memutuskan dengan sendirinya.

    catatan

    Membutuhkan model Anthropic Claude 3.

    • Jenis — Jenis pilihan alat. Nilai yang mungkin adalah any (gunakan alat yang tersedia), auto (model memutuskan), dan tool (gunakan alat yang ditentukan).

    • nama — (Opsional) Nama alat yang akan digunakan. Diperlukan jika Anda menentukan tool di type bidang.

Response

AnthropicClaudeModel mengembalikan bidang berikut untuk panggilan inferensi pesan.

{ "id": string, "model": string, "type" : "message", "role" : "assistant", "content": [ { "type": string, "text": string, "image" :json, "id": string, "name":string, "input": json } ], "stop_reason": string, "stop_sequence": string, "usage": { "input_tokens": integer, "output_tokens": integer } }

Contoh tanggapan dengan nilai stop_reason baru:

// Example with refusal { "stop_reason": "refusal", "stop_details": { "type": "refusal", "category": "cyber", "explanation": "This request triggered restrictions on violative cyber content and was blocked under Anthropic's Usage Policy." }, "content": [], "usage": { "input_tokens": 106, "output_tokens": 1 } } // Example with tool_use { "stop_reason": "tool_use", "content": [ { "type": "tool_use", "id": "toolu_123", "name": "calculator", "input": {"expression": "2+2"} } ] } // Example with model_context_window_exceeded (Claude Sonnet 4.5) { "stop_reason": "model_context_window_exceeded", "content": [ { "type": "text", "text": "The response was truncated due to context window limits..." } ] }
  • id — Pengidentifikasi unik untuk respons. Format dan panjang ID dapat berubah seiring waktu.

  • model — ID untuk Anthropic Claude model yang membuat permintaan.

  • stop_reason — Alasan mengapa Anthropic Claude berhenti menghasilkan respons.

    • end_turn — Model mencapai titik berhenti alami

    • max_tokens — Teks yang dihasilkan melebihi nilai bidang max_tokens input atau melebihi jumlah maksimum token yang didukung model. '.

    • stop_sequ ence — Model menghasilkan salah satu urutan berhenti yang Anda tent stop_sequences ukan di bidang input.

    • penolakan — Model diblokir oleh pengklasifikasi konten sebelum menyelesaikan responsnya. Respons mungkin berisi konten parSIAL jika pengklasifikasi diaktifkan di tengah aliran. Lihat stop_details untuk informasi tambahan tentang pembatasan. Alasan berhenti ini terjadi pada tingkat yang lebih tinggi secara material pada Claude Fable 5 karena pengklasifikasi konten penggunaan ganda.

    • tool_use — Claude memanggil alat dan mengharapkan Anda untuk menjalankannya

    • model_context_window_ — model menghentikan pembuatan karena mencapai batas jendela konteks.

      • Baru dengan Claude Sonnet 4.5

  • stop_sequence — Urutan berhenti yang mengakhiri generasi.

  • stop_details (object | null) — Informasi tambahan tentang mengapa respon berhenti. Hadir kapan stop_reason ada"refusal". Mungkin nol bahkan pada penolakan.

    • type (string) — Selalu "refusal" saat hadir.

    • category (string atau null) — Kategori konten yang memicu pembatasan (misalnya,"cyber","bio"). Null ketika penolakan tidak dipetakan ke kategori bernama.

    • penjelasan (string atau null) — Human-readable penjelasan pembatasan. Tidak dijamin stabil di seluruh permintaan - jangan mengurai secara terprogram.

    catatan

    Bercabang terusstop_reason, bukan aktifstop_details. Bid stop_details ang ini bersifat informatif dan dapat menjadi nol bahkan ketika stop_reason itu"refusal". Penolakan juga dapat terjadi di tengah aliran: pengklasifikasi dapat menyala setelah beberapa konten telah dialirkan. Dalam mode streaming, penolakan datang sebagai message_delta acara terakhir denganstop_reason: "refusal"; setiap blok konten yang dialirkan sebelum penolakan adalah keluaran paruh yang valid.

  • Jenis — Jenis respon. Nilainya selalu message.

  • peran — Peran percakapan dari pesan yang dihasilkan. Nilainya selalu assistant.

  • konten — Konten yang dihasilkan oleh model. Dikembalikan sebagai array. Ada tiga jenis konten, teks, tool_use dan gambar.

    • teks — Tanggapan teks.

      • Jenis — Jenis konten. Nilai ini adalah text.

      • teks — Jika nilainya type adalah teks, berisi teks konten.

    • penggunaan alat — Permintaan dari model untuk menggunakan alat.

      • Jenis — Jenis konten. Nilai ini adalah tool_use.

      • id — ID alat yang diminta oleh model untuk digunakan.

      • name — Berisi nama alat yang diminta.

      • input — Parameter input untuk diteruskan ke alat.

    • Gambar — Permintaan dari model untuk menggunakan alat.

      • Jenis — Jenis konten. Nilai ini adalah image.

      • sumber - Berisi gambar. Untuk informasi selengkapnya, lihat Permintaan multimodal.

  • penggunaan — Wadah untuk jumlah token yang Anda berikan dalam permintaan dan jumlah token yang dihasilkan model dalam respons.

    • input_tokens — Jumlah token input dalam permintaan.

    • output_tokens — Jumlah token yang dihasilkan model dalam respons.

    • stop_sequ ence — Model menghasilkan salah satu urutan berhenti yang Anda tent stop_sequences ukan di bidang input.

Parameter usaha (beta)

effortParameter ini merupakan alternatif untuk memikirkan anggaran token untuk Claude Opus 4.5. Parameter ini Claude memberi tahu seberapa bebas harus menghabiskan token untuk menghasilkan hasil terbaik, menyesuaikan penggunaan token di seluruh pemikiran, panggilan alat, dan komunikasi pengguna. Ini dapat digunakan dengan atau tanpa mode berpikir yang diperpanjang.

Parameter usaha dapat diatur ke:

  • high(default) — Claude menghabiskan token sebanyak yang diperlukan untuk hasil terbaik

  • medium— Penggunaan token yang seimbang

  • low— Penggunaan token konservatif

Untuk menggunakan fitur ini, Anda harus melewati header betaeffort-2025-11-24.

Contoh permintaan:

{ "anthropic_version": "bedrock-2023-05-31", "anthropic_beta": [ "effort-2025-11-24" ], "max_tokens": 4096, "output_config": { "effort": "medium" }, "messages": [{ "role": "user", "content": "Analyze this complex dataset and provide insights" }] }