Alat Pencarian Web
Agen AI mengubah cara organisasi berinteraksi dengan informasi, tetapi mereka menghadapi batasan mendasar: pengetahuan mereka dibekukan pada waktu pelatihan. Ketika pengguna bertanya tentang harga saham hari ini atau rilis perangkat lunak yang dikirim satu jam yang lalu, agen yang hanya mengandalkan data pelatihannya tidak dapat memberikan jawaban yang akurat.
Membangun integrasi pencarian web khusus untuk mengatasi masalah ini mahal — mendapatkan API penelusuran pihak ketiga, mengelola kunci dan kuota dan batas tarif, mengurai format hasil yang tidak konsisten di seluruh penyedia, membangun logika ekstraksi cuplikan sehingga model mendapatkan bagian yang relevan alih-alih HTML mentah, alasan tentang ke mana kueri pelanggan bepergian dan bagaimana data dapat dipertahankan, dan menjaga kesegaran dan cakupan dari waktu ke waktu. Masing-masing adalah proyek itu sendiri.
Alat Pencarian Web di Amazon Bedrock AgentCore menghilangkan kompleksitas itu. Ini adalah kemampuan pencarian MCP-compliant web yang dikelola sepenuhnya yang memungkinkan agen Anda mengambil informasi dari web tanpa overhead infrastruktur apa pun. Ini tersedia sebagai konektor terkelola yang Anda sambungkan ke AgentCore Gateway Anda. Agen menemukannya dengan tools/list panggilan standar dan memanggilnya seperti alat Protokol Konteks Model lainnya. Tidak ada API pencarian untuk penyediaan, tidak ada kredensyal keluar untuk dikelola, dan tidak ada lem penguraian hasil untuk dipertahankan.
Bagian berikut berjalan melalui kemampuan utama, arsitektur indeks web yang dibuat khusus, jaminan privasi, kasus penggunaan, dan cara mengatur Alat Pencarian Web.
Topik
Kemampuan kunci
-
Up-to-date akses informasi — Ambil hasil web saat ini dengan judul, URL, cuplikan, dan tanggal publikasi ke tanggapan agen darat dalam informasi terkini.
-
Manajemen infrastruktur nol — Tidak ada API penelusuran pihak ketiga untuk penyediaan atau penskalaan untuk dikonfigurasi. Gateway mengekspos pencarian web sebagai alat MCP standar secara otomatis.
-
Framework agnostic — Bekerja dengan Strands Agents, LangChain, LangGraph, CreWai, atau MCP-compatible klien apa pun melalui Protokol Konteks Model standar.
-
Purpose-built Indeks web — Didukung oleh indeks Amazon-operated web yang mencakup puluhan miliar dokumen.
-
Grafik pengetahuan untuk fakta kepercayaan tinggi — Entitas dasar dan hubungannya untuk memberikan jawaban faktual daripada meninggalkan model untuk menyimpulkannya dari teks halaman yang diekstraksi.
-
Ekstraksi cuplikan semantik - Menarik bagian yang relevan secara semantik dari setiap halaman web, dioptimalkan untuk jendela konteks model, daripada mengembalikan HTML mentah atau halaman penuh.
Purpose-built indeks web
Banyak solusi yang menambahkan pencarian web ke agen adalah pembungkus mesin pencari pihak ketiga. Alat Pencarian Web di Amazon Bedrock AgentCore berbeda — didukung oleh indeks web yang dibuat dan dioperasikan Amazon secara langsung.
- Cakupan luas
-
Indeks tersebut mencakup puluhan miliar dokumen. Skala itu penting untuk cakupan — pertanyaan panjang tentang pustaka khusus atau spesifikasi produk yang tidak jelas dapat dijawab dengan lebih efektif ketika indeksnya luas daripada terbatas pada halaman yang paling populer.
- Terus diperbarui
-
Amazon menyegarkan indeks secara berkelanjutan, mencerminkan konten baru dan berubah dalam beberapa menit. Untuk agen yang menjawab pertanyaan tentang pergerakan harga, atau pengumuman yang baru saja diterbitkan, jendela kebaruan itu adalah perbedaan antara jawaban yang membumi dan jawaban yang salah dengan percaya diri. Ketika agen Anda mencari “apa yang terjadi hari ini,” hasilnya mencerminkan apa yang sebenarnya terjadi hari ini.
- Grafik pengetahuan untuk fakta kepercayaan tinggi
-
Alat Pencarian Web mencakup grafik pengetahuan bawaan yang mendasari entitas dan hubungan mereka. Untuk pertanyaan faktual — seperti siapa yang memegang peran atau ketika sesuatu didirikan — grafik pengetahuan memberikan jawaban dengan keyakinan tinggi daripada meninggalkan model untuk menyimpulkannya dari teks halaman yang diekstraksi. Ini mengurangi jenis penyimpangan faktual halus yang dapat terjadi ketika agen menyatukan jawaban dari cuplikan saja.
- Ekstraksi cuplikan semantik dioptimalkan untuk konteks model
-
Alih-alih menyerahkan model dump HTML mentah atau halaman penuh, alat ini melakukan ekstraksi cuplikan yang relevan secara semantik. Ini menarik bagian-bagian dari setiap halaman web yang benar-benar menanggung kueri dan mengembalikannya dalam bentuk yang dioptimalkan untuk jendela konteks model. Hasilnya lebih padat, konteks yang lebih relevan per token — model melihat bagian-bagian yang penting dan menghabiskan lebih sedikit token pada boilerplate dan navigasi chrome, yang membantu meningkatkan ketepatan jawaban yang dikutip.
Pribadi dengan desain
Bagi banyak perusahaan, pertanyaan yang menghentikan peluncuran pencarian web bukanlah “apakah itu berhasil” - ini adalah “kemana perginya permintaan pengguna saya, dan apa yang terjadi pada mereka?” Web Search Tool dibangun sehingga jawaban-jawaban itu mudah.
- Pertanyaan tidak pernah pergi AWS
-
Ketika agen Anda mengeluarkan pencarian, kueri disajikan sepenuhnya dalam AWS infrastruktur. Pertanyaan pelanggan tidak dikirim ke mesin pencari pihak ketiga atau diarahkan ke luar. AWS Gateway mengautentikasi ke konektor yang AWS dimiliki dan merutekan permintaan secara internal, sehingga jalur data tetap berada di dalam AWS ujung ke ujung. Untuk tim dengan masalah keluar data, ini menghapus seluruh kategori ulasan.
Cara kerjanya
Alat Pencarian Web adalah konektor bawaan. Gateway menangani manajemen skema, tata kelola parameter, resolusi titik akhir, dan otentikasi layanan.
-
Pengaturan Gateway — Buat Gateway dan tambahkan target Alat Pencarian Web menggunakan
connectorId: "web-search". Gateway memotret skema alat dan menyediakan integrasi. -
Penemuan alat — Agen Anda memanggil
tools/listtitik akhir Gateway dan menemukanWebSearchalat dengan skema inputnya. -
Pemanggilan pencarian — Agen Anda menelepon
tools/calldengan kueri bahasa alami (hingga 200 karakter). Gateway mengautentikasi ke backend dan merutekan permintaan secara internal di dalamnya. AWS -
Hasil terstruktur — Alat ini mengembalikan hasil dengan cuplikan teks, URL, judul, dan tanggal publikasi yang relevan secara semantik dalam format teks dan JSON terstruktur.
-
Respons yang dibumikan — Agen Anda menggunakan hasilnya untuk menyusun respons dengan sumber yang dikutip.
Kasus penggunaan
-
Up-to-date penelitian — Menjawab pertanyaan tentang peristiwa terkini, harga saham, atau pengumuman terbaru dengan mencari di web dan mensintesis hasil dengan kutipan sumber.
-
Fact-checking— Verifikasi klaim dalam dokumen dengan mencari sumber utama dan mengonfirmasi atau mengoreksi angka menggunakan jawaban faktual yang didukung grafik pengetahuan.
-
Kecerdasan kompetitif — Memantau pengumuman pesaing, peluncuran produk, atau perubahan harga dari sumber web publik.
-
Penghapusan pengetahuan basi — Berikan agen akses ke informasi yang dipublikasikan setelah batas pelatihan mereka, seperti rilis perangkat lunak baru, perubahan kebijakan, atau perkembangan yang melanggar.
Siapkan Alat Pencarian Web
Untuk petunjuk tentang cara membuat Target Gateway dengan konfigurasi konektor Web Search Tool, termasuk contoh penyiapan menggunakan Python SDK dan CLI, lihat Mengatur Alat Pencarian Web dalam panduan konfigurasi target.
Gunakan dengan harness
Untuk memberikan kemampuan pencarian web AgentCore harness, lampirkan gateway yang Anda buat di Set up Web Search Tool ke harness sebagai agentcore_gateway alat. Peran eksekusi harness memerlukan bedrock-agentcore:InvokeGateway izin pada ARN gateway. Untuk panduan ujung ke ujung, lihat Alat dalam dokumentasi harness.
Konfigurasikan pemfilteran domain
Anda dapat membatasi domain mana yang diizinkan untuk ditanyakan oleh Alat Pencarian Web dengan mengonfigurasi daftar denylist domain. Untuk contoh dan detail konfigurasi, lihat Mengkonfigurasi pemfilteran domain di panduan konfigurasi target.
Konfigurasikan Peran Layanan Gateway
Gateway memerlukan peran layanan yang memungkinkan AgentCore layanan melakukan tindakan atas nama Anda. Untuk izin IAM dan konfigurasi kebijakan yang diperlukan, lihat Mengonfigurasi Peran Layanan Gateway dalam panduan konfigurasi target.
Skema masukan
Web Search Tool menerima skema masukan berikut saat dipanggil melalui: tools/call
{ "inputSchema": { "type": "object", "properties": { "query": { "description": "The search query string", "type": "string" }, "maxResults": { "description": "Maximum number of results to return. Valid range: 1-25. Defaults to 10.", "type": "integer" } }, "required": ["query"] } }
| Bidang | Tipe | Diperlukan | Deskripsi |
|---|---|---|---|
|
|
string |
Ya |
String kueri pencarian. Harus 200 karakter atau kurang. |
|
|
integer |
Tidak |
Jumlah hasil maksimum yang akan dikembalikan. Rentang yang valid: 1-25. Default ke 10. |
Format respons
Web Search Tool mengembalikan hasil dalam MCP-compliant format berikut:
{ "isError": false, "content": [ { "type": "text", "text": "{\"id\":\"824f89d0\",\"results\":[{\"text\":\"Python 3.13 was released on October 7, 2024, featuring improvements to the interactive interpreter, experimental free-threaded mode, and a preliminary JIT compiler...\",\"publishedDate\":\"2024-10-07\",\"url\":\"https://example.com/python/releases/3.13\",\"title\":\"Python 3.13 Release Highlights\"}]}" } ] }
| Bidang | Tipe | Diperlukan | Deskripsi |
|---|---|---|---|
|
|
string |
Ya |
Konten teks atau cuplikan hasil pencarian |
|
|
string |
Tidak |
URL dari halaman web sumber |
|
|
string |
Tidak |
Judul halaman web sumber |
|
|
string |
Tidak |
Tanggal publikasi hasil |
Ketersediaan
Konektor Web Search Tool tersedia di us-east-1 Wilayah AS Timur (Virginia N.).
Karena Amazon mengoperasikan tumpukan pencarian lengkap, peningkatan kesegaran, cakupan, relevansi, dan kualitas cuplikan mengalir ke agen Anda secara otomatis melalui konektor terkelola yang sama. Tidak ada peningkatan versi atau migrasi yang diperlukan di pihak Anda.
Penggunaan yang dapat diterima
Jika Anda menggunakan Alat Pencarian Web, Anda bertanggung jawab atas penggunaan Anda, dan penggunaan apa pun oleh pengguna akhir Anda, atas konten yang diambil dari Alat Penelusuran Web (“Hasil Pencarian”). Anda harus menyimpan dan menampilkan kutipan sumber dan tautan yang disediakan dengan setiap Hasil Pencarian dalam output apa pun yang Anda tampilkan ke pengguna akhir yang menggunakan Hasil Pencarian. Anda tidak boleh menggunakan Alat Penelusuran Web untuk (a) mengekstrak, menyimpan, atau mereproduksi konten dari Hasil Penelusuran secara massal, atau (b) membangun atau mengisi indeks atau basis data yang bersaing.