Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.
Herramienta de búsqueda web
Los agentes de IA están transformando la forma en que las organizaciones interactúan con la información, pero se enfrentan a una limitación fundamental: sus conocimientos se quedan paralizados durante la formación. Cuando un usuario pregunta sobre las cotizaciones bursátiles actuales o sobre una versión de software que se lanzó hace una hora, un agente que se basa únicamente en sus datos de formación no puede dar respuestas precisas.
Crear integraciones de búsqueda web personalizadas para resolver este problema es costoso: adquirir API de búsqueda de terceros, administrar las claves y las cuotas y los límites de velocidad, analizar formatos de resultados inconsistentes entre los proveedores, crear una lógica de extracción de fragmentos para que los modelos obtengan pasajes relevantes en lugar de HTML sin procesar, razonar sobre dónde viajan las consultas de los clientes y cómo se pueden retener los datos, y mantener la frescura y la cobertura a lo largo del tiempo. Cada uno de estos es un proyecto en sí mismo.
La herramienta de búsqueda web de Amazon Bedrock AgentCore elimina esa complejidad. Es una función de búsqueda MCP-compliant web totalmente gestionada que permite a sus agentes recuperar información de la web sin sobrecargar la infraestructura. Está disponible como un conector administrado que se conecta a su AgentCore Gateway. Los agentes lo descubren con una tools/list llamada estándar y lo invocan como cualquier otra herramienta de Model Context Protocol. No hay API de búsqueda que aprovisionar, no hay credenciales de salida que gestionar y no hay que mantener un sistema de análisis de resultados.
En las siguientes secciones se describen las principales funciones, la arquitectura del índice web creado específicamente, las garantías de privacidad, los casos de uso y cómo configurar la herramienta de búsqueda web.
Temas
Capacidades clave
-
Up-to-date acceso a la información: recupere los resultados web actuales con títulos, URL, fragmentos y fechas de publicación para basar las respuestas de los agentes en información actualizada.
-
Sin necesidad de gestionar la infraestructura: no hay que aprovisionar API de búsqueda de terceros ni escalarlas para configurarlas. El Gateway expone automáticamente la búsqueda web como una herramienta MCP estándar.
-
Independiente del marco: funciona con agentes de Strands LangChain LangGraph, CrewAI o cualquier MCP-compatible cliente a través del protocolo Model Context estándar.
-
Filtrado de dominios y fechas: restrinja las búsquedas con una lista de dominios excluidos a nivel de destino. En las versiones de conector
1.2.0y posteriores, los destinos también admiten una lista de dominios incluidos, y los agentes pueden superar las listas de inclusión y exclusión de dominios y los límites de fecha de publicación por solicitud. -
Purpose-built índice web: respaldado por un índice Amazon-operated web que abarca decenas de miles de millones de documentos.
-
Gráfico de conocimiento para datos de alta confianza: fundamenta a las entidades y sus relaciones para proporcionar respuestas objetivas, en lugar de dejar que el modelo las deduzca a partir del texto de la página extraído.
-
Extracción de fragmentos semánticos: extrae fragmentos semánticamente relevantes de cada página web, optimizados para la ventana de contexto del modelo, en lugar de mostrar HTML sin procesar o páginas completas.
Purpose-built índice web
Muchas soluciones que añaden la búsqueda web a un agente son envoltorios sobre un motor de búsqueda de terceros. La herramienta de búsqueda web de Amazon Bedrock AgentCore es diferente: está respaldada por un índice web que Amazon crea y gestiona directamente.
- Amplia cobertura
-
El índice abarca decenas de miles de millones de documentos. Esa escala es importante para la cobertura: las preguntas largas sobre bibliotecas especializadas o especificaciones de productos poco claras pueden responderse de manera más eficaz cuando el índice es amplio, en lugar de limitarse a las páginas más populares.
- Se actualiza de forma continua
-
Amazon actualiza el índice de forma continua para reflejar el contenido nuevo y modificado en cuestión de minutos. Para los agentes que responden a preguntas sobre los movimientos de precios o sobre anuncios que acaban de publicarse, esa ventana reciente marca la diferencia entre una respuesta fundamentada y una que es totalmente errónea. Cuando su agente busca «lo que pasó hoy», los resultados reflejan lo que realmente ocurrió hoy.
- Gráfico de conocimiento para datos con un alto grado de confianza
-
La herramienta de búsqueda web incluye un gráfico de conocimiento incorporado que basa las entidades y sus relaciones. En el caso de las preguntas basadas en hechos (por ejemplo, quién desempeña un cargo o cuándo se fundó algo), el gráfico de conocimiento proporciona respuestas con un alto grado de confianza, en lugar de dejar que el modelo las deduzca a partir del texto extraído de la página. De este modo, se reduce el tipo de desviaciones sutiles entre los hechos que pueden producirse cuando un agente combina una respuesta basándose únicamente en fragmentos.
- Extracción de fragmentos semánticos optimizada para el contexto del modelo
-
En lugar de entregar al modelo un volcado HTML sin procesar o una página completa, la herramienta realiza la extracción de fragmentos relevantes desde el punto de vista semántico. Extrae los fragmentos de cada página web que realmente guardan relación con la consulta y los devuelve en un formulario optimizado para la ventana contextual del modelo. El resultado es un contexto más denso y relevante por ficha: el modelo ve las partes que importan y dedica menos fichas al texto repetitivo y al cromo de navegación, lo que ayuda a mejorar la precisión de las respuestas citadas.
Privado por diseño
Para muchas empresas, la pregunta que frena el despliegue de una búsqueda en la web no es «si funciona», sino «¿a dónde van las consultas de mis usuarios y qué les ocurre?» La herramienta de búsqueda web está diseñada para que esas respuestas sean sencillas.
- Las consultas nunca salen AWS
-
Cuando su agente realiza una búsqueda, la consulta se atiende en su totalidad dentro de AWS la infraestructura. Las consultas de los clientes no se envían a un motor de búsqueda de terceros ni se envían al exterior AWS. La puerta de enlace se autentica en el conector que AWS posee y enruta la solicitud internamente, de modo que la ruta de datos permanece dentro de un AWS extremo a otro. En el caso de los equipos con problemas de salida de datos, esto elimina toda una categoría de revisión.
Funcionamiento
La herramienta de búsqueda web es un conector integrado. El Gateway gestiona la administración de esquemas, el control de parámetros, la resolución de terminales y la autenticación de servicios.
-
Configuración de la puerta de enlace: cree una puerta de enlace y agregue un objetivo de herramienta de búsqueda web mediante
connectorId: "web-search". La puerta de enlace toma una instantánea del esquema de la herramienta y aprovisiona la integración. -
Detección de herramientas: su agente llama
tools/listal punto final de Gateway y descubre laWebSearchherramienta con su esquema de entrada. -
Invocación de búsqueda: el agente llama
tools/callcon una consulta en lenguaje natural (hasta 200 caracteres) y, en la versión del conector1.2.0y posteriores, utiliza filtros opcionales a nivel de solicitud para los dominios y las fechas de publicación. La puerta de enlace se autentica en el backend y enruta la solicitud internamente desde allí. AWS -
Resultados estructurados: la herramienta devuelve resultados con fragmentos de texto, URL, títulos y fechas de publicación relevantes desde el punto de vista semántico, tanto en formato de texto como en formato JSON estructurado.
-
Respuesta fundamentada: su agente usa los resultados para redactar una respuesta con fuentes citadas.
Casos de uso
-
Up-to-date investigación: responda a preguntas sobre eventos actuales, precios de acciones o anuncios recientes buscando en la web y sintetizando los resultados con las citas de las fuentes.
-
Fact-checking— Verifique las afirmaciones contenidas en los documentos buscando fuentes primarias y confirmando o corrigiendo las cifras utilizando respuestas fácticas respaldadas por gráficos de conocimiento.
-
Inteligencia competitiva: supervise los anuncios de la competencia, los lanzamientos de productos o los cambios de precios desde fuentes web públicas.
-
Eliminación de conocimientos obsoletos: brinde a los agentes acceso a la información publicada una vez finalizada la capacitación, como las nuevas versiones de software, los cambios en las políticas o las últimas novedades.
Configure la herramienta de búsqueda en la web
Para obtener instrucciones sobre cómo crear un destino de puerta de enlace con la configuración del conector de la herramienta de búsqueda web, incluidos ejemplos de configuración con el SDK y la CLI de Python, consulte Configurar la herramienta de búsqueda web en la guía de configuración de destinos.
Úselo con un arnés
Para que un AgentCore arnés pueda buscar en Internet, conecte la puerta de enlace que creó en Configurar la herramienta de búsqueda web al arnés como agentcore_gateway herramienta. La función de ejecución del arnés requiere el bedrock-agentcore:InvokeGateway permiso en el ARN de la puerta de enlace. Para ver un tutorial completo, consulte las herramientas en la documentación del arnés.
Configure el filtrado de dominios
La herramienta de búsqueda web admite dos capas de filtrado que se componen en cada solicitud:
-
Target-level lista de exclusiones de dominios y lista de inclusiones. Al configurar el destino, el administrador configura las listas de dominios de los que el destino excluye o restringe cada búsqueda. Ambas listas están ocultas para el agente que realiza la llamada y se aplican a todas las solicitudes que pasan por el destino.
-
Request-level filtros (versión del conector
1.2.0y posteriores). El agente que realiza la llamada puede pasar unfiltersobjeto opcional con cadatools/callsolicitud:-
domainFilter—includeyexcludelistas, hasta 100 dominios por lista. La herramienta de búsqueda web solo muestra los resultados de los dominiosincludede la lista y elimina cualquier resultado cuyo dominio aparezca en laexcludelista. -
publishedDateFilter—fromytolímites, inclusive, ISO-8601 UTC. La herramienta de búsqueda web solo devuelve resultados con una fecha de publicación que coincide con o entre lastofechasfromy.
-
Request-level los filtros se componen con la lista de exclusiones e inclusiones del nivel de destino:
-
Un dominio se elimina de los resultados si aparece en la lista de exclusiones a nivel de destino o en la lista de exclusiones a nivel de solicitud.
-
Solo se devuelve un dominio si aparece en todas las listas de inclusión configuradas. Si solo se establece la lista de inclusión de nivel de destino o solo la lista de inclusión de nivel de solicitud, se respeta esa lista. Si ambas están configuradas, solo se devuelven los dominios presentes en ambas. Si los dos no comparten ningún dominio, no se devuelven resultados.
Request-level los filtros no pueden anular la lista de exclusiones del nivel de destino ni ampliar los resultados más allá de la lista de inclusión del nivel de destino.
Para ver ejemplos y detalles de configuración, consulte Configurar el filtrado de dominios en la guía de configuración de destino.
Configure la función de servicio de puerta de enlace
La puerta de enlace necesita una función de servicio que permita al AgentCore servicio realizar acciones en su nombre. Para conocer los permisos de IAM y la configuración de políticas necesarios, consulte Configurar el rol de servicio de puerta de enlace en la guía de configuración de destinos.
Esquema de entrada
La herramienta de búsqueda web acepta el siguiente esquema de entrada cuando se invoca. tools/call El filters campo solo está disponible cuando el destino está anclado a la versión del conector 1.2.0 o a una posterior. En las versiones anteriores, el esquema solo query expone y. maxResults
{ "inputSchema": { "type": "object", "properties": { "query": { "description": "The search query string", "type": "string" }, "maxResults": { "description": "Maximum number of results to return. Valid range: 1-25. Defaults to 10.", "type": "integer" }, "filters": { "description": "Optional request-level filters (connector version 1.2.0+). Applied on top of the target-level exclude list and include list.", "type": "object", "properties": { "domainFilter": { "description": "Per-call domain filter. Include and exclude lists each hold up to 100 domains. Root domain matches subdomains.", "type": "object", "properties": { "include": { "description": "Restrict results to these domains.", "type": "array", "items": {"type": "string"} }, "exclude": { "description": "Drop results from these domains.", "type": "array", "items": {"type": "string"} } } }, "publishedDateFilter": { "description": "Per-call published-date filter. Bounds inclusive, ISO-8601 UTC. Applies to web results only.", "type": "object", "properties": { "from": { "description": "Earliest publication date (ISO-8601 UTC).", "type": "string" }, "to": { "description": "Latest publication date (ISO-8601 UTC).", "type": "string" } } } } } }, "required": ["query"] } }
| Campo | Tipo | Obligatorio | Descripción |
|---|---|---|---|
|
|
string |
Sí |
La cadena de la consulta de búsqueda. Debe tener 200 caracteres o menos. |
|
|
entero |
No |
Número máximo de resultados a devolver. Intervalo válido: de 1 a 25. El valor predeterminado es 10. |
|
|
objeto |
No |
Filtros de nivel de solicitud opcionales. Disponible en la versión de conector |
|
|
matriz de cadenas |
No |
Dominios a incluir. Hasta 100 entradas. |
|
|
matriz de cadenas |
No |
Dominios a excluir. Hasta 100 entradas. |
|
|
cadena |
No |
Fecha de publicación más temprana, ISO-8601 UTC. |
|
|
cadena |
No |
Última fecha de publicación, ISO-8601 UTC. |
Formato de las respuestas
La herramienta de búsqueda web muestra los resultados en el siguiente MCP-compliant formato:
{ "isError": false, "content": [ { "type": "text", "text": "{\"id\":\"824f89d0\",\"results\":[{\"text\":\"Python 3.13 was released on October 7, 2024, featuring improvements to the interactive interpreter, experimental free-threaded mode, and a preliminary JIT compiler...\",\"publishedDate\":\"2024-10-07\",\"url\":\"https://example.com/python/releases/3.13\",\"title\":\"Python 3.13 Release Highlights\"}]}" } ] }
| Campo | Tipo | Obligatorio | Descripción |
|---|---|---|---|
|
|
string |
Sí |
Contenido de texto o fragmento del resultado de la búsqueda |
|
|
cadena |
No |
URL de la página web de origen |
|
|
cadena |
No |
Título de la página web de origen |
|
|
cadena |
No |
Fecha de publicación del resultado |
Disponibilidad.
El conector de la herramienta de búsqueda web está disponible en las siguientes AWS regiones:
-
Este de EE. UU. (Virginia del Norte)
us-east-1 -
Europa (Irlanda)
eu-west-1 -
Asia Pacífico (Tokio)
ap-northeast-1
Como Amazon gestiona todas las búsquedas, los agentes reciben automáticamente las mejoras en cuanto a la actualización, la cobertura, la relevancia y la calidad de los fragmentos a través del mismo conector gestionado. No es necesario que actualices ni migres ninguna versión por tu parte.
Uso aceptable
Si utilizas la Herramienta de búsqueda web, eres responsable del uso que hagas, y del uso que hagan tus usuarios finales, del contenido recuperado de la Herramienta de búsqueda web («Resultados de la búsqueda»). Debe conservar y mostrar las citas de las fuentes y los enlaces proporcionados con cada resultado de búsqueda en cualquier resultado de búsqueda que muestre a los usuarios finales que utilicen el resultado de la búsqueda. No puedes usar la herramienta de búsqueda web para (a) extraer, almacenar o reproducir contenido de los resultados de búsqueda de forma masiva, ni (b) crear o rellenar un índice o una base de datos de la competencia.