View a markdown version of this page

Outil de recherche sur le Web - Amazon Bedrock AgentCore

Outil de recherche sur le Web

Les agents d'intelligence artificielle transforment la façon dont les organisations interagissent avec les informations, mais ils sont confrontés à une limite fondamentale : leurs connaissances sont figées au moment de la formation. Lorsqu'un utilisateur pose des questions sur le cours actuel des actions ou sur une version logicielle publiée il y a une heure, un agent qui se fie uniquement à ses données de formation ne peut pas fournir de réponses précises.

La mise en place d'intégrations de recherche Web personnalisées pour résoudre ce problème est coûteuse : acquisition d'API de recherche tierces, gestion des clés, des quotas et des limites de débit, analyse des formats de résultats incohérents entre les fournisseurs, création d'une logique d'extraction d'extraits de code afin que les modèles obtiennent des passages pertinents au lieu du HTML brut, raisonnement concernant la destination des requêtes des clients et la manière dont les données peuvent être conservées, et maintien de la fraîcheur et de la couverture au fil du temps. Chacun de ces projets constitue un projet en soi.

L'outil de recherche Web sur Amazon Bedrock AgentCore élimine cette complexité. Il s'agit d'une fonctionnalité de recherche MCP-compliant Web entièrement gérée qui permet à vos agents de récupérer des informations sur le Web sans aucune surcharge d'infrastructure. Il est disponible sous forme de connecteur géré que vous connectez à votre AgentCore passerelle. Les agents le découvrent par un tools/list appel standard et l'invoquent comme n'importe quel autre outil du Model Context Protocol. Il n'y a aucune API de recherche à fournir, aucune information d'identification sortante à gérer et aucune clé d'analyse des résultats à gérer.

Les sections suivantes présentent les principales fonctionnalités, l'architecture de l'index Web spécialement conçu, les garanties de confidentialité, les cas d'utilisation et la configuration de l'outil de recherche Web.

Capacités clés

  • Up-to-date accès aux informations — Récupérez les résultats Web actuels avec les titres, les URL, les extraits et les dates de publication pour étayer les réponses des agents sur des informations actualisées.

  • Aucune gestion d'infrastructure : aucune API de recherche tierce à fournir ou à dimensionner pour configurer. La passerelle expose automatiquement la recherche sur le Web en tant qu'outil MCP standard.

  • Indépendant du framework — Fonctionne avec les agents Strands,, LangChain LangGraph, CrewAI ou n'importe quel MCP-compatible client via le protocole standard Model Context Protocol.

  • Purpose-built index Web : soutenu par un index Amazon-operated Web couvrant des dizaines de milliards de documents.

  • Graphe de connaissances pour des faits hautement fiables : base les entités et leurs relations pour fournir des réponses factuelles plutôt que de laisser le modèle les déduire du texte de page extrait.

  • Extraction d'extraits sémantiques : extrait les passages sémantiquement pertinents de chaque page Web, optimisés pour la fenêtre contextuelle d'un modèle, plutôt que de renvoyer du code HTML brut ou des pages complètes.

Purpose-built index Web

De nombreuses solutions qui ajoutent la recherche sur le Web à un agent sont des wrappers sur un moteur de recherche tiers. L'outil de recherche Web sur Amazon Bedrock AgentCore est différent : il est soutenu par un index Web qu'Amazon crée et exploite directement.

Une couverture étendue

L'index couvre des dizaines de milliards de documents. Cette échelle est importante pour la couverture : les longues questions concernant les bibliothèques de niche ou les spécifications obscures des produits peuvent être répondues plus efficacement lorsque l'index est large plutôt que limité aux pages les plus populaires.

Mis à jour en permanence

Amazon actualise régulièrement l'index, afin de refléter le contenu nouveau et modifié en quelques minutes. Pour les agents qui répondent à des questions sur les mouvements de prix ou sur des annonces qui viennent d'être publiées, cette période de récence fait la différence entre une réponse fondée et une réponse erronée. Lorsque votre agent recherche « ce qui s'est passé aujourd'hui », les résultats reflètent ce qui s'est réellement passé aujourd'hui.

Graphe de connaissances pour des faits fiables

L'outil de recherche Web inclut un graphe de connaissances intégré qui fonde les entités et leurs relations. Pour les questions factuelles, telles que qui occupe un rôle ou quand quelque chose a été fondé, le graphe de connaissances fournit des réponses fiables au lieu de laisser au modèle le soin de les déduire à partir du texte de page extrait. Cela réduit le type de dérive factuelle subtile qui peut se produire lorsqu'un agent assemble une réponse à partir de simples extraits.

Extraction d'extraits sémantiques optimisée pour le contexte du modèle

Plutôt que de fournir au modèle un dump HTML brut ou une page complète, l'outil effectue une extraction d'extrait de code sémantiquement pertinente. Il extrait les passages de chaque page Web qui concernent réellement la requête et les renvoie sous une forme optimisée pour la fenêtre contextuelle d'un modèle. Le résultat est un contexte plus dense et plus pertinent par jeton : le modèle identifie les éléments importants et dépense moins de jetons sur le chrome standard et le chrome de navigation, ce qui contribue à améliorer la précision des réponses citées.

Privé par conception

Pour de nombreuses entreprises, la question qui bloque le déploiement d'une recherche sur le Web n'est pas « est-ce que cela fonctionne », mais « où vont les requêtes de mes utilisateurs et que leur arrive-t-il ? » L'outil de recherche Web est conçu pour que ces réponses soient simples.

Les requêtes ne partent jamais AWS

Lorsque votre agent lance une recherche, celle-ci est traitée entièrement au sein de AWS l'infrastructure. Les requêtes des clients ne sont pas envoyées à un moteur de recherche tiers ni acheminées vers l'extérieur AWS. La passerelle s'authentifie auprès du connecteur AWS détenu et achemine la demande en interne, de sorte que le chemin de données reste à l'intérieur de AWS bout en bout. Pour les équipes confrontées à des problèmes de sortie de données, cela supprime toute une catégorie de révision.

Comment ça marche

L'outil de recherche Web est un connecteur intégré. La passerelle gère la gestion des schémas, la gouvernance des paramètres, la résolution des points de terminaison et l'authentification des services.

  1. Configuration de la passerelle — Créez une passerelle et ajoutez une cible de l'outil de recherche Web à l'aide deconnectorId: "web-search". La passerelle capture le schéma de l'outil et provisionne l'intégration.

  2. Découverte de l'outil : votre agent appelle tools/list le point de terminaison Gateway et découvre l'WebSearchoutil avec son schéma d'entrée.

  3. Invocation de recherche : votre agent appelle tools/call avec une requête en langage naturel (jusqu'à 200 caractères). La passerelle s'authentifie auprès du backend et achemine la demande en interne. AWS

  4. Résultats structurés — L'outil renvoie des résultats avec des extraits de texte, des URL, des titres et des dates de publication sémantiquement pertinents au format texte et au format JSON structuré.

  5. Réponse fondée : votre agent utilise les résultats pour rédiger une réponse avec des sources citées.

Cas d’utilisation

  • Up-to-date recherche — Répondez à des questions sur l'actualité, les cours des actions ou les annonces récentes en effectuant une recherche sur le Web et en synthétisant les résultats avec des citations de sources.

  • Fact-checking— Vérifiez les affirmations contenues dans les documents en recherchant des sources primaires et en confirmant ou en corrigeant les chiffres à l'aide de réponses factuelles étayées par des graphes de connaissances.

  • Veille concurrentielle — Surveillez les annonces des concurrents, les lancements de produits ou les modifications de prix à partir de sources Web publiques.

  • Élimination des connaissances périmées : donnez aux agents l'accès aux informations publiées après la fin de leur formation, telles que les nouvelles versions de logiciels, les modifications de politique ou les derniers développements.

Configurer l'outil de recherche Web

Pour obtenir des instructions sur la création d'une cible de passerelle avec la configuration du connecteur Web Search Tool, y compris des exemples de configuration à l'aide du SDK Python et de la CLI, voir Configurer l'outil de recherche Web dans le guide de configuration de la cible.

À utiliser avec un harnais

Pour doter un AgentCore harnais de fonctionnalités de recherche sur le Web, associez la passerelle que vous avez créée dans Configurer l'outil de recherche Web au harnais en tant qu'agentcore_gatewayoutil. Le rôle d'exécution du harnais nécessite l'bedrock-agentcore:InvokeGatewayautorisation sur l'ARN de la passerelle. Pour une présentation détaillée de bout en bout, reportez-vous à la section Outils de la documentation du harnais.

Configurer le filtrage des domaines

Vous pouvez restreindre les domaines que l'outil de recherche Web est autorisé à interroger en configurant une liste de domaines refusés. Pour des exemples de configuration et des détails, consultez la section Configurer le filtrage de domaine dans le guide de configuration cible.

Configuration du rôle de service de passerelle

La passerelle a besoin d'un rôle de service qui permet au AgentCore service d'effectuer des actions en votre nom. Pour connaître les autorisations IAM et la configuration des politiques requises, consultez la section Configurer le rôle de service de passerelle dans le guide de configuration cible.

Schéma d'entrée

L'outil de recherche Web accepte le schéma de saisie suivant lorsqu'il est invoqué via tools/call :

{ "inputSchema": { "type": "object", "properties": { "query": { "description": "The search query string", "type": "string" }, "maxResults": { "description": "Maximum number of results to return. Valid range: 1-25. Defaults to 10.", "type": "integer" } }, "required": ["query"] } }
Champ Type Obligatoire Description

query

chaîne

Oui

Chaîne de requête de recherche. Doit comporter 200 caractères ou moins.

maxResults

entier

Non

Nombre maximum de résultats à renvoyer. Plage valide : 1 à 25. La valeur par défaut est 10.

Format de la réponse

L'outil de recherche Web renvoie les résultats au MCP-compliant format suivant :

{ "isError": false, "content": [ { "type": "text", "text": "{\"id\":\"824f89d0\",\"results\":[{\"text\":\"Python 3.13 was released on October 7, 2024, featuring improvements to the interactive interpreter, experimental free-threaded mode, and a preliminary JIT compiler...\",\"publishedDate\":\"2024-10-07\",\"url\":\"https://example.com/python/releases/3.13\",\"title\":\"Python 3.13 Release Highlights\"}]}" } ] }
Champ Type Obligatoire Description

text

chaîne

Oui

Contenu textuel ou extrait du résultat de la recherche

url

chaîne

Non

URL de la page Web source

title

chaîne

Non

Titre de la page Web source

publishedDate

chaîne

Non

Date de publication du résultat

Disponibilité

Le connecteur Web Search Tool est disponible dans la us-east-1 région USA Est (Virginie du Nord).

Comme Amazon gère l'intégralité de la pile de recherche, les améliorations apportées à l'actualité, à la couverture, à la pertinence et à la qualité des extraits sont automatiquement transmises à vos agents via le même connecteur géré. Aucune mise à niveau ou migration de version n'est nécessaire de votre côté.

Utilisation acceptable

Si vous utilisez l'outil de recherche Web, vous êtes responsable de votre utilisation, et de toute utilisation par vos utilisateurs finaux, du contenu extrait de l'outil de recherche Web (« Résultats de recherche »). Vous devez conserver et afficher les citations des sources et les liens fournis avec chaque résultat de recherche dans toute sortie que vous présentez à vos utilisateurs finaux qui utilise le résultat de recherche. Vous ne pouvez pas utiliser l'outil de recherche Web pour (a) extraire, stocker ou reproduire le contenu des résultats de recherche en masse, ou (b) créer ou remplir un index ou une base de données concurrents.