View a markdown version of this page

Outil de recherche sur le Web - Base rocheuse de l'Amazonie AgentCore

Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.

Outil de recherche sur le Web

Les agents d'IA transforment la façon dont les organisations interagissent avec les informations, mais ils sont confrontés à une limitation fondamentale : leurs connaissances sont figées au moment de la formation. Lorsqu'un utilisateur pose des questions sur les cours boursiers actuels ou sur une version logicielle publiée il y a une heure, un agent qui se fie uniquement à ses données de formation ne peut pas fournir de réponses précises.

La création d'intégrations de recherche Web personnalisées pour résoudre ce problème est coûteuse : achat d'API de recherche tierces, gestion des clés, des quotas et des limites de débit, analyse des formats de résultats incohérents entre les fournisseurs, création d'une logique d'extraction d'extraits de code permettant aux modèles d'obtenir des passages pertinents au lieu du code HTML brut, raisonner sur la destination des requêtes des clients et la manière dont les données peuvent être conservées, et maintenir la fraîcheur et la couverture au fil du temps. Chacun d'entre eux constitue un projet en soi.

L'outil de recherche Web sur Amazon Bedrock AgentCore élimine cette complexité. Il s'agit d'une fonction de recherche MCP-compliant Web entièrement gérée qui permet à vos agents de récupérer des informations sur le Web sans aucune surcharge d'infrastructure. Il est disponible en tant que connecteur géré que vous connectez à votre AgentCore passerelle. Les agents le découvrent à l'aide d'un tools/list appel standard et l'invoquent comme n'importe quel autre outil du Model Context Protocol. Il n'y a aucune API de recherche à provisionner, aucune information d'identification sortante à gérer et aucun lien d'analyse des résultats à gérer.

Les sections suivantes présentent les fonctionnalités clés, l'architecture de l'index Web spécialement conçu, les garanties de confidentialité, les cas d'utilisation et la configuration de l'outil de recherche Web.

Capacités clés

  • Up-to-date accès aux informations  : récupérez les résultats Web actuels avec les titres, les URL, les extraits et les dates de publication pour baser les réponses des agents sur des informations à jour.

  • Aucune gestion d'infrastructure  : aucune API de recherche tierce à provisionner ni aucune évolutivité à configurer. La passerelle expose automatiquement la recherche sur le Web en tant qu'outil MCP standard.

  • Indépendant du framework  : fonctionne avec Strands Agents, LangChain LangGraph, CrewAI ou tout autre MCP-compatible client via le protocole standard Model Context.

  • Filtrage par domaine et par date  : limitez les recherches à l'aide d'une liste d'exclusion de domaines au niveau cible. Dans les versions du connecteur 1.2.0 et les versions ultérieures, les cibles prennent également en charge une liste d'inclusion de domaines, et les agents peuvent transmettre des listes d'inclusion et d'exclusion de domaines par demande et des limites de date de publication.

  • Purpose-built index Web  : soutenu par un index Amazon-operated Web couvrant des dizaines de milliards de documents.

  • Graphe de connaissances pour les faits à haut niveau de confiance  : permet aux entités et à leurs relations de fournir des réponses factuelles au lieu de laisser le modèle les déduire à partir du texte de page extrait.

  • Extraction d'extraits sémantiques  : extrait des passages sémantiquement pertinents de chaque page Web, optimisés pour la fenêtre contextuelle d'un modèle, plutôt que de renvoyer du code HTML brut ou des pages complètes.

Purpose-built index Web

De nombreuses solutions qui ajoutent la recherche sur le Web à un agent sont intégrées à un moteur de recherche tiers. L'outil de recherche Web d'Amazon Bedrock AgentCore est différent : il est soutenu par un index Web qu'Amazon crée et gère directement.

Une couverture étendue

L'index couvre des dizaines de milliards de documents. Cette échelle est importante pour la couverture : les questions de longue haleine concernant des bibliothèques spécialisées ou des spécifications de produits obscures peuvent trouver une réponse plus efficace lorsque l'index est large plutôt que limité aux pages les plus populaires.

Mis à jour en permanence

Amazon actualise régulièrement l'index pour refléter le contenu nouveau et modifié en quelques minutes. Pour les agents qui répondent à des questions sur les mouvements de prix ou des annonces qui viennent d'être publiées, cette fenêtre de récence fait la différence entre une réponse fondée et une réponse erronée. Lorsque votre agent recherche « ce qui s'est passé aujourd'hui », les résultats reflètent ce qui s'est réellement passé aujourd'hui.

Graphique de connaissances pour des faits fiables

L'outil de recherche Web inclut un graphe de connaissances intégré qui identifie les entités et leurs relations. Pour les questions factuelles, telles que qui occupe un poste ou quand quelque chose a été fondé, le graphe de connaissances fournit des réponses fiables plutôt que de laisser le modèle les déduire à partir du texte de la page extrait. Cela permet de réduire le type de dérive factuelle subtile qui peut survenir lorsqu'un agent assemble une réponse à partir de bribes uniquement.

Extraction d'extraits sémantiques optimisée pour le contexte du modèle

Plutôt que de transmettre au modèle un dump HTML brut ou une page complète, l'outil effectue une extraction d'extraits sémantiquement pertinente. Il extrait les passages de chaque page Web qui concernent réellement la requête et les renvoie sous une forme optimisée pour la fenêtre contextuelle d'un modèle. Le résultat est un contexte plus dense et plus pertinent par jeton : le modèle voit les parties qui comptent et dépense moins de jetons sur le système standard et le chrome de navigation, ce qui contribue à améliorer la précision des réponses citées.

Privé de par sa conception

Pour de nombreuses entreprises, la question qui bloque le déploiement d'une recherche sur le Web n'est pas « est-ce que cela fonctionne », mais « où vont les requêtes de mes utilisateurs et que leur arrive-t-il ? » L'outil de recherche Web est conçu pour que ces réponses soient simples.

Les requêtes ne partent jamais AWS

Lorsque votre agent lance une recherche, celle-ci est entièrement traitée au sein de AWS l'infrastructure. Les demandes des clients ne sont pas envoyées à un moteur de recherche tiers ni acheminées vers l'extérieur AWS. La passerelle s'authentifie auprès du connecteur AWS dont elle est propriétaire et achemine la demande en interne, de sorte que le chemin des données reste à l'intérieur de AWS bout en bout. Pour les équipes confrontées à des problèmes de sortie de données, cela supprime toute une catégorie de révision.

Comment ça marche

L'outil de recherche sur le Web est un connecteur intégré. La passerelle gère la gestion des schémas, la gouvernance des paramètres, la résolution des terminaux et l'authentification des services.

  1. Configuration de la passerelle  : créez une passerelle et ajoutez une cible de l'outil de recherche Web à l'aide deconnectorId: "web-search". La passerelle capture le schéma de l'outil et fournit l'intégration.

  2. Découverte d'outils  : votre agent appelle tools/list le point de terminaison Gateway et découvre l'WebSearchoutil avec son schéma d'entrée.

  3. Invocation de recherche  : votre agent appelle tools/call avec une requête en langage naturel (200 caractères maximum) et, dans les versions Connector 1.2.0 et ultérieures, des filtres facultatifs au niveau de la demande pour les domaines et les dates de publication. La passerelle s'authentifie auprès du backend et achemine la demande en interne. AWS

  4. Résultats structurés  : l'outil renvoie des résultats avec des extraits de texte, des URL, des titres et des dates de publication pertinents sur le plan sémantique, au format texte et au format JSON structuré.

  5. Réponse fondée — Votre agent utilise les résultats pour rédiger une réponse avec des sources citées.

Cas d’utilisation

  • Up-to-date recherche — Répondez à des questions sur l'actualité, les cours boursiers ou les annonces récentes en effectuant une recherche sur le Web et en synthétisant les résultats avec des citations de sources.

  • Fact-checking— Vérifiez les affirmations contenues dans les documents en recherchant des sources primaires et en confirmant ou en corrigeant les chiffres à l'aide de réponses factuelles étayées par des graphes de connaissances.

  • Veille concurrentielle  : surveillez les annonces des concurrents, les lancements de produits ou les modifications de prix à partir de sources Web publiques.

  • Élimination des connaissances obsolètes  : donnez aux agents l'accès aux informations publiées après la fin de leur formation, telles que les nouvelles versions logicielles, les modifications de politique ou les derniers développements.

Configurer l'outil de recherche sur le Web

Pour obtenir des instructions sur la création d'une cible de passerelle avec la configuration du connecteur de l'outil de recherche Web, y compris des exemples de configuration à l'aide du SDK Python et de l'interface de ligne de commande, voir Configurer l'outil de recherche Web dans le guide de configuration de la cible.

À utiliser avec un harnais

Pour doter un AgentCore harnais d'une fonctionnalité de recherche sur le Web, associez la passerelle que vous avez créée dans Configurer l'outil de recherche Web au harnais en tant qu'agentcore_gatewayoutil. Le rôle d'exécution du harnais nécessite l'bedrock-agentcore:InvokeGatewayautorisation sur l'ARN de la passerelle. Pour la procédure pas à pas de bout en bout, consultez la section Outils de la documentation du harnais.

Configurer le filtrage des domaines

L'outil de recherche Web prend en charge 2 couches de filtrage qui se composent à chaque demande :

  • Target-level liste d'exclusion de domaines et liste d'inclusion. Lors de la configuration de la cible, l'administrateur configure des listes de domaines que la cible exclut de chaque recherche ou auxquels elle limite chaque recherche. Les deux listes sont masquées à l'agent appelant et appliquées à chaque demande qui passe par la cible.

  • Request-level filtres (version du connecteur 1.2.0 et versions ultérieures). L'agent appelant peut transmettre un filters objet optionnel à chaque tools/call demande :

    • domainFilter— include et exclude des listes, jusqu'à 100 domaines par liste. L'outil de recherche Web renvoie les résultats uniquement des domaines de la include liste et supprime tous les résultats dont le domaine apparaît dans la exclude liste.

    • publishedDateFilter— from et to limites, inclusivement, ISO-8601 UTC. L'outil de recherche Web renvoie uniquement les résultats dont la date de publication se situe entre les to dates from et ou.

Request-level les filtres sont composés avec la liste d'exclusion et la liste d'inclusion au niveau de la cible :

  • Un domaine est supprimé des résultats s'il apparaît dans la liste d'exclusion au niveau cible ou dans la liste d'exclusion au niveau de la demande.

  • Un domaine n'est renvoyé que s'il apparaît sur chaque liste d'inclusion définie. Si seule la liste d'inclusion au niveau cible ou uniquement la liste d'inclusion au niveau de la demande est définie, cette liste est respectée. Si les deux sont définis, seuls les domaines présents dans les deux sont renvoyés. Si les deux ne partagent aucun domaine, aucun résultat n'est renvoyé.

Request-level les filtres ne peuvent pas remplacer la liste d'exclusion au niveau cible ni étendre les résultats au-delà de la liste d'inclusion au niveau cible.

Pour des exemples de configuration et des détails, voir Configurer le filtrage de domaine dans le guide de configuration cible.

Configurer le rôle de service de passerelle

La passerelle a besoin d'un rôle de service qui permet au AgentCore service d'effectuer des actions en votre nom. Pour les autorisations IAM requises et la configuration des politiques, voir Configurer le rôle de service de passerelle dans le guide de configuration cible.

Schéma d'entrée

L'outil de recherche Web accepte le schéma d'entrée suivant lorsqu'il est invoqué viatools/call. Le filters champ n'est disponible que lorsque la cible est épinglée à une version du connecteur 1.2.0 ou à une version ultérieure. Dans les versions précédentes, le schéma exposait uniquement query etmaxResults.

{ "inputSchema": { "type": "object", "properties": { "query": { "description": "The search query string", "type": "string" }, "maxResults": { "description": "Maximum number of results to return. Valid range: 1-25. Defaults to 10.", "type": "integer" }, "filters": { "description": "Optional request-level filters (connector version 1.2.0+). Applied on top of the target-level exclude list and include list.", "type": "object", "properties": { "domainFilter": { "description": "Per-call domain filter. Include and exclude lists each hold up to 100 domains. Root domain matches subdomains.", "type": "object", "properties": { "include": { "description": "Restrict results to these domains.", "type": "array", "items": {"type": "string"} }, "exclude": { "description": "Drop results from these domains.", "type": "array", "items": {"type": "string"} } } }, "publishedDateFilter": { "description": "Per-call published-date filter. Bounds inclusive, ISO-8601 UTC. Applies to web results only.", "type": "object", "properties": { "from": { "description": "Earliest publication date (ISO-8601 UTC).", "type": "string" }, "to": { "description": "Latest publication date (ISO-8601 UTC).", "type": "string" } } } } } }, "required": ["query"] } }
Champ Type Obligatoire Description

query

chaîne

Oui

Chaîne de requête de recherche. Doit comporter 200 caractères ou moins.

maxResults

entier

Non

Nombre maximum de résultats à renvoyer. Plage valide : 1 à 25. La valeur par défaut est 10.

filters

objet

Non

Filtres facultatifs au niveau des demandes. Disponible en version connecteur 1.2.0 et versions ultérieures.

filters.domainFilter.include

tableau de chaînes

Non

Domaines à inclure. Jusqu'à 100 entrées.

filters.domainFilter.exclude

tableau de chaînes

Non

Domaines à exclure. Jusqu'à 100 entrées.

filters.publishedDateFilter.from

chaîne

Non

Date de publication la plus ancienne, ISO-8601 UTC.

filters.publishedDateFilter.to

chaîne

Non

Dernière date de publication, ISO-8601 UTC.

Format de la réponse

L'outil de recherche sur le Web renvoie les résultats MCP-compliant au format suivant :

{ "isError": false, "content": [ { "type": "text", "text": "{\"id\":\"824f89d0\",\"results\":[{\"text\":\"Python 3.13 was released on October 7, 2024, featuring improvements to the interactive interpreter, experimental free-threaded mode, and a preliminary JIT compiler...\",\"publishedDate\":\"2024-10-07\",\"url\":\"https://example.com/python/releases/3.13\",\"title\":\"Python 3.13 Release Highlights\"}]}" } ] }
Champ Type Obligatoire Description

text

chaîne

Oui

Contenu textuel ou extrait du résultat de la recherche

url

chaîne

Non

URL de la page Web source

title

chaîne

Non

Titre de la page Web source

publishedDate

chaîne

Non

Date de publication du résultat

Disponibilité

Le connecteur de l'outil de recherche Web est disponible dans les AWS régions suivantes :

  • USA Est (Virginie du Nord) us-east-1

  • Europe (Irlande) eu-west-1

  • Asie-Pacifique (Tokyo) ap-northeast-1

Comme Amazon gère la pile de recherche complète, les améliorations apportées à la fraîcheur, à la couverture, à la pertinence et à la qualité des extraits sont automatiquement transmises à vos agents via le même connecteur géré. Aucune mise à niveau ou migration de version n'est nécessaire de votre part.

Utilisation acceptable

Si vous utilisez l'outil de recherche Web, vous êtes responsable de votre utilisation et de toute utilisation par vos utilisateurs finaux du contenu extrait de l'outil de recherche Web (« Résultats de recherche »). Vous devez conserver et afficher les citations sources et les liens fournis avec chaque résultat de recherche dans tout résultat que vous présentez à vos utilisateurs finaux et qui utilise le résultat de recherche. Vous ne pouvez pas utiliser l'outil de recherche Web pour (a) extraire, stocker ou reproduire du contenu des résultats de recherche en masse, ou (b) créer ou remplir un index ou une base de données concurrents.