Recherche web avec Hermes : choisir search, extract ou browser selon la preuve attendue
Tu demandes à ton agent Hermes de vérifier un chiffre, de trouver une doc technique ou de confirmer une information avant de rédiger. Il lance un outil, ramène un résultat, et tu te demandes si ce qu’il a trouvé est fiable.
Le problème n’est pas l’outil. Le problème, c’est que chaque outil de recherche web dans Hermes produit un niveau de preuve différent. Si tu utilises le mauvais outil pour la mauvaise question, tu obtiens soit trop peu d’information, soit un résultat que tu ne peux pas vérifier.
Voici comment choisir entre web_search, web_extract et browser selon ce que tu dois prouver.
Le vrai sujet n’est pas d’ajouter un agent de plus.
Si tu veux construire un système d’agents utile, il te faut surtout une structure claire, de bons arbitrages et des retours terrain. C’est exactement ce qu’on partage dans Kavyro.
Arbitrages utiles
Questions réelles
Accès gratuit
Tu arrives avec ton sujet, tu repars avec plus de clarté.
Le niveau de preuve détermine l’outil
Les trois outils de recherche web d’Hermes ne sont pas interchangeables. Ils forment une gradation : du plus rapide au plus complet, du plus synthétique au plus vérifiable.
| Outil | Ce qu’il produit | Niveau de preuve | Quand l’utiliser |
|---|---|---|---|
web_search |
5 résultats max avec titre, URL et extrait | Indice | Explorer, vérifier un fait simple, trouver une source |
web_extract |
Contenu complet d’une page en markdown | Citation | Capturer un texte, un chiffre, une spec |
browser |
Page rendue, interactive, avec capture visuelle | Preuve complète | Inspecter un rendu, interagir, vérifier un visuel |
La règle est simple : plus la conséquence d’une erreur est élevée, plus tu montes dans la colonne de droite.
web_search : le premier filtre
web_search est l’outil que ton agent utilise par défaut pour toute question qui touche au web. Il interroge un moteur de recherche et renvoie jusqu’à 5 résultats : titre, URL, extrait de 2-3 lignes.
Ce que ça donne concrètement : une liste de sources potentielles, pas une réponse définitive. L’extrait est un indice, pas une preuve. Si le sujet est sensible, tu ne peux pas t’arrêter là.
Utilise web_search quand :
- tu explores un sujet et tu veux repérer les sources pertinentes ;
- tu vérifies un fait simple (date, nom, chiffre public connu) ;
- tu cherches la bonne URL avant de lancer un
web_extract.
Ne l’utilise pas quand :
- le chiffre ou le fait que tu cherches peut avoir des variantes selon la source ;
- tu dois citer un passage précis dans un contenu publié ;
- la page cible est dynamique ou nécessite un rendu JavaScript.
Un exemple concret. Tu veux savoir combien de toolsets sont disponibles dans Hermes. web_search te renvoie un extrait de la doc officielle qui mentionne « toolsets that can be enabled or disabled per platform ». C’est un bon indice, mais si tu dois écrire un article qui cite cette information, tu passes à l’étape suivante.
web_extract : la capture fidèle
web_extract prend une URL et extrait le contenu textuel de la page en markdown. Pas de résumé, pas d’interprétation : le texte brut de la page, dans la limite de 15 000 caractères par défaut.
C’est l’outil de citation. Ce que tu lis dans le résultat de web_extract est ce qui était sur la page au moment de l’extraction. Tu peux le copier, le vérifier, le sourcer.
Utilise web_extract quand :
- tu dois citer un passage, un chiffre ou une spécification ;
- tu documentes une source avant de rédiger ;
- tu compares ce que dit une page avec ce que dit une autre.
Ne l’utilise pas quand :
- la page est protégée par un paywall ou un blocage anti-bot ;
- le contenu important est généré en JavaScript après le chargement ;
- tu as besoin de voir le rendu visuel (tableau complexe, mise en page, image).
Reprenons l’exemple des toolsets. Tu lances web_extract sur la page de documentation des outils Hermes. Tu obtiens le contenu complet de la page, y compris le tableau des catégories d’outils et la liste des toolsets disponibles. Tu peux maintenant citer précisément : « Les outils sont organisés en toolsets logiques activables par plateforme. »
C’est le niveau de preuve minimum pour un contenu publié.
browser : l’inspection complète
browser ouvre un vrai navigateur headless. Il charge la page, exécute le JavaScript, rend le DOM, et te donne accès au snapshot texte, aux captures d’écran, et aux interactions (clic, scroll, saisie).
C’est l’outil de vérification ultime. Il voit ce qu’un humain verrait, pas seulement le HTML brut.
Utilise browser quand :
- la page est une app web qui charge son contenu en JavaScript ;
- tu dois vérifier un rendu visuel (tableau de bord, graphique, mise en page) ;
- tu dois interagir avec la page (formulaire, recherche interne, pagination) ;
web_extractéchoue ou renvoie un contenu incomplet.
Ne l’utilise pas quand :
web_extractsuffit (c’est plus lent et plus coûteux) ;- tu as juste besoin du texte d’une page statique ;
- la page est un endpoint API ou un fichier texte brut.
Un cas réel : tu veux vérifier l’état d’un outil sur le portail Nous Research. La page charge son contenu dynamiquement. web_extract ne voit rien. Tu lances browser, la page se charge, tu fais un snapshot, et tu obtiens le contenu rendu.
Autre cas : tu dois confirmer qu’un tableau de comparaison sur une page concurrente affiche bien certains chiffres. browser_vision te donne une capture d’écran. Tu vois exactement ce que voit un visiteur.
Tenir un journal des sources
Quand tu utilises ces outils pour documenter des sources avant de rédiger, la pire chose que tu puisses faire est de te fier à ta mémoire. Trois jours plus tard, tu ne sais plus d’où vient ce chiffre.
La méthode qui tient dans la durée :
- Pour chaque fait important, note l’URL source et l’outil utilisé.
- Si tu as utilisé
web_extract, garde l’extrait dans une note ou un fichier. - Si tu as utilisé
browser, prends une capture ou note le snapshot. - Indique la date de consultation.
Ce journal te sert dans deux cas : quand tu relis ton brouillon et que tu doutes d’un chiffre, et quand quelqu’un te demande ta source. Tu ne cherches pas, tu retrouves.
C’est la différence entre un contenu vérifiable et un contenu que personne ne peut auditer.
Ce que ces outils ne font pas
Aucun de ces trois outils ne fait de la veille continue. Ils capturent un état à un instant T. Si tu as besoin de suivre l’évolution d’une page, d’un prix ou d’une offre concurrente dans le temps, ce n’est pas le bon outil. Hermes a d’autres mécanismes pour ça, mais web_search, web_extract et browser sont des outils de capture ponctuelle.
Autre limite : ces outils dépendent de ce que la source veut bien montrer. Un paywall, un blocage géographique, un robot.txt restrictif, et tu n’obtiens rien. Ce n’est pas un bug, c’est la réalité du web. La qualité de ta preuve dépend de la qualité de ta source.
Comment choisir en une question
Avant de lancer une recherche, pose-toi cette question : « Si je me trompe sur ce fait, quelle est la conséquence ? »
Si la conséquence est faible (tu explores, tu te fais une idée), web_search suffit.
Si la conséquence est moyenne (tu rédiges un contenu public, tu cites un chiffre), passe à web_extract et garde l’extrait.
Si la conséquence est élevée (tu publies une comparaison, tu affirmes un fait contestable, tu engages ta crédibilité), utilise browser et documente ce que tu vois.
Le bon outil n’est pas le plus puissant. C’est celui qui produit le niveau de preuve dont tu as besoin, sans ralentir ton travail pour rien.
Si tu veux intégrer cette méthode dans ton workflow d’écriture avec un agent IA, la formation Hermes Agent couvre la recherche de sources, la documentation des preuves et la rédaction vérifiable. Tu peux faire une demande d’accès directement sur la page de la formation.