Web Researcher MCP
Zohar Babin · Programmation · Entreprise
Web Researcher MCP est un serveur open source du Model Context Protocol (MCP) qui donne à des assistants IA comme Claude Desktop et Cursor une vraie recherche web, la lecture de pages entières et des moyens de citer de vraies sources que vous pouvez vérifier. Au lieu de laisser un modèle deviner les références, vous le pointez vers des sources fiables que vous définissez, il cherche uniquement dans celles-là, lit la page entière et renvoie des liens qui fonctionnent vraiment. L'ensemble tourne sur votre machine, donc personne ne voit ce que vous recherchez.

À propos de Web Researcher MCP
Qu'est-ce que Web Researcher MCP
Web Researcher MCP est un serveur de recherche qui se branche à tout assistant IA compatible avec l'usage d'outils. Il connecte votre assistant au web ouvert, aux bases de données académiques, aux offices de brevets, aux registres judiciaires, aux dépôts SEC et aux données économiques, le tout via un seul binaire installé. Vous n'écrivez pas de code pour l'utiliser. Vous l'installez une fois, indiquez à votre client IA où il se trouve, et l'assistant commence à l'appeler dès que vous posez une question de recherche.
Le problème qu'il résout est précis. Les assistants IA inventent des sources. Des études sur Perplexity ont trouvé des citations erronées dans plus d'un tiers de ses réponses, et les chatbots génériques ne distinguent pas un billet de blog d'un acte de justice. Si votre travail est publié, déposé devant un tribunal ou montré à un client, « probablement réel » ne suffit pas. Web Researcher MCP attaque la cause plutôt que le symptôme : vous définissez quelles sources sont interrogeables, donc l'assistant ne voit jamais le spam SEO dès le départ.
Pourquoi la configuration semble-t-elle plus lourde que celle d'une appli classique ? Parce que la principale limite est qu'il s'agit d'un outil tourné vers les développeurs. Il n'y a pas de tableau de bord web convivial ni d'application mobile. Il vous faut un client compatible MCP, et des fonctions plus riches comme la recherche d'images ou d'actualités exigent une clé de fournisseur. DuckDuckGo fonctionne sans configuration, mais c'est l'option la plus faible.
Pour commencer
- Installez le binaire. Sur macOS ou Linux,
brew install zoharbabin/tap/web-researcher-mcps'en charge. Sur n'importe quel système,uvx web-researcher-mcple lance sans rien compiler. - Enregistrez-le auprès de votre assistant IA. Pour Claude Code, lancez
claude mcp add --scope user web-researcher -- uvx web-researcher-mcp. D'autres clients acceptent un petit bloc de configuration JSON. - Ajoutez éventuellement une clé de fournisseur de recherche. Définissez
SEARCH_PROVIDERet la clé correspondante pour activer la recherche d'images et d'actualités, plus de meilleurs résultats. Sans cela, DuckDuckGo fonctionne toujours. - Posez une question de recherche à votre assistant. Il appelle
web_search, lit des pages entières avecscrape_pageet renvoie des sources citées que vous pouvez ouvrir.
Informations sur le produit
Aperçu des tarifs, des plateformes compatibles et des performances de Web Researcher MCP.
Idéal pour
Les utilisateurs, tâches et cas d'usage où cet outil convient le mieux.
Utilisateurs
- Les chercheurs universitaires qui ont besoin d'une revue de littérature avec de vrais DOI et des liens qui fonctionnent
- Les analystes métier qui produisent des livrables pour des clients
- Les avocats et journalistes qui croisent des registres judiciaires et des documents officiels
- Les chercheurs en médecine qui travaillent à partir de preuves cliniques
Tâches
- Vérifier une affirmation face à plusieurs sources indépendantes
- Constituer une bibliographie formatée
- Auditer une liste de références à la recherche de citations rétractées ou mortes
- Mener une recherche approfondie en plusieurs étapes qui s'appuie sur les résultats précédents
Cas d'usage
- Vérifier une citation avant de s'y fier
- Garder une recherche concurrentielle sensible hors des serveurs tiers
- Reproduire un processus de recherche des mois plus tard
Fonctionnalités clés
Des lentilles de recherche qui restreignent où votre IA regarde
Une lentille de recherche est une liste sélectionnée de sites fiables pour un domaine. Choisissez la lentille médicale et votre assistant ne voit que PubMed et des sources similaires. Choisissez la lentille juridique et il interroge des bases de données judiciaires. Les lentilles intégrées couvrent les domaines courants, et vous pouvez définir les vôtres. C'est la fonction qui distingue l'outil d'un chatbot général, car elle retire les sources indésirables avant même que le modèle ne les lise.
Lecture de pages entières, pas d'extraits
L'outil scrape_page lit une URL entière plutôt qu'un résumé. Il gère les pages web, les PDF, les documents Word, les diaporamas, les transcriptions YouTube et les fils Hacker News. Un mode brut renvoie la source verbatim, non nettoyée, quand vous devez inspecter directement le JSON ou le HTML sous-jacent plutôt qu'une vue de lecture déjà arrangée. Lire la source entière, c'est ce qui rend une citation fiable : vous voyez ce que la page dit vraiment, pas ce qu'un index de recherche a supposé.
Vérification des citations et audit de bibliographie
Avant de vous fier à une source, verify_citation contrôle si elle existe, correspond à un vrai enregistrement et est rétractée ou morte. La réponse est une preuve, pas un verdict, donc vous jugez par vous-même. L'outil complémentaire audit_bibliography prend une liste de références entière au format CSL-JSON, RIS ou BibTeX et signale chaque entrée d'un coup. Ensemble, ils repèrent les fausses avant qu'un relecteur ou un client ne le fasse.
Des outils de recherche par domaine
Au-delà de la recherche web générale, le serveur plonge dans des bases spécialisées. La recherche académique renvoie de vrais articles avec DOI et nombre de citations. La recherche de brevets interroge les offices américain, européen et international par code de classification. La recherche de dépôts tire des documents SEC EDGAR et des faits XBRL structurés. La recherche juridique renvoie de vraies décisions de justice américaines, et la recherche économique couvre les données de la Banque mondiale, de l'OCDE, d'Eurostat et de FRED. Chaque outil parle le format attendu par son domaine.
Recherche approfondie multi-étapes et export
La recherche séquentielle permet à l'assistant de se souvenir de ce qu'il a déjà trouvé et de s'appuyer dessus d'une étape à l'autre, au lieu de repartir de zéro à chaque fois. Si le contexte se perd, la récupération de session reprend là où vous vous êtes arrêté. Une fois terminé, l'export de recherche produit un rapport partageable en Markdown ou JSON avec une provenance complète, et get_research_session peut reconstituer la trace plus tard.
Local, privé et indépendant du fournisseur
Le serveur tourne sur votre machine, donc vos requêtes restent privées. Aucun tiers, y compris les auteurs du projet eux-mêmes, ne voit ce que vous recherchez. Les fournisseurs de recherche sont interchangeables : passez à Brave, Google ou l'une des plus de 30 options compatibles en changeant un réglage. Plusieurs fournisseurs peuvent tourner ensemble pour un basculement automatique, donc si l'un a des soucis, les autres prennent le relais.
Avantages et inconvénients
Avantages
- Gratuit et open source sous licence MIT, sans abonnement ni coût par requête.
- Tourne entièrement sur votre machine, donc une recherche sensible ne passe jamais par des serveurs tiers.
- Les citations sont vérifiables par conception : l'outil contrôle chaque source face à de vrais enregistrements plutôt que de faire confiance au modèle.
- Couvre la recherche académique, juridique, brevets, financière et économique en une seule installation, pas seulement la recherche web générale.
- Se déploie via Homebrew, `uvx`, Docker ou un client Python, et tout assistant compatible MCP peut l'utiliser.
Inconvénients
- Pas de tableau de bord graphique ni d'application mobile. Il est conçu pour des personnes à l'aise avec l'édition d'un fichier de configuration et l'exécution de commandes en terminal.
- Des fonctions plus riches comme la recherche d'images et d'actualités exigent une clé d'API du fournisseur, ce qui ajoute une petite étape de configuration au-delà du DuckDuckGo par défaut.
- Le repli simple sur DuckDuckGo est plus faible que les backends de recherche payants, donc la qualité dépend de ce que vous configurez.
- Il ne fonctionne que dans un assistant compatible MCP. Vous ne pouvez pas l'utiliser comme moteur de recherche autonome.
Questions fréquentes
Il donne à un assistant IA une vraie recherche web, la lecture de pages entières et des citations vérifiables. Vous l'utilisez dès que la précision compte : revues de littérature, livrables clients, recherche juridique ou vérification de faits. Le but est d'empêcher l'assistant d'inventer des sources.
Contenus associés
Découvrez des outils, des compétences et des articles liés à Web Researcher MCP.
Alternatives à Web Researcher MCP
Forefront
Forefront · ProgrammationForefront est une plateforme web pour construire avec de l'IA open source. Elle vous laisse affiner les principaux modèles de langage open source sur vos propres données, évaluer leurs performances et les exécuter via une API ou les exporter pour les héberger vous-même. Les développeurs qui veulent le confort d'une plateforme fermée mais tiennent à rester propriétaires de leurs modèles et de leurs données sont le public visé ici.
Startkit
StartKit.AI · ProgrammationStartkit est un boilerplate pour créer des produits SaaS d'IA et des wrappers d'IA. Voyez-le comme un boilerplate de startup IA avec les parties ennuyeuses déjà branchées : authentification, paiements Stripe et Lemon Squeezy, limites d'usage, e-mail transactionnel et un kit de démarrage d'API IA qui parle à OpenAI, Anthropic, Groq ou Llama. Vous clonez le dépôt, fixez votre prix et attaquez la partie du produit pour laquelle les gens paient vraiment. Il repose sur Next.js au-dessus de React et Tailwind, donc une bonne partie du code boilerplate vous semble déjà familière.
Testim
Tricentis · ProgrammationTestim est une plateforme d'automatisation des tests dopée à l'IA, qui sert à créer et exécuter des tests de bout en bout sur des applications web, mobiles et Salesforce. Elle s'appuie sur l'apprentissage automatique pour garder les tests stables quand une interface change, alors les équipes passent moins de temps à réparer des sélecteurs cassés. Pas mal pour un outil de tests automatisés que vous pouvez utiliser dès aujourd'hui. Vous créez des tests en enregistrant des actions dans un navigateur, puis vous ajoutez du JavaScript quand vous avez besoin de plus de contrôle. C'est un choix solide pour une équipe QA bien occupée.
