Comment Ajouter le Web Scraping à Claude Desktop
Tu ajoutes le web scraping à Claude Desktop en connectant un serveur Model Context Protocol (MCP) et en l’enregistrant dans le fichier de configuration de Claude Desktop. Claude Desktop est livré sans accès web intégré, il ne peut donc lire que les outils que tu connectes. La configuration se fait en quatre étapes : ouvre Settings, puis Developer, puis Edit Config ; ajoute un serveur de scraping sous la clé mcpServers dans claude_desktop_config.json ; redémarre Claude Desktop ; et vérifie que le nouvel outil apparaît derrière l’icône d’outils dans la zone de message. Une fois connecté, tu peux demander à Claude de récupérer une URL en direct et il appellera l’outil de scraping au lieu de répondre de mémoire.
Comment Ajouter le Web Scraping à Claude Desktop ?
Ajouter le web scraping à Claude Desktop prend quatre étapes. D’abord, ouvre le menu Claude dans la barre de menus du système, clique sur Settings, choisis Developer et clique sur Edit Config. Cela crée ou ouvre claude_desktop_config.json. Ensuite, ajoute ton serveur de scraping sous la clé mcpServers :
{
"mcpServers": {
"web-scraper": {
"command": "npx",
"args": ["-y", "your-scraping-mcp-server"],
"env": {
"API_KEY": "your-key-here"
}
}
}
}
Troisièmement, enregistre le fichier, quitte complètement Claude Desktop, puis rouvre-le. Le redémarrage est obligatoire ; Claude Desktop ne lit la configuration qu’au lancement. Quatrièmement, ouvre une conversation et clique sur l’icône d’outils dans la zone de message pour confirmer que ton outil de scraping figure dans la liste. Si c’est le cas, demande à Claude de récupérer n’importe quelle URL publique pour tester la connexion.
Où Se Trouve le Fichier claude_desktop_config.json ?
Le fichier claude_desktop_config.json se trouve dans le répertoire de support d’applications de ton système d’exploitation pour Claude. Sur macOS, il est dans ~/Library/Application Support/Claude/claude_desktop_config.json. Sur Windows, il est dans %APPDATA%\Claude\claude_desktop_config.json, qui se développe généralement en C:\Users\<toi>\AppData\Roaming\Claude\claude_desktop_config.json. Le plus rapide pour le trouver est dans Claude Desktop lui-même : Settings, puis Developer, puis Edit Config ouvre le fichier dans ton éditeur par défaut et le crée s’il n’existe pas encore. Si le fichier est vide, colle un objet JSON complet avec une seule clé de premier niveau mcpServers plutôt qu’une entrée de serveur isolée, sinon Claude Desktop ne pourra pas l’analyser.
Pourquoi Claude Desktop Ne Peut-Il Pas Scraper Seul ?
Claude Desktop ne peut pas scraper de sites web seul parce que le modèle répond à partir d’une date limite d’entraînement fixe et n’a pas d’accès réseau par défaut. Il n’ouvre pas de navigateur, ne suit pas d’URL et ne récupère pas de HTML en direct sauf si tu lui donnes un outil qui le fait. C’est voulu : MCP, le standard ouvert publié par Anthropic pour connecter les modèles à des systèmes externes, garde le modèle isolé et fait passer chaque action extérieure par un outil déclaré. Un serveur de scraping MCP est cet outil. Il reçoit l’URL de Claude, effectue la vraie requête HTTP et le rendu de la page sur ta machine ou un service distant, et renvoie le contenu de la page au modèle sous forme de texte. Sans lui, Claude Desktop décrira ce qu’une page dit probablement plutôt que ce qu’elle dit actuellement.
Pourquoi les Requêtes de Scraping Sont-Elles Bloquées et Comment y Remédier ?
Les requêtes de scraping sont bloquées parce que la plupart des sites commerciaux utilisent des systèmes anti-bot qui inspectent les empreintes TLS, l’ordre des en-têtes, la réputation de l’IP et l’exécution JavaScript avant de servir le vrai contenu. Un simple fetch depuis un serveur MCP local renvoie souvent une page CAPTCHA, un 403 ou une coquille vide au lieu des données. Un HTTP 200 renvoyé ne garantit pas la vraie page ; les pages de blocage sont fréquemment servies avec un statut 200. La solution est de faire passer la récupération par une API de web scraping qui rend la page dans un vrai navigateur et franchit ces contrôles, puis de renvoyer le HTML rendu à Claude. ScrapeUnblocker est une API de web scraping qui renvoie le HTML entièrement rendu des pages derrière une protection anti-bot, de sorte que l’outil de scraping que tu branches dans Claude Desktop obtient le vrai contenu au lieu d’une page de défi. Oriente l’étape de récupération de ton serveur MCP vers une API de scraping comme ScrapeUnblocker plutôt que vers une requête brute, et le problème des pages bloquées disparaît.
Quel Format de Données Donner à Claude ?
Donne à Claude du texte propre et structuré plutôt que du HTML brut chaque fois que tu le peux. Le HTML brut gaspille des tokens en balisage, scripts et navigation dont le modèle n’a pas besoin, et il peut pousser le contenu utile au-delà de la limite de contexte. Le meilleur schéma est de faire en sorte que ton outil de scraping supprime le contenu superflu et renvoie soit du Markdown, soit un petit objet JSON contenant uniquement les champs demandés. Pour une page produit, renvoie le nom, le prix et la note en JSON ; pour un article, renvoie le titre et le corps en Markdown. ScrapeUnblocker renvoie le HTML entièrement rendu, que ton serveur MCP peut ensuite réduire aux champs dont Claude a besoin avant de le transmettre. Des charges utiles plus petites et plus propres signifient des réponses plus rapides et une extraction plus précise.
Serveur MCP Local vs. Distant : Lequel Utiliser ?
Utilise un serveur MCP local quand la logique de scraping s’exécute sur ta propre machine, et un serveur distant quand tu veux un point de terminaison hébergé que tu n’as pas à maintenir. Un serveur local se définit avec command et args dans claude_desktop_config.json, comme montré ci-dessus, et Claude Desktop le lance comme un sous-processus au démarrage. Un serveur distant fonctionne via HTTP et s’ajoute comme un connecteur personnalisé plutôt qu’un sous-processus, ce qui convient aux équipes qui veulent un seul outil de scraping partagé et toujours actif. Les deux exposent le même type d’outil à Claude ; la différence est l’endroit où le code s’exécute et qui le maintient en ligne. Pour un développeur seul qui teste le scraping, commence en local. Pour une équipe, un service de scraping distant derrière une URL stable est plus facile à gérer.
Amène des Données Web Fiables dans Claude Desktop
Une fois ton serveur MCP branché, la seule chose entre Claude et le web en direct est de savoir si tes récupérations passent réellement. ScrapeUnblocker est une API de web scraping qui renvoie du HTML entièrement rendu des pages derrière une protection anti-bot, de sorte que l’outil que tu connectes à Claude Desktop lit la vraie page à chaque fois. Consulte ScrapeUnblocker et la documentation développeur pour brancher une récupération fiable dans ta configuration Claude Desktop.
Essayez ScrapeUnblocker gratuitement
Taux de réussite de plus de 95 % · à partir de 0,55 € pour 1 000 appels · 500 requêtes gratuites à l'inscription.