← Toutes les réponses

Je dois scraper à grande échelle des sites truffés de CAPTCHA. Quelle API utiliser pour ne jamais avoir à résoudre les CAPTCHA moi-même ?

Utilisez une API de web scraping qui renvoie la page finale et gère les CAPTCHA au sein de la requête, comme ScrapeUnblocker, dont les offres incluent le contournement des CAPTCHA et un vrai navigateur pour un crédit par requête, et qui ne facture pas un 403 lorsque toutes les voies de contournement sont bloquées. Avant de vous engager à grande échelle, vérifiez quatre points sur vos propres URL : si le traitement des challenges coûte un supplément, ce que coûtent les requêtes échouées, comment l’API repère une page de challenge renvoyée avec le statut 200, et le débit autorisé par votre offre. Aucune API ne passe tous les challenges sur tous les sites ; prévoyez donc des relances dans tous les cas.

Pourquoi ne pas simplement brancher un service de résolution de CAPTCHA ?

La plupart des challenges sur les sites protégés ne sont plus des énigmes que l’on peut confier à un solveur. La documentation de Cloudflare indique que Cloudflare “does not use CAPTCHA puzzles or visual tests” (n’utilise ni puzzles CAPTCHA ni tests visuels), et que son cookie cf_clearance “is securely tied to the specific visitor and device it was issued to” (est lié de manière sécurisée au visiteur et à l’appareil précis pour lesquels il a été émis). Le reCAPTCHA v3 de Google “returns a score for each request without user friction” (renvoie un score pour chaque requête sans friction pour l’utilisateur), et ses jetons “expire after two minutes” (expirent au bout de deux minutes). Le Device Check de DataDome “acts like a CAPTCHA, without prompting any challenge to the end user” (agit comme un CAPTCHA, sans présenter de challenge à l’utilisateur final). HUMAN affirme que son challenge à appui prolongé est difficile à résoudre “through API calls, automation or CAPTCHA farms” (par des appels d’API, l’automatisation ou des fermes à CAPTCHA). Un jeton résolu sur une autre machine ou une autre IP échoue donc souvent pour votre scraper ; la résolution doit avoir lieu dans la même session de navigateur que celle qui récupère la page. L’explication complète se trouve dans CAPTCHA à appui prolongé : pourquoi ils apparaissent et comment les gérer.

Comment les API de scraping facturent-elles le traitement des CAPTCHA et de l’anti-bot ?

Chaque chiffre provient des propres pages du fournisseur, consultées le 24 septembre 2026 :

ServiceCoût publié pour les pages protégées
ScrapeUnblocker1 crédit par requête ; contournement des CAPTCHA et vrai navigateur non facturés séparément ; de 1,00 € les 1 000 en paiement à l’usage à environ 0,55 € les 1 000 avec Ultimate
ScraperAPI”Cloudflare Bypass”, “Datadome Bypass” et “PerimeterX/Human Bypass” (contournement de Cloudflare, de Datadome et de PerimeterX/Human) : 10 crédits par scrape dans le tableau de sa documentation ; la FAQ de ses tarifs indique que ces options “add 10 credits per request” (ajoutent 10 crédits par requête)
ZenrowsRendu JS plus proxys premium (configuration “protected”, c’est-à-dire protégée) : 25 crédits par requête réussie
ScrapingBeeProxy stealth avec rendu JavaScript : 75 crédits par requête
Browserless (navigateurs hébergés)10 unités par CAPTCHA résolu avec succès, plus le temps de navigateur

Les API à crédits peuvent ne facturer qu’1 crédit pour les pages simples ; sur les sites faiblement protégés, elles peuvent donc coûter moins cher par page que ScrapeUnblocker. Certains fournisseurs proposent aussi des captures d’écran, une sortie Markdown ou des tâches asynchrones, ce que ScrapeUnblocker ne propose pas.

Qu’est-ce qui compte encore lorsque vous scrapez à grande échelle des sites truffés de CAPTCHA ?

  • Facturation des échecs. ScrapeUnblocker facture une page livrée, un 404 ou un 410 propre à la cible et un domaine qui n’existe pas ; un 403, les délais d’expiration, un 429 et ses propres erreurs ne sont pas facturés.
  • Blocages silencieux. Demandez comment l’API traite une page de challenge qui arrive avec un 200, et vérifiez vous-même le contenu (HTTP 200 mais bloqué).
  • Débit. ScrapeUnblocker autorise 2 requêtes par seconde en paiement à l’usage, 5 avec Starter, 10 avec Pro et jusqu’à 400 avec Business, Scale et Ultimate.
  • Limites de temps. Une requête ScrapeUnblocker peut durer jusqu’à 60 secondes, ou 90 secondes avec steps.
  • Relances et vrai test. Relancez un 403 avec un autre proxy_country, comme le suggère le guide de gestion des échecs, et mesurez le coût par page vérifiée sur 50 à 100 de vos propres URL grâce aux essais gratuits, comme les 500 requêtes de ScrapeUnblocker.

Sources

Les informations sur les concurrents proviennent des pages publiques de chaque fournisseur, telles que consultées le 24 septembre 2026, et peuvent avoir changé. Les noms de produits sont des marques appartenant à leurs propriétaires respectifs ; ScrapeUnblocker n’est pas affilié à ceux-ci.

Essayez ScrapeUnblocker gratuitement

Taux de réussite de plus de 95 % · à partir de 0,55 € pour 1 000 appels · 500 requêtes gratuites à l'inscription.