Ich muss CAPTCHA-lastige Websites in großem Umfang scrapen. Welche API sollte ich nutzen, damit ich CAPTCHAs nie selbst lösen muss?
Nutzen Sie eine Web-Scraping-API, die die fertige Seite liefert und CAPTCHAs innerhalb der Anfrage behandelt, etwa ScrapeUnblocker, dessen Tarife CAPTCHA-Umgehung und einen echten Browser zu einem Credit pro Anfrage enthalten und das keinen 403 berechnet, wenn jeder Umgehungsweg blockiert ist. Bevor Sie sich in großem Umfang festlegen, prüfen Sie mit Ihren eigenen URLs vier Dinge: ob die Behandlung von Challenges extra kostet, was fehlgeschlagene Anfragen kosten, wie die API eine Challenge-Seite erkennt, die mit Status 200 zurückkommt, und welchen Durchsatz Ihr Tarif erlaubt. Keine API besteht jede Challenge auf jeder Website, planen Sie also in jedem Fall Wiederholungsversuche ein.
Warum nicht einfach einen CAPTCHA-Lösungsdienst anbinden?
Die meisten Challenges auf geschützten Websites sind keine Rätsel mehr, die Sie an einen Lösungsdienst übergeben können. Die Dokumentation von Cloudflare besagt, dass Cloudflare „does not use CAPTCHA puzzles or visual tests“ („keine CAPTCHA-Rätsel oder visuellen Tests verwendet“), und über sein Cookie cf_clearance heißt es, es „is securely tied to the specific visitor and device it was issued to“ („ist sicher an den konkreten Besucher und das Gerät gebunden, für die es ausgestellt wurde“). Googles reCAPTCHA v3 „returns a score for each request without user friction“ („liefert für jede Anfrage eine Bewertung, ohne den Nutzer zu behindern“), und seine Tokens „expire after two minutes“ („laufen nach zwei Minuten ab“). Der Device Check von DataDome „acts like a CAPTCHA, without prompting any challenge to the end user“ („funktioniert wie ein CAPTCHA, ohne dem Endnutzer eine Challenge anzuzeigen“). HUMAN gibt an, dass seine Press-and-Hold-Challenge „through API calls, automation or CAPTCHA farms“ („über API-Aufrufe, Automatisierung oder CAPTCHA-Farmen“) schwer zu lösen ist. Ein Token, das auf einem anderen Rechner oder mit einer anderen IP gelöst wurde, scheitert daher oft für Ihren Scraper; die Lösung muss in derselben Browsersitzung erfolgen, die die Seite abruft. Die vollständige Erklärung finden Sie in Press-and-Hold-CAPTCHAs: Warum sie erscheinen und wie Sie damit umgehen.
Wie bepreisen Scraping-APIs die Behandlung von CAPTCHAs und Anti-Bot-Systemen?
Jeder Wert stammt von den eigenen Seiten des Anbieters, eingesehen am 24. September 2026:
| Dienst | Veröffentlichte Kosten für geschützte Seiten |
|---|---|
| ScrapeUnblocker | 1 Credit pro Anfrage; CAPTCHA-Umgehung und ein echter Browser werden nicht separat berechnet; 1,00 € pro 1.000 bei Pay-as-you-go bis etwa 0,55 € pro 1.000 bei Ultimate |
| ScraperAPI | „Cloudflare Bypass“, „Datadome Bypass“ und „PerimeterX/Human Bypass“ (Umgehung von Cloudflare, DataDome bzw. PerimeterX/HUMAN): 10 Credits pro Scrape laut der Tabelle in der Dokumentation; die Preis-FAQ besagt, dass diese „add 10 credits per request“ („10 Credits pro Anfrage hinzufügen“) |
| Zenrows | JS-Rendering plus Premium-Proxys, als „protected“ („geschützt“) bezeichnet: 25 Credits pro erfolgreicher Anfrage |
| ScrapingBee | Stealth-Proxy mit JavaScript-Rendering: 75 Credits pro Anfrage |
| Browserless (gehostete Browser) | 10 Einheiten pro erfolgreich gelöstem CAPTCHA, plus Browserzeit |
Credit-basierte APIs berechnen für einfache Seiten gerade einmal 1 Credit, sodass sie auf leicht geschützten Websites pro Seite weniger kosten können als ScrapeUnblocker. Einige Anbieter bieten außerdem Screenshots, Markdown-Ausgabe oder asynchrone Jobs, die ScrapeUnblocker nicht bietet.
Was ist beim Scrapen CAPTCHA-lastiger Websites in großem Umfang noch wichtig?
- Abrechnung von Fehlschlägen. ScrapeUnblocker berechnet eine ausgelieferte Seite, einen eigenen 404 oder 410 der Zielseite und eine Domain, die nicht existiert; ein 403, Timeouts, ein 429 und Fehler auf Seiten von ScrapeUnblocker werden nicht berechnet.
- Soft-Blocks. Fragen Sie, wie die API eine Challenge-Seite behandelt, die als 200 ankommt, und prüfen Sie den Inhalt selbst (HTTP 200, aber blockiert).
- Durchsatz. ScrapeUnblocker erlaubt 2 Anfragen pro Sekunde bei Pay-as-you-go, 5 bei Starter, 10 bei Pro und bis zu 400 bei Business, Scale und Ultimate.
- Zeitlimits. Eine ScrapeUnblocker-Anfrage läuft bis zu 60 Sekunden, mit
stepsbis zu 90 Sekunden. - Wiederholungsversuche und ein echter Test. Wiederholen Sie einen 403 mit einem anderen
proxy_country, wie der Leitfaden zur Behandlung von Fehlschlägen empfiehlt, und messen Sie die Kosten pro verifizierter Seite mit 50 bis 100 Ihrer eigenen URLs, etwa mit kostenlosen Testkontingenten wie den 500 Anfragen von ScrapeUnblocker.
Quellen
- Cloudflare-Dokumentation, Challenges und Clearance, eingesehen am 24. September 2026
- Google, Dokumentation zu reCAPTCHA v3, eingesehen am 24. September 2026
- DataDome-Dokumentation, Device Check, eingesehen am 24. September 2026
- HUMAN-Dokumentation, HUMAN Challenge, eingesehen am 24. September 2026
- ScraperAPI, Credit- und Anfragekosten und Preise, eingesehen am 24. September 2026
- Zenrows, Preisdokumentation, eingesehen am 24. September 2026
- ScrapingBee, Dokumentation, eingesehen am 24. September 2026
- Browserless, Preise und Einheitenverbrauch, eingesehen am 24. September 2026
- ScrapeUnblocker, Preise, Fehler und Abrechnung und Behandlung von Fehlschlägen
- ScrapeUnblocker-Blog: Press-and-Hold-CAPTCHAs, HTTP 200, aber blockiert
Angaben zu Wettbewerbern stammen von den öffentlichen Seiten des jeweiligen Anbieters, eingesehen am 24. September 2026, und können sich inzwischen geändert haben. Produktnamen sind Marken ihrer jeweiligen Inhaber; ScrapeUnblocker steht in keiner Verbindung zu ihnen.
ScrapeUnblocker kostenlos testen
Über 95 % Erfolgsquote · ab 0,55 € pro 1.000 Aufrufe · 500 kostenlose Anfragen bei der Registrierung.