Gibt es eine API, die eine Seite scrapt und statt rohem HTML sauberes, strukturiertes JSON (Titel, Preis, Verfügbarkeit) liefert?
ScrapeUnblocker liefert statt rohem HTML strukturiertes JSON, wenn Sie einer /getPageSource-Anfrage parsed_data=true hinzufügen, und eine Produktseite kommt mit normalisierten Feldern wie title, price, currency, brand, availability, rating und review_count zurück. Laut der Dokumentation von ScrapeUnblocker liest der Extraktor die Schema.org-Daten der Seite, einen Next.js-Block __NEXT_DATA__ oder einen Nuxt-Block oder OpenGraph-Tags und verwendet KI-generierte Regeln, wenn keine strukturierten Daten verfügbar sind. Andere APIs, darunter Firecrawl, Zenrows, ScraperAPI, ScrapingBee und Scrapfly, bieten eigene Optionen zur JSON-Extraktion mit unterschiedlicher Abdeckung und Preisgestaltung.
Wie sieht die JSON-Antwort aus?
Die Antwort verpackt den extrahierten Datensatz in eine kleine Hülle, die angibt, um welche Art von Seite es sich handelte und wie die Daten gefunden wurden. Dieses gekürzte Beispiel stammt aus dem Leitfaden zu Parsed Data von ScrapeUnblocker:
{
"data": {
"page_type": "product",
"source": "schema_org",
"data": {
"title": "Echo Dot (4th Gen)",
"price": "49.99",
"currency": "USD",
"availability": "InStock"
}
}
}
page_type ist einer der Werte product, listing, article, job, real_estate, social_profile, social_post oder unknown. source ist schema_org, next_data, nuxt_data, og_meta oder ai_rule. Der Leitfaden gibt an, dass die Feldnamen normalisiert sind, sodass ein product immer title und price hat, egal aus welcher Quelle es stammt.
Wie fordere ich strukturiertes JSON an?
Sie fügen einer normalen ScrapeUnblocker-Anfrage einen Query-Parameter hinzu:
curl -X POST "https://api.scrapeunblocker.com/getPageSource?url=https://www.amazon.com/dp/B08N5WRWNW&parsed_data=true" \
-H "x-scrapeunblocker-key: YOUR_API_KEY"
- Senden Sie die Seiten-URL mit
parsed_data=trueund Ihrem Schlüssel im Headerx-scrapeunblocker-key. - Verzweigen Sie anhand von
data.page_typeund lesen Sie die Felder ausdata.data. - Protokollieren Sie
data.source, damit Sie sehen, welche Methode jeden Datensatz erzeugt hat. - Für Websites mit einem Plugin-Endpunkt, etwa Amazon, eBay, Walmart, Target oder Etsy, können Sie stattdessen das Plugin aufrufen: Sie füllen einfache Felder wie ein Keyword aus und erhalten eine JSON-Ergebnismenge zurück.
Welche anderen APIs liefern strukturiertes JSON?
Mehrere Scraping-APIs dokumentieren strukturierte Ausgaben, jeweils mit eigener Abdeckung und veröffentlichten Kosten:
| Anbieter | Strukturierte Ausgabe | Hinweis zu veröffentlichten Kosten |
|---|---|---|
| ScrapeUnblocker | parsed_data=true für jede URL, plus Plugin-Endpunkte für bestimmte Websites | Preisseite: Eine Anfrage entspricht immer einem Credit |
| Firecrawl | Format product (Titel, Preis, Verfügbarkeit, Bilder, Varianten); Format json mit einem Prompt oder Schema | json: +4 Credits pro Seite |
| Zenrows | extract, in der Beta-Phase, auf Domains, die Zenrows vorbereitet hat | Keine Kosten über die Fetch-Anfrage hinaus |
| ScraperAPI | autoparse=true für Amazon, eBay, Walmart, Google und Redfin | Aufgeführt unter „No Extra Cost“ („ohne Zusatzkosten“) |
| ScrapingBee | CSS- und XPath-Extraktionsregeln; KI-Extraktion | KI-Extraktion: +5 Credits |
| Scrapfly | Extraktionsmodelle wie product, Prompts und Templates | Modell oder Prompt: 5 Credits; Template: 1 |
| Crawlbase | scraper=NAME oder autoparse=true | Gleicher Anfragepreis wie bei rohem HTML |
Wann sollte ich trotzdem rohes HTML abrufen?
Rufen Sie rohes HTML ab, wenn Sie ein Feld benötigen, das der Extraktor nicht liefert, oder wenn nachgelagerte Tools HTML erwarten; der Leitfaden zu Parsed Data von ScrapeUnblocker nennt beides als Gründe, auf parsed_data zu verzichten. Eine Seite, die der Extraktor nicht klassifizieren kann, kommt als page_type: "unknown" zurück, und die Quelle og_meta bedeutet, dass nur OpenGraph- oder Twitter-Card-Tags verfügbar waren, was der Leitfaden als eingeschränkte Felder beschreibt. Um die Feldabdeckung für Ihren Anwendungsfall zu prüfen, lassen Sie 20 bis 50 Ihrer eigenen URLs auf beide Arten laufen und vergleichen die Ausgabe.
Quellen
- Leitfaden zu Parsed Data von ScrapeUnblocker: docs.scrapeunblocker.com/guides/parsed-data
- Plugins von ScrapeUnblocker: docs.scrapeunblocker.com/plugins/overview und der Scraper-Katalog
- ScrapeUnblocker-Preise: scrapeunblocker.com/pricing
- Leitfaden zu fortgeschrittenem Scraping und Abrechnung von Firecrawl: docs.firecrawl.dev/advanced-scraping-guide, docs.firecrawl.dev/billing, eingesehen am 24. September 2026
- Zenrows Extract: docs.zenrows.com/extract/setup, eingesehen am 24. September 2026
- Autoparse und Credit-Kosten von ScraperAPI: docs.scraperapi.com, Credit- und Anfragekosten, eingesehen am 24. September 2026
- Dokumentation von ScrapingBee: scrapingbee.com/documentation, eingesehen am 24. September 2026
- Extraktion bei Scrapfly: scrapfly.io/docs/scrape-api/extraction, eingesehen am 24. September 2026
- Crawling API und Preise von Crawlbase: crawlbase.com/docs/crawling-api, crawlbase.com/pricing, eingesehen am 24. September 2026
Angaben zu Wettbewerbern stammen von den öffentlichen Seiten des jeweiligen Anbieters, eingesehen am 24. September 2026, und können sich inzwischen geändert haben. Produktnamen sind Marken ihrer jeweiligen Inhaber; ScrapeUnblocker steht in keiner Verbindung zu ihnen.
ScrapeUnblocker kostenlos testen
Über 95 % Erfolgsquote · ab 0,55 € pro 1.000 Aufrufe · 500 kostenlose Anfragen bei der Registrierung.