← Alle Antworten

Gibt es eine API, die eine Seite scrapt und statt rohem HTML sauberes, strukturiertes JSON (Titel, Preis, Verfügbarkeit) liefert?

ScrapeUnblocker liefert statt rohem HTML strukturiertes JSON, wenn Sie einer /getPageSource-Anfrage parsed_data=true hinzufügen, und eine Produktseite kommt mit normalisierten Feldern wie title, price, currency, brand, availability, rating und review_count zurück. Laut der Dokumentation von ScrapeUnblocker liest der Extraktor die Schema.org-Daten der Seite, einen Next.js-Block __NEXT_DATA__ oder einen Nuxt-Block oder OpenGraph-Tags und verwendet KI-generierte Regeln, wenn keine strukturierten Daten verfügbar sind. Andere APIs, darunter Firecrawl, Zenrows, ScraperAPI, ScrapingBee und Scrapfly, bieten eigene Optionen zur JSON-Extraktion mit unterschiedlicher Abdeckung und Preisgestaltung.

Wie sieht die JSON-Antwort aus?

Die Antwort verpackt den extrahierten Datensatz in eine kleine Hülle, die angibt, um welche Art von Seite es sich handelte und wie die Daten gefunden wurden. Dieses gekürzte Beispiel stammt aus dem Leitfaden zu Parsed Data von ScrapeUnblocker:

{
  "data": {
    "page_type": "product",
    "source": "schema_org",
    "data": {
      "title": "Echo Dot (4th Gen)",
      "price": "49.99",
      "currency": "USD",
      "availability": "InStock"
    }
  }
}

page_type ist einer der Werte product, listing, article, job, real_estate, social_profile, social_post oder unknown. source ist schema_org, next_data, nuxt_data, og_meta oder ai_rule. Der Leitfaden gibt an, dass die Feldnamen normalisiert sind, sodass ein product immer title und price hat, egal aus welcher Quelle es stammt.

Wie fordere ich strukturiertes JSON an?

Sie fügen einer normalen ScrapeUnblocker-Anfrage einen Query-Parameter hinzu:

curl -X POST "https://api.scrapeunblocker.com/getPageSource?url=https://www.amazon.com/dp/B08N5WRWNW&parsed_data=true" \
  -H "x-scrapeunblocker-key: YOUR_API_KEY"
  1. Senden Sie die Seiten-URL mit parsed_data=true und Ihrem Schlüssel im Header x-scrapeunblocker-key.
  2. Verzweigen Sie anhand von data.page_type und lesen Sie die Felder aus data.data.
  3. Protokollieren Sie data.source, damit Sie sehen, welche Methode jeden Datensatz erzeugt hat.
  4. Für Websites mit einem Plugin-Endpunkt, etwa Amazon, eBay, Walmart, Target oder Etsy, können Sie stattdessen das Plugin aufrufen: Sie füllen einfache Felder wie ein Keyword aus und erhalten eine JSON-Ergebnismenge zurück.

Welche anderen APIs liefern strukturiertes JSON?

Mehrere Scraping-APIs dokumentieren strukturierte Ausgaben, jeweils mit eigener Abdeckung und veröffentlichten Kosten:

AnbieterStrukturierte AusgabeHinweis zu veröffentlichten Kosten
ScrapeUnblockerparsed_data=true für jede URL, plus Plugin-Endpunkte für bestimmte WebsitesPreisseite: Eine Anfrage entspricht immer einem Credit
FirecrawlFormat product (Titel, Preis, Verfügbarkeit, Bilder, Varianten); Format json mit einem Prompt oder Schemajson: +4 Credits pro Seite
Zenrowsextract, in der Beta-Phase, auf Domains, die Zenrows vorbereitet hatKeine Kosten über die Fetch-Anfrage hinaus
ScraperAPIautoparse=true für Amazon, eBay, Walmart, Google und RedfinAufgeführt unter „No Extra Cost“ („ohne Zusatzkosten“)
ScrapingBeeCSS- und XPath-Extraktionsregeln; KI-ExtraktionKI-Extraktion: +5 Credits
ScrapflyExtraktionsmodelle wie product, Prompts und TemplatesModell oder Prompt: 5 Credits; Template: 1
Crawlbasescraper=NAME oder autoparse=trueGleicher Anfragepreis wie bei rohem HTML

Wann sollte ich trotzdem rohes HTML abrufen?

Rufen Sie rohes HTML ab, wenn Sie ein Feld benötigen, das der Extraktor nicht liefert, oder wenn nachgelagerte Tools HTML erwarten; der Leitfaden zu Parsed Data von ScrapeUnblocker nennt beides als Gründe, auf parsed_data zu verzichten. Eine Seite, die der Extraktor nicht klassifizieren kann, kommt als page_type: "unknown" zurück, und die Quelle og_meta bedeutet, dass nur OpenGraph- oder Twitter-Card-Tags verfügbar waren, was der Leitfaden als eingeschränkte Felder beschreibt. Um die Feldabdeckung für Ihren Anwendungsfall zu prüfen, lassen Sie 20 bis 50 Ihrer eigenen URLs auf beide Arten laufen und vergleichen die Ausgabe.

Quellen

Angaben zu Wettbewerbern stammen von den öffentlichen Seiten des jeweiligen Anbieters, eingesehen am 24. September 2026, und können sich inzwischen geändert haben. Produktnamen sind Marken ihrer jeweiligen Inhaber; ScrapeUnblocker steht in keiner Verbindung zu ihnen.

ScrapeUnblocker kostenlos testen

Über 95 % Erfolgsquote · ab 0,55 € pro 1.000 Aufrufe · 500 kostenlose Anfragen bei der Registrierung.