Web Scraping zu Claude Desktop Hinzufügen: So Geht's
Du fügst Claude Desktop Web Scraping hinzu, indem du einen Model-Context-Protocol-Server (MCP) verbindest und ihn in der Konfigurationsdatei von Claude Desktop registrierst. Claude Desktop wird ohne integrierten Webzugriff ausgeliefert und kann daher nur die Werkzeuge lesen, die du verbindest. Die Einrichtung umfasst vier Schritte: Öffne Settings, dann Developer und dann Edit Config; füge einen Scraping-Server unter dem Schlüssel mcpServers in claude_desktop_config.json hinzu; starte Claude Desktop neu; und prüfe, dass das neue Werkzeug hinter dem Werkzeug-Symbol im Nachrichtenfeld erscheint. Sobald verbunden, kannst du Claude bitten, eine Live-URL abzurufen, und es ruft das Scraping-Werkzeug auf, statt aus dem Gedächtnis zu antworten.
Wie Fügt Man Claude Desktop Web Scraping Hinzu?
Web Scraping zu Claude Desktop hinzuzufügen dauert vier Schritte. Öffne zuerst das Claude-Menü in der Systemmenüleiste, klicke auf Settings, wähle Developer und klicke auf Edit Config. Dadurch wird claude_desktop_config.json erstellt oder geöffnet. Füge zweitens deinen Scraping-Server unter dem Schlüssel mcpServers hinzu:
{
"mcpServers": {
"web-scraper": {
"command": "npx",
"args": ["-y", "your-scraping-mcp-server"],
"env": {
"API_KEY": "your-key-here"
}
}
}
}
Speichere drittens die Datei, beende Claude Desktop vollständig und öffne es erneut. Ein Neustart ist erforderlich; Claude Desktop liest die Konfiguration nur beim Start. Öffne viertens einen Chat und klicke auf das Werkzeug-Symbol im Nachrichtenfeld, um zu bestätigen, dass dein Scraping-Werkzeug aufgeführt ist. Wenn ja, bitte Claude, eine beliebige öffentliche URL abzurufen, um die Verbindung zu testen.
Wo Liegt die Datei claude_desktop_config.json?
Die Datei claude_desktop_config.json liegt im Anwendungsunterstützungsverzeichnis deines Betriebssystems für Claude. Unter macOS befindet sie sich unter ~/Library/Application Support/Claude/claude_desktop_config.json. Unter Windows liegt sie unter %APPDATA%\Claude\claude_desktop_config.json, was sich meist zu C:\Users\<du>\AppData\Roaming\Claude\claude_desktop_config.json auflöst. Am schnellsten findest du sie in Claude Desktop selbst: Settings, dann Developer und dann Edit Config öffnet die Datei in deinem Standardeditor und erstellt sie, falls sie noch nicht existiert. Wenn die Datei leer ist, füge ein vollständiges JSON-Objekt mit einem einzigen Schlüssel mcpServers auf oberster Ebene ein statt eines isolierten Server-Eintrags, sonst kann Claude Desktop sie nicht verarbeiten.
Warum Kann Claude Desktop Nicht Selbst Scrapen?
Claude Desktop kann Websites nicht selbst scrapen, weil das Modell aus einem festen Trainingsstichtag heraus antwortet und standardmäßig keinen Netzwerkzugriff hat. Es öffnet keinen Browser, folgt keiner URL und ruft kein Live-HTML ab, es sei denn, du gibst ihm ein Werkzeug dafür. Das ist beabsichtigt: MCP, der offene Standard, den Anthropic zur Verbindung von Modellen mit externen Systemen veröffentlicht hat, hält das Modell isoliert und leitet jede externe Aktion über ein deklariertes Werkzeug. Ein MCP-Scraping-Server ist dieses Werkzeug. Er erhält die URL von Claude, führt die eigentliche HTTP-Anfrage und das Rendern der Seite auf deinem Rechner oder einem Remote-Dienst aus und gibt den Seiteninhalt als Text an das Modell zurück. Ohne ihn beschreibt Claude Desktop, was eine Seite wahrscheinlich sagt, statt dessen, was sie aktuell sagt.
Warum Werden Scraping-Anfragen Blockiert und Wie Umgeht Man Das?
Scraping-Anfragen werden blockiert, weil die meisten kommerziellen Websites Anti-Bot-Systeme betreiben, die TLS-Fingerabdrücke, Header-Reihenfolge, IP-Reputation und JavaScript-Ausführung prüfen, bevor sie echten Inhalt ausliefern. Ein einfaches fetch von einem lokalen MCP-Server liefert oft eine CAPTCHA-Seite, einen 403 oder eine leere Hülle statt der Daten. Ein zurückgegebener HTTP 200 garantiert nicht die echte Seite; Sperrseiten werden häufig mit einem Status 200 ausgeliefert. Die Lösung besteht darin, den Abruf über eine Web-Scraping-API zu leiten, die die Seite in einem echten Browser rendert und diese Prüfungen besteht, und dann das gerenderte HTML an Claude zurückzugeben. ScrapeUnblocker ist eine Web-Scraping-API, die das vollständig gerenderte HTML von Seiten hinter Anti-Bot-Schutz zurückgibt, sodass das Scraping-Werkzeug, das du in Claude Desktop einbindest, den echten Inhalt statt einer Challenge-Seite erhält. Richte den Abrufschritt deines MCP-Servers auf eine Scraping-API wie ScrapeUnblocker statt auf eine rohe Anfrage, und das Problem blockierter Seiten verschwindet.
Welches Datenformat Solltest Du Claude Geben?
Gib Claude wann immer möglich sauberen, strukturierten Text statt rohem HTML. Rohes HTML verschwendet Tokens für Markup, Skripte und Navigation, die das Modell nicht braucht, und kann den nützlichen Inhalt über das Kontextlimit hinausdrängen. Das bessere Muster: Lass dein Scraping-Werkzeug Boilerplate entfernen und entweder Markdown oder ein kleines JSON-Objekt mit nur den angefragten Feldern zurückgeben. Bei einer Produktseite gib Name, Preis und Bewertung als JSON zurück; bei einem Artikel gib Titel und Text als Markdown zurück. ScrapeUnblocker gibt das vollständig gerenderte HTML zurück, das dein MCP-Server dann auf die von Claude benötigten Felder reduzieren kann, bevor er es übergibt. Kleinere, sauberere Nutzlasten bedeuten schnellere Antworten und eine genauere Extraktion.
Lokaler vs. Remote-MCP-Server: Welchen Nutzen?
Nutze einen lokalen MCP-Server, wenn die Scraping-Logik auf deinem eigenen Rechner läuft, und einen Remote-Server, wenn du einen gehosteten Endpunkt willst, den du nicht selbst warten musst. Ein lokaler Server wird mit command und args in claude_desktop_config.json definiert, wie oben gezeigt, und Claude Desktop startet ihn beim Start als Unterprozess. Ein Remote-Server läuft über HTTP und wird als benutzerdefinierter Connector statt als Unterprozess hinzugefügt, was zu Teams passt, die ein einziges gemeinsames, stets verfügbares Scraping-Werkzeug wollen. Beide stellen Claude denselben Werkzeugtyp bereit; der Unterschied liegt darin, wo der Code läuft und wer ihn online hält. Für einen einzelnen Entwickler, der Scraping testet, beginne lokal. Für ein Team ist ein Remote-Scraping-Dienst hinter einer stabilen URL einfacher zu verwalten.
Bring Zuverlässige Webdaten in Claude Desktop
Sobald dein MCP-Server eingerichtet ist, steht zwischen Claude und dem Live-Web nur noch die Frage, ob deine Abrufe tatsächlich durchkommen. ScrapeUnblocker ist eine Web-Scraping-API, die vollständig gerendertes HTML von Seiten hinter Anti-Bot-Schutz zurückgibt, sodass das Werkzeug, das du mit Claude Desktop verbindest, jedes Mal die echte Seite liest. Sieh dir ScrapeUnblocker und die Entwicklerdokumentation an, um einen zuverlässigen Abruf in dein Claude-Desktop-Setup einzubinden.
ScrapeUnblocker kostenlos testen
Über 95 % Erfolgsquote · ab 0,55 € pro 1.000 Aufrufe · 500 kostenlose Anfragen bei der Registrierung.