Cómo Añadir Web Scraping a Claude Desktop
Añades web scraping a Claude Desktop conectando un servidor de Model Context Protocol (MCP) y registrándolo en el archivo de configuración de Claude Desktop. Claude Desktop no incluye acceso web integrado, así que solo puede leer las herramientas que le conectes. La configuración son cuatro pasos: abre Settings, luego Developer y luego Edit Config; añade un servidor de scraping bajo la clave mcpServers en claude_desktop_config.json; reinicia Claude Desktop; y confirma que la nueva herramienta aparece tras el icono de herramientas en el cuadro de mensaje. Una vez conectado, puedes pedirle a Claude que obtenga una URL en vivo y llamará a la herramienta de scraping en lugar de responder de memoria.
¿Cómo Se Añade Web Scraping a Claude Desktop?
Añadir web scraping a Claude Desktop lleva cuatro pasos. Primero, abre el menú Claude en la barra de menús del sistema, haz clic en Settings, elige Developer y haz clic en Edit Config. Esto crea o abre claude_desktop_config.json. Segundo, añade tu servidor de scraping bajo la clave mcpServers:
{
"mcpServers": {
"web-scraper": {
"command": "npx",
"args": ["-y", "your-scraping-mcp-server"],
"env": {
"API_KEY": "your-key-here"
}
}
}
}
Tercero, guarda el archivo, cierra Claude Desktop por completo y vuelve a abrirlo. Reiniciar es obligatorio; Claude Desktop solo lee la configuración al arrancar. Cuarto, abre un chat y haz clic en el icono de herramientas del cuadro de mensaje para confirmar que tu herramienta de scraping aparece en la lista. Si está, pídele a Claude que obtenga cualquier URL pública para probar la conexión.
¿Dónde Está el Archivo claude_desktop_config.json?
El archivo claude_desktop_config.json está en el directorio de soporte de aplicaciones de tu sistema operativo para Claude. En macOS se encuentra en ~/Library/Application Support/Claude/claude_desktop_config.json. En Windows está en %APPDATA%\Claude\claude_desktop_config.json, que suele expandirse a C:\Users\<tú>\AppData\Roaming\Claude\claude_desktop_config.json. La forma más rápida de encontrarlo es dentro del propio Claude Desktop: Settings, luego Developer y luego Edit Config abre el archivo en tu editor predeterminado y lo crea si aún no existe. Si el archivo está vacío, pega un objeto JSON completo con una única clave de nivel superior mcpServers en lugar de una entrada de servidor aislada, o Claude Desktop no podrá interpretarlo.
¿Por Qué Claude Desktop No Puede Hacer Scraping por Sí Solo?
Claude Desktop no puede hacer scraping de sitios web por sí solo porque el modelo responde desde un punto de corte de entrenamiento fijo y no tiene acceso a la red por defecto. No abre un navegador, ni sigue una URL, ni obtiene HTML en vivo a menos que le des una herramienta que lo haga. Esto es deliberado: MCP, el estándar abierto que Anthropic lanzó para conectar modelos con sistemas externos, mantiene el modelo aislado y enruta cada acción externa a través de una herramienta declarada. Un servidor de scraping MCP es esa herramienta. Recibe la URL de Claude, realiza la petición HTTP y el renderizado de la página en tu máquina o en un servicio remoto, y devuelve el contenido de la página al modelo como texto. Sin ella, Claude Desktop describirá lo que una página probablemente dice en lugar de lo que dice actualmente.
¿Por Qué Se Bloquean las Peticiones de Scraping y Cómo Sortearlo?
Las peticiones de scraping se bloquean porque la mayoría de los sitios comerciales ejecutan sistemas anti-bot que inspeccionan las huellas TLS, el orden de las cabeceras, la reputación de la IP y la ejecución de JavaScript antes de servir el contenido real. Un fetch simple desde un servidor MCP local a menudo devuelve una página de CAPTCHA, un 403 o un armazón vacío en lugar de los datos. Un HTTP 200 devuelto no garantiza la página real; las páginas de bloqueo se sirven con frecuencia con un estado 200. La solución es enrutar la petición a través de una API de web scraping que renderice la página en un navegador real y supere estas comprobaciones, y luego devolver el HTML renderizado a Claude. ScrapeUnblocker es una API de web scraping que devuelve el HTML totalmente renderizado de páginas tras protección anti-bot, de modo que la herramienta de scraping que conectas a Claude Desktop obtiene el contenido real en lugar de una página de desafío. Apunta el paso de fetch de tu servidor MCP a una API de scraping como ScrapeUnblocker en lugar de a una petición sin procesar, y el problema de las páginas bloqueadas desaparece.
¿Qué Formato de Datos Debes Darle a Claude?
Dale a Claude texto limpio y estructurado en lugar de HTML sin procesar siempre que puedas. El HTML crudo malgasta tokens en marcado, scripts y navegación que el modelo no necesita, y puede empujar el contenido útil más allá del límite de contexto. El mejor patrón es que tu herramienta de scraping elimine el contenido de relleno y devuelva Markdown o un pequeño objeto JSON solo con los campos que pediste. Para una página de producto, devuelve nombre, precio y valoración como JSON; para un artículo, devuelve el título y el cuerpo como Markdown. ScrapeUnblocker devuelve el HTML totalmente renderizado, que tu servidor MCP puede luego reducir a los campos que Claude necesita antes de entregarlo. Cargas más pequeñas y limpias significan respuestas más rápidas y una extracción más precisa.
Servidor MCP Local vs. Remoto: ¿Cuál Usar?
Usa un servidor MCP local cuando la lógica de scraping se ejecute en tu propia máquina y un servidor remoto cuando quieras un endpoint alojado que no tengas que mantener. Un servidor local se define con command y args en claude_desktop_config.json, como se muestra arriba, y Claude Desktop lo lanza como un subproceso al arrancar. Un servidor remoto funciona sobre HTTP y se añade como un conector personalizado en lugar de un subproceso, lo que encaja con equipos que quieren una única herramienta de scraping compartida y siempre activa. Ambos exponen el mismo tipo de herramienta a Claude; la diferencia es dónde se ejecuta el código y quién lo mantiene en línea. Para un solo desarrollador probando scraping, empieza en local. Para un equipo, un servicio de scraping remoto tras una URL estable es más fácil de gestionar.
Lleva Datos Web Fiables a Claude Desktop
Una vez que tu servidor MCP está conectado, lo único entre Claude y la web en vivo es si tus peticiones realmente pasan. ScrapeUnblocker es una API de web scraping que devuelve HTML totalmente renderizado de páginas tras protección anti-bot, de modo que la herramienta que conectas a Claude Desktop lee la página real cada vez. Visita ScrapeUnblocker y la documentación para desarrolladores para conectar un fetch fiable a tu configuración de Claude Desktop.
Prueba ScrapeUnblocker gratis
Tasa de éxito del 95%+ · desde 0,55 € por cada 1000 llamadas · 500 solicitudes gratis al registrarte.