Voyage
Tripadvisor Scraper
tripadvisor.com
Tripadvisor est protégé par DataDome, l'un des systèmes anti-bot les plus difficiles à franchir à grande échelle : une requête simple reçoit un défi, pas une page. ScrapeUnblocker la rend dans un vrai navigateur, récupère la clearance DataDome une fois et la rejoue sur toute la flotte, si bien qu'un run complet de 1000 appels tient à 99,6% au lieu de s'effondrer après les premières centaines. Le texte des avis, les notes et les classements reviennent dans la page telle que tout visiteur la verrait.
Ce que vous pouvez extraire
- Nom et catégorie de l'établissement, du restaurant ou de l'attraction
- Note globale, nombre d'avis et position au classement
- Texte de chaque avis, auteur et date
- Niveau de prix et tags de cuisine ou de services
- Adresse, position GPS et coordonnées de contact
Comment le scraper
curl -X POST \
-H "X-ScrapeUnblocker-Key: $SU_API_KEY" \
"https://api.scrapeunblocker.com/getPageSource?url=https%3A%2F%2Fwww.tripadvisor.com%2F&parsed_data=true"import requests
resp = requests.post(
"https://api.scrapeunblocker.com/getPageSource",
headers={"X-ScrapeUnblocker-Key": SU_API_KEY},
params={"url": "https://www.tripadvisor.com/", "parsed_data": True},
)
print(resp.text)import { ScrapeUnblockerClient } from 'scrapeunblocker';
const su = new ScrapeUnblockerClient({ apiKey: process.env.SU_API_KEY });
const results = await su.getPageSource({
url: 'https://www.tripadvisor.com/',
parsedData: true,
});
console.log(results); Les requêtes sont en POST et passent leurs paramètres dans la query string. Le rendu navigateur a toujours lieu : aucun flag à activer.
Lire la documentation de l'API
Scrapers similaires
Commencez à scraper ce site dès aujourd'hui
Palier gratuit inclus. Aucune carte bancaire requise pour tester.