Données d'entreprise
Yelp Local Scraper
yelp.com
Yelp est servi via un endpoint de plugin dédié plutôt que par la récupération de page générique. En mode recherche, donnez-lui un terme et un lieu - comme des cafés à San Francisco, CA - et il renvoie les entreprises déjà analysées : nom, note et nombre d'avis, gamme de prix, catégories, adresse et quartier, et une URL de fiche propre ; filtrez par tri, prix et ouvert maintenant, et parcourez autant que nécessaire. En mode détail, donnez-lui l'URL d'une entreprise et il renvoie un établissement complet - téléphone, site web, horaires d'ouverture, attributs, spécialités, avis mis en avant, photos et plats populaires. Il lit les données intégrées de Yelp lui-même derrière son anti-bot et, comme Yelp sert d'abord les États-Unis, l'exit utilise les États-Unis par défaut - alors gardez les campagnes massives à un rythme régulier.
Ce que vous pouvez extraire
- Nom de l'entreprise, note et nombre d'avis
- Gamme de prix ($ à $$$$) et catégories
- Adresse, quartier et une URL de fiche propre
- Mode détail : téléphone, site web et horaires d'ouverture
- Mode détail : attributs, spécialités et plats populaires
- Mode détail : photos et avis mis en avant
Endpoints dédiés
/local/yelp Recherche et détail d'entreprises Yelp
Entreprises locales Yelp en deux modes. Recherche (mode=search) : find_desc plus find_loc renvoie un tableau businesses avec name, rating, reviewCount, priceRange, categories, address, neighborhoods, url et image ; filtrez avec sort, price et open_now et paginez avec max_results. Détail (mode=detail) : une entreprise par url avec téléphone, site web, horaires, attributs, spécialités, avis mis en avant, photos et plats populaires. Utilise un exit américain par défaut.
Comment le scraper
curl -X POST \
-H "X-ScrapeUnblocker-Key: $SU_API_KEY" \
"https://api.scrapeunblocker.com/local/yelp?mode=search&find_desc=coffee&find_loc=San%20Francisco%2C%20CA"import requests
resp = requests.post(
"https://api.scrapeunblocker.com/local/yelp",
headers={"X-ScrapeUnblocker-Key": SU_API_KEY},
params={"mode": "search", "find_desc": "coffee", "find_loc": "San Francisco, CA"},
)
print(resp.text)import { ScrapeUnblockerClient } from 'scrapeunblocker';
const su = new ScrapeUnblockerClient({ apiKey: process.env.SU_API_KEY });
const data = await su.yelpSearch('coffee', 'San Francisco, CA', { sort: 'rating' });
console.log(data); Les requêtes sont en POST et passent leurs paramètres dans la query string. Le rendu navigateur a toujours lieu : aucun flag à activer.
Lire la documentation de l'API
Questions fréquentes
Est-il légal de scraper Yelp ?
Collecter des données Yelp publiques comme les noms des établissements, les notes et les horaires d'ouverture est licite dans de nombreuses juridictions, mais les règles dépendent de votre pays, des données collectées et de leur usage. Certaines de ces données peuvent être personnelles : respectez donc les règles de protection de la vie privée qui vous sont applicables. ScrapeUnblocker renvoie la page publique ; ce que vous collectez et la façon dont vous l'utilisez relève de votre responsabilité.
Comment scraper Yelp sans me faire bloquer ?
Yelp utilise sa propre protection anti-bot. Le plugin ScrapeUnblocker fait tourner des sorties résidentielles et ISP et gère les défis pour vous, puis renvoie les établissements en JSON. Dans le benchmark de ScrapeUnblocker, 93 % des 1 125 appels ont renvoyé du contenu réel, en environ 3,3 s par appel.
Quelles données Yelp puis-je obtenir ?
Le mode search renvoie chaque établissement avec son nom, sa note et son nombre d'avis, sa gamme de prix ($ à $$$$), ses catégories, son adresse, son quartier, une URL de fiche propre et une image. Le mode detail renvoie un établissement complet : téléphone, site web, horaires d'ouverture, attributs, spécialités, points forts des avis, photos et plats populaires.
Ai-je besoin d'une API ou d'un compte Yelp ?
Non. Le plugin Yelp renvoie les données des établissements en JSON, sans compte API Yelp. Utilisez mode=search avec find_desc et find_loc, par exemple coffee et San Francisco, CA, ou mode=detail avec l'URL d'un établissement Yelp pour obtenir un lieu complet.
Puis-je collecter des établissements Yelp à grande échelle ?
Oui. Un appel de recherche collecte jusqu'à 240 établissements sur plusieurs pages avec max_results, et les appels s'exécutent en parallèle dans la limite de simultanéité de votre offre : de 20 à 100 requêtes simultanées sur les offres Pay as you go, Starter et Pro, et de 200 à 400 sur Business, Scale et Ultimate. Gardez un rythme mesuré et régulier pour les gros volumes. Le plugin utilise par défaut une sortie américaine.
Combien coûte le scraping de Yelp ?
Chaque appel au plugin Yelp correspond à une requête, et 1 requête = 1 crédit : 1,00 EUR pour 1 000 en paiement à l'usage, en descendant jusqu'à environ 0,55 EUR pour 1 000 sur l'offre Ultimate. Une recherche via le plugin est un appel, et la réponse contient déjà tous les résultats. Les blocages, timeouts et erreurs côté ScrapeUnblocker ne sont pas facturés. L'essai gratuit inclut 500 requêtes, sans carte bancaire.
Scrapers similaires
Commencez à scraper ce site dès aujourd'hui
Palier gratuit inclus. Aucune carte bancaire requise pour tester.