Tous les scrapers

Moteurs de recherche

Yahoo Images Scraper

images.search.yahoo.com

99.9% Taux de réussite
2.9s Réponse moyenne
Bot detection + rate limiting Protection
1 040 appels Mesuré sur

Yahoo Images sert des résultats issus de l'index d'images de Bing sur ses propres pages, avec un site régional pour de nombreux pays. Sa grille charge de nouvelles tuiles au fil du défilement et range l'image originale et la page source de chaque résultat dans des attributs de la tuile, si bien que scraper soi-même implique de rendre la page et de lire chaque tuile. Un endpoint de plugin dédié prend un mot-clé et renvoie chaque résultat déjà parsé : l'URL réelle de l'image en pleine résolution (pas une miniature), le domaine et la page source, un titre et le nom du site, une miniature et les dimensions originales en pixels - sans grille à rendre vous-même et sans compte Yahoo. proxy_country choisit le site régional de Yahoo (de.images.search.yahoo.com pour DE) et la sortie via laquelle la page est rendue dans un vrai navigateur, et pages collecte jusqu'à 10 pages d'environ 60 images chacune en un seul appel. La réponse reprend le format de nos plugins Google Images et Bing Images, donc un seul pipeline les traite tous.

Ce que vous pouvez extraire

  • L'URL de l'image originale en pleine résolution sur le site de l'éditeur, pour chaque résultat
  • Le domaine source et l'URL de la page source qui affiche l'image
  • Le titre du résultat, ainsi que le site que Yahoo affiche pour lui
  • Une URL de miniature hébergée par Bing, rapide à charger : celle que Yahoo affiche dans sa grille
  • Largeur et hauteur originales de l'image en pixels
  • Un lien vers la visionneuse Yahoo Images pour chaque résultat
  • Environ 60 résultats par page, jusqu'à 10 pages par appel, depuis le site régional de Yahoo du pays de votre choix

Endpoints dédiés

/images/yahoo-search

Recherche Yahoo Images

Résultats d'images pour un mot-clé. Renvoie pour chaque résultat l'URL de l'image source en pleine résolution et le domaine source, ainsi que la page source, le titre, le nom du site, la miniature, les dimensions et un lien vers la visionneuse Yahoo Images ; proxy_country choisit le site régional de Yahoo et la sortie ; jusqu'à 10 pages d'environ 60 résultats chacune, plafonnables avec max_results.

Comment le scraper

curl -X POST \
  -H "X-ScrapeUnblocker-Key: $SU_API_KEY" \
  "https://api.scrapeunblocker.com/images/yahoo-search?q=eiffel%20tower&pages=1"
import requests

resp = requests.post(
    "https://api.scrapeunblocker.com/images/yahoo-search",
    headers={"X-ScrapeUnblocker-Key": SU_API_KEY},
    params={"q": "eiffel tower", "pages": "1"},
)
print(resp.text)
import { ScrapeUnblockerClient } from 'scrapeunblocker';

const su = new ScrapeUnblockerClient({ apiKey: process.env.SU_API_KEY });

const results = await su.yahooImages('eiffel tower', {
  pages: 1,
});
console.log(results);

Les requêtes sont en POST et passent leurs paramètres dans la query string. Le rendu navigateur a toujours lieu : aucun flag à activer.

Exemple de réponse

{
  "engine": "yahoo",
  "query": "eiffel tower",
  "gl": "us",
  "proxyCountry": "US",
  "resultsCollected": 60,
  "pagesFetched": 1,
  "hasMore": true,
  "results": [
    {
      "position": 1,
      "imageUrl": "https://cdn.britannica.com/54/75854-050-E27E66C0/Eiffel-Tower-Paris.jpg",
      "sourceDomain": "britannica.com",
      "sourcePageUrl": "https://www.britannica.com/topic/Eiffel-Tower-Paris-France",
      "title": "Eiffel Tower | History, Height, & Facts | Britannica",
      "sourceName": "www.britannica.com",
      "thumbnailUrl": "https://tse3.mm.bing.net/th/id/OIP.Z97bkX40h0DN2g8WwHpqJwHaLO?r=0&pid=Api&h=220&P=0",
      "width": 1056,
      "height": 1600,
      "fileSize": null,
      "yahooImagesUrl": "https://images.search.yahoo.com/search/images;_ylt=A2RRWreO_LlqFQMABYGJzbkF;_ylu=Y29sbwN1cy1lYXN0LTEEcG9zAzEEdnRpZAMEc2VjA3Ny?p=eiffel+tower&imgurl=https%3A%2F%2Fcdn.britannica.com..."
    },
    {
      "position": 2,
      "imageUrl": "https://cdn.britannica.com/52/245552-050-3D7334F9/Eiffel-Tower-Paris.jpg",
      "sourceDomain": "morilly.com",
      "sourcePageUrl": "https://morilly.com/blog/paris-attractions-eiffel-tower",
      "title": "Paris attractions eiffel tower 60 photos - Morilly.com",
      "sourceName": "morilly.com",
      "thumbnailUrl": "https://tse4.mm.bing.net/th/id/OIP.54RmpGCUWV9JgeBRQFxVjAHaHo?r=0&pid=Api&h=220&P=0",
      "width": 1551,
      "height": 1600,
      "fileSize": null,
      "yahooImagesUrl": "https://images.search.yahoo.com/search/images;_ylt=A2RRWreO_LlqFQMAB4GJzbkF;_ylu=Y29sbwN1cy1lYXN0LTEEcG9zAzIEdnRpZAMEc2VjA3Ny?p=eiffel+tower&imgurl=https%3A%2F%2Fcdn.britannica.com..."
    }
  ]
}

Lire la documentation de l'API

Questions fréquentes

Le scraping de Yahoo Images est-il légal ?

Collecter des résultats d'images publics - URLs, domaines sources et titres - est licite dans de nombreuses juridictions, mais les règles dépendent de votre pays, des données collectées et de leur usage. Les images elles-mêmes restent la propriété de leurs titulaires, vous restez donc responsable de leur utilisation. ScrapeUnblocker renvoie les résultats publics ; ce que vous collectez et comment vous l'utilisez relève de votre décision.

Comment scraper Yahoo Images sans se faire bloquer ?

Yahoo utilise la détection de bots et la limitation de débit. Le plugin /images/yahoo-search rend chaque page de résultats dans un vrai navigateur via une sortie dans le pays de votre choix, rend de nouveau une page via une sortie fraîche lorsqu'elle revient bloquée, et renvoie les résultats d'images déjà parsés. Dans le benchmark de ScrapeUnblocker, 99,9 % des 1 040 appels avec des mots-clés différents ont renvoyé de vrais résultats, en environ 2,9 s par appel.

Quelles données j'obtiens pour chaque image ?

Pour chaque résultat : la position, l'URL de l'image source en pleine résolution sur le site de l'éditeur (pas une miniature), le domaine et la page source, le titre et le site que Yahoo affiche pour lui, une URL de miniature hébergée par Bing, la largeur et la hauteur originales en pixels, et un lien vers la visionneuse Yahoo Images. Yahoo Images sert des résultats issus de l'index d'images de Bing, d'où les miniatures hébergées chez Bing. fileSize est présent pour correspondre au plugin Google Images et vaut toujours null pour Yahoo.

Ai-je besoin d'une API ou d'un compte Yahoo ?

Non. Yahoo ne propose pas d'API publique pour ses résultats d'images (son API de recherche BOSS a été fermée en 2016), et le plugin ne nécessite aucun compte Yahoo : envoyez q avec votre clé ScrapeUnblocker et recevez des résultats d'images parsés. Comme le format reprend celui de /images/google-search et /images/bing-search, du code écrit pour l'un ou l'autre lit Yahoo Images en changeant seulement le chemin.

Puis-je scraper Yahoo Images depuis un pays précis ?

Oui. Passez proxy_country avec un code pays à deux lettres (US par défaut). Il choisit le site régional d'images de Yahoo, par exemple de.images.search.yahoo.com pour DE ou uk.images.search.yahoo.com pour GB, et la sortie via laquelle la page est rendue, donc vous obtenez les résultats d'images que voit un internaute dans ce pays ; un pays sans site régional utilise images.search.yahoo.com.

Combien coûte le scraping de Yahoo Images ?

Chaque page de résultats récupérée est facturée comme une requête : un appel pages=3 qui récupère trois pages d'environ 60 images compte pour 3 requêtes, et pagesFetched indique le nombre exact. 1 requête = 1 crédit, 1,00 EUR pour 1 000 en paiement à l'usage, en descendant jusqu'à environ 0,55 EUR pour 1 000 sur l'offre Ultimate. Les blocages et les timeouts ne sont pas facturés, et l'essai gratuit inclut 500 requêtes sans carte bancaire.

Scrapers similaires

Commencez à scraper ce site dès aujourd'hui

Palier gratuit inclus. Aucune carte bancaire requise pour tester.