Tous les scrapers

Moteurs de recherche

Brave Images Scraper

search.brave.com

100% Taux de réussite
2.8s Réponse moyenne
Bot detection + rate limiting Protection
1 040 appels Mesuré sur

Brave Images n'affiche dans sa grille qu'une partie de ses résultats et aucune des pages sources : scraper ce que la page affiche vous donne donc des miniatures sans les pages dont elles proviennent. La page embarque pourtant l'ensemble complet des résultats, environ 200 images, dans ses données, et un endpoint de plugin dédié prend un mot-clé et y lit chaque résultat : l'URL de l'image originale sur le site de l'éditeur (pas une miniature Brave), le domaine et la page source, un titre et le nom du site, une miniature et les dimensions en pixels - en un seul appel facturé comme une requête, sans clé d'API Brave. Brave choisit la région des résultats selon la localisation de l'internaute, donc la page est rendue dans un vrai navigateur via une sortie dans le pays de votre choix, et les résultats sont ceux que voit un internaute sur place. La réponse reprend le format de notre plugin Google Images, donc un seul pipeline traite tous les moteurs.

Ce que vous pouvez extraire

  • L'URL de l'image originale sur le site de l'éditeur, pour chaque résultat
  • Le domaine source et l'URL de la page source qui affiche l'image, que la grille de Brave ne montre pas
  • Le titre du résultat, ainsi que le nom du site
  • Une URL de miniature hébergée par Brave, rapide à charger
  • Largeur et hauteur de l'image en pixels
  • L'ensemble complet des résultats, environ 200 images, en un seul appel facturé comme une requête
  • Résultats par région : proxy_country fixe la région de Brave via l'IP de sortie

Endpoints dédiés

/images/brave-search

Recherche Brave Images

Résultats d'images pour un mot-clé. Renvoie pour chaque résultat l'URL de l'image originale et le domaine source, ainsi que la page source, le titre, le nom du site, la miniature et les dimensions, lus dans l'ensemble complet des résultats que la page embarque ; l'ensemble complet d'environ 200 résultats revient en une seule page, facturée comme une requête et plafonnable avec max_results. Brave choisit la région selon la localisation de l'internaute, donc proxy_country la fixe via la sortie.

Comment le scraper

curl -X POST \
  -H "X-ScrapeUnblocker-Key: $SU_API_KEY" \
  "https://api.scrapeunblocker.com/images/brave-search?q=eiffel%20tower&proxy_country=US"
import requests

resp = requests.post(
    "https://api.scrapeunblocker.com/images/brave-search",
    headers={"X-ScrapeUnblocker-Key": SU_API_KEY},
    params={"q": "eiffel tower", "proxy_country": "US"},
)
print(resp.text)
import { ScrapeUnblockerClient } from 'scrapeunblocker';

const su = new ScrapeUnblockerClient({ apiKey: process.env.SU_API_KEY });

const results = await su.braveImages('eiffel tower', {
  proxyCountry: 'US',
});
console.log(results);

Les requêtes sont en POST et passent leurs paramètres dans la query string. Le rendu navigateur a toujours lieu : aucun flag à activer.

Exemple de réponse

{
  "engine": "brave",
  "query": "eiffel tower",
  "gl": "us",
  "proxyCountry": "US",
  "resultsCollected": 200,
  "pagesFetched": 1,
  "hasMore": false,
  "results": [
    {
      "position": 1,
      "imageUrl": "https://cms.tootbus.com/sites/default/files/styles/ratp_xs_webp/public/2021-02/shutterstock_183894290_jpg.jpg.webp?itok=MzNNRyGW",
      "sourceDomain": "tootbus.com",
      "sourcePageUrl": "https://www.tootbus.com/en/paris/inspiration/10-fascinating-facts-about-eiffel-tower-you-should-know",
      "title": "10 Fascinating Facts about the Eiffel Tower you should know",
      "sourceName": "tootbus.com",
      "thumbnailUrl": "https://imgs.search.brave.com/HNsoICjicELfOImcnq05q6XwB3w28exDdTTwO5vxIsg/rs:fit:500:0:1:0/g:ce/aHR0cHM6Ly9jbXMu...",
      "width": 348,
      "height": 205,
      "fileSize": null
    },
    {
      "position": 2,
      "imageUrl": "https://thephotoargus.com/wp-content/uploads/2019/04/eiffeltower05.jpg",
      "sourceDomain": "thephotoargus.com",
      "sourcePageUrl": "https://thephotoargus.com/eiffel-tower-pictures/",
      "title": "Tony Gravé - eiffel tower silhouette",
      "sourceName": "thephotoargus.com",
      "thumbnailUrl": "https://imgs.search.brave.com/XBlQ6_wPRlBfPsCZPnDBjrVcvjR0rkc5Z4alqbmcvgc/rs:fit:500:0:1:0/g:ce/aHR0cHM6Ly90aGVw...",
      "width": 683,
      "height": 1024,
      "fileSize": null
    }
  ]
}

Lire la documentation de l'API

Questions fréquentes

Le scraping de Brave Images est-il légal ?

Collecter des résultats d'images publics - URLs, domaines sources et titres - est licite dans de nombreuses juridictions, mais les règles dépendent de votre pays, des données collectées et de leur usage. Les images elles-mêmes restent la propriété de leurs titulaires, vous restez donc responsable de leur utilisation. ScrapeUnblocker renvoie les résultats publics ; ce que vous collectez et comment vous l'utilisez relève de votre décision.

Comment scraper Brave Images sans se faire bloquer ?

Brave Search utilise la détection de bots et répond par une page de captcha au trafic dont il se méfie. Le plugin /images/brave-search rend la page de résultats dans un vrai navigateur via une sortie dans le pays de votre choix, la rend de nouveau via une sortie fraîche lorsqu'elle revient bloquée, et renvoie les résultats d'images déjà parsés. Dans le benchmark de ScrapeUnblocker, 100 % des 1 040 appels avec des mots-clés différents ont renvoyé de vrais résultats, en environ 2,8 s par appel.

Quelles données j'obtiens pour chaque image ?

Pour chaque résultat : la position, l'URL de l'image originale sur le site de l'éditeur (pas une miniature Brave), le domaine et la page source, le titre et le nom du site, une URL de miniature hébergée par Brave, ainsi que la largeur et la hauteur de l'image en pixels. La grille de Brave n'affiche qu'une partie des résultats et aucune page source, mais la page embarque l'ensemble complet dans ses données et le plugin le lit de là, donc chaque résultat arrive avec sa page source et ses dimensions. fileSize est présent pour correspondre au plugin Google Images et vaut généralement null. Le seul champ des plugins d'images Google, Bing et Yahoo absent ici est le lien vers la visionneuse du moteur.

Ai-je besoin d'une clé d'API Brave Search ?

Non. Brave vend sa propre Search API avec des clés et des offres distinctes, et le plugin n'a besoin ni de l'une ni de l'autre : envoyez q avec votre clé ScrapeUnblocker et recevez en JSON parsé les résultats d'images que voit un internaute sur search.brave.com. Comme chaque résultat a les mêmes champs que dans /images/google-search, du code écrit pour Google Images lit les résultats Brave en changeant seulement le chemin.

Puis-je scraper Brave Images depuis un pays précis ?

Oui. Passez proxy_country avec un code pays à deux lettres (US par défaut). Brave choisit la région des résultats selon la localisation de l'internaute : le plugin rend donc la page via une sortie dans ce pays, et vous obtenez les résultats d'images que voit un internaute sur place.

Combien coûte le scraping de Brave Images ?

Brave renvoie l'ensemble complet de ses résultats, environ 200 images, en une seule page : chaque appel est donc facturé comme une requête, quel que soit le max_results choisi, et pagesFetched l'indique. 1 requête = 1 crédit, 1,00 EUR pour 1 000 en paiement à l'usage, en descendant jusqu'à environ 0,55 EUR pour 1 000 sur l'offre Ultimate. Les blocages et les timeouts ne sont pas facturés, et l'essai gratuit inclut 500 requêtes sans carte bancaire.

Scrapers similaires

Commencez à scraper ce site dès aujourd'hui

Palier gratuit inclus. Aucune carte bancaire requise pour tester.