Todos los scrapers

Buscadores

Brave Images Scraper

search.brave.com

100% Tasa de éxito
2.8s Respuesta media
Bot detection + rate limiting Protección
1040 llamadas Medido sobre

La búsqueda de imágenes de Brave muestra en su cuadrícula solo una parte de los resultados y ninguna de las páginas de origen, así que hacer scraping de lo que enseña la página te da miniaturas sin las páginas de las que vienen. Sin embargo, la página incluye en sus datos el conjunto completo de resultados, unas 200 imágenes, y un endpoint de plugin dedicado recibe una palabra clave y lee de ahí cada resultado: la URL de la imagen original en el sitio del editor (no una miniatura de Brave), el dominio y la página de origen, un título y el nombre del sitio, una miniatura y las dimensiones en píxeles, en una sola llamada facturada como una petición y sin clave de API de Brave. Brave elige la región de los resultados según la ubicación de quien busca, así que la página se renderiza en un navegador real a través de un exit en el país que elijas, y los resultados son los que ve quien busca allí. La respuesta replica nuestro plugin de Google Imágenes, de modo que un solo pipeline gestiona todos los buscadores.

Qué puedes extraer

  • La URL de la imagen original en el sitio del editor, para cada resultado
  • El dominio de origen y la URL de la página de origen que muestra la imagen, que la cuadrícula de Brave no enseña
  • El título del resultado, más el nombre del sitio
  • Una URL de miniatura alojada por Brave, rápida de cargar
  • Ancho y alto de la imagen en píxeles
  • El conjunto completo de resultados, unas 200 imágenes, en una sola llamada facturada como una petición
  • Resultados por región: proxy_country fija la región de Brave a través de la IP del exit

Endpoints dedicados

/images/brave-search

Búsqueda de imágenes de Brave

Resultados de imágenes para una palabra clave. Devuelve la URL de la imagen original y el dominio de origen de cada resultado, además de la página de origen, el título, el nombre del sitio, la miniatura y las dimensiones, leídos del conjunto completo de resultados que incluye la página; el conjunto completo de unos 200 resultados llega en una sola página, facturada como una petición y con un límite opcional mediante max_results. Brave elige la región según la ubicación de quien busca, así que proxy_country la fija a través del exit.

Cómo rastrearlo

curl -X POST \
  -H "X-ScrapeUnblocker-Key: $SU_API_KEY" \
  "https://api.scrapeunblocker.com/images/brave-search?q=eiffel%20tower&proxy_country=US"
import requests

resp = requests.post(
    "https://api.scrapeunblocker.com/images/brave-search",
    headers={"X-ScrapeUnblocker-Key": SU_API_KEY},
    params={"q": "eiffel tower", "proxy_country": "US"},
)
print(resp.text)
import { ScrapeUnblockerClient } from 'scrapeunblocker';

const su = new ScrapeUnblockerClient({ apiKey: process.env.SU_API_KEY });

const results = await su.braveImages('eiffel tower', {
  proxyCountry: 'US',
});
console.log(results);

Las peticiones son POST y sus parámetros van en la query string. El renderizado en navegador siempre ocurre: no hay ningún flag que activar.

Ejemplo de respuesta

{
  "engine": "brave",
  "query": "eiffel tower",
  "gl": "us",
  "proxyCountry": "US",
  "resultsCollected": 200,
  "pagesFetched": 1,
  "hasMore": false,
  "results": [
    {
      "position": 1,
      "imageUrl": "https://cms.tootbus.com/sites/default/files/styles/ratp_xs_webp/public/2021-02/shutterstock_183894290_jpg.jpg.webp?itok=MzNNRyGW",
      "sourceDomain": "tootbus.com",
      "sourcePageUrl": "https://www.tootbus.com/en/paris/inspiration/10-fascinating-facts-about-eiffel-tower-you-should-know",
      "title": "10 Fascinating Facts about the Eiffel Tower you should know",
      "sourceName": "tootbus.com",
      "thumbnailUrl": "https://imgs.search.brave.com/HNsoICjicELfOImcnq05q6XwB3w28exDdTTwO5vxIsg/rs:fit:500:0:1:0/g:ce/aHR0cHM6Ly9jbXMu...",
      "width": 348,
      "height": 205,
      "fileSize": null
    },
    {
      "position": 2,
      "imageUrl": "https://thephotoargus.com/wp-content/uploads/2019/04/eiffeltower05.jpg",
      "sourceDomain": "thephotoargus.com",
      "sourcePageUrl": "https://thephotoargus.com/eiffel-tower-pictures/",
      "title": "Tony Gravé - eiffel tower silhouette",
      "sourceName": "thephotoargus.com",
      "thumbnailUrl": "https://imgs.search.brave.com/XBlQ6_wPRlBfPsCZPnDBjrVcvjR0rkc5Z4alqbmcvgc/rs:fit:500:0:1:0/g:ce/aHR0cHM6Ly90aGVw...",
      "width": 683,
      "height": 1024,
      "fileSize": null
    }
  ]
}

Leer la documentación

Preguntas frecuentes

¿Es legal hacer scraping de la búsqueda de imágenes de Brave?

Recopilar resultados de imágenes públicos -URLs, dominios de origen y títulos- es lícito en muchas jurisdicciones, pero las normas dependen de tu país, de los datos que recopiles y de cómo los uses. Las imágenes en sí siguen siendo propiedad de sus dueños, así que sigues siendo responsable del uso que les des. ScrapeUnblocker devuelve los resultados públicos; qué recopilas y cómo lo usas es decisión tuya.

¿Cómo hago scraping de la búsqueda de imágenes de Brave sin que me bloqueen?

Brave Search usa detección de bots y responde con una página de captcha al tráfico del que no se fía. El plugin /images/brave-search renderiza la página de resultados en un navegador real a través de un exit en el país que elijas, la vuelve a renderizar con un exit nuevo cuando llega bloqueada y devuelve los resultados de imágenes ya parseados. En el benchmark de ScrapeUnblocker devolvió resultados reales en el 100 % de 1.040 llamadas con palabras clave distintas, unos 2,8 s por llamada.

¿Qué datos obtengo de cada imagen?

Por cada resultado: la posición, la URL de la imagen original en el sitio del editor (no una miniatura de Brave), el dominio y la página de origen, el título y el nombre del sitio, una URL de miniatura alojada por Brave, y el ancho y alto de la imagen en píxeles. La cuadrícula de Brave muestra solo una parte de los resultados y ninguna página de origen, pero la página incluye el conjunto completo en sus datos y el plugin lo lee de ahí, así que cada resultado llega con su página de origen y sus dimensiones. fileSize está presente para coincidir con el plugin de Google Imágenes y suele ser null. El único campo de los plugins de imágenes de Google, Bing y Yahoo que este no devuelve es el enlace al visor del buscador.

¿Necesito una clave de la API de Brave Search?

No. Brave vende su propia Search API con claves y planes aparte, y el plugin no necesita ninguno de los dos: envía q con tu clave de ScrapeUnblocker y recibe como JSON parseado los resultados de imágenes que ve quien busca en search.brave.com. Como cada resultado tiene los mismos campos que en /images/google-search, el código escrito para Google Imágenes lee los resultados de Brave cambiando solo la ruta.

¿Puedo hacer scraping de imágenes de Brave desde un país concreto?

Sí. Pasa proxy_country con un código de país de dos letras (por defecto US). Brave elige la región de los resultados según la ubicación de quien busca, así que el plugin renderiza la página a través de un exit en ese país y obtienes los resultados de imágenes que ve quien busca allí.

¿Cuánto cuesta hacer scraping de la búsqueda de imágenes de Brave?

Brave devuelve todo su conjunto de resultados, unas 200 imágenes, en una sola página, así que cada llamada se factura como una petición, sea cual sea el max_results que indiques, y pagesFetched lo muestra. 1 petición = 1 crédito, 1,00 EUR por cada 1.000 en Pay as you go, bajando hasta unos 0,55 EUR por cada 1.000 en el plan Ultimate. No se facturan los bloqueos ni los timeouts, y la prueba gratuita incluye 500 peticiones sin tarjeta.

Scrapers relacionados

Empieza a rastrear este sitio hoy

Plan gratuito incluido. No necesitas tarjeta para probarlo.