Todos los scrapers

Social y vídeo

Instagram Scraper

instagram.com

100% Tasa de éxito
3s Respuesta media
In-house anti-bot Protección
130 llamadas Medido sobre

Instagram decide qué servir según la salida que ve, no según lo convincente que sea tu navegador: desde una dirección de centro de datos responde a la URL de un perfil con su muro de login, y lo hace con un 200 de aspecto normal. Detectamos ese muro y tomamos una salida nueva en lugar de devolverlo, y por eso ahora marca 100% donde antes se quedaba en los ochenta: la cifra anterior contaba muros de login como éxitos. Las páginas de perfil y de publicación vienen renderizadas en el servidor, así que no interviene ningún navegador y una llamada tarda unos dos segundos. Añade `parsed_data=true` y obtienes las cifras como enteros exactos en lugar de la prosa redondeada que pinta la página: Instagram muestra «287 K me gusta» donde el payload dice 287.279. Los recuentos por publicación vienen de la URL de la publicación: Instagram no los incluye en lo que sirve en una página de perfil, así que el perfil devuelve el muro con un enlace permanente por publicación y ningún número inventado.

Qué puedes extraer

  • Perfil público: nombre de usuario, nombre completo, bio, seguidores y seguidos
  • Publicación y reel: texto, número exacto de me gusta y comentarios, fecha de publicación
  • Muro del perfil: las 12 publicaciones más recientes, cada una con su enlace permanente
  • URLs y miniaturas de los medios de la publicación
  • Insignia de verificado, foto de perfil y los enlaces externos de la bio

Cómo rastrearlo

curl -X POST \
  -H "X-ScrapeUnblocker-Key: $SU_API_KEY" \
  "https://api.scrapeunblocker.com/getPageSource?url=https%3A%2F%2Fwww.instagram.com%2Fnasa&parsed_data=true"
import requests

resp = requests.post(
    "https://api.scrapeunblocker.com/getPageSource",
    headers={"X-ScrapeUnblocker-Key": SU_API_KEY},
    params={"url": "https://www.instagram.com/nasa", "parsed_data": True},
)
print(resp.text)
import { ScrapeUnblockerClient } from 'scrapeunblocker';

const su = new ScrapeUnblockerClient({ apiKey: process.env.SU_API_KEY });

const results = await su.getPageSource({
  url: 'https://www.instagram.com/nasa',
  parsedData: true,
});
console.log(results);

Las peticiones son POST y sus parámetros van en la query string. El renderizado en navegador siempre ocurre: no hay ningún flag que activar.

Leer la documentación

Scrapers relacionados

Empieza a rastrear este sitio hoy

Plan gratuito incluido. No necesitas tarjeta para probarlo.