Social y vídeo
Instagram Scraper
instagram.com
Instagram decide qué servir según la salida que ve, no según lo convincente que sea tu navegador: desde una dirección de centro de datos responde a la URL de un perfil con su muro de login, y lo hace con un 200 de aspecto normal. Detectamos ese muro y tomamos una salida nueva en lugar de devolverlo, y por eso ahora marca 100% donde antes se quedaba en los ochenta: la cifra anterior contaba muros de login como éxitos. Las páginas de perfil y de publicación vienen renderizadas en el servidor, así que no interviene ningún navegador y una llamada tarda unos dos segundos. Añade `parsed_data=true` y obtienes las cifras como enteros exactos en lugar de la prosa redondeada que pinta la página: Instagram muestra «287 K me gusta» donde el payload dice 287.279. Los recuentos por publicación vienen de la URL de la publicación: Instagram no los incluye en lo que sirve en una página de perfil, así que el perfil devuelve el muro con un enlace permanente por publicación y ningún número inventado.
Qué puedes extraer
- Perfil público: nombre de usuario, nombre completo, bio, seguidores y seguidos
- Publicación y reel: texto, número exacto de me gusta y comentarios, fecha de publicación
- Muro del perfil: las 12 publicaciones más recientes, cada una con su enlace permanente
- URLs y miniaturas de los medios de la publicación
- Insignia de verificado, foto de perfil y los enlaces externos de la bio
Cómo rastrearlo
curl -X POST \
-H "X-ScrapeUnblocker-Key: $SU_API_KEY" \
"https://api.scrapeunblocker.com/getPageSource?url=https%3A%2F%2Fwww.instagram.com%2Fnasa&parsed_data=true"import requests
resp = requests.post(
"https://api.scrapeunblocker.com/getPageSource",
headers={"X-ScrapeUnblocker-Key": SU_API_KEY},
params={"url": "https://www.instagram.com/nasa", "parsed_data": True},
)
print(resp.text)import { ScrapeUnblockerClient } from 'scrapeunblocker';
const su = new ScrapeUnblockerClient({ apiKey: process.env.SU_API_KEY });
const results = await su.getPageSource({
url: 'https://www.instagram.com/nasa',
parsedData: true,
});
console.log(results); Las peticiones son POST y sus parámetros van en la query string. El renderizado en navegador siempre ocurre: no hay ningún flag que activar.
Scrapers relacionados
Empieza a rastrear este sitio hoy
Plan gratuito incluido. No necesitas tarjeta para probarlo.