Datos de empresas
Similarweb Scraper
similarweb.com
La página pública de sitios web de Similarweb estima el tráfico de cualquier sitio, pero está protegida por AWS WAF y limita las vistas gratuitas por visitante: pasado un pequeño cupo sirve la misma página con todas las cifras a cero, que parece un dato pero no lo es. Un endpoint de plugin dedicado recibe un dominio, cualquier URL del sitio o una URL de página de Similarweb, abre la página como un visitante nuevo en cada llamada y devuelve el resumen ya parseado: ranking global, por país y por categoría con su cambio mensual, visitas totales del último mes y su variación, tasa de rebote, páginas por visita y duración media de la visita, visitas y rankings de los últimos tres meses, el reparto por fuente de tráfico, los países principales, género y grupos de edad, sitios similares con su afinidad, el reparto entre búsqueda orgánica y de pago con las palabras clave principales y su CPC, redes sociales principales, sitios de referencia, enlaces salientes, editores de anuncios display, tecnologías, intereses de la audiencia y el perfil de la empresa. Las cifras son estimaciones de la propia Similarweb, y snapshotDate indica el mes que describen. Un dominio para el que Similarweb no tiene página vuelve con found: false y las mismas claves vacías, así que cada respuesta tiene la misma forma.
Qué puedes extraer
- Ranking global, por país y por categoría, cada uno con su cambio respecto al mes anterior
- Visitas totales del último mes con su variación, tasa de rebote, páginas por visita y duración media de la visita
- Visitas y rankings de cada uno de los últimos tres meses, y el mes que describen los datos
- Reparto por fuente de tráfico, países principales por cuota y género y grupos de edad de la audiencia
- Sitios similares con su categoría, ranking en la categoría y afinidad
- Reparto entre búsqueda orgánica y de pago, el número de palabras clave y las palabras clave principales con su CPC
- Redes sociales principales, sitios de referencia, enlaces salientes, editores de anuncios display, tecnologías, intereses de la audiencia y el perfil de la empresa
Endpoints dedicados
/seo/similarweb Resumen de un sitio web en Similarweb
El resumen público de Similarweb para un dominio (un dominio simple, cualquier URL del sitio o una URL de página de Similarweb): globalRank, countryRank y categoryRank con sus cambios, totalVisits y visitsChangePercent, bounceRate, pagesPerVisit, avgVisitDuration, visitsHistory y rankHistory de los últimos tres meses, trafficSources, topCountries, demographics, competitors, search (reparto orgánico y de pago, palabras clave principales), socialNetworks, referrals, outgoingLinks, displayAds, technologies, audienceInterests y company. found es false para un dominio sin página en Similarweb, hasTrafficData es false para un sitio demasiado pequeño para estimarlo; proxy_country es opcional.
Cómo rastrearlo
curl -X POST \
-H "X-ScrapeUnblocker-Key: $SU_API_KEY" \
"https://api.scrapeunblocker.com/seo/similarweb?domain=github.com"import requests
resp = requests.post(
"https://api.scrapeunblocker.com/seo/similarweb",
headers={"X-ScrapeUnblocker-Key": SU_API_KEY},
params={"domain": "github.com"},
)
print(resp.text)import { ScrapeUnblockerClient } from 'scrapeunblocker';
const su = new ScrapeUnblockerClient({ apiKey: process.env.SU_API_KEY });
const results = await su.similarwebOverview('github.com');
console.log(results); Las peticiones son POST y sus parámetros van en la query string. El renderizado en navegador siempre ocurre: no hay ningún flag que activar.
Ejemplo de respuesta
{
"domain": "github.com",
"found": true,
"hasTrafficData": true,
"url": "https://www.similarweb.com/website/github.com/",
"snapshotDate": "2026-08-01",
"description": "Join the world's most widely adopted, AI-powered developer platform where millions of developers, businesses,...",
"category": "computers_electronics_and_technology/programming_and_developer_software",
"globalRank": 50,
"globalRankChange": -1,
"country": "US",
"countryRank": 81,
"countryRankChange": -2,
"categoryRank": 4,
"categoryRankChange": 0,
"totalVisits": 649321442,
"visitsChangePercent": 1.79,
"bounceRate": 0.3666,
"pagesPerVisit": 5.77,
"avgVisitDuration": "00:06:24",
"avgVisitDurationSeconds": 384,
"visitsHistory": [
{ "month": "2026-06", "visits": 615239605, "changePercent": -3.28 },
{ "month": "2026-07", "visits": 637885711, "changePercent": 3.68 },
{ "month": "2026-08", "visits": 649321442, "changePercent": 1.79 }
],
"trafficSources": [
{ "source": "direct", "share": 0.526, "rank": 1 },
{ "source": "organic", "share": null, "rank": 2 },
{ "source": "referrals", "share": null, "rank": 3 }
],
"countriesTotal": 111,
"topCountries": [
{ "countryCode": "US", "share": 0.1861, "shareChange": -0.0265 },
{ "countryCode": "CN", "share": 0.1166, "shareChange": 0.0865 },
{ "countryCode": "IN", "share": 0.1047, "shareChange": 0.0194 }
],
"demographics": {
"male": 0.6981,
"female": 0.3019,
"ageGroups": [
{ "minAge": 18, "maxAge": 24, "share": 0.2744 },
{ "minAge": 25, "maxAge": 34, "share": 0.3449 }
]
},
"competitors": [
{
"domain": "stackoverflow.com",
"category": "computers_electronics_and_technology/programming_and_developer_software",
"categoryRank": 81,
"affinity": 1.0
},
{
"domain": "huggingface.co",
"category": "computers_electronics_and_technology/computers_electronics_and_technology",
"categoryRank": 52,
"affinity": 0.9239
}
],
"search": {
"organicShare": 0.9997,
"paidShare": 0.0003,
"keywordsTotal": 2754220,
"topKeywords": [
{ "keyword": "github", "cpc": 1.63, "volume": null, "estimatedValue": null },
{ "keyword": "yt-dlp", "cpc": 4.63, "volume": null, "estimatedValue": null }
]
},
"socialNetworks": {
"total": 68,
"top": [
{ "name": "Youtube", "share": 0.4302 },
{ "name": "Reddit", "share": 0.2917 }
]
},
"referrals": {
"total": 920,
"topSites": [
{ "domain": null, "share": 0.0434, "locked": true },
{ "domain": "linux.do", "share": 0.0208, "locked": false }
],
"topCategories": [
{
"category": "Computers_Electronics_and_Technology/Programming_and_Developer_Software",
"share": 0.2856
}
]
},
"technologies": {
"total": 148,
"categoriesTotal": 20,
"categories": [
{ "category": "audio_video_media", "topTechnology": "YouTube", "technologiesCount": 8 },
{
"category": "conversion_and_analytics",
"topTechnology": "Google Analytics",
"technologiesCount": 6
}
]
},
"company": {
"name": "GitHub",
"yearFounded": 2008,
"headquartersCountry": "US",
"headquartersCity": "San Francisco",
"employeesMin": 501,
"employeesMax": 1000,
"revenueMin": 1000000000,
"revenueMax": null,
"revenueCurrency": "USD",
"parentDomain": "github.com"
}
} Preguntas frecuentes
¿Es legal hacer scraping de Similarweb?
Recopilar las estimaciones de tráfico que Similarweb muestra en sus páginas públicas de sitios web es lícito en muchas jurisdicciones, pero las normas dependen de tu país, de los datos que recopiles y de cómo los uses. Las cifras son estimaciones de Similarweb, no la analítica propia del sitio, así que preséntalas como estimaciones. ScrapeUnblocker devuelve el resumen público; qué recopilas y cómo lo usas es decisión tuya.
¿Cómo hago scraping de Similarweb sin que me bloqueen?
Similarweb está protegido por AWS WAF, que responde a un visitante nuevo con un desafío de JavaScript y rechaza directamente algunos exits, y limita las vistas gratuitas por visitante: pasado un pequeño cupo sirve la página con todas las cifras a cero. El plugin /seo/similarweb renderiza la página en un perfil de navegador nuevo y con un exit nuevo en cada llamada, espera a que se resuelva el desafío, pasa a otro exit cuando uno es rechazado y solo devuelve datos de una página sin limitación de vistas. En el benchmark de ScrapeUnblocker respondió al 98,6 % de 1.100 llamadas con dominios distintos, con el resumen o con found: false para un dominio que Similarweb no sigue, unos 9,5 s por llamada.
¿Qué datos obtengo de un sitio web?
El ranking global, por país y por categoría con su cambio mensual, las visitas totales del último mes y su variación, la tasa de rebote, las páginas por visita y la duración media de la visita (como texto y en segundos), las visitas y los rankings de cada uno de los últimos tres meses, el reparto por fuente de tráfico, el número de países y los países principales con su cuota, el reparto por género y los grupos de edad, los sitios similares con su categoría, ranking en la categoría y afinidad, el reparto entre búsqueda orgánica y de pago con el número de palabras clave y las palabras clave principales con su CPC, y las redes sociales principales, los sitios de referencia, los enlaces salientes, los editores de anuncios display, las tecnologías, los intereses de la audiencia y el perfil de la empresa: año de fundación, sede, rango de empleados y de ingresos. La página gratuita de Similarweb muestra solo una parte: los canales que no revela vuelven con share null, y los sitios que reserva a los usuarios de pago vuelven con domain null y locked: true.
¿Necesito una cuenta o una clave de API de Similarweb?
No. La API de Similarweb necesita una cuenta de Similarweb y una clave de API; el plugin no necesita ninguna de las dos, ni inicio de sesión: envía un dominio con tu clave de ScrapeUnblocker y recibe el resumen como JSON. Obtienes las mismas estimaciones que Similarweb muestra en su página de sitios web a los visitantes sin sesión iniciada.
¿Qué pasa cuando Similarweb no tiene datos de un dominio?
Un dominio para el que Similarweb no tiene página vuelve con found: false y las claves de datos null o vacías, así que puedes distinguirlo de un fallo, que devuelve un código de error. Un sitio que Similarweb sigue pero considera demasiado pequeño para estimarlo vuelve con found: true y hasTrafficData: false. Se quita el www. inicial, y los subdominios como docs.python.org se consultan por separado, porque Similarweb los sigue por separado.
¿Cuánto cuesta hacer scraping de Similarweb?
Cada llamada es una petición: un dominio, un resumen. 1 petición = 1 crédito, 1,00 EUR por cada 1.000 en Pay as you go, bajando hasta unos 0,55 EUR por cada 1.000 en el plan Ultimate. No se facturan los bloqueos ni los timeouts, y la prueba gratuita incluye 500 peticiones sin tarjeta.
Scrapers relacionados
Empieza a rastrear este sitio hoy
Plan gratuito incluido. No necesitas tarjeta para probarlo.