Tous les scrapers

Données d'entreprise

Similarweb Scraper

similarweb.com

98.6% Taux de réussite
9.5s Réponse moyenne
AWS WAF Protection
1 100 appels Mesuré sur

La page publique de Similarweb consacrée à un site estime le trafic de n'importe quel site, mais elle est protégée par AWS WAF et limite les vues gratuites par visiteur : au-delà d'un petit quota, elle sert la même page avec tous les chiffres à zéro, ce qui ressemble à des données mais n'en est pas. Un endpoint de plugin dédié prend un domaine, n'importe quelle URL du site ou une URL de page Similarweb, ouvre la page comme un nouveau visiteur à chaque appel et renvoie la vue d'ensemble déjà parsée : rang mondial, par pays et par catégorie avec leur variation mensuelle, visites totales du dernier mois et leur variation, taux de rebond, pages par visite et durée moyenne de visite, visites et rangs des trois derniers mois, la répartition par source de trafic, les principaux pays, le genre et les tranches d'âge, les sites similaires avec leur affinité, la répartition entre recherche organique et payante avec les principaux mots-clés et leur CPC, les principaux réseaux sociaux, les sites référents, les liens sortants, les éditeurs de publicités display, les technologies, les centres d'intérêt de l'audience et le profil de l'entreprise. Les chiffres sont des estimations de Similarweb elle-même, et snapshotDate indique le mois qu'ils décrivent. Un domaine pour lequel Similarweb n'a pas de page revient avec found: false et les mêmes clés vides, ce qui donne à chaque réponse la même forme.

Ce que vous pouvez extraire

  • Rang mondial, par pays et par catégorie, chacun avec sa variation par rapport au mois précédent
  • Visites totales du dernier mois avec leur variation, taux de rebond, pages par visite et durée moyenne de visite
  • Visites et rangs pour chacun des trois derniers mois, et le mois que décrivent les données
  • Répartition par source de trafic, principaux pays par part, et genre et tranches d'âge de l'audience
  • Sites similaires avec leur catégorie, leur rang dans la catégorie et leur affinité
  • Répartition entre recherche organique et payante, le nombre de mots-clés et les principaux mots-clés avec leur CPC
  • Principaux réseaux sociaux, sites référents, liens sortants, éditeurs de publicités display, technologies, centres d'intérêt de l'audience et profil de l'entreprise

Endpoints dédiés

/seo/similarweb

Vue d'ensemble d'un site sur Similarweb

La vue d'ensemble publique de Similarweb pour un domaine (un domaine simple, n'importe quelle URL du site ou une URL de page Similarweb) : globalRank, countryRank et categoryRank avec leurs variations, totalVisits et visitsChangePercent, bounceRate, pagesPerVisit, avgVisitDuration, visitsHistory et rankHistory sur les trois derniers mois, trafficSources, topCountries, demographics, competitors, search (répartition organique et payante, principaux mots-clés), socialNetworks, referrals, outgoingLinks, displayAds, technologies, audienceInterests et company. found vaut false pour un domaine sans page Similarweb, hasTrafficData vaut false pour un site trop petit pour être estimé ; proxy_country est facultatif.

Comment le scraper

curl -X POST \
  -H "X-ScrapeUnblocker-Key: $SU_API_KEY" \
  "https://api.scrapeunblocker.com/seo/similarweb?domain=github.com"
import requests

resp = requests.post(
    "https://api.scrapeunblocker.com/seo/similarweb",
    headers={"X-ScrapeUnblocker-Key": SU_API_KEY},
    params={"domain": "github.com"},
)
print(resp.text)
import { ScrapeUnblockerClient } from 'scrapeunblocker';

const su = new ScrapeUnblockerClient({ apiKey: process.env.SU_API_KEY });

const results = await su.similarwebOverview('github.com');
console.log(results);

Les requêtes sont en POST et passent leurs paramètres dans la query string. Le rendu navigateur a toujours lieu : aucun flag à activer.

Exemple de réponse

{
  "domain": "github.com",
  "found": true,
  "hasTrafficData": true,
  "url": "https://www.similarweb.com/website/github.com/",
  "snapshotDate": "2026-08-01",
  "description": "Join the world's most widely adopted, AI-powered developer platform where millions of developers, businesses,...",
  "category": "computers_electronics_and_technology/programming_and_developer_software",
  "globalRank": 50,
  "globalRankChange": -1,
  "country": "US",
  "countryRank": 81,
  "countryRankChange": -2,
  "categoryRank": 4,
  "categoryRankChange": 0,
  "totalVisits": 649321442,
  "visitsChangePercent": 1.79,
  "bounceRate": 0.3666,
  "pagesPerVisit": 5.77,
  "avgVisitDuration": "00:06:24",
  "avgVisitDurationSeconds": 384,
  "visitsHistory": [
    { "month": "2026-06", "visits": 615239605, "changePercent": -3.28 },
    { "month": "2026-07", "visits": 637885711, "changePercent": 3.68 },
    { "month": "2026-08", "visits": 649321442, "changePercent": 1.79 }
  ],
  "trafficSources": [
    { "source": "direct", "share": 0.526, "rank": 1 },
    { "source": "organic", "share": null, "rank": 2 },
    { "source": "referrals", "share": null, "rank": 3 }
  ],
  "countriesTotal": 111,
  "topCountries": [
    { "countryCode": "US", "share": 0.1861, "shareChange": -0.0265 },
    { "countryCode": "CN", "share": 0.1166, "shareChange": 0.0865 },
    { "countryCode": "IN", "share": 0.1047, "shareChange": 0.0194 }
  ],
  "demographics": {
    "male": 0.6981,
    "female": 0.3019,
    "ageGroups": [
      { "minAge": 18, "maxAge": 24, "share": 0.2744 },
      { "minAge": 25, "maxAge": 34, "share": 0.3449 }
    ]
  },
  "competitors": [
    {
      "domain": "stackoverflow.com",
      "category": "computers_electronics_and_technology/programming_and_developer_software",
      "categoryRank": 81,
      "affinity": 1.0
    },
    {
      "domain": "huggingface.co",
      "category": "computers_electronics_and_technology/computers_electronics_and_technology",
      "categoryRank": 52,
      "affinity": 0.9239
    }
  ],
  "search": {
    "organicShare": 0.9997,
    "paidShare": 0.0003,
    "keywordsTotal": 2754220,
    "topKeywords": [
      { "keyword": "github", "cpc": 1.63, "volume": null, "estimatedValue": null },
      { "keyword": "yt-dlp", "cpc": 4.63, "volume": null, "estimatedValue": null }
    ]
  },
  "socialNetworks": {
    "total": 68,
    "top": [
      { "name": "Youtube", "share": 0.4302 },
      { "name": "Reddit", "share": 0.2917 }
    ]
  },
  "referrals": {
    "total": 920,
    "topSites": [
      { "domain": null, "share": 0.0434, "locked": true },
      { "domain": "linux.do", "share": 0.0208, "locked": false }
    ],
    "topCategories": [
      {
        "category": "Computers_Electronics_and_Technology/Programming_and_Developer_Software",
        "share": 0.2856
      }
    ]
  },
  "technologies": {
    "total": 148,
    "categoriesTotal": 20,
    "categories": [
      { "category": "audio_video_media", "topTechnology": "YouTube", "technologiesCount": 8 },
      {
        "category": "conversion_and_analytics",
        "topTechnology": "Google Analytics",
        "technologiesCount": 6
      }
    ]
  },
  "company": {
    "name": "GitHub",
    "yearFounded": 2008,
    "headquartersCountry": "US",
    "headquartersCity": "San Francisco",
    "employeesMin": 501,
    "employeesMax": 1000,
    "revenueMin": 1000000000,
    "revenueMax": null,
    "revenueCurrency": "USD",
    "parentDomain": "github.com"
  }
}

Lire la documentation de l'API

Questions fréquentes

Le scraping de Similarweb est-il légal ?

Collecter les estimations de trafic que Similarweb affiche sur ses pages publiques de sites est licite dans de nombreuses juridictions, mais les règles dépendent de votre pays, des données collectées et de leur usage. Les chiffres sont des estimations de Similarweb, pas l'analytique propre du site, présentez-les donc comme des estimations. ScrapeUnblocker renvoie la vue d'ensemble publique ; ce que vous collectez et comment vous l'utilisez relève de votre décision.

Comment scraper Similarweb sans se faire bloquer ?

Similarweb est protégé par AWS WAF, qui répond à un nouveau visiteur par un challenge JavaScript et refuse d'emblée certaines sorties, et il limite les vues gratuites par visiteur : au-delà d'un petit quota, il sert la page avec tous les chiffres à zéro. Le plugin /seo/similarweb rend la page dans un profil de navigateur neuf, via une sortie neuve, à chaque appel, attend que le challenge soit résolu, passe à une autre sortie quand l'une est refusée et ne renvoie des données que depuis une page sans limitation de vues. Dans le benchmark de ScrapeUnblocker, 98,6 % des 1 100 appels avec des domaines différents ont reçu une réponse, la vue d'ensemble ou found: false pour un domaine que Similarweb ne suit pas, en environ 9,5 s par appel.

Quelles données j'obtiens pour un site ?

Le rang mondial, par pays et par catégorie avec leur variation mensuelle, les visites totales du dernier mois et leur variation, le taux de rebond, les pages par visite et la durée moyenne de visite (en texte et en secondes), les visites et les rangs de chacun des trois derniers mois, la répartition par source de trafic, le nombre de pays et les principaux pays avec leur part, la répartition par genre et les tranches d'âge, les sites similaires avec leur catégorie, leur rang dans la catégorie et leur affinité, la répartition entre recherche organique et payante avec le nombre de mots-clés et les principaux mots-clés avec leur CPC, ainsi que les principaux réseaux sociaux, sites référents, liens sortants, éditeurs de publicités display, technologies, centres d'intérêt de l'audience et le profil de l'entreprise : année de création, siège, tranche d'effectif et de chiffre d'affaires. La page gratuite de Similarweb n'en montre qu'une partie : les canaux qu'elle ne révèle pas reviennent avec share null, et les sites qu'elle réserve aux utilisateurs payants reviennent avec domain null et locked: true.

Ai-je besoin d'un compte ou d'une clé API Similarweb ?

Non. L'API de Similarweb nécessite un compte Similarweb et une clé API ; le plugin n'a besoin ni de l'un ni de l'autre, ni de connexion : envoyez un domaine avec votre clé ScrapeUnblocker et recevez la vue d'ensemble en JSON. Vous obtenez les mêmes estimations que celles que Similarweb montre aux visiteurs non connectés sur sa page consacrée au site.

Que se passe-t-il quand Similarweb n'a pas de données pour un domaine ?

Un domaine pour lequel Similarweb n'a pas de page revient avec found: false et les clés de données null ou vides, ce qui permet de le distinguer d'un échec, qui renvoie un statut d'erreur. Un site que Similarweb suit mais juge trop petit pour être estimé revient avec found: true et hasTrafficData: false. Le www. initial est retiré, et les sous-domaines comme docs.python.org sont interrogés séparément, car Similarweb les suit séparément.

Combien coûte le scraping de Similarweb ?

Chaque appel est une requête : un domaine, une vue d'ensemble. 1 requête = 1 crédit, 1,00 EUR pour 1 000 en paiement à l'usage, en descendant jusqu'à environ 0,55 EUR pour 1 000 sur l'offre Ultimate. Les blocages et les timeouts ne sont pas facturés, et l'essai gratuit inclut 500 requêtes sans carte bancaire.

Scrapers similaires

Commencez à scraper ce site dès aujourd'hui

Palier gratuit inclus. Aucune carte bancaire requise pour tester.