Unternehmensdaten
Similarweb Scraper
similarweb.com
Die öffentliche Website-Seite von Similarweb schätzt den Traffic jeder Website, steht aber hinter AWS WAF und begrenzt kostenlose Aufrufe pro Besucher: Nach einem kleinen Kontingent liefert sie dieselbe Seite mit allen Zahlen auf null, was wie Daten aussieht, aber keine sind. Ein dedizierter Plugin-Endpoint nimmt eine Domain, eine beliebige URL der Website oder eine Similarweb-Seiten-URL, öffnet die Seite bei jedem Call als neuer Besucher und gibt die Übersicht bereits geparst zurück: globalen Rang, Länder- und Kategorierang mit ihrer monatlichen Veränderung, die Besuche des letzten Monats und ihre Veränderung, Absprungrate, Seiten pro Besuch und durchschnittliche Besuchsdauer, Besuche und Ränge der letzten drei Monate, die Aufteilung nach Traffic-Quellen, die Top-Länder, Geschlecht und Altersgruppen, ähnliche Websites mit ihrer Affinität, die Aufteilung zwischen organischer und bezahlter Suche mit den Top-Keywords und ihrem CPC, die wichtigsten sozialen Netzwerke, verweisende Websites, ausgehende Links, Display-Ad-Publisher, Technologien, Interessen der Zielgruppe und das Unternehmensprofil. Die Zahlen sind Schätzungen von Similarweb selbst, und snapshotDate nennt den Monat, den sie beschreiben. Eine Domain, für die Similarweb keine Seite hat, kommt mit found: false und denselben Schlüsseln leer zurück, sodass jede Antwort dieselbe Form hat.
Was Sie extrahieren können
- Globaler Rang, Länder- und Kategorierang, jeweils mit der Veränderung zum Vormonat
- Besuche des letzten Monats mit ihrer Veränderung, Absprungrate, Seiten pro Besuch und durchschnittliche Besuchsdauer
- Besuche und Ränge für jeden der letzten drei Monate und der Monat, den die Daten beschreiben
- Aufteilung nach Traffic-Quellen, Top-Länder nach Anteil sowie Geschlecht und Altersgruppen der Zielgruppe
- Ähnliche Websites mit Kategorie, Kategorierang und Affinität
- Aufteilung zwischen organischer und bezahlter Suche, die Anzahl der Keywords und die Top-Keywords mit CPC
- Wichtigste soziale Netzwerke, verweisende Websites, ausgehende Links, Display-Ad-Publisher, Technologien, Interessen der Zielgruppe und das Unternehmensprofil
Dedizierte Endpoints
/seo/similarweb Similarweb-Website-Übersicht
Die öffentliche Similarweb-Übersicht für eine Domain (eine einfache Domain, eine beliebige URL der Website oder eine Similarweb-Seiten-URL): globalRank, countryRank und categoryRank mit ihren Veränderungen, totalVisits und visitsChangePercent, bounceRate, pagesPerVisit, avgVisitDuration, visitsHistory und rankHistory für die letzten drei Monate, trafficSources, topCountries, demographics, competitors, search (organische und bezahlte Aufteilung, Top-Keywords), socialNetworks, referrals, outgoingLinks, displayAds, technologies, audienceInterests und company. found ist false für eine Domain ohne Similarweb-Seite, hasTrafficData ist false für eine Website, die für eine Schätzung zu klein ist; proxy_country ist optional.
So wird es gescrapt
curl -X POST \
-H "X-ScrapeUnblocker-Key: $SU_API_KEY" \
"https://api.scrapeunblocker.com/seo/similarweb?domain=github.com"import requests
resp = requests.post(
"https://api.scrapeunblocker.com/seo/similarweb",
headers={"X-ScrapeUnblocker-Key": SU_API_KEY},
params={"domain": "github.com"},
)
print(resp.text)import { ScrapeUnblockerClient } from 'scrapeunblocker';
const su = new ScrapeUnblockerClient({ apiKey: process.env.SU_API_KEY });
const results = await su.similarwebOverview('github.com');
console.log(results); Requests sind POST und übergeben ihre Parameter im Query-String. Browser-Rendering findet immer statt - dafür gibt es kein Flag.
Beispielantwort
{
"domain": "github.com",
"found": true,
"hasTrafficData": true,
"url": "https://www.similarweb.com/website/github.com/",
"snapshotDate": "2026-08-01",
"description": "Join the world's most widely adopted, AI-powered developer platform where millions of developers, businesses,...",
"category": "computers_electronics_and_technology/programming_and_developer_software",
"globalRank": 50,
"globalRankChange": -1,
"country": "US",
"countryRank": 81,
"countryRankChange": -2,
"categoryRank": 4,
"categoryRankChange": 0,
"totalVisits": 649321442,
"visitsChangePercent": 1.79,
"bounceRate": 0.3666,
"pagesPerVisit": 5.77,
"avgVisitDuration": "00:06:24",
"avgVisitDurationSeconds": 384,
"visitsHistory": [
{ "month": "2026-06", "visits": 615239605, "changePercent": -3.28 },
{ "month": "2026-07", "visits": 637885711, "changePercent": 3.68 },
{ "month": "2026-08", "visits": 649321442, "changePercent": 1.79 }
],
"trafficSources": [
{ "source": "direct", "share": 0.526, "rank": 1 },
{ "source": "organic", "share": null, "rank": 2 },
{ "source": "referrals", "share": null, "rank": 3 }
],
"countriesTotal": 111,
"topCountries": [
{ "countryCode": "US", "share": 0.1861, "shareChange": -0.0265 },
{ "countryCode": "CN", "share": 0.1166, "shareChange": 0.0865 },
{ "countryCode": "IN", "share": 0.1047, "shareChange": 0.0194 }
],
"demographics": {
"male": 0.6981,
"female": 0.3019,
"ageGroups": [
{ "minAge": 18, "maxAge": 24, "share": 0.2744 },
{ "minAge": 25, "maxAge": 34, "share": 0.3449 }
]
},
"competitors": [
{
"domain": "stackoverflow.com",
"category": "computers_electronics_and_technology/programming_and_developer_software",
"categoryRank": 81,
"affinity": 1.0
},
{
"domain": "huggingface.co",
"category": "computers_electronics_and_technology/computers_electronics_and_technology",
"categoryRank": 52,
"affinity": 0.9239
}
],
"search": {
"organicShare": 0.9997,
"paidShare": 0.0003,
"keywordsTotal": 2754220,
"topKeywords": [
{ "keyword": "github", "cpc": 1.63, "volume": null, "estimatedValue": null },
{ "keyword": "yt-dlp", "cpc": 4.63, "volume": null, "estimatedValue": null }
]
},
"socialNetworks": {
"total": 68,
"top": [
{ "name": "Youtube", "share": 0.4302 },
{ "name": "Reddit", "share": 0.2917 }
]
},
"referrals": {
"total": 920,
"topSites": [
{ "domain": null, "share": 0.0434, "locked": true },
{ "domain": "linux.do", "share": 0.0208, "locked": false }
],
"topCategories": [
{
"category": "Computers_Electronics_and_Technology/Programming_and_Developer_Software",
"share": 0.2856
}
]
},
"technologies": {
"total": 148,
"categoriesTotal": 20,
"categories": [
{ "category": "audio_video_media", "topTechnology": "YouTube", "technologiesCount": 8 },
{
"category": "conversion_and_analytics",
"topTechnology": "Google Analytics",
"technologiesCount": 6
}
]
},
"company": {
"name": "GitHub",
"yearFounded": 2008,
"headquartersCountry": "US",
"headquartersCity": "San Francisco",
"employeesMin": 501,
"employeesMax": 1000,
"revenueMin": 1000000000,
"revenueMax": null,
"revenueCurrency": "USD",
"parentDomain": "github.com"
}
} Häufige Fragen
Ist das Scrapen von Similarweb legal?
Das Sammeln der Traffic-Schätzungen, die Similarweb auf seinen öffentlichen Website-Seiten zeigt, ist in vielen Rechtsordnungen zulässig, aber die Regeln hängen von deinem Land, den erhobenen Daten und ihrer Verwendung ab. Die Zahlen sind Schätzungen von Similarweb, nicht die eigene Analytics der Website, stelle sie also als Schätzungen dar. ScrapeUnblocker gibt die öffentliche Übersicht zurück; was du sammelst und wie du es nutzt, ist deine Entscheidung.
Wie scrape ich Similarweb, ohne blockiert zu werden?
Similarweb steht hinter AWS WAF, das einem neuen Besucher mit einer JavaScript-Challenge antwortet und manche Exits direkt abweist, und es begrenzt kostenlose Aufrufe pro Besucher: Nach einem kleinen Kontingent liefert es die Seite mit allen Zahlen auf null. Das Plugin /seo/similarweb rendert die Seite bei jedem Call in einem frischen Browserprofil über einen frischen Exit, wartet, bis die Challenge gelöst ist, wechselt zu einem anderen Exit, wenn einer abgewiesen wird, und liefert nur Daten von einer Seite ohne Aufrufbegrenzung. Im Benchmark von ScrapeUnblocker kam bei 98,6 % von 1.100 Calls mit unterschiedlichen Domains eine Antwort zurück, die Übersicht oder found: false für eine Domain, die Similarweb nicht verfolgt, etwa 9,5 s pro Call.
Welche Daten bekomme ich für eine Website?
Den globalen Rang, Länder- und Kategorierang mit ihrer monatlichen Veränderung, die Besuche des letzten Monats und ihre Veränderung, Absprungrate, Seiten pro Besuch und durchschnittliche Besuchsdauer (als Text und in Sekunden), Besuche und Ränge für jeden der letzten drei Monate, die Aufteilung nach Traffic-Quellen, die Anzahl der Länder und die Top-Länder mit ihrem Anteil, die Geschlechterverteilung und Altersgruppen, ähnliche Websites mit Kategorie, Kategorierang und Affinität, die Aufteilung zwischen organischer und bezahlter Suche mit der Anzahl der Keywords und den Top-Keywords mit CPC sowie die wichtigsten sozialen Netzwerke, verweisenden Websites, ausgehenden Links, Display-Ad-Publisher, Technologien, Interessen der Zielgruppe und das Unternehmensprofil: Gründungsjahr, Hauptsitz, Mitarbeiter- und Umsatzspanne. Die kostenlose Similarweb-Seite zeigt davon nur einen Teil: Kanäle, die sie nicht offenlegt, kommen mit share null zurück, und Websites, die sie zahlenden Nutzern vorbehält, mit domain null und locked: true.
Brauche ich ein Similarweb-Konto oder einen API-Schlüssel?
Nein. Die API von Similarweb braucht ein Similarweb-Konto und einen API-Schlüssel; das Plugin braucht beides nicht und auch keinen Login: Sende eine Domain mit deinem ScrapeUnblocker-Schlüssel und bekomme die Übersicht als JSON zurück. Du bekommst dieselben Schätzungen, die Similarweb nicht angemeldeten Besuchern auf seiner Website-Seite zeigt.
Was passiert, wenn Similarweb keine Daten zu einer Domain hat?
Eine Domain, für die Similarweb keine Seite hat, kommt mit found: false und leeren oder null gesetzten Datenschlüsseln zurück, sodass du sie von einem Fehler unterscheiden kannst, der einen Fehlerstatus liefert. Eine Website, die Similarweb verfolgt, aber für eine Schätzung zu klein findet, kommt mit found: true und hasTrafficData: false zurück. Ein führendes www. wird entfernt, und Subdomains wie docs.python.org werden einzeln abgefragt, weil Similarweb sie getrennt verfolgt.
Wie viel kostet das Scrapen von Similarweb?
Jeder Call ist eine Anfrage: eine Domain, eine Übersicht. 1 Anfrage = 1 Credit, 1,00 EUR pro 1.000 bei Pay-as-you-go, bis hinunter zu etwa 0,55 EUR pro 1.000 im Ultimate-Tarif. Blockierungen und Timeouts werden nicht berechnet, und die kostenlose Testphase umfasst 500 Anfragen ohne Karte.
Ähnliche Scraper
Starten Sie noch heute mit dieser Seite
Kostenloses Kontingent inklusive. Zum Testen ist keine Kreditkarte nötig.