Données d'entreprise
Crunchbase Scraper
crunchbase.com
Crunchbase est servi via un endpoint de plugin dédié plutôt que par la récupération de page générique. Donnez-lui une organisation - son slug, la partie après /organization/ dans l'URL du profil comme stripe, ou l'URL complète du profil - et il lit les données que charge la page de profil et renvoie l'organisation déjà parsée : nom, raison sociale, description courte et complète, logo, site web, siège, statut d'activité, type d'entreprise et statut boursier avec symbole et place de cotation, tranche d'effectifs, secteurs et groupes de secteurs, le CB rank avec sa tendance sur 90 jours, les scores growth et heat, les fondateurs, le type de la dernière levée, les nombres de levées, d'investisseurs, d'acquisitions, d'investissements et de profils de salariés, les levées de fonds avec leurs investisseurs principaux, les investisseurs, acquisitions, investissements, exits, filiales, dirigeants clés avec leur fonction, membres du conseil d'administration, entreprises similaires, produits, e-mail de contact, téléphone, liens vers les réseaux sociaux, visites web mensuelles, indicateurs technologiques, prédictions de Crunchbase, événements clés comme les lancements de produits, partenariats, licenciements et changements de direction avec leurs sources presse, bureaux et actualités récentes. Vous n'avez qu'un nom ? Passez query à la place et obtenez jusqu'à 25 organisations correspondantes avec leurs slugs. Sachez ce qu'il peut atteindre : il lit ce que voit un visiteur non connecté, si bien que les valeurs que Crunchbase réserve aux utilisateurs payants (dates de création, de fermeture et d'introduction en bourse, montants totaux levés, dates et montants des levées, prix d'acquisition, exits, valorisation) reviennent à null, paywalledFields nomme celles que Crunchbase détient pour l'organisation, et les listes comme les levées de fonds ou les dirigeants clés contiennent ce que montre le profil public, pas un export complet. Aucun compte Crunchbase ni clé d'API n'est nécessaire.
Ce que vous pouvez extraire
- Nom, raison sociale, description courte et complète, logo, site web et siège
- Statut d'activité, type d'entreprise et statut boursier, symbole et place de cotation, tranche d'effectifs, secteurs et groupes de secteurs
- CB rank avec sa tendance sur 90 jours, scores growth et heat avec leur variation sur 90 jours
- Fondateurs, dirigeants clés avec fonction et date de prise de poste, et membres du conseil d'administration
- Levées de fonds avec investisseurs principaux, investisseurs, acquisitions, investissements, exits et filiales, avec leurs nombres
- Entreprises similaires, produits, e-mail de contact, téléphone et liens vers les réseaux sociaux
- Visites web mensuelles et leur évolution, indicateurs technologiques, prédictions, événements clés avec sources presse, bureaux et actualités récentes
- Recherche par nom d'entreprise : jusqu'à 25 correspondances avec slug, URL, description courte et logo
- Les valeurs payantes (dates, montants totaux levés, montants des levées, prix d'acquisition, valorisation) reviennent à null et sont nommées dans paywalledFields
Endpoints dédiés
/companies/crunchbase Profil d'organisation Crunchbase ou recherche par nom
Une organisation Crunchbase par slug (comme stripe) ou URL de profil : name, slug, uuid, url, legalName, shortDescription, description, logo, website, headquarters, operatingStatus, companyType, ipoStatus, stockSymbol, stockExchange, employeeRange, industries, industryGroups, rank avec rankDelta90d, growthScore, heatScore, founders, lastFundingType, les compteurs num*, acquiredBy, owner, fundingRounds, investors, acquisitions, investments, exits, subOrganizations, keyPeople, boardMembers, similarCompanies, products, contactEmail, phone, socialLinks, webTraffic, technology, predictions, events, offices et news. Les valeurs que Crunchbase réserve aux utilisateurs payants valent null et sont nommées dans paywalledFields. Ou, avec query à la place d'organization, jusqu'à max_results (1-25) organisations correspondantes avec name, slug, url, shortDescription et logo, plus le nombre total count.
Comment le scraper
curl -X POST \
-H "X-ScrapeUnblocker-Key: $SU_API_KEY" \
"https://api.scrapeunblocker.com/companies/crunchbase?organization=stripe"import requests
resp = requests.post(
"https://api.scrapeunblocker.com/companies/crunchbase",
headers={"X-ScrapeUnblocker-Key": SU_API_KEY},
params={"organization": "stripe"},
)
print(resp.text)import { ScrapeUnblockerClient } from 'scrapeunblocker';
const su = new ScrapeUnblockerClient({ apiKey: process.env.SU_API_KEY });
const org = await su.crunchbaseCompany('stripe');
const matches = await su.crunchbaseCompany({ query: 'Revolut', maxResults: 5 });
console.log(org);
console.log(matches); Les requêtes sont en POST et passent leurs paramètres dans la query string. Le rendu navigateur a toujours lieu : aucun flag à activer.
Exemple de réponse
{
"organization": {
"name": "Stripe",
"slug": "stripe",
"url": "https://www.crunchbase.com/organization/stripe",
"legalName": "Stripe, LLC.",
"shortDescription": "Stripe enables businesses to accept payments, manage billing, and embed financial services into digital platforms.",
"website": "https://stripe.com",
"headquarters": {
"city": "South San Francisco",
"region": "California",
"country": "United States",
"continent": "North America",
"text": "South San Francisco, California, United States"
},
"operatingStatus": "active",
"companyType": "for_profit",
"ipoStatus": "private",
"foundedOn": null,
"employeeRange": "5001-10000",
"industries": [
"Billing",
"Compliance",
"E-Commerce Platforms",
"Finance"
],
"rank": 36,
"rankDelta90d": 6.2,
"growthScore": 95,
"heatScore": 82,
"founders": [
{
"name": "John Collison",
"slug": "john-collison",
"url": "https://www.crunchbase.com/person/john-collison",
"type": "person"
},
{
"name": "Patrick Collison",
"slug": "patrick-collison",
"url": "https://www.crunchbase.com/person/patrick-collison",
"type": "person"
}
],
"lastFundingType": "Secondary Market",
"fundingTotal": null,
"numFundingRounds": 25,
"numInvestors": 75,
"numAcquisitions": 24,
"fundingRounds": [
{
"name": "Secondary Market - Stripe",
"url": "https://www.crunchbase.com/funding_round/stripe-secondary-market--9d7e5ac9",
"type": "Secondary Market",
"announcedOn": null,
"moneyRaised": null,
"numInvestors": 1,
"leadInvestors": [
{
"name": "Robinhood Ventures",
"slug": "robinhood-ventures",
"url": "https://www.crunchbase.com/organization/robinhood-ventures",
"type": "organization"
}
]
}
],
"keyPeople": [
{
"name": "Steffan Tomlinson",
"slug": "steffan-tomlinson",
"url": "https://www.crunchbase.com/person/steffan-tomlinson",
"type": "person",
"title": "Chief Financial Officer",
"startedOn": "2023-08-02"
}
],
"similarCompanies": [
{
"name": "Checkout.com",
"slug": "checkout-com",
"url": "https://www.crunchbase.com/organization/checkout-com",
"type": "organization"
},
{
"name": "Nuvei",
"slug": "nuvei",
"url": "https://www.crunchbase.com/organization/nuvei",
"type": "organization"
}
],
"webTraffic": {
"monthlyVisits": 203227314,
"monthlyVisitsChange": 0.0693545159706943
},
"paywalledFields": [
"foundedOn",
"fundingTotal",
"lastFundingAt",
"numExits"
]
},
"slug": "stripe"
} Lire la documentation de l'API
Questions fréquentes
Le scraping de Crunchbase est-il légal ?
Collecter les données d'entreprise que Crunchbase affiche publiquement, comme les descriptions, les secteurs, les levées de fonds et les investisseurs, est licite dans de nombreuses juridictions, mais les règles dépendent de votre pays, des données collectées et de leur usage. Les noms des fondateurs et des dirigeants sont des données personnelles, respectez donc les règles de confidentialité qui s'appliquent à vous. ScrapeUnblocker renvoie le profil public ; ce que vous collectez et comment vous l'utilisez relève de votre responsabilité.
Comment scraper Crunchbase sans se faire bloquer ?
Crunchbase utilise la détection de bots et la limitation de débit. Le plugin /companies/crunchbase lit les données que charge la page de profil, via les étapes sans navigateur de ScrapeUnblocker, plusieurs fois sur de nouvelles sorties, et n'ouvre la page de profil dans un vrai navigateur que lorsque ces tentatives reviennent vides. Dans le benchmark de ScrapeUnblocker, 96,3 % des 1 100 appels, avec une organisation différente à chaque fois, ont renvoyé l'organisation, en environ 7,1 s par appel ; les échecs sont des appels que Crunchbase bloquait encore après toutes les nouvelles tentatives.
Quelles données Crunchbase puis-je obtenir ?
L'identité et la description, le site web, le siège, le statut d'activité, le type d'entreprise et le statut boursier, le symbole boursier, la tranche d'effectifs, les secteurs, le CB rank avec sa tendance sur 90 jours, les scores growth et heat, les fondateurs, le type de la dernière levée, les nombres de levées, d'investisseurs, d'acquisitions, d'investissements et de profils de salariés, les levées de fonds avec leurs investisseurs principaux, les investisseurs, acquisitions, investissements, exits, filiales, dirigeants clés avec fonction et date de prise de poste, membres du conseil d'administration, entreprises similaires, produits, e-mail de contact, téléphone, liens vers les réseaux sociaux, visites web mensuelles et leur évolution, indicateurs technologiques, prédictions de Crunchbase, événements clés (lancements de produits, partenariats, récompenses, licenciements, changements de direction, procédures judiciaires) avec leurs sources presse, bureaux et actualités récentes. Chaque clé est toujours présente et vaut null quand Crunchbase ne l'affiche pas.
Pourquoi les dates de création et les montants levés sont-ils vides ?
Crunchbase réserve certaines valeurs aux utilisateurs payants : dates de création, de fermeture et d'introduction en bourse, montants totaux levés, dates et montants des levées, prix d'acquisition, nombres d'exits et valorisations. Le plugin lit ce que voit un visiteur non connecté, si bien que ces valeurs reviennent à null au lieu d'être devinées, et paywalledFields nomme celles que Crunchbase détient pour cette organisation. Les compteurs comme numFundingRounds et numInvestors, les types de levées, les noms des investisseurs et les investisseurs principaux sont publics et reviennent renseignés. Les listes comme fundingRounds, keyPeople ou news contiennent les entrées que montre le profil public, en général les plus récentes, tandis que les compteurs num* donnent les totaux.
Ai-je besoin d'un compte ou d'une clé d'API Crunchbase ?
Non. Le plugin ne nécessite ni compte Crunchbase, ni connexion, ni clé d'API : envoyez un slug ou une URL de profil avec votre clé ScrapeUnblocker et recevez l'organisation en JSON. Vous n'avez qu'un nom d'entreprise ? Passez query, par exemple Revolut, et obtenez jusqu'à 25 organisations correspondantes avec leurs slugs, issues de la même recherche que la barre de recherche de Crunchbase, puis rappelez avec le slug voulu.
Combien coûte le scraping de Crunchbase ?
Chaque appel est une requête : un profil d'organisation, ou une recherche par nom avec jusqu'à 25 correspondances. 1 requête = 1 crédit, 1,00 EUR pour 1 000 en paiement à l'usage, en descendant jusqu'à environ 0,55 EUR pour 1 000 sur l'offre Ultimate. Les blocages et les timeouts ne sont pas facturés, et l'essai gratuit inclut 500 requêtes sans carte bancaire.
Scrapers similaires
Commencez à scraper ce site dès aujourd'hui
Palier gratuit inclus. Aucune carte bancaire requise pour tester.