Scraper Crunchbase

Les fiches d'entreprise,
en tableur.

Donnez-lui une liste d'URL d'organisation crunchbase.com et récupérez leurs fiches sous forme de lignes : le nom et la description de l'entreprise, le site web, sa date de création, son effectif, ses secteurs, sa localisation, son rang Crunchbase et son statut d'activité, ainsi que ses liens LinkedIn, X et Facebook. Seize colonnes, une ligne par entreprise. Une chose à savoir avant de commencer : Crunchbase est derrière Cloudflare, et ce scraper a besoin d'un proxy résidentiel pour renvoyer quoi que ce soit.

500 lignes gratuites, une seule fois0,002 $ par ligne ensuite16 colonnesCSV · XLSX · JSON
Comment ça marche

Une liste d'entreprises en entrée,
leurs fiches en sortie.

L'entrée, c'est la page de l'organisation - l'URL que vous auriez ouverte vous-même. Collez celles que vous avez déjà et le job lit chaque fiche.

  1. ÉTAPE 1Connectez-vous à la plateforme.
  2. ÉTAPE 2Ouvrez le Scraper Crunchbase.
  3. ÉTAPE 3Collez des URL crunchbase.com/organization/, une par ligne - ou importez un fichier CSV, XLSX, TXT ou Parquet.
  4. ÉTAPE 4Configurez un proxy résidentiel - sans lui, l'exécution ne renvoie aucune ligne.
  5. ÉTAPE 5Fixez une limite par requête, ou laissez-la à zéro pour tout prendre.
  6. ÉTAPE 6Cliquez sur Get Data.

Une ligne par entreprise, chacune marquée de l'URL dont elle provient - de sorte qu'une exécution sur tout un portefeuille se rapproche encore de votre liste d'entrée.

Pourquoi les équipes l'utilisent

Les données d'entreprise,
dans un seul fichier.

Des champs de fiche, pas un dump de la page

Seize colonnes nommées reviennent par organisation - la description, le site web, la date de création, l'effectif, les secteurs, la localisation, le rang, le statut d'activité et trois liens sociaux. Vous obtenez des champs sur lesquels filtrer, pas du HTML à démonter ensuite.

Le proxy est une vraie exigence, pas une note de bas de page

Crunchbase est derrière Cloudflare, et il ne cède pas devant une adresse de datacenter. Ce scraper a besoin d'un proxy résidentiel configuré sur le job ; sans lui, une exécution se termine et ne renvoie rien. Nous préférons que vous le lisiez ici plutôt que de le découvrir sur un export vide.

Un seul réglage, fixé avant l'exécution

Un plafond de lignes par requête, choisi avant le démarrage du job, ou laissé à zéro pour tout prendre. Ce scraper n'a pas d'option de tri - c'est vous qui nommez les entreprises, l'ordre est donc celui que vous avez donné.

Ce que vous récupérez

Seize colonnes,
une ligne par entreprise.

Chaque ligne porte la fiche de l'organisation telle que Crunchbase la présente : ce qu'est l'entreprise, où elle est, quelle est sa taille, comment Crunchbase la classe et où la retrouver ailleurs sur le web.

La liste de colonnes ci-dessous est la ligne d'en-tête d'exports réels, corroborée par le tableau de colonnes que l'interface d'exécution affiche - les deux concordent exactement. Ce qu'elle n'est pas : un échantillon. Lisez la note sous le tableau avant d'écrire du code contre l'un de ces champs, car elle dit clairement ce que nous avons vu ce scraper renvoyer et ce que nous n'avons pas vu.

Dictionnaire de données

Seize colonnes,
nommées et rien de plus.

Les noms sont exacts : ce sont la ligne d'en-tête du classeur et le tableau de colonnes de l'interface d'exécution, et les deux concordent. Les descriptions disent à quoi sert chaque colonne. Elles ne décrivent pas son format, et la note sous le tableau explique pourquoi.

query
L'URL d'organisation crunchbase.com que vous avez soumise, répétée sur chaque ligne qui en provient.
company
Le nom de l'organisation tel que Crunchbase l'enregistre.
description
La description, issue de la fiche, de ce que fait l'entreprise.
website
Le site web propre de l'entreprise.
founded
La date de création de l'entreprise.
employees
L'effectif que Crunchbase indique pour l'entreprise.
industries
Les secteurs auxquels la fiche est associée.
city
La ville du siège de l'entreprise.
region
La région ou l'État de cette localisation.
country
Le pays de cette localisation.
rank
Le rang que Crunchbase attribue à l'organisation.
operating_status
Si l'entreprise est toujours en activité, tel que Crunchbase l'enregistre.
linkedin
Le lien LinkedIn de l'entreprise, issu de la fiche.
twitter
Le lien X (Twitter) de l'entreprise, issu de la fiche.
facebook
Le lien Facebook de l'entreprise, issu de la fiche.
logo
L'image du logo de l'entreprise, issue de la fiche.

Lisez ceci avant de bâtir quoi que ce soit sur le tableau ci-dessus. Tous les exports d'exécution dont nous disposons pour ce scraper sont revenus vides - cinq exécutions entre le 30/06/2026 et le 15/07/2026, chacune un classeur avec cette ligne d'en-tête et aucune ligne de données en dessous. La cause n'est pas un bug : Crunchbase est derrière Cloudflare, et une exécution sans proxy résidentiel se termine et ne renvoie rien. Les seize noms sont donc solides - deux sources indépendantes les portent, dans cet ordre - et rien d'autre ici ne l'est. Nous ne publions aucune valeur d'exemple ni aucun format pour quelque champ que ce soit : ni si founded est une année ou une date complète, ni si employees est une tranche ou un nombre, ni si rank est global ou par catégorie, ni comment industries sépare ses étiquettes, ni quel vocabulaire utilise operating_status. Affirmer l'un de ces points reviendrait à deviner. Lancez une exécution en offre gratuite avec votre propre proxy sur une organisation et lisez le premier fichier obtenu : c'est le seul échantillon qui vous dira la vérité sur vos données.

Contrôles d'exécution

Réglé sur le job,
pas dans le tableur.

Ce scraper n'a qu'un réglage en plus du champ de requête : un plafond de lignes par requête. Le reste de ce que vous décidez en amont, c'est la façon dont vous transmettez les URL d'organisation, et le proxy par lequel le job passe.

Saisie par URL d'organisation Limite par requête Coller une par ligne Import CSV Import XLSX Import TXT Import Parquet Proxy résidentiel
Cas d'usage courants

Trois tâches que l'on exécute
le plus souvent ici.

Quelques exemples de la façon dont les équipes utilisent les données de fiches d'entreprise pour répondre à une question qu'elles se posent vraiment.

Enrichissement

Compléter une liste que vous avez déjà

Vous avez les entreprises ; ce qui manque, c'est leur forme. Une exécution transforme une colonne d'URL d'organisation en effectif, secteurs, localisation et site web : la liste devient segmentable au lieu d'être seulement lisible.

RevOps
Cartographie de marché

Cartographier une catégorie sur pièces

Prenez toutes les organisations d'un espace et mettez leurs descriptions, secteurs et localisations côte à côte. À quoi ressemble un marché se voit bien mieux dans un fichier qu'à travers cinquante onglets.

Stratégie
Sourcing

Filtrer un pipeline avant le premier appel

Date de création, effectif et statut d'activité sont les champs qui décident si une entreprise mérite une conversation. Les avoir à côté des liens sociaux, c'est le travail préparatoire fait avant que quiconque décroche.

Investissement
Tarifs

Ne payez que les entreprises
que vous extrayez vraiment.

Pas d'abonnement, pas de minimum, pas de facture récurrente. Vos 500 premières lignes sont offertes - ensuite, paiement à l'usage, au même tarif forfaitaire que tous les autres scrapers d'ici.

Offre gratuite

500 lignes gratuites - 0 $

Sur chaque nouveau compte, une seule fois. Aucune carte bancaire requise. Limites par requête, import de fichier et tous les formats d'export inclus. Le proxy dont ce scraper a besoin, c'est à vous de le fournir - sur l'offre gratuite comme après.

0 $ pour toujours
Paiement à l'usage

0,002 $ par ligne, après l'offre gratuite

Le même tarif forfaitaire que tous les autres scrapers de la plateforme. L'estimateur affiche le nombre de lignes et le coût en crédits avant le démarrage - pas de facture surprise, pas d'unités de calcul à convertir.

Le plus choisi
Volume

Sur mesure · gros volume

Tarifs au volume, workers dédiés et un SLA pour la surveillance continue ou de très gros historiques. Dites-nous vos chiffres et nous vous faisons une offre.

Parlons-en
10 % de remise sur votre première exécution payante.Utilisez le code LIVESCRAPER10 au paiement.
S'inscrire
S'associe bien avec

La fiche,
et tout ce qui l'entoure.

Le volet juridique

Est-il légal de scraper
les fiches Crunchbase ?

Réponse courte : les pages d'organisation sont des données d'entreprise publiques - et la contrainte ici est technique et contractuelle plutôt que liée à la vie privée.

Une page d'organisation Crunchbase est montrée à quiconque l'ouvre, connecté ou non. Le nom de l'entreprise, la description, le site web, la localisation et les liens sociaux sont publiés pour être lus. Collecter des informations d'entreprise publiquement visibles à des fins de recherche est une pratique établie de longue date, et rien ici ne touche à une connexion ni à un paywall.

Cet export relève de la donnée d'entreprise et non de la donnée personnelle - une société, sa taille, ses secteurs et ses liens, pas une personne nommée. L'obligation est plus légère que pour un export d'avis ou de profils, sans être nulle : une entreprise d'une seule personne reste une personne, et une liste de très petites structures peut basculer dans le personnel plus vite qu'on ne le croit.

La contrainte à anticiper est celle de Crunchbase. Le site est activement protégé par Cloudflare, et ses conditions restreignent l'accès automatisé - c'est donc autant une question contractuelle que technique, et si vous avez un abonnement ou un accord d'API avec eux, vérifiez-le avant de passer à l'échelle. Nous n'exécutons aucun traceur tiers sur la couche de données, et vos exports sont supprimés automatiquement au bout de 30 jours.

livescraper.app · principes
Uniquement les pages d'organisation publiques
Aucune connexion, aucun compte touché
Nécessite votre propre proxy résidentiel!
Données d'entreprise, pas données personnelles
Les exports s'auto-suppriment (30 jours)
Vérifiez les conditions de Crunchbase avant de passer à l'échelle.
Questions fréquentes

Ce que l'on demande
avant de s'inscrire.

Les questions qui reviennent le plus. Autre chose ? Parlons-en - ce sont des humains, pas des bots, qui écrivent les réponses.

Comment scraper les fiches d'entreprise Crunchbase ?+
Avec le Scraper Crunchbase :
  1. Connectez-vous à la plateforme.
  2. Ouvrez le Scraper Crunchbase.
  3. Collez des URL crunchbase.com/organization/, une par ligne - ou importez un fichier CSV, XLSX, TXT ou Parquet.
  4. Configurez un proxy résidentiel - sans lui, l'exécution ne renvoie aucune ligne.
  5. Fixez une limite par requête, ou laissez-la à zéro pour tout prendre.
  6. Cliquez sur Get Data.
Ai-je besoin d'un proxy pour celui-ci ?+
Oui, et c'est le point le plus important de cette page. Crunchbase est protégé par Cloudflare, qui ne sert pas de données à une adresse de datacenter. Ce scraper a besoin d'un proxy résidentiel configuré sur le job. Sans lui, l'exécution se termine normalement et l'export revient avec une ligne d'en-tête et rien en dessous.
Puis-je chercher par nom d'entreprise ou par domaine plutôt que par URL ?+
Pas avec ce scraper. Celui-ci prend des URL crunchbase.com/organization/, une par ligne. Résoudre un nom ou un domaine vers la bonne organisation est un service distinct - le Crunchbase Search Scraper - donc si votre liste est faite de noms d'entreprises plutôt que de liens, c'est celui-là qu'il vous faut d'abord.
Que récupère-t-on pour chaque entreprise ?+
Seize colonnes : la requête soumise, le nom et la description de l'entreprise, le site web, la date de création, l'effectif, les secteurs, la ville, la région et le pays, le rang Crunchbase, le statut d'activité, ainsi que les liens LinkedIn, X et Facebook et le logo.
Pourquoi cette page n'affiche-t-elle aucune valeur d'exemple ?+
Parce que nous n'imprimons pas de valeurs que nous n'avons pas vues. Tous les exports dont nous disposons pour ce scraper ont renvoyé zéro ligne - cinq exécutions entre le 30/06/2026 et le 15/07/2026, chacune un classeur avec la ligne d'en-tête et rien en dessous, toutes faites sans proxy résidentiel. Cela rend les seize noms de colonnes fiables, puisque deux sources indépendantes les listent dans cet ordre, et fait de toute affirmation sur leur contenu une supposition. Nos autres pages décrivent les formats de champs parce que nous les avons mesurés ; celle-ci se tait parce que nous ne l'avons pas pu.
Mon exécution est revenue vide. Qu'est-ce qui a échoué ?+
Presque certainement le proxy. Un job Crunchbase sans adresse de sortie résidentielle se voit servir un défi Cloudflare plutôt qu'une fiche, et le job se termine proprement sans rien dedans - exactement le fichier vide qu'ont produit nos propres exécutions de test. Vérifiez d'abord le proxy, et vérifiez que l'URL est bien une page d'organisation, avant de chercher ailleurs.
Puis-je trier ou limiter les entreprises ?+
Les limiter, oui. Fixez une limite par requête, ou laissez-la à zéro pour tout prendre. Ce scraper n'a pas de contrôle de tri - c'est vous qui nommez les organisations, l'ordre est donc celui que vous avez fourni.
Combien ça coûte ?+
Les 500 premières lignes sont gratuites et offertes une seule fois, sans carte bancaire. Ensuite, c'est 0,002 $ par ligne - le même tarif forfaitaire que tous les autres scrapers de la plateforme. L'estimateur affiche le coût d'une exécution avant qu'elle ne démarre. Le proxy est un coût distinct, et il est à votre charge.

Vos 500 premières entreprises,
offertes par la maison.

500 lignes gratuites une seule fois sur chaque nouveau compte - sans expiration. Ensuite, 0,002 $ par ligne, au fil de l'eau - aucune carte enregistrée tant que vous ne le décidez pas. Le proxy résidentiel, c'est vous qui l'apportez.

Activation immédiate · sans carte bancaire

Scraper les fiches d'entreprise Crunchbase à grande échelle

Le Scraper Crunchbase de Livescraper transforme une liste de pages d'organisation en données d'entreprise. Vous soumettez des URL crunchbase.com/organization/ - saisies une par ligne, ou importées en CSV, XLSX, TXT ou Parquet -, plafonnez si vous le souhaitez les lignes par requête, et téléchargez les fiches sous forme de fichier CSV, Excel ou JSON propre. Une ligne par entreprise, seize colonnes.

Chaque ligne porte la fiche telle que Crunchbase la présente : le nom et la description de l'entreprise, le site web, la date de création, l'effectif, les secteurs auxquels la fiche est associée, la ville, la région et le pays de son siège, le rang que Crunchbase lui attribue, son statut d'activité, ainsi que ses liens LinkedIn, X et Facebook et son logo. Les équipes RevOps s'en servent pour enrichir une liste d'URL d'organisation en quelque chose de segmentable. Les équipes stratégie cartographient une catégorie en alignant descriptions, secteurs et localisations. Les équipes d'investissement filtrent un pipeline sur la date de création, l'effectif et le statut d'activité avant le premier appel.

Une exigence n'est pas optionnelle et figure ici plutôt qu'enfouie. Crunchbase est protégé par Cloudflare, et ce scraper a besoin d'un proxy résidentiel pour renvoyer quoi que ce soit : sans lui, un job se termine proprement et l'export contient une ligne d'en-tête et aucune donnée. C'est le comportement qu'ont produit nos propres exécutions de test, et c'est la première chose à vérifier si une exécution revient vide. Notez aussi que ce scraper ne prend que des URL d'organisation : résoudre un nom d'entreprise ou un domaine vers la bonne fiche relève du Crunchbase Search Scraper, un service distinct.

Cette page fait aussi, délibérément, quelque chose que les pages sœurs ne font pas. Elle ne publie aucune valeur d'exemple ni aucun format pour quelque champ que ce soit - ni si la date de création est une année ou une date complète, ni si l'effectif est une tranche ou un nombre, ni quel vocabulaire utilise le statut d'activité - parce que tous les exports dont nous disposons pour ce scraper ont renvoyé zéro ligne, et qu'une valeur non observée n'est pas une valeur à imprimer. Les seize noms de colonnes sont exacts et recoupés ; tout le reste, c'est à votre première exécution en offre gratuite de vous le dire. Commencez gratuitement : vos 500 premières lignes ne coûtent rien et ne demandent aucune carte bancaire, puis c'est 0,002 $ par ligne, au forfait.