Extracteur universel par IA

Pour les sites qui n’ont
aucun extracteur à eux.

Collez l’URL de n’importe quelle page, nommez les attributs voulus - prix, description, note, tout ce que la page porte - et récupérez-les en colonnes. Aucun parseur par site à attendre : la page est lue et les champs demandés ressortent sous forme de ligne.

500 lignes gratuites, une seule foispuis 0,002 $ par ligneles colonnes que vous définissezCSV · XLSX · JSON
Comment ça marche

Donnez-lui une page
et une liste de champs.

Deux entrées et rien d’autre : où chercher, et quoi rapporter. La seconde est ce qui fait fonctionner l’outil sur un site pour lequel personne n’a écrit de parseur.

  1. ÉTAPE 1Connectez-vous à la plateforme.
  2. ÉTAPE 2Ouvrez l’Extracteur universel par IA.
  3. ÉTAPE 3Collez les URL des pages, une par ligne - ou importez un fichier CSV, XLSX, TXT ou Parquet.
  4. ÉTAPE 4Ajoutez les attributs que vous voulez extraire. Choisissez parmi les suggestions ou saisissez les vôtres.
  5. ÉTAPE 5Fixez la limite de pages par requête - elle démarre à 1, augmentez-la une fois satisfait.
  6. ÉTAPE 6Choisissez votre format de sortie, puis cliquez sur Get Data.

Chaque page est récupérée via notre pool de proxys, jamais votre IP réelle, et lue par Claude, qui en extrait les attributs que vous avez nommés.

Pourquoi les équipes l’utilisent

Un seul extracteur pour
la longue traîne.

C’est vous qui décidez des colonnes

Les attributs que vous saisissez sont le schéma. Demandez un prix et une note, vous obtenez deux colonnes ; ajoutez une description, il y en a trois. Rien ici n’a de ligne d’en-tête figée - précisément pour cela l’outil convient à des pages qui diffèrent les unes des autres.

Pas d’attente d’un parseur dédié

La plupart des sites ne seront jamais assez populaires pour obtenir un extracteur sur mesure. C’est la réponse pour ceux-là : un catalogue de fournisseur, un annuaire professionnel, une place de marché régionale - tout ce qui a les données sur la page sans personne pour maintenir un extracteur.

Le même format de fichier que le reste

Quelle que soit la façon dont vous définissez les colonnes, la sortie est le CSV, XLSX ou JSON habituel que produit le reste de la plateforme. Elle entre dans le même pipeline qu’une exécution issue de n’importe lequel de nos extracteurs à schéma figé.

Ce que vous récupérez

Il n’y a pas de liste de colonnes,
et c’est là tout l’intérêt.

Toutes les autres pages de ce site nomment un ensemble figé de colonnes. Celle-ci ne le peut pas, parce que c’est vous qui l’écrivez.

Les attributs que vous ajoutez sont la sortie. Saisissez price et rating et le fichier comporte deux colonnes portant ces noms. Le sélecteur propose quelques attributs courants pour démarrer - name, price, discount price, description, image, rating, reviews - mais le champ accepte du texte libre : la liste est un confort, pas une limite. Demandez ce que la page porte réellement.

Cette souplesse est tout le produit, et elle a une conséquence évidente : nous ne pouvons ni vous montrer un export d’exemple ni promettre ce que contiendra telle cellule, puisque les deux dépendent de la page visée et des mots choisis. Nommez les attributs comme la page les intitule elle-même, attendez-vous à une cellule vide lorsqu’une page ne porte tout simplement pas ce que vous avez demandé, et éprouvez la formulation sur deux ou trois pages avant de la lâcher sur une liste.

Une différence pratique avec le reste de la plateforme : la limite de pages démarre à 1, pas à 100. C’est une valeur par défaut sensée pour un outil que l’on est censé essayer d’abord sur une page, mais cela signifie qu’une exécution s’arrêtera après une seule page tant que vous ne l’aurez pas augmentée.

Ce qu’il accepte

N’importe quelle page,
et les champs que vous nommez.

Il n’y a pas de liste de sites pris en charge à vérifier, parce qu’il n’y a pas de parseur par site. Les deux entrées obligatoires sont les URL et les attributs que vous voulez en tirer.

N’importe quelle URL, une par ligne Attributs à extraire (obligatoire) Suggérés : name · price · description Ou saisissez votre propre attribut Import CSV · XLSX · TXT · Parquet Limite de pages par requête (démarre à 1) Lu par Claude Jamais votre IP réelle
Cas d’usage courants

Trois tâches que l’on
exécute le plus souvent ici.

Quelques exemples de ce à quoi sert réellement un extracteur sans schéma figé.

Longue traîne

Extraire un site pour lequel personne n’a bâti de parseur

Une place de marché régionale, l’annuaire d’une fédération, le catalogue d’un fabricant. Les données sont sur la page et il n’existe aucun outil dédié - nommez les champs dont vous avez besoin et prenez-les.

Recherche · Couverture
Prototypage

Tester une idée avant de s’y engager

Visez une poignée de pages avec une liste d’attributs approximative et voyez si les données dont vous avez besoin s’y trouvent seulement. C’est un premier pas moins coûteux que de spécifier un extracteur sur mesure pour une source non validée.

Exploration · Faisabilité
Formes atypiques

Récupérer le champ que l’export standard laisse de côté

Parfois un extracteur dédié renvoie presque tout ce que vous voulez. Visez les mêmes pages avec celui-ci, demandez uniquement l’attribut manquant, et rattachez le résultat par l’URL.

Enrichissement · Comblement
Tarifs

Ne payez que les lignes
que vous tirez réellement.

Pas d’abonnement, pas de minimum, pas de facture récurrente. Vos 500 premières lignes sont offertes - ensuite, paiement à l’usage, au même tarif forfaitaire que tous les autres extracteurs ici.

Offre gratuite

500 lignes gratuites - 0 $

Sur chaque nouveau compte, en une seule fois. Aucune carte requise. Listes d’attributs personnalisées, import de fichier et tous les formats d’export inclus.

0 $ pour toujours
Paiement à l’usage

0,002 $ par ligne, après l’offre gratuite

Le même tarif forfaitaire que le reste de la plateforme. L’estimateur préalable affiche le nombre de lignes et le coût en crédits avant le démarrage d’une exécution - pas de facture surprise, pas d’unités de calcul à convertir.

Le plus populaire
Volume

Sur mesure · gros volumes

Tarifs dégressifs, workers dédiés et un SLA pour traiter de grandes listes de pages de façon planifiée. Donnez-nous vos chiffres et nous chiffrons.

Parlons-en
10 % de remise sur votre première exécution payante.Utilisez le code LIVESCRAPER10 au paiement.
S’inscrire
Préférez ceux-ci quand ils conviennent

Un extracteur dédié
vaut mieux qu’un généraliste.

Cet outil existe pour les sites sans extracteur sur mesure. Là où il en existe un, c’est le meilleur choix - il connaît les particularités du site et livre un ensemble de colonnes documenté.

Le volet juridique

Est-il légal d’extraire
n’importe quelle page ?

Réponse courte : cela dépend entièrement de la page - c’est la réponse honnête pour un outil sans cible fixe, et elle place davantage de jugement entre vos mains que nos autres extracteurs.

Tous les autres extracteurs d’ici visent un site : nous pouvons donc vous dire ce qu’ils collectent et ce que disent les conditions de ce site. Celui-ci vise là où vous l’envoyez, nous ne pouvons donc pas faire cette appréciation à votre place. L’exécution récupère la page comme le ferait un visiteur ordinaire, via notre pool de proxys et jamais votre IP réelle, et lit ce qui s’y trouve - elle ne se connecte pas, ne contourne pas de péage et n’atteint rien qu’un visiteur ne pourrait voir. Au-delà, savoir si telle page peut faire l’objet d’une collecte est une question portant sur ses conditions et sur votre finalité, et c’est à vous d’y répondre avant d’y pointer l’outil.

Soyez délibéré sur les attributs que vous demandez. Un extracteur généraliste renverra tout ce que vous nommez, y compris des éléments qui sont des données personnelles - le nom d’une personne, une adresse e-mail, un numéro de téléphone. Les demander transforme une simple récupération de page en traitement de données personnelles, et dans l’UE et au Royaume-Uni cela amène le RGPD avec vous comme responsable de traitement : une base légale, la transparence sur l’origine des données, le respect des oppositions et des effacements. L’outil ne vous arrêtera pas ; l’obligation est la vôtre.

Nous n’exécutons aucun traceur tiers sur la couche de données, et vos exports s’auto-suppriment au bout de 30 jours. Si vous avez un doute sur une source ou un champ, prenez conseil avant de monter en volume plutôt qu’après.

livescraper.app · principes
Récupère les pages comme le ferait un visiteur
Ni connexion, ni péage, aucun compte touché
Jamais votre IP réelle
Les exports s’effacent automatiquement (30 jours)
Vous choisissez la cible - et assumez ce jugement!
Vérifiez les conditions de la source avant de monter en volume.
Questions fréquentes

Ce que l’on demande
avant de s’inscrire.

Les questions que l'on nous pose le plus. Autre chose ? Parlons-en - ce sont des humains, pas des bots, qui rédigent les réponses.

Comment utiliser l’Extracteur universel par IA ?+
Connectez-vous à la plateforme. Ouvrez l’Extracteur universel par IA. Collez les URL des pages, une par ligne - ou importez un fichier CSV, XLSX, TXT ou Parquet. Ajoutez les attributs que vous voulez extraire, en choisissant parmi les suggestions ou en saisissant les vôtres. Fixez la limite de pages par requête. Choisissez votre format de sortie, puis cliquez sur Get Data.
Quelles colonnes vais-je obtenir ?+
Celles que vous demandez. Les attributs que vous ajoutez sont le schéma de sortie : saisissez price et rating et votre fichier comporte deux colonnes portant ces noms. C’est pourquoi cette page n’a pas de dictionnaire de données - contrairement à tous les autres extracteurs d’ici, il n’y a pas d’ensemble figé de colonnes à publier, puisque vous l’écrivez au moment de l’exécution.
Quels attributs puis-je demander ?+
Tout ce que la page porte. Le sélecteur propose name, price, discount price, description, image, rating et reviews pour démarrer, mais le champ accepte du texte libre : ce sont donc un confort et non une limite. Nommez les attributs comme la page les intitule elle-même et vous obtiendrez de meilleurs résultats qu’avec un terme abstrait.
Que se passe-t-il si une page n’a pas l’attribut demandé ?+
Attendez-vous à une cellule vide pour cette ligne. L’outil lit ce qui est sur la page - il ne va pas chercher ailleurs et n’infère pas une valeur absente. C’est bon à retenir quand vous pointez une même liste d’attributs vers un ensemble de pages qui n’ont pas toutes la même forme.
Quels sites sont pris en charge ?+
Il n’y a pas de liste de sites pris en charge, parce qu’il n’y a pas de parseur par site. C’est tout l’intérêt : l’outil est bâti pour la longue traîne des sites qui n’auront jamais d’extracteur dédié. Là où il en existe un - Google Maps, Amazon et le reste de notre catalogue - ce sera le choix le plus prévisible.
Pourquoi la limite de pages démarre-t-elle à 1 ?+
Parce que c’est un outil que l’on est censé essayer d’abord sur une seule page : la valeur par défaut garde donc une première exécution petite et peu coûteuse. Cela signifie toutefois qu’une exécution s’arrête après une page tant que vous ne l’augmentez pas, ce qui surprend ceux qui ont l’habitude du 100 par défaut de nos autres extracteurs.
Puis-je faire confiance à l’extraction sans la vérifier ?+
Vérifiez-la. Nous n’avons jamais publié de chiffre de précision pour cet outil et nous n’allons pas en inventer un - sa qualité dépend de la page et de la façon dont vous formulez les attributs. Faites-le tourner sur deux ou trois pages représentatives, lisez la sortie à côté de la page, ajustez la formulation, et seulement ensuite pointez-le vers une longue liste. Ce sont cinq minutes qui évitent un mauvais jeu de données.
Combien ça coûte ?+
Les 500 premières lignes sont gratuites et offertes une seule fois, sans carte bancaire. Ensuite, c'est 0,002 $ par ligne - le même tarif forfaitaire que tous les autres scrapers de la plateforme. L'estimateur affiche le coût d'une exécution avant qu'elle ne démarre.

Le site dont vous avez besoin
n’a aucun extracteur. Tant mieux.

Vos 500 premières lignes sont gratuites - sans carte, sans abonnement. Ensuite c’est 0,002 $ par ligne, au forfait.

Activation instantanée · sans carte bancaire

Extraire n’importe quelle page avec un schéma sur mesure

La plupart des outils d’extraction se construisent site par site. Quelqu’un étudie le balisage d’une page, écrit un extracteur et publie un ensemble figé de colonnes - ce qui marche à merveille pour la poignée de sites assez gros pour justifier l’effort, et pas du tout pour tout le reste. L’Extracteur universel par IA est fait pour tout le reste. Vous lui donnez des URL de pages et une liste des attributs voulus, chaque page est récupérée via notre pool de proxys et lue par Claude, et les attributs que vous avez nommés reviennent comme les colonnes d’un fichier CSV, XLSX ou JSON ordinaire.

C’est pourquoi cette page n’a pas de dictionnaire de données. Toutes les autres pages produit de ce site publient une ligne d’en-tête figée ; celle-ci ne le peut pas, puisque vous écrivez le schéma au moment de l’exécution. Saisissez price et rating et votre fichier comporte deux colonnes portant ces noms. Le sélecteur propose une poignée d’attributs courants - name, price, discount price, description, image, rating, reviews - mais le champ accepte du texte libre : demandez ce que la page porte réellement.

Cette souplesse a un coût qu’il vaut mieux énoncer clairement. Comme la cible et le schéma sont tous deux les vôtres, nous ne pouvons ni vous montrer un export d’exemple ni promettre ce que contiendra telle cellule, et nous ne publions aucun chiffre de précision. Le conseil pratique est celui qu’on donnerait à un collègue : nommez les attributs comme la page les intitule, attendez-vous à une cellule vide là où une page ne porte simplement pas ce que vous avez demandé, et validez la formulation sur deux ou trois pages représentatives avant de la pointer vers une longue liste. Notez aussi que la limite de pages démarre à 1 plutôt qu’aux 100 par défaut de nos autres extracteurs.

Là où un extracteur dédié existe déjà pour votre source, utilisez-le : il connaît les particularités de ce site et livre un ensemble de colonnes documenté. Celui-ci mérite sa place sur les sites pour lesquels personne n’a bâti de parseur, et n’en bâtira probablement jamais. Commencez gratuitement : vos 500 premières lignes ne coûtent rien et ne demandent pas de carte, et ensuite c’est 0,002 $ par ligne, au forfait.