Commencez par le tableau dont vous avez besoin
Un annuaire de fournisseurs, un comparatif de prix, une sélection de recherche : les informations utiles commencent souvent dans un tableau sur une page web. Avant de copier quoi que ce soit, décidez quelles lignes et colonnes doivent figurer dans le résultat. Un export propre commence par un périmètre clair.
Vérifiez si la page propose son propre téléchargement CSV ou tableur. Un export natif est souvent le moyen le plus rapide d’obtenir toutes les données, surtout avec une pagination ou des colonnes masquées. Sinon, copier les cellules visibles peut convenir à un petit tableau.
Ne supposez pas que les informations visibles constituent l’ensemble des données. La page peut charger d’autres lignes au défilement ou n’afficher qu’une page de résultats. Notez l’URL source et la partie du tableau capturée pour y revenir plus tard.
Extrayez le tableau avec WebAct
L’extracteur gratuit de tableaux web comprend un exemple CSV et une tâche à copier. Installez WebAct, vérifiez votre compte et choisissez une connexion à ChatGPT dans le navigateur. Activez l’extension dans l’onglet source et sélectionnez le tableau comme contexte.
Passez en mode Tâche et collez la tâche d’extraction. Elle demande les en-têtes et valeurs d’origine, une colonne d’URL source et un nombre clair de lignes exportées. Commencez par un petit tableau de 25 lignes chargées au maximum. Examinez les actions proposées, exécutez la tâche et vérifiez le fichier avant l’import.
Comparez le nombre de lignes exportées à celles que vous souhaitiez capturer. Examinez la première, la dernière et une ligne contenant une virgule ou un guillemet. Le contenu absent ou illisible doit être signalé, jamais complété par supposition.
Vérifiez le fichier dans votre tableur
Utilisez l’assistant d’import de votre tableur si les données contiennent des codes postaux, codes produit ou longs identifiants numériques. Traitez ces colonnes comme du texte pour conserver les zéros initiaux et les grands identifiants. Un CSV contient des valeurs et des séparateurs, mais ne conserve ni la mise en forme du tableur ni les types de colonnes.
La tâche d’extraction demande à WebAct de neutraliser les cellules pouvant être interprétées comme des formules et de signaler les valeurs modifiées. Vérifiez ces valeurs avant d’ouvrir le fichier. CSV ne contient ni mise en forme ni information fiable sur les types.
Si l’application suivante attend du JSON, demandez les noms de champs et les types de valeurs exacts qu’elle exige. Vérifiez un enregistrement complet avant d’utiliser le résultat.
Quand copier devient un travail en soi
Pour un tableau ponctuel, un téléchargement natif peut suffire. Pour des extractions répétées, enregistrez une tâche WebAct avec les colonnes et le format de sortie souhaités.
Avec WebAct actif sur la page, sélectionnez la zone pertinente et demandez : « Extrayez les noms, entreprises et postes visibles en CSV. Incluez les en-têtes et vérifiez que toutes les lignes visibles sont présentes. » Comparez le résultat à la source, puis enregistrez la tâche si vous souhaitez la réutiliser.
Soyez précis sur le terme « visible ». Ne supposez jamais que les lignes masquées, les autres pages et le contenu non chargé par le navigateur sont inclus. Une automatisation utile fournit un résultat vérifiable et explique clairement sa couverture.
Un petit raccourci pour ce guide
Découvrez l’extracteur gratuit de tableaux web →. L’extension et un compte WebAct sont requis. Free comprend 25 tâches d’automatisation par mois ; les limites du fournisseur s’appliquent.