Extraction de données de pages

Extraction de liens d’une page web — outil gratuit.

Listez les destinations de liens uniques et leur texte d'ancrage, sans les ouvrir.

Commencez avec une page ouverte contenant des liens classiques.

Extension Chrome et compte requis.
25 tâches d’automatisation gratuites par mois. Les limites du fournisseur dans le navigateur s’appliquent.

Une tâche. Un résultat utile.EXEMPLE
Illustrative input · supplied source facts
Page URL: https://example.com/ About links to /about Pricing links to /pricing
Fichier CSV prêt à vérifier.Un fichier distinct. La source reste inchangée.
Télécharger l’exemple CSV ↓
Exemples de données d’entrée et de résultat. Exécutez la tâche dans l’extension sur votre propre page.
DE VOTRE PAGE À LA PROCHAINE ÉTAPE

Trois étapes simples.

  1. 01

    Préparez WebAct.

    Installez l’extension Chrome et vérifiez votre compte WebAct. Choisissez Modèle via le navigateur → ChatGPT, puis connectez-vous si nécessaire.

  2. 02

    Sélectionnez le contenu utile.

    Ouvrez cette source : une page ouverte contenant des liens classiques. Activez WebAct depuis la barre d'outils, sélectionnez le contexte pertinent et passez en mode Tâche.

  3. 03

    Collez. Lancez. Vérifiez.

    Vérifiez les actions proposées, lancez la tâche, puis comparez le résultat à la source avant de l’utiliser.

Ce que vous fournissez.

une page ouverte contenant des liens classiques.

Ce que vous obtenez.

Listez les destinations de liens uniques et leur texte d'ancrage, sans les ouvrir. Fichier CSV.

Gardez un périmètre précis.

Un onglet actif ; commencez avec 25 enregistrements au maximum ou un document court. Les fichiers générés doivent rester sous 48 000 octets UTF-8. L’inspection de la page en lecture seule nécessite une approbation explicite.

QUAND VOUS VOULEZ

Confiez les tâches répétitives à WebAct.

Copiez cette tâche et collez-la dans WebAct sur la page source.

Extraction de liens d’une page webTÂCHE
Travaillez uniquement à partir de cette source : une page ouverte contenant des liens classiques. Listez les destinations de liens uniques et leur texte d'ancrage, sans les ouvrir. Créez un fichier CSV nommé webact-webpage-link-extractor.csv. Le fichier complet doit peser moins de 48 000 octets en UTF-8. Si nécessaire, proposez une inspection en lecture seule du document actuel avec run_js, soumise à mon accord explicite. Ne récupérez pas d’URL, n’accédez pas aux identifiants, n’exécutez pas de code distant et ne modifiez pas le contenu de la page. Utilisez uniquement le contenu observé et les faits que je fournis. Laissez les valeurs manquantes inconnues. Conservez les identifiants, dates, unités et devises. Signalez les contenus omis, tronqués ou illisibles ; n’affirmez pas que tout est couvert. Vérifiez le résultat par rapport à la source et arrêtez-vous si les données nécessaires ne sont pas disponibles. Conservez une seule ligne d’en-tête, des colonnes cohérentes, des guillemets échappés et du texte littéral qui ne s’exécute pas comme une formule dans un tableur. Avant de commencer, demandez-moi les réglages nécessaires ou les faits source manquants. Commencez avec 25 éléments maximum ou un document court. Indiquez précisément le contenu source inclus. Préparation : Précisez si vous voulez tous les liens visibles ou seulement ceux d’une zone sélectionnée. Indiquez explicitement comment traiter les doublons.

Collez en mode Tâche, avec Modèle via le navigateur sélectionné.

Adaptez la tâche à vos besoins. Précisez si vous voulez tous les liens visibles ou seulement ceux d’une zone sélectionnée. Indiquez explicitement comment traiter les doublons.

QUELQUES PRÉCISIONS UTILES

Avant de commencer.

Deux URL absolues avec les libellés About et Pricing.

Chat ou Tâche ? Choisissez votre mode
Quelles données fournir pour « Extraction de liens d’une page web » ?

une page ouverte contenant des liens classiques. Développez le contenu utile et ne partagez que le contexte nécessaire à cette tâche.

Que faut-il vérifier dans le résultat ?

Deux URL absolues avec les libellés About et Pricing. Seul le contenu visible sélectionné est inclus. Les faits manquants restent inconnus ; vérifiez le résultat avant de l'utiliser.

Cet outil collecte-t-il un site entier ?

Travaillez sur une petite sélection dans l’onglet activé. Les enregistrements masqués, les pages liées et les contenus non chargés ne sont pas inclus. Sélectionnez une zone lisible et vérifiez le périmètre de l’export.

Puis-je l’utiliser avec l’offre gratuite ?

Oui. Installez l’extension Chrome, vérifiez votre compte WebAct et utilisez une connexion ChatGPT disponible dans le même profil Chrome. L’offre gratuite comprend 25 tâches d’automatisation lancées par l’utilisateur par mois civil (UTC), partagées entre tous les outils. Une tâche est décomptée au démarrage de sa première action ; ses étapes et nouvelles tentatives nécessaires ne sont pas décomptées séparément. Les limites du fournisseur s’appliquent. Après 25 tâches, passez à une offre payante ou attendez le renouvellement.

Cette page exécute-t-elle la tâche ?

Cette page propose un exemple et une consigne à copier. Exécutez-la avec WebAct sur la page source que vous activez. Le contexte sélectionné est traité par votre fournisseur d’IA via le navigateur. Une réponse classique dans le chat ne consomme pas votre quota d’automatisation WebAct ; créer un fichier ou modifier des champs en mode Tâche, oui.

Découvrez comment nous traitons le contexte de page partagé dans notre politique de confidentialité.

UNE TÂCHE RÉPÉTITIVE EN MOINS

Un peu plus de place pour votre travail.

Retrouvez WebAct sur la page où vous travaillez déjà.

Installer WebAct