Extraction de données de pages

Extraction d’URL d’images d’une page web — outil gratuit.

Exportez les URL, textes alternatifs et dimensions des images chargées, sans télécharger les images.

Commencez avec les images du document actuel, inspectées avec du code de page autorisé.

Extension Chrome et compte requis.
25 tâches d’automatisation gratuites par mois. Les limites du fournisseur dans le navigateur s’appliquent.

Une tâche. Un résultat utile.EXEMPLE
Illustrative input · supplied source facts
Page: https://example.com/catalog <img src="/bag.jpg" alt="Canvas bag" width="640" height="480">
Fichier CSV prêt à vérifier.Un fichier distinct. La source reste inchangée.
Télécharger l’exemple CSV ↓
Exemples de données d’entrée et de résultat. Exécutez la tâche dans l’extension sur votre propre page.
DE VOTRE PAGE À LA PROCHAINE ÉTAPE

Trois étapes simples.

  1. 01

    Préparez WebAct.

    Installez l’extension Chrome et vérifiez votre compte WebAct. Choisissez Modèle via le navigateur → ChatGPT, puis connectez-vous si nécessaire.

  2. 02

    Sélectionnez le contenu utile.

    Ouvrez cette source : les images du document actuel, inspectées avec du code de page autorisé. Activez WebAct depuis la barre d'outils, sélectionnez le contexte pertinent et passez en mode Tâche.

  3. 03

    Collez. Lancez. Vérifiez.

    Vérifiez les actions proposées, lancez la tâche, puis comparez le résultat à la source avant de l’utiliser.

Ce que vous fournissez.

les images du document actuel, inspectées avec du code de page autorisé.

Ce que vous obtenez.

Exportez les URL, textes alternatifs et dimensions des images chargées, sans télécharger les images. Fichier CSV.

Gardez un périmètre précis.

Un onglet actif ; commencez avec 25 enregistrements au maximum ou un document court. Les fichiers générés doivent rester sous 48 000 octets UTF-8. L’inspection de la page en lecture seule nécessite une approbation explicite.

QUAND VOUS VOULEZ

Confiez les tâches répétitives à WebAct.

Copiez cette tâche et collez-la dans WebAct sur la page source.

Extraction d’URL d’images d’une page webTÂCHE
Travaillez uniquement à partir de cette source : les images du document actuel, inspectées avec du code de page autorisé. Exportez les URL, textes alternatifs et dimensions des images chargées, sans télécharger les images. Créez un fichier CSV nommé webact-webpage-image-url-extractor.csv. Le fichier complet doit peser moins de 48 000 octets en UTF-8. Si nécessaire, proposez une inspection en lecture seule du document actuel avec run_js, soumise à mon accord explicite. Ne récupérez pas d’URL, n’accédez pas aux identifiants, n’exécutez pas de code distant et ne modifiez pas le contenu de la page. Utilisez uniquement le contenu observé et les faits que je fournis. Laissez les valeurs manquantes inconnues. Conservez les identifiants, dates, unités et devises. Signalez les contenus omis, tronqués ou illisibles ; n’affirmez pas que tout est couvert. Vérifiez le résultat par rapport à la source et arrêtez-vous si les données nécessaires ne sont pas disponibles. Exporte les URL d’images et les métadonnées existantes ; ne fournit aucune licence et ne télécharge pas les images. Conservez une seule ligne d’en-tête, des colonnes cohérentes, des guillemets échappés et du texte littéral qui ne s’exécute pas comme une formule dans un tableur. Avant de commencer, demandez-moi les réglages nécessaires ou les faits source manquants. Commencez avec 25 éléments maximum ou un document court. Indiquez précisément le contenu source inclus.

Collez en mode Tâche, avec Modèle via le navigateur sélectionné.

Adaptez la tâche à vos besoins. Précisez les champs, le ton ou le niveau de détail souhaités. Conservez les faits d’origine et signalez les éléments à vérifier.

QUELQUES PRÉCISIONS UTILES

Avant de commencer.

Une URL d’image résolue et son texte alternatif existant.

Chat ou Tâche ? Choisissez votre mode
Quelles données fournir pour « Extraction d’URL d’images d’une page web » ?

les images du document actuel, inspectées avec du code de page autorisé. Développez le contenu utile et ne partagez que le contexte nécessaire à cette tâche.

Que faut-il vérifier dans le résultat ?

Une URL d’image résolue et son texte alternatif existant. Exporte les URL d’images et les métadonnées existantes ; ne fournit aucune licence et ne télécharge pas les images.

Cet outil collecte-t-il un site entier ?

Travaillez sur une petite sélection dans l’onglet activé. Les enregistrements masqués, les pages liées et les contenus non chargés ne sont pas inclus. Sélectionnez une zone lisible et vérifiez le périmètre de l’export.

Puis-je l’utiliser avec l’offre gratuite ?

Oui. Installez l’extension Chrome, vérifiez votre compte WebAct et utilisez une connexion ChatGPT disponible dans le même profil Chrome. L’offre gratuite comprend 25 tâches d’automatisation lancées par l’utilisateur par mois civil (UTC), partagées entre tous les outils. Une tâche est décomptée au démarrage de sa première action ; ses étapes et nouvelles tentatives nécessaires ne sont pas décomptées séparément. Les limites du fournisseur s’appliquent. Après 25 tâches, passez à une offre payante ou attendez le renouvellement.

Cette page exécute-t-elle la tâche ?

Cette page propose un exemple et une consigne à copier. Exécutez-la avec WebAct sur la page source que vous activez. Le contexte sélectionné est traité par votre fournisseur d’IA via le navigateur. Une réponse classique dans le chat ne consomme pas votre quota d’automatisation WebAct ; créer un fichier ou modifier des champs en mode Tâche, oui.

Découvrez comment nous traitons le contexte de page partagé dans notre politique de confidentialité.

UNE TÂCHE RÉPÉTITIVE EN MOINS

Un peu plus de place pour votre travail.

Retrouvez WebAct sur la page où vous travaillez déjà.

Installer WebAct