Datenextraktion aus Seiten

Links aus Webseiten extrahieren – kostenlos.

Liste eindeutige Linkziele und ihre Ankertexte auf, ohne die Links aufzurufen.

Beginne mit eine geöffnete Seite mit gewöhnlichen Links.

Chrome-Erweiterung und Konto erforderlich.
25 kostenlose Automatisierungsaufgaben pro Monat. Die Limits des Browser-Anbieters gelten.

Eine Aufgabe. Ein nützliches Ergebnis.BEISPIEL
Illustrative input · supplied source facts
Page URL: https://example.com/ About links to /about Pricing links to /pricing
CSV-Datei, bereit zur Prüfung.Eine separate Datei. Die Quelle bleibt unverändert.
Beispiel-CSV herunterladen ↓
Beispiele für Eingabe und Ausgabe. Führe die Aufgabe in der Erweiterung auf deiner eigenen Seite aus.
VON DEINER SEITE ZUM NÄCHSTEN SCHRITT

Drei einfache Schritte.

  1. 01

    WebAct vorbereiten.

    Installiere die Chrome-Erweiterung und bestätige dein WebAct-Konto. Wähle Browsermodell → ChatGPT und melde dich an, wenn du dazu aufgefordert wirst.

  2. 02

    Passende Inhalte auswählen.

    Öffne diese Quelle: eine geöffnete Seite mit gewöhnlichen Links. Aktiviere WebAct über die Symbolleiste, wähle den relevanten Kontext und wechsle in den Aufgabenmodus.

  3. 03

    Einfügen. Ausführen. Prüfen.

    Prüfe die vorgeschlagenen Aktionen, führe die Aufgabe aus und gleiche das Ergebnis vor der Verwendung mit der Quelle ab.

Was du mitbringst.

eine geöffnete Seite mit gewöhnlichen Links.

Was du erhältst.

Liste eindeutige Linkziele und ihre Ankertexte auf, ohne die Links aufzurufen. CSV-Datei.

Den Umfang klar begrenzen.

Ein aktiver Tab; beginne mit bis zu 25 Datensätzen oder einem kurzen Dokument. Erzeugte Dateien müssen unter 48.000 UTF-8-Bytes bleiben. Auch die schreibgeschützte Seitenprüfung erfordert eine ausdrückliche Freigabe.

BEREIT, WENN DU ES BIST

Überlass die Routinearbeit WebAct.

Kopiere diese Aufgabe und füge sie auf deiner Quellseite in WebAct ein.

Links aus Webseiten extrahierenAUFGABE
Arbeite ausschließlich mit dieser Quelle: eine geöffnete Seite mit gewöhnlichen Links. Liste eindeutige Linkziele und ihre Ankertexte auf, ohne die Links aufzurufen. Erstelle eine CSV-Datei namens webact-webpage-link-extractor.csv. Halte die gesamte Datei in UTF-8 unter 48.000 Byte. Schlage bei Bedarf eine schreibgeschützte run_js-Prüfung des aktuellen Dokuments vor und hole meine ausdrückliche Zustimmung ein. Rufe keine URLs ab, greife nicht auf Zugangsdaten zu, führe keinen entfernten Code aus und ändere keine Seiteninhalte. Verwende nur beobachtete Inhalte und Fakten, die ich bereitstelle. Lass fehlende Werte unbekannt. Behalte IDs, Datumsangaben, Einheiten und Währungen bei. Gib ausgelassene, abgeschnittene oder unlesbare Inhalte an; behaupte keine vollständige Abdeckung. Prüfe die Ausgabe anhand der Quelle und halte an, wenn die erforderliche Eingabe nicht verfügbar ist. Verwende eine Kopfzeile, einheitliche Spalten, korrekt maskierte Anführungszeichen und wörtlichen Text, der in der Tabellenkalkulation nicht als Formel ausgeführt wird. Frage mich vor dem Start nach fehlenden erforderlichen Einstellungen oder Quelldaten. Beginne mit bis zu 25 Datensätzen oder einem kurzen Dokument. Gib genau an, welche Quellinhalte enthalten sind. Vorbereitung: Gib an, ob du alle sichtbaren Links oder nur die eines ausgewählten Bereichs benötigst. Lege den Umgang mit Duplikaten ausdrücklich fest.

Im Aufgabenmodus einfügen; Browsermodell muss ausgewählt sein.

Passe die Aufgabe an. Gib an, ob du alle sichtbaren Links oder nur die eines ausgewählten Bereichs benötigst. Lege den Umgang mit Duplikaten ausdrücklich fest.

EIN PAAR NÜTZLICHE DETAILS

Bevor du loslegst.

Zwei absolute URLs mit den Beschriftungen About und Pricing.

Chat oder Aufgabe? Wähle deinen Modus
Welche Eingaben benötigt „Links aus Webseiten extrahieren“?

eine geöffnete Seite mit gewöhnlichen Links. Klappe die relevanten Inhalte auf und teile nur den Kontext, der für diese Aufgabe nötig ist.

Was sollte ich am Ergebnis prüfen?

Zwei absolute URLs mit den Beschriftungen About und Pricing. Nur die ausgewählten sichtbaren Inhalte werden einbezogen. Fehlende Fakten bleiben unbekannt; prüfe das Ergebnis vor der Nutzung.

Erfasst dies eine ganze Website?

Arbeite mit einer kleinen Auswahl im aktivierten Tab. Verborgene Datensätze, verlinkte Seiten und nicht geladene Inhalte sind nicht Teil dieser Anleitung. Wähle einen lesbaren Bereich und prüfe den Umfang des Exports.

Kann ich das im kostenlosen Tarif nutzen?

Ja. Installiere die Chrome-Erweiterung, bestätige dein WebAct-Konto und nutze eine verfügbare ChatGPT-Browserverbindung im selben Chrome-Profil. Der kostenlose Tarif enthält 25 von dir gestartete Automatisierungsaufgaben pro Kalendermonat (UTC), gemeinsam für alle Tools. Eine Aufgabe zählt, sobald ihre erste Aktion startet; Schritte und notwendige Wiederholungen zählen nicht zusätzlich. Anbieterlimits gelten. Nach 25 Aufgaben kannst du upgraden oder auf die Zurücksetzung warten.

Führt diese Seite die Aufgabe aus?

Diese Seite zeigt ein Beispiel und eine Aufgabe zum Kopieren. Führe sie mit WebAct auf der aktivierten Quellseite aus. Dein KI-Anbieter im Browser verarbeitet den ausgewählten Seitenkontext. Eine normale Chatantwort verbraucht kein WebAct-Aufgabenkontingent; das Erstellen einer Datei oder Ändern von Feldern im Aufgabenmodus dagegen schon.

Wie wir geteilten Seitenkontext verarbeiten, erfährst du in unserer Datenschutzerklärung.

EINE ROUTINEAUFGABE WENIGER

Etwas mehr Freiraum für deine Arbeit.

Nutze WebAct direkt auf der Seite, auf der du gerade arbeitest.

WebAct installieren