Beginne mit der Tabelle, die du wirklich brauchst

Ein Lieferantenverzeichnis, ein Preisvergleich, eine Rechercheauswahl: Nützliche Informationen beginnen oft als Tabelle auf einer Webseite. Entscheide vor dem Kopieren, welche Zeilen und Spalten in deine Ausgabe gehören. Ein sauberer Export beginnt mit einem klaren Umfang.

Prüfe, ob die Seite einen eigenen CSV- oder Tabellen-Download anbietet. Ein integrierter Export liefert oft am schnellsten vollständige Daten, besonders bei mehreren Ergebnisseiten oder verborgenen Spalten. Andernfalls kann bei einer kleinen Tabelle das Kopieren sichtbarer Zellen ausreichen.

Gehe nicht davon aus, dass die sichtbaren Informationen der vollständige Datensatz sind. Eine Seite kann beim Scrollen weitere Zeilen laden oder nur eine Ergebnisseite anzeigen. Halte Quell-URL und erfassten Tabellenbereich fest, damit du später darauf zurückkommen kannst.

Extrahiere die Tabelle mit WebAct

Das kostenlose Tool zum Extrahieren von Webseitentabellen enthält eine Beispiel-CSV und eine kopierfertige Aufgabe. Installiere WebAct, verifiziere dein Konto und wähle eine ChatGPT-Browserverbindung. Aktiviere die Erweiterung im Quelltab und wähle die Tabelle als Kontext aus.

Wechsle zu Aufgabe und füge die Extraktionsaufgabe ein. Sie verlangt ursprüngliche Überschriften und Werte, eine Spalte mit der Quell-URL und eine klare Zahl exportierter Zeilen. Beginne mit einer kleinen Tabelle mit höchstens 25 geladenen Zeilen. Prüfe die vorgeschlagenen Aktionen, führe die Aufgabe aus und kontrolliere die Datei vor dem Import.

Vergleiche die Zahl exportierter Zeilen mit den gewünschten Zeilen. Prüfe die erste, die letzte und eine Zeile mit Komma oder Anführungszeichen. Fehlende oder unlesbare Inhalte müssen gemeldet werden und dürfen nie durch Vermutungen ergänzt werden.

Prüfe die Datei in deiner Tabellenkalkulation

Nutze den Importdialog deiner Tabellenkalkulation, wenn die Daten Postleitzahlen, Produktcodes oder lange numerische IDs enthalten. Behandle diese Spalten als Text, damit führende Nullen und lange Kennungen erhalten bleiben. CSV enthält Werte und Trennzeichen, bewahrt aber keine Tabellenformatierung oder Spaltentypen.

Die Extraktionsaufgabe bittet WebAct, Zellen zu neutralisieren, die als Tabellenformeln interpretiert werden könnten, und geänderte Werte zu melden. Prüfe diese Werte vor dem Öffnen der Datei. CSV enthält weder Formatierung noch verlässliche Typinformationen.

Braucht die nächste Anwendung JSON, fordere die genauen Feldnamen und erwarteten Werttypen an. Prüfe einen vollständigen Datensatz, bevor du das Ergebnis verwendest.

Wenn Kopieren zur eigentlichen Arbeit wird

Für eine einmalige Tabelle reicht möglicherweise der integrierte Download. Speichere für wiederholte Extraktionen eine WebAct-Aufgabe mit den benötigten Spalten und dem Ausgabeformat.

Wähle bei aktivem WebAct auf der Seite den relevanten Bereich aus und bitte darum: „Extrahiere die sichtbaren Namen, Unternehmen und Funktionen als CSV. Nimm die Überschriften auf und prüfe, ob jede sichtbare Zeile enthalten ist.“ Vergleiche das Ergebnis mit der Quelle und speichere die Aufgabe, wenn du sie wiederverwenden möchtest.

Definiere klar, was „sichtbar“ bedeutet. Verborgene Zeilen, andere Seiten und ungeladene Inhalte dürfen nie als enthalten vorausgesetzt werden. Eine hilfreiche Automatisierung liefert ein prüfbares Ergebnis und erklärt die Abdeckung eindeutig.

Eine kleine Abkürzung zu dieser Anleitung

Kostenloses Tool zum Extrahieren von Webseitentabellen entdecken →. WebAct-Erweiterung und Konto erforderlich. Free umfasst 25 Automatisierungsaufgaben pro Monat; es gelten die Limits des Anbieters.

Geschrieben vom WebAct-Team. Das beschriebene Verhalten entspricht der aktuellen Implementierung; Limits des Browseranbieters und Website-Beschränkungen gelten weiterhin.