Empieza por la tabla que realmente necesitas
Un directorio de proveedores, una comparación de precios, una selección para investigar: la información útil suele empezar en una tabla de una web. Antes de copiar nada, decide qué filas y columnas necesitas en el resultado. Una exportación limpia empieza con un alcance claro.
Comprueba si la página ofrece su propia descarga en CSV o de hoja de cálculo. Una exportación nativa suele ser la forma más rápida de obtener los datos completos, sobre todo con paginación o columnas ocultas. Si no existe, copiar las celdas visibles puede funcionar bien para una tabla pequeña.
No supongas que lo que ves es todo el conjunto de datos. Una página puede cargar más filas al desplazarte o mostrar solo una página de resultados. Guarda la URL de origen y la parte de la tabla capturada para poder volver a consultarla.
Extrae la tabla con WebAct
El extractor gratuito de tablas web incluye un CSV de ejemplo y una tarea lista para copiar. Instala WebAct, verifica tu cuenta y elige una conexión a ChatGPT en el navegador. Activa la extensión en la pestaña de origen y selecciona la tabla como contexto.
Cambia al modo Tarea y pega la tarea de extracción. Pide conservar los encabezados y valores originales, añadir una columna con la URL de origen y contar claramente las filas exportadas. Empieza con una tabla pequeña de hasta 25 filas cargadas. Revisa las acciones propuestas, ejecuta la tarea y comprueba el archivo antes de importarlo.
Compara el número de filas exportadas con las que querías capturar. Inspecciona la primera, la última y alguna que contenga una coma o comillas. El contenido ausente o ilegible debe señalarse, nunca rellenarse con suposiciones.
Comprueba el archivo en tu hoja de cálculo
Usa el proceso de importación de tu hoja de cálculo cuando haya códigos postales, códigos de producto o identificadores numéricos largos. Trata esas columnas como texto para conservar los ceros iniciales y los identificadores grandes. Un CSV contiene valores y separadores, pero no conserva el formato de la hoja ni los tipos de columna.
La tarea de extracción pide a WebAct neutralizar las celdas que podrían interpretarse como fórmulas e informar de los valores modificados. Comprueba esos valores antes de abrir el archivo. CSV no incluye formato ni información fiable de tipos.
Si la siguiente aplicación necesita JSON, pide los nombres de campo y tipos de valor exactos que espera. Comprueba un registro completo antes de usar el resultado.
Cuando copiar se convierte en el trabajo
Para una tabla puntual, una descarga nativa puede bastar. Si repites la extracción, guarda una tarea de WebAct con las columnas y el formato de salida que necesites.
Con WebAct activo en la página, selecciona la zona relevante y pide: «Extrae los nombres, empresas y cargos visibles a un CSV. Incluye los encabezados y comprueba que estén todas las filas visibles». Contrasta el resultado con la fuente y guarda la tarea si quieres reutilizarla.
Sé preciso al decir «visible». Nunca supongas que se incluyen filas ocultas, otras páginas o contenido que el navegador no ha cargado. Una automatización útil ofrece un resultado comprobable y explica claramente qué abarca.
Un pequeño atajo para esta guía
Explora el extractor gratuito de tablas web →. Necesitas la extensión y una cuenta de WebAct. Free incluye 25 tareas de automatización al mes; se aplican los límites del proveedor.