Comece pela tabela de que você realmente precisa

Um diretório de fornecedores, uma comparação de preços, uma lista para pesquisa: informações úteis muitas vezes começam em uma tabela na web. Antes de copiar, decida quais linhas e colunas devem estar no resultado. Uma boa exportação começa com um escopo claro.

Veja se a página oferece seu próprio download em CSV ou planilha. A exportação nativa costuma ser a forma mais rápida de obter dados completos, principalmente com paginação ou colunas ocultas. Se não houver, copiar as células visíveis pode funcionar bem para uma tabela pequena.

Não presuma que as informações visíveis sejam o conjunto completo de dados. A página pode carregar mais linhas ao rolar ou mostrar apenas uma página de resultados. Registre a URL de origem e a parte capturada da tabela para consultar depois.

Extraia a tabela com o WebAct

O extrator gratuito de tabelas de sites inclui um CSV de exemplo e uma tarefa pronta para copiar. Instale o WebAct, verifique sua conta e escolha uma conexão com o ChatGPT no navegador. Ative a extensão na aba de origem e selecione a tabela como contexto.

Mude para o modo Tarefa e cole a tarefa de extração. Ela pede os cabeçalhos e valores originais, uma coluna com a URL de origem e uma contagem clara de linhas exportadas. Comece com uma tabela pequena de até 25 linhas carregadas. Revise as ações propostas, execute a tarefa e confira o arquivo antes de importar.

Compare a contagem de linhas exportadas com as que pretendia capturar. Examine a primeira, a última e uma linha com vírgula ou aspas. Conteúdo ausente ou ilegível deve ser informado, nunca preenchido por suposição.

Confira o arquivo na planilha

Use o processo de importação da planilha quando os dados tiverem códigos postais, códigos de produto ou IDs numéricos longos. Trate essas colunas como texto para manter zeros à esquerda e identificadores grandes. Um CSV contém valores e separadores, mas não preserva a formatação da planilha nem os tipos das colunas.

A tarefa de extração pede ao WebAct para neutralizar células que possam ser interpretadas como fórmulas de planilha e informar os valores alterados. Confira esses valores antes de abrir o arquivo. CSV não contém formatação nem informações confiáveis de tipo.

Se o próximo aplicativo precisar de JSON, peça os nomes exatos dos campos e os tipos de valor esperados. Confira um registro completo antes de usar o resultado.

Quando copiar vira o trabalho

Para uma tabela pontual, o download nativo pode bastar. Para extrações repetidas, salve uma tarefa WebAct com as colunas e o formato de saída necessários.

Com o WebAct ativo na página, selecione a região relevante e peça: “Extraia os nomes, empresas e cargos visíveis para um CSV. Inclua os cabeçalhos e confira se todas as linhas visíveis estão presentes.” Compare o resultado com a fonte e salve a tarefa se quiser reutilizá-la.

Seja claro sobre o que é “visível”. Nunca presuma que linhas ocultas, outras páginas e conteúdo não carregado pelo navegador estejam incluídos. Uma automação útil entrega um resultado verificável e explica claramente sua abrangência.

Um pequeno atalho para este guia

Conheça o extrator gratuito de tabelas de sites →. É necessário ter a extensão e uma conta WebAct. O Free inclui 25 tarefas de automação mensais; aplicam-se os limites do provedor.

Escrito pela equipe WebAct. O comportamento descrito reflete a implementação atual; os limites do provedor no navegador e as restrições dos sites continuam valendo.