# Extrator de tabelas PDF para CSV/JSON

Extrai tabelas de PDF com OpenDataLoader e exporta em JSON, CSV ou HTML

> Página canônica: https://elysiatools.com/pt/tools/pdf-table-extractor-to-csv-json

- **Categoria:** Data Processing

- **Palavras-chave:** pdf, tabela, csv, json

## Visão geral

Depois de enviar um PDF, a ferramenta usa o OpenDataLoader para detectar tabelas semanticas e exporta no formato escolhido. JSON preserva pagina, bbox e estrutura; CSV achata as celulas; HTML gera tabelas visuais.

## Entradas

- **Arquivo PDF** (file)
- **Formato de exportacao** (select)
- **Metodo de deteccao de tabelas** (select)
- **Paginas** (text): e.g. 1,3,5-7
- **Usar arvore estrutural** (checkbox)

## Quando usar

- Quando precisar converter tabelas financeiras ou relatórios em PDF para formatos de dados estruturados como CSV ou JSON.
- Para extrair dados de páginas específicas de um documento longo sem precisar processar o arquivo inteiro.
- Quando for necessário preservar a estrutura semântica e as coordenadas (bbox) das tabelas originais para integração em outros sistemas.

## Como funciona

- Faça o upload do arquivo PDF contendo as tabelas que deseja extrair.
- Selecione o formato de exportação desejado (JSON, CSV ou HTML) e o método de detecção de tabelas (Padrão ou Cluster).
- Opcionalmente, defina as páginas específicas (ex: 1,3,5-7) e ative o uso da árvore estrutural para refinar a extração.
- Baixe o arquivo gerado com os dados da tabela extraídos e formatados conforme sua configuração.

## Casos de uso

- Analistas financeiros extraindo balanços patrimoniais e demonstrativos de resultados de relatórios anuais em PDF para planilhas.
- Pesquisadores convertendo tabelas de dados de artigos científicos em arquivos JSON para análise em scripts Python ou R.
- Equipes de contabilidade transformando faturas e extratos bancários em PDF para o formato CSV para importação em softwares de gestão.

## Perguntas frequentes

### Quais formatos de exportação estão disponíveis?

Você pode exportar as tabelas extraídas em JSON (preserva estrutura e bbox), CSV (achata as células em linhas e colunas) ou HTML (gera tabelas visuais).

### Posso extrair tabelas de páginas específicas?

Sim, você pode usar o campo 'Páginas' para definir intervalos exatos, como '1,3,5-7', processando apenas as partes necessárias do PDF.

### O que é o método de detecção 'Cluster'?

É um algoritmo alternativo de detecção de tabelas que agrupa elementos próximos no PDF, útil para layouts complexos onde o método padrão pode não identificar a tabela corretamente.

### A ferramenta faz OCR em PDFs digitalizados como imagens?

Não, a ferramenta extrai dados de PDFs baseados em texto e árvores estruturais, não suportando reconhecimento óptico de caracteres (OCR) em documentos escaneados.

### O que a opção 'Usar árvore estrutural' faz?

Ela orienta o extrator a utilizar as tags estruturais internas do PDF (se existirem no documento) para identificar linhas e colunas com maior precisão.

## Ferramentas relacionadas

- [Gerador PDF de treino fitness](https://elysiatools.com/pt/tools/fitness-workout-pdf-generator): Gera um PDF imprimivel de treino a partir de JSON ou CSV com tabelas, caixas de progresso e QR opcionais
- [Gerador de Faturas PDF](https://elysiatools.com/pt/tools/pdf-invoice-generator): Gera uma fatura PDF com marca a partir de itens estruturados
- [Gerador de Data URI](https://elysiatools.com/pt/tools/data-uri-generator): Converte arquivos em Data URIs (Base64 ou porcentagem-codificada) para incorporar imagens, fontes e recursos diretamente em HTML, CSS ou Markdown
- [Ferramenta de diff CSV / Excel](https://elysiatools.com/pt/tools/csv-excel-diff-tool): Compara duas fontes CSV ou XLSX e exporta um relatorio PDF com diferencas por linha, coluna e celula
- [Ponte de PDF (OCR) para JSON estruturado](https://elysiatools.com/pt/tools/ocr-pdf-to-structured-json-bridge): Extrai a camada de texto do PDF com geometria (linhas por posição y, tabelas por vaos de coluna, títulos por tamanho de fonte, pares chave-valor com dois pontos) e preenche campo a campo um JSON Schema do usuário — rótulos pareados por chaves normalizadas, valores coagidos aos tipos declarados e validados com ajv.
- [Exportação de anotações PDF](https://elysiatools.com/pt/tools/pdf-annotation-export): Extrai anotações existentes (destaques, comentários, carimbos, links) de um PDF para uma string JSON
- [Exportação de dados de formulário PDF](https://elysiatools.com/pt/tools/pdf-form-data-export): Lê nomes, tipos e valores atuais dos campos AcroForm de um PDF e os exporta como string JSON
- [Explorador de estrutura JSON a partir de PDF](https://elysiatools.com/pt/tools/pdf-to-json-structure-explorer): Extrai a estrutura JSON do OpenDataLoader de um PDF e exibe titulos, paragrafos, tabelas, listas e bounding boxes

## Exemplos

- [Exemplos PDF](https://elysiatools.com/pt/samples/pdf-samples): Exemplos PDF gerados por ferramentas de 2026-02-01 a 2026-02-10
- [Exemplos CSV](https://elysiatools.com/pt/samples/csv-samples): Arquivos CSV de exemplo com vários tipos de dados, tamanhos e níveis de complexidade
- [Exemplos Python](https://elysiatools.com/pt/samples/python): Exemplos de código Python e demonstrações Hello World
- [Amostras JSON de Terraform Plan](https://elysiatools.com/pt/samples/terraform-plan-json-samples): Arquivos Terraform plan JSON para visualizacao de dependencias e revisao de mudancas, no estilo terraform show -json

## Conteúdo relacionado

- [Extração OCR de documentos](https://elysiatools.com/pt/hubs/document-ocr-extraction): Extraia texto OCR de scans e converta páginas ou imagens em Markdown, JSON, tabelas, legendas e blocos prontos para recuperacao com verificacao de qualidade.
- [Fluxo de conversão, OCR e extração de PDF](https://elysiatools.com/pt/hubs/pdf-convert): Converta documentos, páginas wiki, comentarios e imagens em PDF, depois extraia texto, imagens, tabelas, estrutura ou OCR de PDFs existentes.
- [Fluxos de extracao e depuracao de PDF](https://elysiatools.com/pt/hubs/pdf-extraction-debugging-workflows): Depure PDFs dificeis verificando criptografia, seguranca, paginas, ordem de leitura, OCR, tabelas e saidas estruturadas.
- [Preparação de PDF para LLM e RAG](https://elysiatools.com/pt/hubs/pdf-llm-rag-prep): Transforme PDFs em entradas limpas, seguras e citaveis para resumo com LLM, embeddings, busca e RAG.
