# Perícia e reparo de codificação de texto

Inspeciona codificação, BOM, quebras de linha e mojibake e gera um candidato de reparo local com pontuação.

> Página canônica: https://elysiatools.com/pt/tools/text-encoding-forensics-and-repair

- **Categoria:** Text Processing

- **Palavras-chave:** codificação, mojibake, BOM, reparo

## Visão geral

A ferramenta de perícia e reparo de codificação de texto identifica a codificação, o BOM, o estilo de quebra de linha e sinais de mojibake. Você pode colar texto ou enviar arquivos compatíveis para gerar um candidato de reparo local em JSON.

## Entradas

- **Conteúdo do texto** (textarea): Paste text or mojibake here...
- **Enviar arquivo de texto** (file)
- **Codificação de origem** (select)
- **Modo de reparo** (select)
- **Quebras de linha** (select)
- **Remover BOM** (checkbox)

## Quando usar

- Corrigir texto corrompido, como “CafÃ©” em vez de “Café”.
- Normalizar BOM e quebras de linha entre formatos Unix e Windows.
- Verificar a codificação provável de textos em UTF-8, UTF-16, GB18030, Windows-1252 ou ISO-8859-1.

## Como funciona

- Cole o conteúdo no campo de texto ou envie um arquivo TXT, CSV, JSON ou Markdown de até 10 MB.
- Escolha a codificação de origem ou mantenha a detecção automática.
- Selecione o modo de reparo, o padrão de quebras de linha e se o BOM deve ser removido.
- A ferramenta retorna um resultado JSON com o texto reparado e diagnósticos disponíveis, como a codificação identificada ou o estilo original de quebra de linha.

## Casos de uso

- Reparar caracteres corrompidos em textos copiados de sistemas que usam codificações diferentes.
- Padronizar arquivos de configuração, dados e documentação com o mesmo estilo de quebra de linha.
- Inspecionar arquivos antes de importá-los em aplicações que exigem uma codificação específica.

## Perguntas frequentes

### Quais tipos de arquivo posso enviar?

A ferramenta aceita arquivos de texto simples, CSV, JSON e Markdown.

### O que é mojibake?

É um texto exibido com caracteres incorretos após uma interpretação inadequada da codificação, como “CafÃ©”.

### A codificação de origem pode ser detectada automaticamente?

Sim. A opção padrão é a detecção automática, mas também é possível selecionar uma codificação.

### Posso converter CRLF para LF?

Sim. Selecione LF no campo de quebras de linha para converter o texto para o padrão Unix.

### O que acontece ao remover o BOM?

O BOM inicial é removido do texto, e o resultado informa essa alteração nos diagnósticos quando aplicável.

## Ferramentas relacionadas

- [Estimador de Tokens de IA](https://elysiatools.com/pt/tools/ai-token-estimator): Analisa textos multilíngues e estima tokens para OpenAI, Codex, Claude e DeepSeek
- [Removedor de Caracteres BOM](https://elysiatools.com/pt/tools/data-bom-remover): Remover caracteres BOM (Byte Order Mark) de conteúdo de texto e arquivos. Perfeito para limpar arquivos de texto com problemas de codificação.
- [Workbench de texto confuso para dados estruturados](https://elysiatools.com/pt/tools/messy-text-to-structured-data-workbench): Infere tabelas de texto colado, delimitadores mistos, linhas chave-valor ou HTML e exporta CSV, JSON e Markdown.
- [Fusionador de TXT](https://elysiatools.com/pt/tools/txt-merger): Combina múltiplos arquivos de texto com várias estratégias (concatenar, intercalar, etc.)
- [Limitador de Faixa de Dados](https://elysiatools.com/pt/tools/data-range-limiter): Limitar valores numéricos a faixas específicas através de recorte, filtragem ou marcação de valores fora da faixa. Perfeito para controle de qualidade de dados, limpeza de sensores, execução de regras de negócio e pré-processamento de dados. Recursos: - Recorte de faixa (recorta valores para limites mínimo/máximo) - Filtragem de faixa (remove linhas fora dos limites) - Marcação de faixa (marca valores modificados) - Configuração de faixa por coluna - Detecção automática de colunas numéricas - Múltiplas estratégias de processamento - Relatório detalhado de modificações - Análise estatística de alterações - Execução de regras de negócio Casos de Uso Comuns: - Validação e limpeza de dados de sensores - Preparação de entrada para machine learning - Controle e validação de qualidade de dados - Execução de restrições de negócio - Gerenciamento e controle de valores anômalos - Pipelines de pré-processamento de dados
- [Analisador de previsao e sazonalidade](https://elysiatools.com/pt/tools/time-series-forecast-seasonality-analyzer): Projeta periodos futuros a partir de series temporais CSV ou JSON e mostra tendencia, sazonalidade e residuo
- [Transformador CSV](https://elysiatools.com/pt/tools/csv-transformer): Transformar e processar dados CSV com operações de colunas, cálculos e conversões de tipo de dados. Exemplos de operações: • Renomear coluna: \[{"type": "rename", "column": "nome_antigo", "new_name": "novo_nome"}\] • Adicionar coluna calculada: \[{"type": "add_column", "new_column": "total", "formula": "preco * quantidade"}\] • Remover coluna: \[{"type": "remove_column", "remove_column": "coluna_a_remover"}\] • Converter tipo de dado: \[{"type": "convert_type", "convert_column": "idade", "target_type": "number"}\] • Calcular valores: \[{"type": "calculate", "target_column": "total", "expression": "preco * imposto + entrega"}\] • Filtrar linhas: \[{"type": "filter_values", "filter_column": "status", "operator": "equals", "value": "ativo"}\]
- [CSV Data Grouper](https://elysiatools.com/pt/tools/csv-data-grouper): Group CSV data by specified columns with aggregation options. Perfect for summarizing and analyzing large datasets by categories, dates, or other criteria.

## Exemplos

- [Exemplos PDF](https://elysiatools.com/pt/samples/pdf-samples): Exemplos PDF gerados por ferramentas de 2026-02-01 a 2026-02-10
- [Exemplos CSV](https://elysiatools.com/pt/samples/csv-samples): Arquivos CSV de exemplo com vários tipos de dados, tamanhos e níveis de complexidade
- [Exemplos Python](https://elysiatools.com/pt/samples/python): Exemplos de código Python e demonstrações Hello World
- [Amostras de Conversor Hex/Unicode](https://elysiatools.com/pt/samples/text-hex-unicode-formats): Amostras de teste para conversão de sequências de escape hex e unicode
