# Криминалистика и восстановление кодировки текста

Проверяет кодировку, BOM, переводы строк и mojibake, а затем создаёт локальный вариант исправления с оценкой.

> Каноническая страница: https://elysiatools.com/ru/tools/text-encoding-forensics-and-repair

- **Категория:** Text Processing

- **Ключевые слова:** кодировка, mojibake, BOM, исправление

## Обзор

Инструмент анализирует текст или поддерживаемый текстовый файл, определяет кодировку, BOM, стиль переводов строк и признаки mojibake, а затем формирует локальный вариант исправления в формате JSON.

## Входные данные

- **Текст** (textarea): Paste text or mojibake here...
- **Загрузить текстовый файл** (file)
- **Исходная кодировка** (select)
- **Режим исправления** (select)
- **Переводы строк** (select)
- **Удалить BOM** (checkbox)

## Когда использовать

- Когда текст отображается как mojibake, например «CafÃ©» вместо «Café».
- Когда нужно удалить BOM или привести переводы строк к LF либо CRLF.
- Когда требуется проверить UTF-8, UTF-16, GB18030, Windows-1252 или ISO-8859-1 перед исправлением текста.

## Как это работает

- Вставьте текст или загрузите файл TXT, CSV, JSON либо Markdown размером до 10 МБ.
- Выберите исходную кодировку или оставьте автоматическое определение.
- Укажите режим исправления, стиль переводов строк и необходимость удалить BOM.
- Получите JSON с исправленным текстом и диагностикой, включая оценку mojibake и обнаруженный стиль строк.

## Сценарии использования

- Восстановление текста после ошибочного преобразования UTF-8 через Latin-1.
- Подготовка текстовых файлов с единым стилем переводов строк для дальнейшей обработки.
- Проверка BOM и кодировки перед публикацией или передачей TXT, CSV, JSON и Markdown-файлов.

## Частые вопросы

### Какие данные можно проверить?

Можно вставить текст или загрузить файл TXT, CSV, JSON либо Markdown.

### Какие кодировки доступны?

Доступны автоматическое определение, UTF-8, UTF-16 LE, UTF-16 BE, GB18030/GBK, Windows-1252 и ISO-8859-1.

### Что такое mojibake?

Это искажённый текст, появившийся из-за неправильной интерпретации исходной кодировки, например «CafÃ©».

### Можно ли сохранить исходный текст без исправлений?

Да. Для этого выберите режим «Preserve Text».

### Что делает настройка переводов строк?

Она сохраняет исходный стиль либо преобразует переводы строк в LF или CRLF.

## Связанные инструменты

- [Оценщик AI-токенов](https://elysiatools.com/ru/tools/ai-token-estimator): Анализирует смешанные языки и оценивает токены для OpenAI, Codex, Claude и DeepSeek
- [Удалитель BOM Символов](https://elysiatools.com/ru/tools/data-bom-remover): Удаление BOM (Byte Order Mark) символов из текстового и файлового содержимого. Идеально для очистки текстовых файлов с проблемами кодировки.
- [Мастер преобразования неструктурированного текста в данные](https://elysiatools.com/ru/tools/messy-text-to-structured-data-workbench): Выводит таблицу из текста, смешанных разделителей, строк ключ-значение или HTML и экспортирует CSV, JSON и Markdown.
- [Объединитель TXT](https://elysiatools.com/ru/tools/txt-merger): Объединяет несколько текстовых файлов с различными стратегиями (конкатенация, чередование и т.д.)
- [Ограничитель Диапазона Данных](https://elysiatools.com/ru/tools/data-range-limiter): Ограничение числовых значений указанными диапазонами путем обрезки, фильтрации или маркировки значений вне диапазона. Идеально для контроля качества данных, очистки данных сенсоров, применения бизнес-правил и предварительной обработки данных. Возможности: - Обрезка диапазона (обрезает значения до минимальных/максимальных границ) - Фильтрация диапазона (удаляет строки вне пределов) - Маркировка диапазона (маркирует измененные значения) - Конфигурация диапазона по столбцам - Автоматическое обнаружение числовых столбцов - Множественные стратегии обработки - Подробный отчет об изменениях - Статистический анализ изменений - Применение бизнес-правил Общие случаи использования: - Валидация и очистка данных сенсоров - Подготовка входных данных для машинного обучения - Контроль и валидация качества данных - Применение бизнес-ограничений - Управление и контроль аномальных значений - Конвейеры предварительной обработки данных
- [Анализатор прогноза и сезонности](https://elysiatools.com/ru/tools/time-series-forecast-seasonality-analyzer): Строит прогноз по CSV или JSON временным рядам и показывает тренд, сезонность и остатки в одном отчете
- [CSV Трансформер](https://elysiatools.com/ru/tools/csv-transformer): Трансформация и обработка данных CSV с операциями столбцов, вычислениями и преобразованиями типов данных. Примеры операций: • Переименовать столбец: \[{"type": "rename", "column": "старое_имя", "new_name": "новое_имя"}\] • Добавить вычисляемый столбец: \[{"type": "add_column", "new_column": "итого", "formula": "цена * количество"}\] • Удалить столбец: \[{"type": "remove_column", "remove_column": "столбец_для_удаления"}\] • Преобразовать тип данных: \[{"type": "convert_type", "convert_column": "возраст", "target_type": "number"}\] • Вычислить значения: \[{"type": "calculate", "target_column": "итого", "expression": "цена * налог + доставка"}\] • Фильтровать строки: \[{"type": "filter_values", "filter_column": "статус", "operator": "equals", "value": "активный"}\]
- [Группировщик данных CSV](https://elysiatools.com/ru/tools/csv-data-grouper): Группируйте данные CSV по указанным столбцам с опциями агрегации. Идеально для суммирования и анализа больших наборов данных по категориям, датам или другим критериям.

## Примеры

- [PDF Примеры](https://elysiatools.com/ru/samples/pdf-samples): PDF примеры, созданные инструментами 2026-02-01..2026-02-10
- [CSV Примеры](https://elysiatools.com/ru/samples/csv-samples): Примеры CSV-файлов с различными типами данных, размерами и уровнями сложности
- [Примеры Python](https://elysiatools.com/ru/samples/python): Примеры кода Python и демонстрации Hello World
- [Примеры Hex/Unicode Конвертера](https://elysiatools.com/ru/samples/text-hex-unicode-formats): Тестовые примеры для преобразования hex и unicode escape-последовательностей
