# 文本编码取证与修复

检查编码、BOM、换行风格和乱码迹象，并生成带评分的本地修复候选。

> 标准页面: https://elysiatools.com/zh/tools/text-encoding-forensics-and-repair

- **分类:** Text Processing

- **关键词:** 编码取证, 乱码修复, 字符集, BOM

## 概述

文本编码取证与修复工具可检查文本或常见文本文件的编码、BOM、换行风格和乱码迹象，并根据设置生成带诊断信息的修复结果。

## 输入项

- **文本内容** (textarea): Paste text or mojibake here...
- **上传文本文件** (file)
- **源编码** (select)
- **修复模式** (select)
- **输出换行** (select)
- **移除 BOM** (checkbox)

## 适用场景

- 粘贴出现乱码的文本，检查并尝试修复 UTF-8、GB18030、Windows-1252 或 ISO-8859-1 等编码问题。
- 上传 TXT、CSV、JSON 或 Markdown 文件，确认源编码、BOM 状态和原始换行风格。
- 需要统一文本格式时，移除 BOM，并将换行转换为 LF 或 CRLF。

## 工作原理

- 粘贴文本，或上传不超过 10 MB 的 TXT、CSV、JSON 或 Markdown 文件。
- 选择源编码；可使用“自动检测”，也可指定 UTF-8、UTF-16、GB18030、Windows-1252 或 ISO-8859-1。
- 选择自动修复乱码、规范化 BOM 和换行，或保留文本，并设置输出换行模式。
- 工具返回 JSON 结果，包含修复后的文本以及可用的乱码、BOM 和换行诊断信息。

## 使用案例

- 修复网页、日志或数据文件中常见的 UTF-8 乱码。
- 整理跨系统传输的文本，统一 BOM 和 Unix 或 Windows 换行格式。
- 检查 CSV、JSON 和 Markdown 文件在不同编码设置下的显示问题。

## 常见问题

### 支持哪些输入方式？

可以直接粘贴文本，也可以上传 TXT、CSV、JSON 或 Markdown 文件。

### 可以自动检测文本编码吗？

可以。将“源编码”设为“自动检测”即可；也可以手动选择支持的编码。

### 哪些编码可以手动选择？

支持 UTF-8、UTF-16 Little Endian、UTF-16 Big Endian、GB18030/GBK、Windows-1252 和 ISO-8859-1。

### 如何处理 BOM 和换行？

可选择移除 BOM，并将输出换行设置为保留原样、LF 或 CRLF。

### 工具会输出什么结果？

工具输出 JSON，通常包含 repairedText，以及与乱码评分、BOM 和换行检测相关的诊断信息。

## 相关工具

- [AI Token 预估器](https://elysiatools.com/zh/tools/ai-token-estimator): 按语言体系分析文本，并预估 OpenAI、Codex、Claude 和 DeepSeek 的 token 消耗
- [BOM字符移除器](https://elysiatools.com/zh/tools/data-bom-remover): 从文本和文件内容中移除BOM（字节顺序标记）字符。非常适合清理有编码问题的文本文件、修复CSV导入和为处理准备数据。 功能特点： - 检测并移除UTF-8 BOM (EF BB BF) - 检测并移除UTF-16 BOM (FE FF 或 FF FE) - 检测并移除UTF-32 BOM (00 00 FE FF 或 FF FE 00 00) - 支持多种输入格式 - 可视化BOM字符显示 - 详细检测报告 - 支持批量文本处理 常见用途： - 修复CSV文件导入错误 - 清理文本文件编码问题 - 为JSON解析准备数据 - 修复XML解析问题 - 解决API数据编码冲突 - 标准化文本数据格式
- [混乱文本结构化数据工作台](https://elysiatools.com/zh/tools/messy-text-to-structured-data-workbench): 从粘贴文本、混合分隔符、键值行或 HTML 中推断表格，并导出 CSV、JSON 和 Markdown。
- [文本文件合并工具](https://elysiatools.com/zh/tools/txt-merger): 合并多个文本文件，支持多种合并策略（连接、交错、智能合并等）
- [数据范围限制器](https://elysiatools.com/zh/tools/data-range-limiter): 将数值限制在指定范围内，通过裁剪、过滤或标记越界值。完美用于数据质量控制、传感器数据清洗、业务规则执行和数据预处理。 功能特点： - 范围裁剪（将值裁剪到最小/最大边界） - 范围过滤（移除越界行） - 范围标记（标记修改的值） - 每列范围配置 - 自动数值列检测 - 多种处理策略 - 详细修改报告 - 变更统计分析 - 业务规则执行 常见用途： - 传感器数据验证和清洗 - 机器学习输入准备 - 数据质量控制和验证 - 业务约束执行 - 异常值管理和控制 - 数据预处理管道
- [时间序列预测与季节性分析](https://elysiatools.com/zh/tools/time-series-forecast-seasonality-analyzer): 从 CSV 或 JSON 时间序列数据中预测未来数期，并在一份报告中查看趋势、季节项和残差分解
- [CSV转换器](https://elysiatools.com/zh/tools/csv-transformer): 转换和处理CSV数据，支持列操作、计算和数据类型转换。 操作示例： • 重命名列: \[{"type": "rename", "column": "旧列名", "new_name": "新列名"}\] • 添加计算列: \[{"type": "add_column", "new_column": "总计", "formula": "价格 * 数量"}\] • 删除列: \[{"type": "remove_column", "remove_column": "要删除的列名"}\] • 转换数据类型: \[{"type": "convert_type", "convert_column": "年龄", "target_type": "number"}\] • 计算值: \[{"type": "calculate", "target_column": "总计", "expression": "价格 * 税率 + 运费"}\] • 过滤行: \[{"type": "filter_values", "filter_column": "状态", "operator": "equals", "value": "激活"}\]
- [CSV数据分组器](https://elysiatools.com/zh/tools/csv-data-grouper): 按指定列对CSV数据进行分组，支持聚合选项。非常适合按类别、日期或其他标准来总结和分析大型数据集。

## 示例

- [PDF示例](https://elysiatools.com/zh/samples/pdf-samples): 2026-02-01 到 2026-02-10 工具生成的PDF示例
- [CSV示例](https://elysiatools.com/zh/samples/csv-samples): 各种数据类型、大小和复杂度级别的CSV示例文件
- [Python 示例](https://elysiatools.com/zh/samples/python): Python代码示例和Hello World演示
- [十六进制/Unicode转换样本](https://elysiatools.com/zh/samples/text-hex-unicode-formats): 十六进制和Unicode转义序列转换的测试样本
