1. 修复“café”
内容编辑背景
编辑从旧系统复制法语文本时,单词“café”显示为“café”。
问题
需要判断并逆转 UTF-8 被当作 Latin-1 读取造成的乱码。
如何使用
将“café”粘贴到“乱码文本”中,并将“修复链”设为“自动”。
text:café;chain:auto结果
工具识别出合适的修复候选,并还原为“café”。
Elysia Tools
导航
Text Processing
修复因错误编码解码导致的乱码(mojibake)——逆转 UTF-8/Latin-1、Windows-1252、GBK、Shift-JIS、Big5、MacRoman 链。自动模式尝试所有链并选最干净的结果。
详情
Mojibake 是字节以一种字符编码编码、却被另一种编码解码时产生的乱码(如 UTF-8 字节被当 Latin-1 显示,出现 é 而非 é)。本工具逆转错误解码:用疑似错误的编码重新编码乱码字符串,再用正确编码重新解码这些字节。自动模式尝试所有常见链(Latin-1、Windows-1252、GBK、Shift-JIS、Big5、MacRoman),按"产生多少干净可打印文本"给每个候选打分,所以你可以粘贴神秘乱码让侦探找出原文。适合修复损坏的 CSV 导出、被错误标记的网页、数据库导入伪影、跨语言区复制粘贴的乱码。
执行
填写表单、运行工具,并在同一页面查看结果。
案例
相关内容
等待运行
工具使用指南
乱码修复(编码侦探)用于还原因错误字符编码解码产生的 mojibake,例如将“café”修复为“café”。粘贴乱码文本后,可自动尝试 UTF-8、Latin-1、Windows-1252、GBK、Shift-JIS、Big5 和 MacRoman 等修复链,或手动选择编码链。
背景
编辑从旧系统复制法语文本时,单词“café”显示为“café”。
问题
需要判断并逆转 UTF-8 被当作 Latin-1 读取造成的乱码。
如何使用
将“café”粘贴到“乱码文本”中,并将“修复链”设为“自动”。
text:café;chain:auto结果
工具识别出合适的修复候选,并还原为“café”。
背景
文档中的右单引号被显示为“’”,影响正文排版和校对。
问题
需要修复由 UTF-8 字节被错误按 Latin-1 解码产生的标点乱码。
如何使用
粘贴“’”,保持自动修复模式运行。
text:’;chain:auto结果
乱码被还原为正确的弯引号“’”。
Mojibake 是文本使用错误字符编码解码后产生的乱码,例如“café”。
自动模式会尝试 Latin-1、Windows-1252、GBK、Shift-JIS、Big5 和 MacRoman 等常见链。
可以。工具支持选择 UTF-8 与 Latin-1、Windows-1252、GBK、Shift-JIS、Big5 或 MacRoman 的对应修复链。
在“乱码文本”框中直接粘贴需要修复的字符串即可,例如“café”或“’”。
工具以 HTML 结果展示修复后的文本。自动模式会返回评分较高、较干净的候选结果。