1. 清理多语言产品名称
内容编辑背景
内容编辑需要将包含拉丁重音、中文和西里尔字母的产品名称整理成便于旧系统录入的文本。
问题
原始名称含有多种 Unicode 字符,直接录入时可能出现兼容性问题。
如何使用
在文本框中输入“Café 北京 Привет”,并将“无法转写字符处理”设为“丢弃无法转写的”。
keepUnknown: drop结果
重音被去除,中文转为拼音,西里尔字母被罗马化,得到更易读的 ASCII 文本。
Elysia Tools
导航
Text Processing
将任意 Unicode 文本转为纯 ASCII:去掉重音(é→e、ñ→n)、转写西里尔/希腊字母、把中文转拼音(北京→Bei Jing)。无法转写的 emoji 和符号会被丢弃。
详情
一种"有损但可读"的 Unicode→ASCII 转换。去掉拉丁组合符号(Façade→Facade、Ångström→Angstrom),罗马化非拉丁字母(Привет→Privet、Αθήνα→Athina),中文经 pinyin-pro 转拼音并正确处理多音字(重庆→chong qing)。日本汉字只能给拼音级结果(真罗马字需要形态词典)。适用于构建纯 ASCII 文件名、搜索索引、slug 前置处理、遗留系统数据录入、清理带不可见 Unicode 的粘贴文本。展示转写前后的非 ASCII 字符数,方便确认结果是否纯 ASCII。
执行
填写表单、运行工具,并在同一页面查看结果。
案例
相关内容
等待运行
工具使用指南
Unicode 转 ASCII 转写器可将包含重音、中文、西里尔字母或希腊字母的文本转换为更易读的 ASCII 形式:去除拉丁字母重音、罗马化非拉丁字母,并将中文转为拼音。无法转写的 emoji 和符号可选择丢弃或保留。
背景
内容编辑需要将包含拉丁重音、中文和西里尔字母的产品名称整理成便于旧系统录入的文本。
问题
原始名称含有多种 Unicode 字符,直接录入时可能出现兼容性问题。
如何使用
在文本框中输入“Café 北京 Привет”,并将“无法转写字符处理”设为“丢弃无法转写的”。
keepUnknown: drop结果
重音被去除,中文转为拼音,西里尔字母被罗马化,得到更易读的 ASCII 文本。
背景
搜索索引需要为中文地名生成拼音形式,同时正确处理包含多音字的地名。
问题
“重庆”中的“重”在此处读作“chong”,不能简单按常见读音转换。
如何使用
输入“重庆和北京”,并保持无法转写字符处理为“丢弃无法转写的”。
keepUnknown: drop结果
文本转换为“chong qing he Bei Jing”,其中“重庆”的多音字得到符合语境的拼音。
中文会转换为拼音,例如“北京”变为“Bei Jing”,“重庆”变为“chong qing”。
工具会去除重音和变音符号,例如“Café”变为“Cafe”,“Ångström”变为“Angstrom”。
可以,工具会将这类非拉丁字母罗马化,例如“Привет”变为“Privet”。
默认会丢弃无法转写的字符,也可以选择保留它们的原样。
日文汉字只能得到拼音级结果,不等同于需要形态词典支持的标准罗马字。
背景
数据录入人员需要将包含法语、西班牙语等重音字母的名称输入只接受基础 ASCII 的系统。
问题
原始文本中的重音字符可能无法被目标系统正确保存或匹配。
如何使用
输入“Façade Ångström naïve”,使用默认的无法转写字符处理选项。
keepUnknown: drop结果
文本中的重音和变音符号被去除,结果保留可读的基础拉丁字母形式。