Text Processing
从混合文本中提取电话号码,支持多个国家和格式
phone-number-extractorText Processing
智能识别并删除每行开头的相同前缀,提供多种检测模式
prefix-removerText Processing
规范化和统一文本中的标点符号,支持中英文标点符号转换
punctuation-normalizerText Processing
规范化段落格式,包括适当的间距、标点符号和结构
paragraph-formatterText Processing
同时检查数字、日期、单位、引号、破折号、标题层级、人物名和专名一致性,生成 style sheet
manuscript-style-consistency-auditorText Processing
从文本中移除所有非字母数字的特殊字符,提供灵活的保留选项
non-alphanumeric-cleanerText Processing
从HTML代码中移除标签并提取纯文本内容
new-html-tag-stripperText Processing
将多行文本合并为一行,提供自定义分隔符和格式选项
multiline-mergerText Processing
从文本内容中提取奇数行,支持多种索引方法和自定义条件
odd-line-extractorText Processing
统一和清理文本中的各种数字格式,确保一致性
number-format-cleanerText Processing
统一和规范化文本中的换行符格式,确保行尾格式一致
newline-normalizerText Processing
修复因错误编码解码导致的乱码(mojibake)——逆转 UTF-8/Latin-1、Windows-1252、GBK、Shift-JIS、Big5、MacRoman 链。自动模式尝试所有链并选最干净的结果。
mojibake-repair