Text Processing
清理文本中的零宽字符、不可见字符和隐藏字符,提供详细的统计信息
zero-width-removerText Processing
使用可解释的本地规则完成分词、句子切分、停用词、词形、词干、实体和 n-gram 标注,并导出 JSONL 或 CoNLL。
text-nlp-annotation-workbenchText Processing
执行可移植的文本清洗配方,并查看每步 diff、耗时和字符变化。
text-pipeline-builderText Processing
确定性地分析、替换、删除或复制英文元音和辅音,并返回位置统计与变更步骤。
vowel-consonant-processorText Processing
一次性计算任意文本的 MD5、SHA-1、SHA-256、SHA-512、CRC-32 哈希。同时给出十六进制和 Base64 两种摘要(基于 UTF-8 编码)。
text-hash-generatorText Processing
检查编码、BOM、换行风格和乱码迹象,并生成带评分的本地修复候选。
text-encoding-forensics-and-repairText Processing
把文本填充到固定宽度,并左对齐、右对齐、居中或两端对齐,可自选填充字符。
text-padText Processing
把一组字母重组为所有合法的英文单词。拼字/变位词求解器,尊重字母计数并按长度过滤。
word-unscramblerText Processing
把英文数字词转成阿拉伯数字。支持千/百万/十亿量级、"and"、通过 "point" 表达的小数以及连字符,并就地替换数字片段。
words-to-numberText Processing
把文本转换为 Unicode 小型大写字母(ʜᴇʟʟᴏ)。使用 Phonetic Extensions 区的小型大写字形;没有专用字形的字母回退为小写。
small-caps-converterText Processing
通过 URL 抓取 RSS / Atom 订阅源(或粘贴原始 XML),按发布日期排序、去重、按时间窗口过滤,并输出一份适合 newsletter 与聚合站的干净 Markdown 摘要
rss-feed-markdown-summarizerText Processing
比较简历与职位描述,归一化关键词变体并突出覆盖缺口
resume-job-description-matcher