# 过滤文本中的单词

快速返回匹配模式或正则表达式的文本单词

> 标准页面: https://elysiatools.com/zh/tools/text-word-filter

- **分类:** Text Processing

- **关键词:** 文本, 过滤, 单词, 模式, 正则表达式, 匹配, 搜索, 提取, 文本单词过滤器

## 概述

过滤文本中的单词工具是一款高效的文本处理助手，能够根据指定的模式、正则表达式或特定规则（如长度、元音数量等）从长文本中快速提取并筛选出符合条件的单词，帮助用户精准获取所需信息。

## 输入项

- **文本输入** (textarea): 输入要过滤单词的文本...
- **过滤类型** (select)
- **模式/文本** (text): 要匹配的模式（大多数过滤类型需要）
- **单词边界** (checkbox): 仅匹配完整单词
- **区分大小写** (checkbox): 过滤时匹配大小写
- **输出格式** (select)
- **自定义分隔符** (text): 单词间的自定义分隔符（覆盖输出格式）
- **删除重复项** (checkbox): 从结果中删除重复单词
- **按字母排序** (checkbox): 按字母顺序排序结果
- **最大长度** (text): 最大单词长度（用于长度过滤类型）
- **最大元音数** (text): 最大元音数（用于元音过滤类型）
- **最大辅音数** (text): 最大辅音数（用于辅音过滤类型）

## 适用场景

- 需要从大量文档中提取特定格式或包含特定字符的单词时。
- 需要对文本进行清洗，去除重复项并按字母顺序排列单词列表时。
- 需要利用正则表达式进行复杂模式匹配以筛选特定词汇时。

## 工作原理

- 在输入框中粘贴需要处理的文本内容。
- 选择过滤类型（如包含、正则表达式、长度等）并设置对应的匹配模式。
- 根据需求勾选删除重复项、按字母排序或设置单词边界等高级选项。
- 选择输出格式（如空格、逗号或换行分隔），点击执行即可获取结果。

## 使用案例

- 数据分析：从长篇文章中提取所有长度超过 10 个字符的专业术语。
- 内容创作：快速找出文本中所有包含特定前缀或后缀的单词，用于词汇分析。
- 文本清洗：将杂乱的文本转换为规范的、无重复且按字母排序的单词列表。

## 常见问题

### 该工具支持正则表达式吗？

支持。选择“正则表达式”过滤类型，并在模式框中输入您的正则规则即可进行高级匹配。

### 如何确保只匹配完整的单词？

勾选“单词边界”选项，工具将自动识别并排除单词内部的局部匹配，确保提取结果为完整词汇。

### 可以去除结果中的重复单词吗？

可以。勾选“删除重复项”选项，工具会在输出前自动清理掉所有重复出现的单词。

### 支持自定义输出格式吗？

支持。您可以选择预设的空格、逗号、新行或列表格式，也可以在“自定义分隔符”中输入您需要的符号。

### 过滤时区分大小写吗？

默认不区分。如果您需要严格匹配大小写，请勾选“区分大小写”选项。

## 相关工具

- [过滤文本段落](https://elysiatools.com/zh/tools/text-paragraph-filter): 快速返回匹配模式或正则表达式的所有段落
- [过滤文本句子](https://elysiatools.com/zh/tools/text-sentence-filter): 快速返回匹配模式或正则表达式的所有句子
- [批量邮箱提取器](https://elysiatools.com/zh/tools/bulk-email-extractor): 从输入文本、文章、网页源码或混合内容中提取所有邮箱地址。支持去重和导出为JSON格式。
- [行号删除器](https://elysiatools.com/zh/tools/line-number-remover): 智能识别和删除文本或代码中的行号
- [表情符号提取器](https://elysiatools.com/zh/tools/emoji-extractor): 从文本中提取所有Unicode表情符号，或者可选择删除表情符号
- [汉字提取器](https://elysiatools.com/zh/tools/chinese-character-extractor): 从文本中提取所有中文字符，过滤掉标点符号、英文字母、数字和非中文符号
- [IP地址提取器](https://elysiatools.com/zh/tools/ip-address-extractor): 从日志文件、服务器日志、网络跟踪或任何文本内容中提取IPv4和IPv6地址
- [HTML标签清理器](https://elysiatools.com/zh/tools/html-tag-stripper): 移除HTML标签，提取干净的文本内容

## 示例

- [含表情符号的文本示例](https://elysiatools.com/zh/samples/text-with-emoji-samples): 用于测试表情符号提取的各种语言混合文本和Unicode表情符号
- [正则替换示例](https://elysiatools.com/zh/samples/regex-replace): 用于文本转换和数据清洗的常用正则替换模式集合
- [文本日期示例](https://elysiatools.com/zh/samples/text-with-date-samples): 包含各种日期格式的文本，用于测试日期提取和解析
- [重复行示例](https://elysiatools.com/zh/samples/text-duplicate-line-samples): 用于测试重复行移除工具的各种重复行类型的示例文件

## 相关内容

- [文本提取工具专题](https://elysiatools.com/zh/hubs/text-extract): 汇集 15 个可从混合文本、Markdown、HTML 与日志中提取链接、邮箱、手机号、日期、Emoji 和结构化字段的工具。
- [文本大小写、编码与规范化转换工具](https://elysiatools.com/zh/hubs/text-convert): 在一个专题中比较文本大小写转换、全半角转换、编码转换、Quoted-Printable 处理和行内文本规范化工具。
- [Text 工具专题](https://elysiatools.com/zh/hubs/text-utility): 探索 33 个围绕 text 的 utility 工作流工具，快速找到相近能力。
- [文本分析、可读性与内容检查工具](https://elysiatools.com/zh/hubs/text-analyze): 在一个专题中比较文本统计、语言识别、可读性评分、情感分析、内容审核和模式分析工具。
