# 过滤文本句子

快速返回匹配模式或正则表达式的所有句子

> 标准页面: https://elysiatools.com/zh/tools/text-sentence-filter

- **分类:** Text Processing

- **关键词:** 文本, 过滤, 句子, 模式, 正则表达式, 匹配, 搜索, 提取, 文本句子过滤器

## 概述

过滤文本句子工具是一款高效的文本处理助手，能够根据指定的模式、正则表达式或特定语法规则，从长文本中快速筛选并提取出符合条件的句子，帮助用户从海量信息中精准定位关键内容。

## 输入项

- **文本输入** (textarea): 输入要过滤句子的文本...
- **过滤类型** (select)
- **模式/文本** (text): 要匹配的模式（并非所有过滤类型都使用）
- **句子结束符** (text): 标记句子结束的字符
- **区分大小写** (checkbox): 过滤时匹配大小写
- **保持原始格式** (checkbox): 保持原始间距和标点符号
- **输出格式** (select)
- **删除重复项** (checkbox): 删除重复句子
- **按字母排序** (checkbox): 按字母顺序排序结果
- **最大长度** (text): 最大句子长度（用于长度过滤类型）
- **最大词数** (text): 最大词数（用于词数过滤类型）

## 适用场景

- 从长篇文档或报告中提取包含特定关键词的句子。
- 利用正则表达式批量筛选符合复杂逻辑的文本行。
- 清理文本数据，通过长度、词数或标点符号特征过滤掉无效信息。

## 工作原理

- 将需要处理的文本粘贴到输入框中。
- 在过滤类型中选择匹配模式，如“包含文本”、“正则表达式”或“是疑问句”等。
- 根据需要配置大小写敏感、删除重复项或排序等高级选项。
- 选择输出格式（如编号列表或新行显示），点击执行即可获取过滤后的结果。

## 使用案例

- 学术研究：从文献综述中提取所有包含特定研究方法的句子。
- 数据清洗：从抓取的网页文本中剔除不含数字的无效行或过短的句子。
- 内容编辑：快速筛选出文稿中的所有疑问句，以便进行校对或修改。

## 常见问题

### 该工具支持哪些过滤类型？

支持多种类型，包括包含文本、正则表达式、句子长度、词数统计、是否包含数字、疑问句/感叹句识别等。

### 如何使用正则表达式进行过滤？

在过滤类型中选择“正则表达式”，并在模式输入框中输入您的正则规则即可进行高级匹配。

### 可以保持原始文本的格式吗？

可以，勾选“保持原始格式”选项，工具将保留原始的间距和标点符号。

### 输出结果支持哪些格式？

支持段落格式、每个句子新行、空格分隔、编号列表、项目符号和分号分隔等多种输出方式。

### 处理后的结果可以自动排序吗？

可以，勾选“按字母排序”选项，工具会自动将提取出的句子按字母顺序进行排列。

## 相关工具

- [过滤文本段落](https://elysiatools.com/zh/tools/text-paragraph-filter): 快速返回匹配模式或正则表达式的所有段落
- [过滤文本中的单词](https://elysiatools.com/zh/tools/text-word-filter): 快速返回匹配模式或正则表达式的文本单词
- [批量邮箱提取器](https://elysiatools.com/zh/tools/bulk-email-extractor): 从输入文本、文章、网页源码或混合内容中提取所有邮箱地址。支持去重和导出为JSON格式。
- [行号删除器](https://elysiatools.com/zh/tools/line-number-remover): 智能识别和删除文本或代码中的行号
- [汉字提取器](https://elysiatools.com/zh/tools/chinese-character-extractor): 从文本中提取所有中文字符，过滤掉标点符号、英文字母、数字和非中文符号
- [表情符号提取器](https://elysiatools.com/zh/tools/emoji-extractor): 从文本中提取所有Unicode表情符号，或者可选择删除表情符号
- [批量URL/链接提取器](https://elysiatools.com/zh/tools/bulk-url-extractor): 从文本中提取所有HTTP/HTTPS链接，支持去重和导出功能
- [IP地址提取器](https://elysiatools.com/zh/tools/ip-address-extractor): 从日志文件、服务器日志、网络跟踪或任何文本内容中提取IPv4和IPv6地址

## 示例

- [含表情符号的文本示例](https://elysiatools.com/zh/samples/text-with-emoji-samples): 用于测试表情符号提取的各种语言混合文本和Unicode表情符号
- [正则替换示例](https://elysiatools.com/zh/samples/regex-replace): 用于文本转换和数据清洗的常用正则替换模式集合
- [文本日期示例](https://elysiatools.com/zh/samples/text-with-date-samples): 包含各种日期格式的文本，用于测试日期提取和解析
- [重复行示例](https://elysiatools.com/zh/samples/text-duplicate-line-samples): 用于测试重复行移除工具的各种重复行类型的示例文件

## 相关内容

- [文本提取工具专题](https://elysiatools.com/zh/hubs/text-extract): 汇集 15 个可从混合文本、Markdown、HTML 与日志中提取链接、邮箱、手机号、日期、Emoji 和结构化字段的工具。
- [文本大小写、编码与规范化转换工具](https://elysiatools.com/zh/hubs/text-convert): 在一个专题中比较文本大小写转换、全半角转换、编码转换、Quoted-Printable 处理和行内文本规范化工具。
- [Text 工具专题](https://elysiatools.com/zh/hubs/text-utility): 探索 33 个围绕 text 的 utility 工作流工具，快速找到相近能力。
- [文本分析、可读性与内容检查工具](https://elysiatools.com/zh/hubs/text-analyze): 在一个专题中比较文本统计、语言识别、可读性评分、情感分析、内容审核和模式分析工具。
