# 文本提取器

提取特定模式（电子邮件、电话、URL、数字）

> 标准页面: https://elysiatools.com/zh/tools/text-extractor

- **分类:** Text Processing

- **关键词:** text, extractor, pattern, email, phone, URL, number, extract, Text Extractor

## 概述

文本提取器是一款高效的在线工具，旨在帮助用户从杂乱的文本中快速筛选并提取电子邮件、电话号码、URL、数字或日期等特定信息，支持自定义正则表达式以满足复杂的数据处理需求。

## 输入项

- **文本输入** (textarea): Enter text to extract patterns from...
- **提取类型** (select)
- **自定义模式** (text): Enter regex pattern...
- **区分大小写** (checkbox)
- **输出格式** (select)

## 适用场景

- 从长篇文档或网页内容中快速整理联系人列表时。
- 需要从非结构化文本中清洗出特定格式的数据进行分析时。
- 在处理大量日志或代码片段，需要提取特定标识符或数值时。

## 工作原理

- 将需要处理的原始文本粘贴到输入框中。
- 在“提取类型”中选择预设模式（如电子邮件、电话），或选择“自定义”并输入正则表达式。
- 根据需求选择输出格式（如列表、逗号分隔或仅统计数量）。
- 点击执行，工具将自动扫描并提取符合条件的所有内容。

## 使用案例

- 市场营销：从客户反馈或评论中批量提取联系邮箱。
- 数据分析：从非结构化报告中提取所有关键数值进行汇总。
- 网络爬虫：从抓取的网页源代码中提取所有链接地址。

## 常见问题

### 文本提取器支持哪些预设模式？

目前支持提取电子邮件、电话号码、URL、数字和日期。

### 如果预设模式无法满足需求怎么办？

您可以选择“自定义”模式，并输入您自己的正则表达式（Regex）来匹配特定的文本格式。

### 可以去除提取结果中的重复项吗？

可以，在“输出格式”选项中选择“唯一项（Unique Items）”即可自动过滤重复内容。

### 该工具是否区分大小写？

是的，您可以勾选“区分大小写”选项来控制匹配逻辑。

### 提取结果支持哪些导出格式？

支持按行列表、逗号分隔、仅统计数量或提取唯一项四种格式。

## 相关工具

- [手机号提取器](https://elysiatools.com/zh/tools/phone-number-extractor): 从混合文本中提取电话号码，支持多个国家和格式
- [跳行提取器](https://elysiatools.com/zh/tools/step-line-extractor): 按指定间隔模式提取文本行，完美适用于每隔N行提取一行或跳过指定行数后提取多行
- [文本行提取器](https://elysiatools.com/zh/tools/text-line-extractor): 根据行号或范围从文本中提取指定行
- [AI货币和数字提取器](https://elysiatools.com/zh/tools/ai-currency-extractor): 使用AI智能提取文本中的数字、货币和金融金额，保留原始格式
- [批量邮箱提取器](https://elysiatools.com/zh/tools/bulk-email-extractor): 从输入文本、文章、网页源码或混合内容中提取所有邮箱地址。支持去重和导出为JSON格式。
- [批量URL/链接提取器](https://elysiatools.com/zh/tools/bulk-url-extractor): 从文本中提取所有HTTP/HTTPS链接，支持去重和导出功能
- [汉字提取器](https://elysiatools.com/zh/tools/chinese-character-extractor): 从文本中提取所有中文字符，过滤掉标点符号、英文字母、数字和非中文符号
- [数字和金额提取器](https://elysiatools.com/zh/tools/currency-extractor): 从文本中提取数字，支持货币符号和千位分隔符

## 示例

- [含表情符号的文本示例](https://elysiatools.com/zh/samples/text-with-emoji-samples): 用于测试表情符号提取的各种语言混合文本和Unicode表情符号
- [手机号提取器示例](https://elysiatools.com/zh/samples/phone-number-extractor): 包含来自多个国家的电话号码的混合文本集合，用于提取测试
- [文本日期示例](https://elysiatools.com/zh/samples/text-with-date-samples): 包含各种日期格式的文本，用于测试日期提取和解析
- [包含敏感数据的文本示例](https://elysiatools.com/zh/samples/text-with-sensitive-data-samples): 包含各种类型敏感数据的文本样本，用于测试数据脱敏（电话、邮箱、身份证、银行卡）

## 相关内容

- [PII 检测与日志脱敏复核](https://elysiatools.com/zh/hubs/pii-log-redaction): 在日志、文本和 PDF 中发现疑似个人信息，生成脱敏候选稿，校验标识符模式，并在共享前要求人工审批。
- [从文本、HTML、Markdown 与日志提取结构化信号](https://elysiatools.com/zh/hubs/text-extract): 用清晰的提取路径，把混合文本中的链接、属性、日期、日志字段和敏感匹配结果整理成可复核的数据。
