提取 使用指南
本文介绍如何使用HeronTool的提取工具从文本中精准抓取邮箱、URL、电话等数据。只需三步:粘贴文本、选择工具、一键提取。
步骤一:准备文本
复制目标文本(如网页源码、邮件内容或日志文件)。若文本为HTML格式,建议先用HTML 转文本工具将其转为纯文本,避免标签干扰提取。
步骤二:选择提取工具
根据数据类型,在HeronTool中选择对应工具:
- 提取邮箱:自动识别所有邮箱地址。
- 提取网址:提取所有链接,配合链接提取可获取带锚文本的列表。
- 提取电话:匹配常见电话号码格式(支持国际区号)。
- 正则提取:高级用户可自定义正则表达式,灵活提取任意模式的数据。
步骤三:执行并导出
粘贴文本后点击“提取”,结果即时显示。可复制结果,或导出为CSV文件。若需批量处理多个文件,使用正则提取并保存规则,可重复使用。
常见问题(FAQ)
Q:提取结果包含重复项怎么办?
A:在“提取邮箱/网址/电话”工具中,默认去重;若需保留重复,可在设置中关闭“去重”选项。
Q:正则提取不生效?
A:请检查正则表达式是否正确,并确保“提取内容”选择正确(如提取匹配文本或捕获组)。建议先用简单表达式测试。
Q:提取大型文件时速度慢?
A:建议先用HTML转文本压缩内容,或分割文件处理。HeronTool优化了性能,但超大文本需稍候。
文章标签