如何批量选中多文件内所有匹配项(如正则匹配)并复制提取到文本文件
多文件正则匹配内容批量提取方案
Visual Studio Code 实现方法
VS Code原生支持该操作,不需要额外安装扩展,操作步骤如下:
- 打开待处理html文件所在的根文件夹作为工作区,按下快捷键
Ctrl+Shift+F(macOS系统为Cmd+Shift+F)调出全局搜索面板 - 点击搜索框旁的
.*按钮开启正则匹配模式,在搜索框输入你的提取正则,在「包含的文件」输入框填入*.html限定搜索范围,排除无关文件 - 等待搜索结果加载完成后,在搜索结果列表区域右键点击,选择复制所有匹配项,直接粘贴到空白文本文件即可得到所有匹配的内容,不会附带文件路径、上下文等冗余信息
- 如果使用的是旧版本VS Code没有该右键选项,可以点击搜索面板右上角的「在编辑器中打开结果」按钮,将所有搜索结果导入编辑器标签页,再通过正则替换功能删除非匹配的冗余行,即可得到纯匹配内容汇总。
其他可实现该需求的工具
如果觉得VS Code操作不够便捷,也可以选择以下工具实现:
- 系统自带命令行(无额外安装成本)
直接打开终端进入html文件所在目录,执行对应命令即可自动将匹配结果导出为文本文件:- Windows PowerShell环境执行:
Get-ChildItem -Filter *.html -Recurse | Select-String -Pattern '替换为你的正则表达式' -AllMatches | ForEach-Object { $_.Matches.Value } | Out-File 提取结果.txt -Encoding UTF8 - macOS/Linux 终端环境执行:
grep -r -h -o -E '替换为你的正则表达式' --include="*.html" ./ > 提取结果.txt
提取结果.txt就是汇总好的所有匹配内容。 - Windows PowerShell环境执行:
- Notepad++(Windows平台免费工具)
打开软件后按Ctrl+Shift+F调出文件查找面板,选择正则匹配、指定搜索文件夹和文件后缀为html,搜索完成后可直接一键复制所有匹配内容,不需要提前加载整个工作区,轻量快速。 - PowerGREP(Windows平台专用提取工具)
支持高复杂度的正则规则、多规则并行提取,自带结果去重、格式化、二次筛选功能,适合处理上万份文件的复杂提取场景。
内容的提问来源于stack exchange,提问作者stst
相关产品推荐
相关产品推荐

