如何用egrep查找含指定字符串N次及以上的文件?SQL场景疑问
解决SQL文件筛选问题:找出包含3次及以上"CREATE TABLE"的文件
嘿,我来帮你搞定这个问题!你当前遇到的问题根源在于egrep默认是逐行匹配,你写的正则(CREATE TABLE.*){3}是要求在同一行内连续出现三次"CREATE TABLE"(中间可以夹杂任意内容),但实际SQL文件里每个CREATE TABLE语句基本都是单独成行或者分散在不同行的,所以这个正则根本匹配不到符合条件的文件,自然没有输出。
下面给你两个靠谱的解决方案:
方案一:用grep统计次数+awk筛选
这个方法先让grep统计每个SQL文件里CREATE TABLE的出现次数,再用awk过滤出次数≥3的文件名:
grep -c "CREATE TABLE" ./*.sql | awk -F: '$2 >= 3 {print $1}'
grep -c:输出每个文件的匹配次数,格式为文件名:匹配次数awk -F::以冒号为分隔符,提取文件名($1)和次数($2),当次数≥3时打印文件名
方案二:用awk直接处理文件
awk可以直接遍历每个文件,统计匹配次数并输出符合条件的文件名:
awk '/CREATE TABLE/{count++} END{if(count>=3) print FILENAME}' ./*.sql
/CREATE TABLE/{count++}:每匹配到一次CREATE TABLE,计数器count加1END{if(count>=3) print FILENAME}:处理完整个文件后,如果count≥3,就输出当前文件名
如果你的SQL文件分布在子文件夹里需要递归处理,只需要把./.sql换成./,再配合递归逻辑即可,比如用find命令调用awk:
find . -name "*.sql" -exec awk '/CREATE TABLE/{count++} END{if(count>=3) print FILENAME}' {} \;
内容的提问来源于stack exchange,提问作者PatrickSteiner
相关产品推荐
相关产品推荐

