使用awk提取匹配模式前指定单词失败,求修正方法
问题分析与解决方法
嗨,我来帮你拆解下问题出在哪,以及怎么拿到你想要的结果~
你的操作为什么没得到期望结果?
你用的命令awk -F'secs' '{print $1}' abc.txt,是把整个文本以secs为分隔符切成了两段:
- 第一段是
source: hrs1bdapoc2:21002 1571426725(注意末尾的空格) - 第二段是
(436507.42 hrs) behind the primary
所以print $1会输出整个第一段内容,自然包含了前面的source:...部分,而不是单独的目标数字。你需要的是第一段里的最后一个字段,而不是整个第一段。
几种正确的解决方法
方法1:在awk里拆分第一段取最后一个字段
先用secs分割文本,再把第一段按空格拆分成数组,取数组最后一个元素:
delay_time=$(awk -F'secs' '{split($1, arr, " "); print arr[length(arr)]}' abc.txt) echo $delay_time
原理:split($1, arr, " ")把第一段内容按空格拆成数组arr,length(arr)拿到数组的总长度,取最后一个元素就是你要的数字。
方法2:直接匹配“secs前的数字”
用awk遍历所有字段,精准找到后面紧跟secs的纯数字字段:
delay_time=$(awk '{for(i=1;i<=NF;i++) if($i ~ /^[0-9]+$/ && $(i+1)=="secs") print $i}' abc.txt) echo $delay_time
原理:遍历每一个字段,检查当前字段是纯数字,且下一个字段正好是secs,符合条件就输出该数字,这种方式更精准,避免文本里有其他干扰数字的情况。
方法3:用grep的正则正向预查
如果你的系统grep支持Perl兼容正则(大部分Linux/macOS默认支持),可以直接用正向预查匹配secs前面的数字:
delay_time=$(grep -oP '\d+(?= secs)' abc.txt) echo $delay_time
原理:\d+匹配一串连续数字,(?= secs)是正向预查,确保这串数字后面跟着 secs,-o参数让grep只输出匹配到的部分,不会输出整行内容。
内容的提问来源于stack exchange,提问作者Abhinav
相关产品推荐
相关产品推荐

