使用sed提取包含指定字符串的完整数据块问题求助
解决sed提取完整数据块的问题
你需要调整sed的逻辑,先捕获整个以123开头、ZZZ结尾的数据块,再判断块内是否包含ABC,符合条件就输出完整块,而不是从ABC开始往后取。
正确命令(假设123和ZZZ是单独一行)
sed -n '/^123$/{:start;N;/^ZZZ$/!b start;/ABC/p}' testfile.txt > testfile2.txt
命令拆解
-n:只输出我们指定的内容,避免默认输出所有行/^123$/:定位到每个数据块的起始行(^和$确保是整行匹配123,避免部分匹配的干扰):start:定义一个循环标签,用来持续读取行直到数据块结束N:把下一行追加到当前模式空间(相当于把数据块的行逐步拼起来)/^ZZZ$/!b start:如果当前模式空间的最后一行不是ZZZ,就跳回start标签继续读取下一行,直到捕获完整数据块/ABC/p:当拿到完整数据块后,检查里面是否包含ABC,包含就输出整个块
如果你的123和ZZZ不是单独一行(比如是行内的前缀/后缀),可以去掉^和$,调整成:
sed -n '/123/{:start;N;/ZZZ/!b start;/ABC/p}' testfile.txt > testfile2.txt
原来的命令问题在于:它从找到ABC的位置才开始输出,自然会丢失ABC之前的块内容,而新命令是先抓全整个块,再筛选含ABC的块输出,就能拿到完整内容。
内容的提问来源于stack exchange,提问作者Omair Paracha
相关产品推荐
相关产品推荐

