如何使用awk基于第一列对比两个文件并生成指定输出?
用awk实现双文件匹配替换方案
刚好可以用awk的数组特性完美解决这个需求,核心思路是先把file2的匹配规则存起来,再遍历file1做替换/保留操作,具体命令如下:
awk 'NR==FNR{a[$1]=$0; next} $1 in a{print a[$1]; next} 1' file2 file1
命令拆解说明
NR==FNR{a[$1]=$0; next}:这是awk处理多文件的经典技巧。当awk读取第一个文件(这里是file2)时,NR(全局记录数)和FNR(当前文件内的记录数)是相等的。我们把每行的第一列作为数组a的键,整行内容作为值存起来,next会跳过后面的代码,确保这部分只处理file2。$1 in a{print a[$1]; next}:切换到处理第二个文件(file1)时,检查当前行的第一列是否存在于之前存储的数组a中。如果匹配到,就打印file2中对应的那一行内容,next跳过后续操作避免重复输出。1:这是awk的简写语法,等价于print $0,会自动输出所有没匹配到的行(也就是file1中在file2找不到对应第一列的内容)。
验证效果
用你给出的示例文件测试:
- file1内容:
abc 123 def 456 ghi 789
- file2内容:
abc 321 ghi 987
运行命令后,输出结果正好是:
abc 321 def 456 ghi 987
完全符合你想要的匹配替换、保留原内容的需求~
内容的提问来源于stack exchange,提问作者R. Senterfeit
相关产品推荐
相关产品推荐

