请求编写Bash脚本,匹配两文件指定字段并替换目标文件列内容
请求编写Bash脚本,匹配两文件指定字段并替换目标文件列内容
嗨,这个需求很常见,刚好可以用awk来高效解决——它处理这种按列匹配替换的场景特别顺手,应对你这几万行的文件完全没压力。下面给你几个实用的方案:
核心方案:用Awk建立映射关系替换
这是最直接高效的方法,先把FileA里的「第二列数字→第一列新名称」的映射存起来,再遍历FileB替换对应行的第一列:
awk -F',' 'NR==FNR {map[$2]=$1; next} {if ($2 in map) $1=map[$2]; print}' FileA FileB > FileB_updated
脚本解释:
-F',':指定逗号作为字段分隔符,这样每一行会被拆成$1、$2、$3三个字段NR==FNR:这个条件只对第一个输入文件(FileA)生效,我们把FileA的第二列值作为键,第一列的新名称作为值,存到map关联数组里next:跳过后续逻辑,继续读取FileA的下一行- 处理FileB时,检查当前行的第二列值是否在
map里,如果存在就把第一列替换成对应的新名称,最后打印整行 - 结果输出到
FileB_updated,避免直接修改原文件(更安全)
直接修改原文件的方法
如果你想直接覆盖FileB,有两种方式:
- 用
sponge(需要安装moreutils工具包),它可以避免临时文件的麻烦:
awk -F',' 'NR==FNR {map[$2]=$1; next} {if ($2 in map) $1=map[$2]; print}' FileA FileB | sponge FileB
- 没有
sponge的话,用临时文件中转:
awk -F',' 'NR==FNR {map[$2]=$1; next} {if ($2 in map) $1=map[$2]; print}' FileA FileB > temp_file && mv temp_file FileB
额外处理:匹配不到的行怎么办?
如果FileB里有第二列数字在FileA中不存在的行,上面的脚本会保留原第一列内容。如果你想标记这些行(比如加前缀),可以修改脚本:
awk -F',' 'NR==FNR {map[$2]=$1; next} {if ($2 in map) $1=map[$2]; else $1="NO_MATCH_"$1; print}' FileA FileB > FileB_updated
这样匹配不到的行第一列会变成NO_MATCH_oldname,方便你后续排查。
备注:内容来源于stack exchange,提问作者masoud hanifehzadeh
相关产品推荐
相关产品推荐

