Awk条件字段打印需求:关联Input.csv与Master.csv匹配输出
使用Awk实现跨CSV文件的匹配与筛选需求
需求回顾
你需要实现的逻辑是:
- 对比
Input.csv和Master.csv两个CSV文件 - 匹配条件:Input.csv第1字段(水果名) == Master.csv第2字段(水果名) 且 Master.csv第3字段(数量) < Input.csv第3字段(数量)
- 满足条件时,将两个文件对应的整行输出到
Desired Output.csv
核心Awk脚本与解释
这是专门针对你的需求写的Awk脚本,我会逐行解释每个部分的作用:
# 设置CSV字段分隔符为逗号(如果是制表符就改成FS="\t") BEGIN { FS = "," } # 处理第一个传入的文件:Master.csv NR == FNR { # 用水果名($2)作为数组键,存储Master的整行内容 master_record[$2] = $0 # 同时存储Master对应的数量值,方便后续对比 master_amount[$2] = $3 # 跳过后续逻辑,继续处理Master的下一行 next } # 处理第二个传入的文件:Input.csv $1 in master_record && master_amount[$1] < $3 { # 输出匹配的Master行 + Input行,写入目标文件 print master_record[$1] "," $0 > "Desired Output.csv" }
关键逻辑说明
NR == FNR:Awk的经典技巧,NR是全局总行数,FNR是当前文件的行数,当处理第一个文件(这里是Master.csv)时两者相等,我们先把Master的所有记录缓存到数组里。$1 in master_record:检查Input当前行的水果名(第1字段)是否在Master里有匹配记录。master_amount[$1] < $3:对比Master的数量是否小于Input的数量。
运行方式
方式1:保存为脚本文件运行
- 把上面的脚本保存为
fruit_filter.awk - 在终端运行:
awk -f fruit_filter.awk Master.csv Input.csv
方式2:一行命令直接运行
如果你不想存脚本,直接用单行命令:
awk 'BEGIN {FS=","} NR==FNR {m[$2]=$0; amt[$2]=$3; next} $1 in m && amt[$1]<$3 {print m[$1] "," $0 > "Desired Output.csv"}' Master.csv Input.csv
示例验证
假设你的文件内容如下:
Master.csv
ID,Fruits,Amount 1,Apple,15 2,Banana,25 3,Orange,10
Input.csv
Fruits,Price,Amount Apple,2.5,20 Banana,1.8,22 Orange,3.0,15
运行后Desired Output.csv的内容会是:
1,Apple,15,Apple,2.5,20 3,Orange,10,Orange,3.0,15
完全符合你的需求:Apple的Master数量15<20,Orange的10<15,都被输出;Banana的25>22不满足条件,被过滤。
额外注意事项
- 如果你的CSV包含带逗号的引号字段(比如
"Apple,Red",10),单纯用FS=","会拆分错误,这时候可以用Gawk的FPAT功能来正确解析CSV:BEGIN { FPAT = "([^,]+)|(\"[^\"]+\")" } # 后面的逻辑和之前一样 - 如果你想调整输出的分隔符(比如用制表符代替逗号),把
print语句里的","改成"\t"即可。 - 如果需要追加输出而不是覆盖文件,把
>改成>>。
内容的提问来源于stack exchange,提问作者DEC
相关产品推荐
相关产品推荐

