You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

求助:用Bash/Awk将多文件对应列求和并合并为单个输出文件

多文件按关键字求和的Awk解决方案

你的核心需求是把多个文件里相同关键字($1字段)对应的数值($2字段)累加,之前的命令思路有误,paste会把文件横向拼接,导致无法正确累加所有对应位置的数值。

基础版命令(不保证顺序)

直接用Awk的数组实现累加,一行命令就能搞定:

awk '{sum[$1] += $2} END {for (key in sum) print key, sum[key]}' file*.txt > Output.txt

逻辑很直白:

  • 每读取一行,就把当前行的$2数值加到以$1为键的数组元素中
  • 所有文件处理完成后(END块),遍历数组输出每个关键字和对应的总和

保持原顺序的版本

如果需要输出顺序和原文件里关键字出现的顺序一致(比如按TEST0、TEST1的先后顺序),可以额外加一个数组记录首次出现的顺序:

awk '!seen[$1]++ {order[++n] = $1} {sum[$1] += $2} END {for (i=1; i<=n; i++) print order[i], sum[order[i]]}' file*.txt > Output.txt

这里!seen[$1]++会在关键字第一次出现时,把它存入order数组,最后按这个数组的顺序输出,就能和原文件的顺序完全匹配。

为什么你之前的命令无效

paste file*会把每个文件的对应行横向拼接,比如第一行会变成:

DATA:TEST0 20 DATA:TEST0 2 DATA:TEST0 44

这时候你写的$2=$1+$2是把字符串DATA:TEST0和数值20相加,Awk会自动把字符串转成0,结果就是0+20=20,完全没处理后面的2和44,自然得不到正确的总和。

内容的提问来源于stack exchange,提问作者James

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.25 10:36:22