如何将单列CSV拆分为多个行数均等、带id表头的文件,仅用awk/sed实现?
解决方案
以下是使用awk实现需求的命令,无需其他工具,直接执行即可得到符合要求的拆分文件:
awk ' # 读取表头并存储 NR == 1 { header = $0 next } # 计算当前数据行归属的目标文件名 { file_num = int((NR - 2) / 2) + 1 target_file = "file" file_num ".csv" # 首次写入该文件时先写入表头 if (!(target_file in created)) { print header > target_file created[target_file] = 1 } # 写入当前数据行 print $0 > target_file } ' file.csv
命令说明
- 第一行读取原文件的表头
id存入变量,跳过后续对第一行的处理 - 从第二行开始为数据行,按每2行划分到一个文件的规则,计算对应的目标文件名
- 每个目标文件第一次写入时,会先写入表头,保证每个拆分后的文件都带表头
- 最终生成的
file1.csv/file2.csv/file3.csv内容和你给出的示例完全一致
如果需要调整每个文件的数据条数,只需要把代码里int((NR - 2) / 2) + 1中的分母2改成你需要的单文件数据条数即可。
内容的提问来源于stack exchange,提问作者aalokkumar
相关产品推荐
相关产品推荐

