如何从MD5.txt的文件列表中隔位拼接对应的fq.gz测序文件?
fq.gz文件拼接解决方案
错误原因
你之前编写的脚本是将存储文件名的临时文本文件进行拼接,没有调用文件名对应的实际测序文件,因此得到的结果不符合预期。
解决方案
通用一行命令(自动识别样本ID,无需手动修改参数)
直接复制以下命令到终端执行即可:
ID=$(awk 'NR==1{split($2,a,"_");print a[1]}' MD5.txt); cat $(awk 'NR==1||NR==3{print $2}' MD5.txt) > ${ID}_L4_1.fq.gz; cat $(awk 'NR==2||NR==4{print $2}' MD5.txt) > ${ID}_L4_2.fq.gz
说明
- 全程不会生成任何临时文件,执行完成后直接得到你需要的
NGS35_L4_1.fq.gz和NGS35_L4_2.fq.gz两个拼接后文件 - 适配你给出的MD5.txt文件结构,只要文件内顺序保持你示例的格式就可以正常运行
内容的提问来源于stack exchange,提问作者lecb
相关产品推荐
相关产品推荐

