GNU Awk报attempt to use scalar as array错误求助
问题根本原因
该报错由不同版本GNU Awk对未定义变量的类型推断逻辑差异导致:
脚本执行时匹配到第一行>Cluster 0会优先调用display()函数,此时gene_ids还未被赋值为数组,属于未定义变量:
- MacPorts编译的GNU Awk对该场景做了兼容处理,未定义变量传入
length()时不会固定变量类型,后续仍可被初始化为数组 - Ubuntu环境下的GNU Awk(包括同版本自定义编译的版本)类型检查更严格,未定义变量传入
length()时会被默认初始化为标量空字符串,后续执行gene_ids[$7] = 1尝试将标量作为数组使用,就会抛出attempt to use scalar 'gene_ids' as an array错误。
可行解决方案
以下两种方案均可解决问题,任选其一即可:
方案1:提前初始化数组(推荐)
在BEGIN块中提前将gene_ids标记为数组类型,避免类型推断异常,修改后完整脚本如下:
#!/usr/bin/awk -f BEGIN { FS = "[_.]" # 对未定义变量执行delete操作会直接将其标记为数组类型,无额外副作用 delete gene_ids } function display() { if (length(gene_ids) > 1) for (j=0; j <= i; j++) print a[j] } { if (/^>Cluster /) { display() delete a delete gene_ids a[i=0] = $0 } else { a[++i] = $0 gene_ids[$7] = 1 } } END { display() }
方案2:跳过首次空调用
增加首次执行标记,避免第一个Cluster加载前调用无意义的display():
#!/usr/bin/awk -f BEGIN { FS = "[_.]" # 标记是否为第一次遇到Cluster条目 is_first = 1 } function display() { if (length(gene_ids) > 1) for (j=0; j <= i; j++) print a[j] } { if (/^>Cluster /) { # 首次遇到Cluster时没有上一个待处理的条目,跳过display调用 if (!is_first) { display() } else { is_first = 0 } delete a delete gene_ids a[i=0] = $0 } else { a[++i] = $0 gene_ids[$7] = 1 } } END { display() }
两种方案在所有GNU Awk版本中均可正常运行,输出和原预期完全一致。
内容的提问来源于stack exchange,提问作者Rodolfo Aramayo
相关产品推荐
相关产品推荐

