R读取固定宽度文件调用substr仅返回首行值问题排查
问题根因
你直接将整个data.frame对象作为入参传给了substr()函数,没有传入数据框中实际存储字符串的列向量,属于对R变量结构认知偏差导致的调用错误。
substr()要求第一个入参是字符型向量,传入结构为3行1列的data.framep2时,函数只会隐式提取数据框的第一个元素(即第一行的V1值)处理,不会逐行遍历所有记录。你最终拿到的只有第一行15-16位的字符"12",转数值求和自然返回12。- 额外的参数匹配问题:你调用
read.fwf时设置读取宽度为14,意味着每行最多读入14个字符,后续要截取15-16位的逻辑本身就和读取参数冲突,即使修正入参也会拿到空值。
修复方法
先调整文件读取宽度,确保目标数值段被完整读入,再传入对应列执行截取计算:
# 调整读取宽度为16,完整覆盖每行内容 p1 <- read.fwf(file="test.txt", width = 16) p2 <- as.data.frame(p1) # 传入存储字符串的V1列,而非整个p2数据框 sum(as.numeric(substr(p2$V1, start = 15, stop = 16)))
执行后返回结果为12+15+16=43,和逐行计算的预期结果一致。
优化建议:读固定宽度文件时可以直接按字段拆分宽度,无需后续手动截串。比如按字段位置将宽度参数设为
c(4,6,3),分别对应REC列、00000列、末尾数值列,读入后直接取第三列转数值求和,代码可读性更高。
内容的提问来源于stack exchange,提问作者Mich28
相关产品推荐
相关产品推荐

