如何使用GNU sed格式化浮点数至8位小数(补尾零与前导零)
解决方案:用GNU sed结合shell命令实现浮点数格式化
1. 处理纯数字行
针对单独的整数/浮点数输入,我们先通过sed标准化数字格式,再调用printf完成补零:
sed -E ' # 补全无整数部分的小数前导零(如 .38 → 0.38) s/^([+-]?)\./\10./; # 为无小数部分的整数添加小数点和占位零(如 0 → 0.0,126 → 126.0) s/^([+-]?[0-9]+)$/\1.0/; # 调用printf格式化,LC_NUMERIC确保使用点号作为小数分隔符 e "LC_NUMERIC=en_US.UTF-8 printf \"%.8f\n\" $0" ' input.txt
效果验证
输入:
0 126 99.0234 .38 -47.88 -234.23001101 40565004.22
输出:
0.00000000 126.00000000 99.02340000 0.38000000 -47.88000000 -234.23001101 40565004.22000000
2. 处理<rowNo>|<date time>|<number>格式的行
你原有命令失效的原因是:sed默认仅做字符串替换,不会执行$(...)中的shell命令。需要使用GNU sed的e修饰符,让sed执行替换后的shell代码:
sed -E ' s/^([0-9]+)\|([^|]+)\|([+-]?[0-9]*\.?[0-9]*)$/echo "\1|\2|$(LC_NUMERIC=en_US.UTF-8 printf \"%.8f\" \3)"/e ' test.csv
命令解释
-E:启用扩展正则表达式,简化分组写法- 正则
^([0-9]+)\|([^|]+)\|([+-]?[0-9]*\.?[0-9]*)$:精准匹配三列结构,第三组捕获所有合法数字格式(含正负号、整数、小数) - 替换语句:保留前两列内容,对第三列调用
printf完成格式化 e修饰符:触发sed执行替换后的完整shell命令,输出最终格式化结果
效果验证
输入:1|2024-02-01 00:27:16|.38
输出:1|2024-02-01 00:27:16|0.38000000
关键注意事项
- 必须使用GNU sed:
e修饰符是GNU sed的扩展功能,POSIX标准sed不支持 LC_NUMERIC=en_US.UTF-8:强制printf使用点号作为小数分隔符,避免本地化环境的干扰- 输入适配:由于你提到输入是最多8位小数的字符串,
printf %.8f会直接补零到8位;若输入小数部分超过8位,会自动四舍五入(符合你的补充说明需求)
内容的提问来源于stack exchange,提问作者Zaphod Beeblebrox
相关产品推荐
相关产品推荐

