如何使用sed/tr/awk等Unix工具通用替换所有转义序列为非转义等价字符
问题背景
处理Wireshark显示过滤器配置文件dfilter_buttons时,需要提取指定名称对应的过滤器规则,同时将规则内的所有十六进制转义序列批量替换为原始字符,适配后续新增的各类转义场景。
输入样例
"TRUE","test","sip contains \x22Hello, world\x5cx22\x22",""
期望输出
sip contains "Hello, world\x22"
现有问题
当前使用的awk脚本存在两处问题:
- 字段分隔符设置错误,原代码
FS="",""为无效写法,正确的CSV字段分隔符应为"," - 未对提取出的字段做通用转义序列还原,当前输出为:
sip contains \x22Hello, world\x5cx22\x22
通用解决方法
结合Perl的正则表达式替换能力,可以批量处理所有\xXX格式的十六进制转义序列,无需针对特定字符单独写规则,后续新增任意转义都可自动适配:
filter_name=test awk -v fname="$filter_name" 'BEGIN{FS="\",\""} $2==fname {sub(/^"/,"",$3); sub(/"$/,"",$3); print $3}' "$config_file" | perl -pe 's/\\x([0-9a-fA-F]{2})/chr(hex($1))/ge'
代码说明
- awk部分修正了字段分隔符,同时手动去除第三个字段首尾残留的双引号,准确提取原始规则字符串
- 后续管道接的Perl命令逻辑:匹配所有
\x加两位十六进制字符的序列,转换为对应的ASCII字符,g表示全局匹配,e表示把替换部分当做代码执行 - 该方案支持所有标准十六进制转义序列的还原,不需要为新增的转义字符修改规则
内容的提问来源于stack exchange,提问作者Rusty Lemur
相关产品推荐
相关产品推荐

