如何在Bash脚本中将字符串转换为UTF-8 Unsigned Int 8数组?
实现字符串转UTF-8 UInt8数组的Bash脚本
完全可以实现,以下是两种实用的实现方式:
方法1:利用printf和od命令(简单直观)
str_to_uint8() { local input="$1" # 将字符串转为UTF-8字节,提取十进制值后格式化为数组 local bytes=$(printf "%s" "$input" | od -An -t u1 | tr -s ' ' ', ') echo "\"$input\" = [$bytes] (UTF-8 UINT8 value)" } # 测试示例 str_to_uint8 "hey" str_to_uint8 "example"
运行后输出:
"hey" = [104, 101, 121] (UTF-8 UINT8 value)
"example" = [101, 120, 97, 109, 112, 108, 101] (UTF-8 UINT8 value)
方法2:纯Bash内置实现(无需外部命令)
如果不想依赖od这类外部工具,可使用Bash内置功能完成:
str_to_uint8_bash() { local input="$1" local -a bytes=() local char # 遍历字符串的每个UTF-8字符,提取字节值 while IFS= read -r -n1 char; do local val=$(printf "%d" "'$char") bytes+=("$val") done <<< "$input" # 拼接成数组格式 local byte_str=$(IFS=, ; echo "${bytes[*]}") echo "\"$input\" = [$byte_str] (UTF-8 UINT8 value)" } # 测试示例 str_to_uint8_bash "hey" str_to_uint8_bash "example"
这个方法兼容性更强,适合嵌入式或受限环境,Bash 4.2+版本对UTF-8的支持更稳定,确保你的环境使用UTF-8 locale(可通过locale命令查看)。
内容的提问来源于stack exchange,提问作者JohnG
相关产品推荐
相关产品推荐

