You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

为何numpy的np.char.encode会将空unicode数组转为float64空数组?

空Unicode数组编码后为何变为float64类型?

我定义了一个空的Unicode数组:

a = np.array([], dtype=np.str_)

对其执行UTF-8编码:

b = np.char.encode(a, encoding='utf8')

得到的结果却是dtype=float64的空数组:

# array([], dtype=float64)

但如果数组非空,编码结果就是符合预期的dtype=|S[n]字节数组:

a = np.array(['ss', 'ff☆'], dtype=np.str_)
b = np.char.encode(a, encoding='utf8')
# array([b'ss', b'ff\xe2\x98\x86'], dtype='|S5')

解决方案(编辑补充)

若需要避免空数组编码后的类型异常,可使用以下代码处理:

if a.size == 0:
    encoded_array = np.chararray((0,))
else:
    encoded_array = np.char.encode(a, encoding='utf8')

这段代码会在原数组为空时,生成一个dtype='|S1'的空编码数组。

内容的提问来源于stack exchange,提问作者wrkyle

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.26 03:48:23