如何正确索引二维NumPy数组?为何y[0:12][0]未取到第一列?
二维NumPy数组切片误区解析
问题背景
我编写脚本读取多个.txt文件,将内容填充到12行4列的二维NumPy数组y中。尝试切片时发现y[0:12][0]与y[0][0:12]返回结果一致,都是第一行数据。原本预期y[0:12][0]会返回第一列的所有元素(从0.7202到9.860),功能已通过其他方法实现,但想明确错误原因。
代码示例
print(y) [['0.7202', '0.3344', '0.4673', '1.480'], ['0.6879', '0.3133', '0.4359', '1.358'], ['0.5888', '0.2536', '0.3494', '1.018'], ['0.4579', '0.182', '0.2482', '0.6607'], ['0.7271', '0.5603', '0.7601', '1.832'], ['0.8885', '1.106', '1.441', '2.628'], ['1.251', '2.111', '2.552', '3.695'], ['1.842', '3.712', '4.153', '5.135'], ['1.415', '1.768', '2.602', '7.858'], ['2.892', '5.557', '7.303', '15.74'], ['5.635', '13.94', '16.00', '26.41'], ['9.860', '27.31', '27.72', '36.66']] print(y[0:12][0]) ['0.7202', '0.3344', '0.4673', '1.480'] print(y[0][0:12]) ['0.7202', '0.3344', '0.4673', '1.480']
错误原因
你混淆了链式切片和多维切片的逻辑:
y[0:12][0]是两次独立的一维切片:- 第一步
y[0:12]:取出数组的前12行(即整个数组,因为原数组只有12行),返回的仍是12行4列的二维数组。 - 第二步
[0]:对第一步返回的二维数组取第0行,最终得到第一行数据。
- 第一步
y[0][0:12]是先取第0行(一维数组),再取该一维数组的前12个元素(但该行仅4个元素,故返回整个第一行),结果自然与前者一致。
正确获取第一列的方法
要获取第一列所有元素,需使用NumPy的多维切片语法,在单个方括号内同时指定行和列的范围:
# 取所有行的第0列(完整写法) print(y[0:12, 0]) # 更简洁的写法,冒号表示取对应维度的全部元素 print(y[:, 0])
执行后会得到预期的第一列元素:['0.7202', '0.6879', '0.5888', ..., '9.860']
内容的提问来源于stack exchange,提问作者Frosty Pookie
相关产品推荐
相关产品推荐

