MultiIndex切片疑问:iloc[:2,:2]结果解析与索引起始咨询
关于MultiIndex的iloc切片疑问解答
为什么执行health_data.iloc[:2, :2]会得到该结果?
iloc是基于整数位置的索引方法,它不关心DataFrame的索引(包括多级索引MultiIndex)的标签内容,只按行和列的绝对位置来选取数据,位置从0开始计数。
行维度分析:
原health_data共有4行数据,对应的位置索引为0、1、2、3:
- 位置0:2013年visit1
- 位置1:2013年visit2
- 位置2:2014年visit1
- 位置3:2014年visit2
iloc[:2]表示选取前2行(位置0和1),也就是2013年的两次visit数据。
列维度分析:
原数据的列是二级MultiIndex,展开后对应的位置索引为0到5:
- 位置0:
(Bob, HR) - 位置1:
(Bob, Temp) - 位置2:
(Guido, HR) - 位置3:
(Guido, Temp) - 位置4:
(Sue, HR) - 位置5:
(Sue, Temp)
iloc[:, :2]表示选取前2列(位置0和1),也就是Bob的HR和Temp数据。
将行和列的选取结果组合,就得到了你看到的仅包含Bob的2013年两次visit的HR和Temp数据。
多级索引矩阵的索引起始位置是哪里?
无论是多级索引还是普通索引,使用iloc时的索引起始位置都是0,和常规的Python序列索引逻辑一致。iloc完全基于数据在DataFrame中的物理位置,和索引的标签值无关。
内容的提问来源于stack exchange,提问作者Nora
相关产品推荐
相关产品推荐

