如何用Pandas便捷实现MultiIndex的不连续列选择?
解决MultiIndex列DataFrame的精准列选择问题
直接构造包含目标列元组的列表,用DataFrame的索引直接选取即可,一步到位,无需拼接:
先看原始DataFrame的结构:
import pandas as pd df = pd.DataFrame(columns=pd.MultiIndex.from_product([['A','B'],[1,2,3,4]]), data=[[0,1,2,3,4,5,6,7],[10,11,12,13,14,15,16,17], [20,21,22,23,24,25,26,27]])
构造目标列的元组列表,直接索引:
# 定义需要选择的列,每个元素是(第一层索引, 第二层索引)的元组 target_cols = [('A', 1), ('A', 2), ('A', 4), ('B', 1), ('B', 3)] new_df = df[target_cols]
验证结果,new_df.columns会输出:
MultiIndex([('A', 1), ('A', 2), ('A', 4), ('B', 1), ('B', 3)], )
这种方法直接通过MultiIndex的元组匹配来选择列,比分别选取再拼接高效得多,代码也更简洁。
内容的提问来源于stack exchange,提问作者germ
相关产品推荐
相关产品推荐

