如何为Pandas DataFrame选择多段连续列范围?
解决Pandas多段连续列选择的简洁方法
你遇到的语法错误是因为Python列表里不能直接用0:6这种切片表达式作为元素——切片语法只能用来提取已有序列的子集,不能直接放在列表里当元素使用。下面给你两种简洁的实现方式,替代手动列所有索引的麻烦:
方法1:用range()生成连续索引列表
range()可以生成连续的整数序列,把需要的多个范围生成列表后合并,再传给columns参数:
import pandas as pd # 生成目标列索引:0-6(包含) + 12-15(包含) # 注意range是左闭右开,所以range(7)对应0-6,range(12,16)对应12-15 selected_cols = list(range(7)) + list(range(12, 16)) data = pd.read_excel(rf'C:\Users\dusti\Desktop\bulk export.xlsx', sheet_name=1, header=None) df = pd.DataFrame(data, columns=selected_cols) df.to_csv(rf'C:\Users\dusti\Desktop\bulk export1.csv', header=False, index=False) print(df)
方法2:用iloc直接选择列范围
更符合Pandas风格的写法是用iloc(按位置索引选择),直接指定列的范围组合,无需提前生成列表:
import pandas as pd data = pd.read_excel(rf'C:\Users\dusti\Desktop\bulk export.xlsx', sheet_name=1, header=None) # iloc[:, 列索引列表]:冒号表示选择所有行,后面是需要的列索引组合 df = data.iloc[:, list(range(7)) + list(range(12, 16))] df.to_csv(rf'C:\Users\dusti\Desktop\bulk export1.csv', header=False, index=False) print(df)
如果你的列范围更多,还可以把这些范围存到一个列表里,再用循环合并,比如:
ranges = [(0,7), (12,16), (20,25)] selected_cols = [] for start, end in ranges: selected_cols.extend(range(start, end))
这样后续修改列范围会更方便。
内容的提问来源于stack exchange,提问作者ah2Bwise
相关产品推荐
相关产品推荐

