如何使用pandas选取Excel文件中的指定列并仅展示该列内容
pandas选取Excel指定列的实现方法
首先你需要先完成Excel文件的读取,再进行列筛选,完整实现方案如下:
- 第一步:读取Excel文件
import pandas as pd # 替换为你的本地文件路径,sheet_name可指定要读取的工作表,默认读取第一个工作表 df = pd.read_excel('示例文件.xlsx', sheet_name='Sheet1')
- 第二步:选取单列并输出内容
以下写法均会返回单列Series结构,直接打印即可看到该列所有内容
- 最简洁的常用写法(推荐日常使用)
videos_col = df['videos'] # 打印整列内容 print(videos_col) # 若不需要展示行索引,可使用以下写法 # print(videos_col.to_string(index=False)) # 也可转成列表格式输出 # print(videos_col.to_list())
- loc写法(适合需要同时按行筛选的场景)
你的原有写法可以简化为以下格式,无需额外判断列名:
videos_col = df.loc[:, 'videos'] print(videos_col)
- 如果你需要提取指定行该列的取值,直接一步操作即可,无需先取整列再取行:
# num为你要提取的行索引 videosvar = df.loc[num, 'videos'] print(videosvar)
原有代码优化提示:你写的
df.loc[:, df.columns == 'videos']返回的是DataFrame结构而非单列Series,存在不必要的结构冗余,直接指定列名字符串即可简化实现。如果要将列内容转为numpy数组,更推荐使用to_numpy()方法替代values属性,兼容性更强。
内容的提问来源于stack exchange,提问作者Nour Eldin Megahed
相关产品推荐
相关产品推荐

