在Wrangler中读取Excel时如何指定要读取的特定单元格范围
Wrangler读取Excel指定单元格范围的解决方案
根据你使用的Wrangler类型,可直接用对应内置参数实现需求,不需要额外组合列声明:
场景1:使用AWS Wrangler(awswrangler,现名AWS SDK for Pandas)
wr.s3.read_excel方法原生继承pandas read_excel的全部参数,直接组合参数即可匹配单元格范围:
usecols参数完全兼容pandas的列范围写法,支持列字母范围、列名列表、列索引列表三种格式,指定要读取的列区间skiprows参数指定跳过开头的行数,匹配范围的起始行nrows参数指定读取的总行数,匹配范围的结束行
读取B1:E450的示例代码:
import awswrangler as wr df = wr.s3.read_excel( path="你的文件路径(本地路径或S3路径均可)", sheet_name=0, # 可替换为你的工作表名称 usecols="B:E", # 对应B到E列的范围 skiprows=0, # 跳过0行,从Excel第1行开始读取 nrows=450, # 共读取450行,正好到Excel第450行 header=0 # 若B1为表头设置为0,无表头则设置为None )
场景2:使用Power Query Wrangler(Excel/ Power BI内置数据整理工具)
不需要导入全表再筛选,直接修改源步骤的M公式即可:
- 选中目标工作表导入后进入Power Query编辑器
- 找到公式栏的源步骤公式,在工作表选择后追加范围声明
- 修改后的示例公式:
Source = Excel.Workbook(File.Contents("你的本地Excel文件路径"), null, true){[Item="你的工作表名称",Kind="Sheet"]}[Data]{[Range="B1:E450"]}[Data]
修改后直接刷新即可加载指定范围的数据。
内容的提问来源于stack exchange,提问作者RaptorX
相关产品推荐
相关产品推荐

