Spark Excel库无法读取整列数据,仅能读取指定单元格范围的问题咨询
Spark Excel库无法读取整列数据,仅能读取指定单元格范围的问题咨询
我最近在用Spark Excel库把Excel文件读取成Dataset<Row>,遇到了一个奇怪的问题,想请教大家。
当我用以下配置读取指定单元格范围时,一切都很顺利,Dataset<Row>能正常实例化:
String filePath = "file:///Users/myuser/example-data.xlsx"; Dataset<Row> dataset = spark.read() .format("com.crealytics.spark.excel") .option("header", "true") .option("inferSchema", "true") .option("dataAddress", "'ExampleData'!A2:D7") .load(filePath);
但只要我改成读取A到D的整列数据,得到的就是一个空的Dataset<Row>:
// dataset will be empty .option("dataAddress", "'ExampleData'!A:D")
我还试过分开设置sheetName和dataAddress,结果还是空数据集:
// dataset will be empty .option("sheetName", "ExampleData") .option("dataAddress", "A:D")
甚至改用sheetIndex(试过0和1两种索引,不确定是不是0-based的),搭配整列范围的dataAddress,结果依旧是空的:
// dataset will be empty; and I have experimented by setting it to 0 as well // in case it is a 0-based index .option("sheetIndex", 1) .option("dataAddress", "A:D")
想问问大家,这是Spark Excel库的预期行为吗?还是我遇到了一个bug?或者是我没有正确使用Options API?
备注:内容来源于stack exchange,提问作者IamYourFaja
相关产品推荐
相关产品推荐

