使用PySpark/Databricks读取含重音命名的Blob存储文件报错
Databricks PySpark读取Azure Blob含重音符号文件名失败的解决方案
问题现象
在Databricks环境中使用PySpark读取Azure Blob存储内的文件时,若文件名包含重音符号(例如ávalon.json),会出现读取失败的情况。
报错信息
shaded.databricks.org.apache.hadoop.fs.azure.AzureException: java.util.NoSuchElementException: An error occurred while enumerating the result, check the original exception for details.
示例代码
container = "" storage_account = "" sas_token = "" wasb_file = f"wasbs://{container}@{storage_account}.blob.core.windows.net/ávalon.json" spark.conf.set(f"fs.azure.sas.{container}.{storage_account}.blob.core.windows.net", sas_token) spark.read.json(wasb_file)
解决方案
将文件名修改为无重音的名称(如avalon.json)后,即可正常读取文件。
内容的提问来源于stack exchange,提问作者psee
相关产品推荐
相关产品推荐

