如何将Azure文件共享中的CSV文件读取为Pandas DataFrame
把Azure文件共享的CSV文本转换为Pandas DataFrame的方法
要解决这个问题,核心是把获取到的CSV文本内容转换成Pandas能识别的类文件对象,具体步骤如下:
导入额外依赖库
需要引入pandas和io.StringIO——后者可以把字符串包装成read_csv能处理的类文件对象。修改现有代码逻辑
拿到CSV文本内容后,用StringIO包裹,再传入pd.read_csv生成DataFrame。
完整代码示例:
from azure.storage.file import FileService import pandas as pd from io import StringIO storageAccount='...' accountKey='...' file_service = FileService(account_name=storageAccount, account_key=accountKey) share_name = '...' directory_name = '...' file_name = 'Name.csv' # 获取CSV文本,可指定编码(比如utf-8)避免乱码 file = file_service.get_file_to_text(share_name, directory_name, file_name, encoding='utf-8') # 将文本转换为DataFrame df = pd.read_csv(StringIO(file.content)) # 验证结果 print(df.head())
补充说明:
- 如果CSV用了特殊编码(比如gb2312),要在
get_file_to_text和read_csv中统一指定对应编码参数。 - 若CSV分隔符不是逗号,可在
pd.read_csv里加sep=';'这类参数调整。
内容的提问来源于stack exchange,提问作者Akansha
相关产品推荐
相关产品推荐

