在Jupyter中读取CSV文件时出现错误,原因是什么?
排查pandas读取CSV文件错误的常见原因
你执行的代码如下:
import pandas as pd df = pd.read_csv(r"C:\Users\deban\OneDrive\Desktop\spam.csv") df.head()
结合这类场景,常见错误原因及对应解决办法:
编码格式不匹配:
spam.csv这类公开数据集通常采用latin-1(或ISO-8859-1)编码,而pandas默认以utf-8格式读取,会触发解码错误。解决方式是指定编码参数:df = pd.read_csv(r"C:\Users\deban\OneDrive\Desktop\spam.csv", encoding='latin-1')文件路径或权限问题:尽管用了原始字符串避免转义,但OneDrive路径可能存在同步延迟、权限限制,导致文件无法被正常访问。可以:
- 确认文件确实存在于指定路径,未被OneDrive同步删除或移动
- 将文件复制到本地非OneDrive目录后再尝试读取
文件本身损坏:CSV文件可能存在格式异常(如换行符错误、字段分隔符混乱),可以用文本编辑器打开文件检查内容,或重新下载该数据集。
pandas版本兼容问题:旧版本pandas对某些CSV格式的支持不完善,尝试升级pandas:
pip install --upgrade pandas
内容的提问来源于stack exchange,提问作者DEBANJAN BHATTACHARJEE
相关产品推荐
相关产品推荐

