Google Colab无法正常解析CSV文件,Jupyter Notebook可正常解析
解决Pandas在Google Colab中读取CSV时的ParserError问题
问题原因
你直接使用Google Drive的网页共享URL作为pd.read_csv的输入,这个URL指向的是文件的预览页面而非原始CSV文件本身。Pandas尝试解析网页HTML内容,自然会出现字段数不匹配的错误——这就是文件在本地Jupyter能正常读取,但Colab里报错的核心原因。
可行解决方案
方案1:挂载Google Drive到Colab**(推荐)**
这是最稳定的方式,能直接访问Drive中的所有文件:
from google.colab import drive drive.mount('/content/drive') # 替换为你Drive中文件的实际路径 train = pd.read_csv("/content/drive/MyDrive/你的文件夹路径/train.csv", sep=",", lineterminator='\n', header=0)
运行代码后会弹出授权链接,按步骤完成登录授权即可。
方案2:使用Google Drive文件的直接下载链接
将你的共享URL转换为直接下载格式:
- 原URL格式通常为:
https://drive.google.com/file/d/文件ID/view?usp=sharing - 转换为:
https://drive.google.com/uc?id=文件ID
然后用转换后的链接读取:
train = pd.read_csv("https://drive.google.com/uc?id=你的文件ID", sep=",", lineterminator='\n', header=0)
方案3:直接上传文件到Colab会话
如果文件体积不大,可直接上传到当前Colab会话:
from google.colab import files uploaded = files.upload() # 读取上传的文件(文件名替换为你上传的文件名) import pandas as pd train = pd.read_csv("train.csv", sep=",", lineterminator='\n', header=0)
运行代码后点击上传按钮选择本地文件即可,注意会话结束后上传的文件会被清除。
内容的提问来源于stack exchange,提问作者Álvaro V.
相关产品推荐
相关产品推荐

