使用Google Drive链接加载数据集后调用data.head(10)报错
解决Google Drive链接加载CSV到Pandas的错误问题
问题根源
你用的是Google Drive的网页预览链接(带/view?usp=sharing),这种链接返回的是HTML页面而非原始CSV文件。Pandas错误地将HTML内容当作CSV解析,导致生成的DataFrame结构混乱、内存碎片化,最终触发PerformanceWarning和运行时错误。
解决方案
- 转换链接为可下载格式:提取Google Drive文件ID(原链接中
/d/和/view之间的部分:16M5AvCjoJKDVsqoBI2Wbgqxt-JPBEN9a),构造可直接下载的链接:https://drive.google.com/uc?export=download&id=你的文件ID - 修改代码并消除碎片化警告:
import pandas as pd # 替换为可下载链接 url = 'https://drive.google.com/uc?export=download&id=16M5AvCjoJKDVsqoBI2Wbgqxt-JPBEN9a' names = ['Class', 'id', 'Sequence'] data = pd.read_csv(url, names=names) # 复制DataFrame消除内存碎片化警告 data = data.copy() data.head(10)
补充说明
- 若文件较大或需要权限验证,可能需要额外处理cookie,但大部分公开文件用上述链接即可直接下载。
data.copy()会重新生成一个内存连续的DataFrame,彻底消除PerformanceWarning提示。
内容的提问来源于stack exchange,提问作者zuber shaikh
相关产品推荐
相关产品推荐

