Kaggle环境下DataFrame保存为CSV报只读文件系统错误如何解决
错误产生原因
Kaggle Notebook运行环境对默认工作路径做了只读权限限制,仅/kaggle/working/专属目录开放写入权限。你直接将文件写入当前相对路径,等同于写入只读目录,因此触发Read-only file system报错。
额外提醒:Kaggle的可写working目录单Notebook存储上限为20GB,你的数据量有2000万行,需要提前确认输出文件体积未超出该上限,避免后续存储空间不足报错。
解决方案
- 调整输出路径到可写目录,修改代码如下即可正常写入:
# 直接写入到可写working目录 df_merge.to_csv('/kaggle/working/processed.csv', sep='\t')
- 大文件存储优化:2000万行的CSV文件体积较大,建议开启压缩或更换存储格式降低空间占用:
- 开启gzip压缩存储CSV:
df_merge.to_csv('/kaggle/working/processed.csv.gz', sep='\t', compression='gzip') - 切换为读写效率更高、压缩比更大的parquet格式存储:
df_merge.to_parquet('/kaggle/working/processed.parquet')
- 开启gzip压缩存储CSV:
- 写入完成后,可在Notebook右侧「Data」栏的Output分类下找到生成的文件,点击即可下载到本地。
内容的提问来源于stack exchange,提问作者el-cheapo
相关产品推荐
相关产品推荐

