阿尔茨海默症项目:如何向Google Colab导入整文件夹图像数据集?挂载报错求助
解决Google Colab导入图像数据集文件夹的问题
核心结论
完全可以将装满图像数据集的整个文件夹导入Google Colab,下面提供几种可靠方法,同时解决你遇到的挂载错误:
一、先修复当前的Drive挂载错误
你遇到的'file not found'和'Transport endpoint is not connected'错误,主要源于两个问题:
- 挂载路径误用反斜杠,Colab基于Linux环境,路径必须使用正斜杠
- 共享文件夹未添加到自己的Google Drive中
正确的Drive挂载步骤:
- 执行标准挂载代码:
from google.colab import drive drive.mount('/content/drive')
- 弹出授权链接后,登录Google账号,复制授权码粘贴到输入框完成挂载
- 若共享文件夹未显示,先打开共享链接,右键文件夹选择「添加到我的云端硬盘」,之后就能在
/content/drive/MyDrive/路径下找到该文件夹
挂载异常修复(针对Transport endpoint is not connected)
执行以下代码卸载后重新挂载:
!fusermount -u /content/drive drive.mount('/content/drive')
二、导入整个数据集文件夹的三种常用方法
方法1:通过Google Drive挂载(永久存储,适合长期使用)
挂载完成后,直接通过路径访问文件夹。比如你的数据集在Drive的Alzheimer_Dataset文件夹下,读取图像的代码示例:
import os dataset_path = '/content/drive/MyDrive/Alzheimer_Dataset' # 遍历文件夹下的图像 for img_name in os.listdir(dataset_path): img_path = os.path.join(dataset_path, img_name) # 后续处理逻辑
方法2:本地文件夹直接上传(临时使用,会话结束后文件消失)
- 点击Colab左侧面板的「文件」图标,选择「上传」,直接选中本地数据集文件夹上传
- 若文件夹过大,建议先打包成ZIP文件上传,再用代码解压:
!unzip Alzheimer_Dataset.zip -d ./Alzheimer_Dataset/
方法3:通过Google Cloud Storage(适合超大型数据集)
如果数据集超过Drive存储限额,可上传到Google Cloud Storage(GCS):
- 将文件夹上传到GCS桶中
- 在Colab中执行以下命令复制到本地:
!gsutil cp -r gs://your-bucket-name/Alzheimer_Dataset ./
内容的提问来源于stack exchange,提问作者The Flipper
相关产品推荐
相关产品推荐

