如何配置本地CelebA数据集路径并管理已下载数据适配PyTorch?
适配PyTorch的CelebA数据集本地管理方案
1. 明确PyTorch预期的目录结构
PyTorch的CelebA数据集类默认要求的目录结构如下:
E:/BaiduNetdiskDownload/ celeba/ img_align_celeba/ 000001.jpg 000002.jpg ...(所有对齐人脸图片) list_attr_celeba.txt list_bbox_celeba.txt list_landmarks_align_celeba.txt list_eval_partition.txt ...(其他标注文件)
你的代码里root参数指定的是E:/BaiduNetdiskDownload,所以所有文件要整理到该路径下的celeba子目录中。
2. 确定需要解压的文件
针对你下载的压缩包,按以下规则处理:
- 必须解压:
img_align_celeba.zip,解压后得到img_align_celeba文件夹,直接放到celeba目录下。 - 必须解压:所有以
list_开头的标注文件压缩包(比如list_attr_celeba.txt.zip、list_bbox_celeba.txt.zip等),解压后将所有.txt文件移到celeba目录下。 - 可选解压:如果下载了
img_celeba.7z(原始未对齐图片),若任务不需要可以跳过;需要的话解压后放到celeba目录下,命名为img_celeba即可。
3. 验证目录结构
整理完成后,确认E:/BaiduNetdiskDownload/celeba/下存在:
img_align_celeba文件夹(包含所有jpg格式的人脸图片)- 全部
list_*.txt系列标注文件
4. 修改代码加载本地数据集
将代码中的download=True改为download=False,PyTorch就会自动读取本地已整理好的数据集:
torchvision.datasets.CelebA( root='E:/BaiduNetdiskDownload', download=False, transform=transform, target_type=target_type )
内容的提问来源于stack exchange,提问作者SHIYUKUN
相关产品推荐
相关产品推荐

