CelebA人脸数据集10000个身份类别的标注信息查询
CelebA 身份标注获取及使用说明
- 你当前下载的仅为CelebA数据集的图像部分,身份标注属于独立的标注组件,和图像包分开发布。官方对应10000+身份的标注文件为
identity_CelebA.txt,覆盖数据集全部20余万张图像。 - 该标注文件每行记录对应一张图像,格式为
[图像文件名] [身份ID],身份ID为1到10177的连续整数,同一ID对应的所有图像属于同一个身份主体。 - 如果你需要生成按身份分类的子文件夹结构,可通过读取该标注文件做批量迁移,参考实现代码如下:
import os import shutil # 替换为你的本地路径 RAW_IMG_DIR = "./celebA/images" IDENTITY_ANNO_PATH = "./celebA/anno/identity_CelebA.txt" CLASSIFIED_OUTPUT_DIR = "./celebA/classified_by_id" os.makedirs(CLASSIFIED_OUTPUT_DIR, exist_ok=True) with open(IDENTITY_ANNO_PATH, "r", encoding="utf-8") as f: for line in f: img_name, identity_id = line.strip().split() # 生成单身份子文件夹 id_dir = os.path.join(CLASSIFIED_OUTPUT_DIR, f"identity_{identity_id}") os.makedirs(id_dir, exist_ok=True) # 复制图像到对应文件夹 shutil.copy2( os.path.join(RAW_IMG_DIR, img_name), os.path.join(id_dir, img_name) )
- 身份标注通常和人脸关键点标注、属性标注打包发布,压缩包命名一般为
Anno开头,你可以在获取原始图像包的同渠道查找该标注包资源即可。 - 注意如果下载的是CelebA的裁剪子集,需要找对应子集版本的身份标注,避免标注和图像文件名不匹配的问题
内容的提问来源于stack exchange,提问作者Nuha
相关产品推荐
相关产品推荐

