CamVid12图像分割数据集标签获取及32类转12类规则问询
CamVid12 数据集获取与32类转12类规则说明
一、现成的CamVid12数据集
- 不少基于SegNet/ESPNet的开源复现项目里,会直接提供预处理好的带12类掩码的CamVid12数据集,你可以在代码托管平台搜索关键词「CamVid12」「SegNet CamVid12 dataset」,这类项目的data目录或release板块通常会包含完整的标注文件。
- 部分学术数据集分享社区的用户专区也有整理好的版本,下载后建议核对标注类别与论文描述是否一致,避免出现偏差。
二、32类转12类的详细合并规则
SegNet和ESPNet采用的12类合并规则是统一的,具体对应关系如下(原32类→合并后12类):
- Sky → Sky
- Building、Wall、Fence、GuardRail、Bridge、Tunnel → Building
- Pole、TrafficLight、TrafficSign → Pole
- Vegetation、Terrain → Vegetation
- Tree → Tree
- Car、Truck、Bus、Train、Motorcycle、Bicycle → Vehicle
- Pedestrian、Person_sitting、Child、Stroller、Wheelchair → Pedestrian
- Road、LaneMerking、RoadMerking → Road
- Sidewalk、ParkingBlock、SidewalkMerking → Sidewalk
- ParkingSpace → ParkingSpace
- Animal → Animal
- 剩余未列出的类别(如Void、Dynamic等)统一归为无效类(通常用黑色或特定灰度值标记)
你可以基于这个映射规则编写批量处理脚本,用Python的PIL或OpenCV库遍历原32类掩码图像,将对应像素值替换为12类的目标值。
内容的提问来源于stack exchange,提问作者Jonah
相关产品推荐
相关产品推荐

