torchvision的AnchorGenerator的anchor尺寸对应输入图还是特征图?
PyTorch AnchorGenerator sizes参数答疑
核心结论
AnchorGenerator的sizes参数直接对应原始输入图像上的anchor物理尺寸,不需要手动结合backbone下采样倍率做换算。
逻辑说明
torchvision的AnchorGenerator实现中,已经内置了特征图到原始图像的尺度映射逻辑,你只需要额外传入对应特征层的下采样步长strides参数,内部会自动完成尺寸换算,不需要用户手动处理。
场景示例
针对你提到的测试场景:
- 检测目标在原始输入图像上的尺寸为32x32,宽高比为1.0
- 对应backbone包含2个步长为2的池化层,总下采样倍率为4
你只需要做如下参数设置即可,不需要手动计算32/(2^2)=8:
sizes参数传入(32,)- 对应特征层的
strides参数传入4
内容的提问来源于stack exchange,提问作者millivolt9
相关产品推荐
相关产品推荐

