You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

torchvision的AnchorGenerator的anchor尺寸对应输入图还是特征图?

PyTorch AnchorGenerator sizes参数答疑

核心结论

AnchorGenerator的sizes参数直接对应原始输入图像上的anchor物理尺寸,不需要手动结合backbone下采样倍率做换算。

逻辑说明

torchvision的AnchorGenerator实现中,已经内置了特征图到原始图像的尺度映射逻辑,你只需要额外传入对应特征层的下采样步长strides参数,内部会自动完成尺寸换算,不需要用户手动处理。

场景示例

针对你提到的测试场景:

  • 检测目标在原始输入图像上的尺寸为32x32,宽高比为1.0
  • 对应backbone包含2个步长为2的池化层,总下采样倍率为4

你只需要做如下参数设置即可,不需要手动计算32/(2^2)=8:

  • sizes参数传入(32,)
  • 对应特征层的strides参数传入4

内容的提问来源于stack exchange,提问作者millivolt9

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.10.02 21:18:01