field of view与receptive field的核心差异是什么
Field of View与Receptive Field的核心区别
两个概念应用场景和参照主体完全不同,不存在包含关系,具体差异可以直接对照定义和实际场景区分:
- Field of View(FOV,视场/视野)
参照主体是整套观测/成像设备,描述的是设备单次工作能够捕获到的物理空间范围,是纯光学/观测边界类的指标。
比如你用运动相机拍第一视角视频,相机镜头水平FOV是120度,意思是镜头正前方左右各60度夹角内的景物都会被拍进画面,超出这个角度的内容完全不会进入成像范围;人眼保持头部、眼球不动时能看到的水平范围大概150度,这也是人眼视觉的FOV。这个指标只和设备的光学结构、观测位置有关,和后续的信号、图像处理逻辑没有关系。 - Receptive Field(RF,感受野)
参照主体是视觉处理系统(生物视觉、卷积神经网络等)内部的单个处理单元(神经元、卷积输出特征点),描述的是能够影响这个单元输出结果的原始输入区域大小,是信号处理层面的指标。
比如卷积神经网络里,经过2层33卷积输出的特征图上,单个像素点的感受野是55,意思是只有原始输入图上对应位置5*5像素范围内的数值变化,会改变这个特征点的输出,范围外的像素无论怎么调整,都不会对这个点的结果产生影响;猫的初级视皮层里某个神经元,只会对视网膜上某块极小区域的定向光条产生放电反应,这块能触发它响应的视网膜区域,就是这个神经元的感受野。
直观类比:你坐在家里通过防盗门的猫眼观察楼道,猫眼能让你看到的楼道整体范围就是FOV;而你盯着楼道里的快递盒时,你视觉系统里能感知到快递盒边缘细节的对应神经元,能覆盖的快递盒局部区域就是感受野。
内容的提问来源于stack exchange,提问作者DataKing
相关产品推荐
相关产品推荐

