什么意思directorr 发布时怎么去边框

边框回归为什么宽高坐标会设計这种形式?
为什么边框回归只能微调在离Ground Truth近的时候才能生效?
这里引用王斌师兄的理解如下图所示:


对于上图,绿色的框表示Ground Truth, 红色嘚框为Selective Search提取的Region Proposal那么即便红色的框被分类器识别为飞机,但是由于红色的框定位不准(IoU<0.5) 那么这张图相当于没有正确的检测出飞机。 如果我們能对红色的框进行微调 使得经过微调后的窗口跟Ground Truth 更接近, 这样岂不是定位会更准确

继续借用师兄的理解:对于窗口一般使用四维向量(x,y,w,h)(x,y,w,h) 来表示, 分别表示窗口的中心点坐标和宽高 对于图 2, 红色的框 P 代表原始的Proposal, 绿色的框 G 代表目标的 Ground Truth, 我们的目标是寻找一种关系使得输入原始的窗口 P 经过映射得到一个跟真实窗口 G 更接近的回归窗口G^G^

中我们的输入以及输出分别是什么呢?

为什么宽高尺度会设计这种形式

首先CNN具有尺度不变性, 以图3为例: 

里面很多都是参考师兄在caffe社区的回答本来不想重复打字的,但是美观的强迫症让我手动把latex公式巴拉巴拉敲完,当然也为了让大家看起来顺眼后面还有一些公式那块资料很少,是我在阅读paper+个人总结不对的地方还请大家留言多多指正。

}

我要回帖

更多关于 什么意思director 的文章

更多推荐

版权声明:文章内容来源于网络,版权归原作者所有,如有侵权请点击这里与我们联系,我们将及时删除。

点击添加站长微信