读论文系列：Object Detection ECCV2016

作者: 梦里茶 | 来源:发表于2018-04-06 20:54 被阅读51次

转载请注明作者：梦里茶

Single Shot MultiBox Detector

Introduction

一句话概括：SSD就是关于类别的多尺度RPN网络

基本思路：

SSD

正样本
选择与bounding box jaccard overlap（两张图的交集/并集）大于0.5的anchor作为正样本
样本比例
Hard negative mining：由于负样本很多，需要去掉一部分负样本，先整图经过网络，根据每个anchor的最高类置信度进行排序，选择置信度靠前的样本，这样筛选出来的负样本也会更难识别，并且最终正负样本比例大概是1:3

还是一如既往的location loss + classification loss，并为location loss添加了系数α（然而实际上α=1）进行平衡，并在batch维度进行平均

SSD Loss

其中定位loss与faster rcnn相同

Location loss

这个式子里的k不是很明确，其实想表达不算背景0类的意思，且前景类只为match的类算location loss

分类loss就是很常用的softmax交叉熵了

classification

核心的内容到这里就讲完了，其实跟YOLO和faster rcnn也很像，是一个用anchor box充当固定的proposal的rpn，并且用多尺度的anchor来适应多种尺度和形状的目标对象。

在训练中还用到了data augmentation（数据增强/扩充），每张图片多是由下列三种方法之一随机采样而来

然后这些图片会被resize到固定的大小，随机水平翻转，加入一些图像上的噪声，详情可以参考另一篇论文：

Some improvements on deep convolutional neural network based image classification

从切除实验中，可以看到data augmentaion是很重要的（从65.6到71.6）

Experiment

这个表中还提到了atrous，指的是空洞卷积，是图像分割（deeplab）领域首先提出的一个卷积层改进，基于相邻像素冗余的假设，跳过相邻像素进行卷积，感受野更大，测试速度也更快。

具体可以参考 ICLR2015 Deeplab

从这个表中也可以看出多种形状的anchor可以提升准确率

输入尺寸为300x300，batch size为8的SSD300可以做到实时(59FPS)且准确(74.3% mAP)的测试

SSD算是一个改进性的东西，站在Faster RCNN的肩膀上达到了实时且准确的检测

读论文系列：Object Detection ECCV2016
转载请注明作者：梦里茶 Single Shot MultiBox Detector Introduction 一句...
FPN:feature pyramid networks for
论文：feature pyramid networks for object detection论文链接论文概述...
FPN（Feature Pyramid Networks for
论文题目：Feature Pyramid Networks for Object Detection论文地址：传送...
读论文系列：Object Detection SPP-net
本文为您解读ECCV2014 SPP-net: Spatial Pyramid Pooling in Deep C...
读论文系列：Object Detection NIPS2015
转载请注明作者：梦里茶 Faster RCNN在Fast RCNN上更进一步，将Region Proposal也用...
读论文系列：Object Detection CVPR2017
YOLOv2/YOLO9000 YOLO9000: Better, Faster, Stronger YOLOv2...
读论文系列：Object Detection ICCV2015
Fast RCNN是对RCNN的性能优化版本，在VGG16上，Fast R-CNN训练速度是RCNN的9倍, 测试...
读论文系列：Object Detection CVPR2016
CVPR2016： You Only Look Once:Unified, Real-Time Object De...
读论文系列：Object Detection · VOC终身成就
Object Detection其实是模式识别中一个比较老的领域了，Pascal VOC Challenge 从2...
目标检测中的上下文信息
Attentive Contexts for Object Detection 论文地址：https://arxi...