1 引言
1.1 研究背景
目标检测是一种应用特定计算机算法在图像中找到所需目标的技术。近年来,随着 计算机硬件的不断发展,目标检测的各种算法也迎来了巨大的突破,越来越多地应用于 交通检测、智能支付、医疗影像等各个方面。在计算机视觉中,目标检测是要比图像分 类更复杂的一个问题,它不仅要清楚目标的类型,还需做到目标的定位。所以,物体检 测的难度更大,挑战性更强,相应的深度学习模型也会更加复杂。
目标检测有许多算法,卷积神经网络(Convolutional Neural Networks, CNN)是其代 表算法之一。它是一个前馈神经网络,具有卷积计算和深度结构。目前,基于卷积神经网 络的目标检测算法大致可分为两种模式,即 twostage 模式和 onestage 模式,twostage 模 式的检测过程分为两个步骤:首先由算法生成若干个候选框,再通过 CNN 对候选框进行 分类;onestage 模式则是端到端的学习,直接对对目标的置信概率和位置进行回归,相 对来说精度有所损失,但速度较 twostage 模式的算法更快。[1]






















