目标检测简介

2023年4月6日上午11:43 • 目标检测

1 什么是目标检测

　　目标检测（Object Detection）的任务是找出图像中所有感兴趣的目标（物体），确定它们的类别和位置，是计算机视觉领域的核心问题之一。由于各类物体有不同的外观，形状，姿态，加上成像时光照，遮挡等因素的干扰，目标检测一直是计算机视觉领域最具有挑战性的问题。

计算机视觉中关于图像识别有四大类任务：

分类-Classification：解决“是什么？”的问题，即给定一张图片或一段视频判断里面包含什么类别的目标。

定位-Location：解决“在哪里？”的问题，即定位出这个目标的的位置。

检测-Detection：解决“是什么？在哪里？”的问题，即定位出这个目标的的位置并且知道目标物是什么。

分割-Segmentation：分为实例的分割（Instance-level）和场景分割（Scene-level），解决“每一个像素属于哪个目标物或场景”的问题。

目标检测简介

2 目标检测要解决的核心问题

除了图像分类之外，目标检测要解决的核心问题是：

1.目标可能出现在图像的任何位置。

2.目标有各种不同的大小。

3.目标可能有各种不同的形状。

如果用矩形框来定义目标，则矩形有不同的宽高比。由于目标的宽高比不同，因此采用经典的滑动窗口+图像缩放的方案解决通用目标检测问题的成本太高。

3 目标检测算法分类

基于深度学习的目标检测算法主要分为两类：

1.Two stage目标检测算法

先进行区域生成（region proposal，RP）（一个有可能包含待检物体的预选框），再通过卷积神经网络进行样本分类。

任务：特征提取—>生成RP—>分类/定位回归。

常见的two stage目标检测算法有：R-CNN、SPP-Net、Fast R-CNN、Faster R-CNN和R-FCN等。

2.One stage目标检测算法

不用RP，直接在网络中提取特征来预测物体分类和位置。

任务：特征提取—>分类/定位回归。

常见的one stage目标检测算法有：OverFeat、YOLOv1、YOLOv2、YOLOv3、SSD和RetinaNet等。

目标检测简介

本站文章如无特殊说明，均为本站原创，如若转载，请注明出处：目标检测简介 - Python技术站

人工智能目标检测

赞 (0)

微信扫一扫

微信扫一扫

支付宝扫一扫

支付宝扫一扫

【计算机视觉】运动目标检测算法文献阅读笔记

上一篇 2023年4月6日

10行Python代码实现目标检测

下一篇 2023年4月6日

Keras

python+keras实现语音识别

科大讯飞:https://www.iflytek.com/ 版权声明：本文为CSDN博主「南方朗郎」的原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接及本声明。原文链接：https://blog.csdn.net/sunshuai_coder/article/details/83658625 仅做笔记，未实验市面上语音识别技术原理…

2023年4月8日
000
卷积神经网络

深度学习七(卷积神经网络)

转载：http://blog.csdn.net/zouxy09/article/details/8781543 接上 9.5、Convolutional Neural Networks卷积神经网络卷积神经网络是人工神经网络的一种，已成为当前语音分析和图像识别领域的研究热点。它的权值共享网络结构使之更类似于生物神经网络，降低了网络模型的复杂…

2023年4月8日
000
机器学习笔记—– ID3算法的python实战

本文申明：本文原创，如有转载请申明。数据代码来自实验数据都是来自【美】Peter Harrington 写的《Machine Learning in Action》这本书，侵删。 Hello,又和大家见面了，今天心情出奇的好，不知道为什么。就是好。。。此处省略一万字。。。上一次和大家说了，决策树的理论部分，今天我们就来动手帮助眼科医生做一个系统，让这个系统学…

机器学习 2023年4月12日
000
循环神经网络

时间序列(五): 大杀器: 循环神经网络

循环神经网络目录循环神经网络引言循环神经网络循环结构* RNN 结构* 双向循环神经网络深度循环神经网络穿越时间的反向传播算法反向传播算法* 一. 一个乘积: 二. 二个假设: 三: 三个步骤: 四: 四个基本方程**: BPTT** 总结参考方献: 引言上几节讲了一些时间序列的基本概念, 大家总感觉不那么的’智能’, 与现在的人工智能的…

2023年4月6日
000
使用基于Caffe的MobileNet分类踩坑备忘录

首先要帮Caffe甩个锅：Caffe对图像处理进行了很高明的封装，以protobuffer形式组织的搭积木式的网络构建也很灵活方便，这里的坑都是自己腿不好，走路不稳崴进去的。 1. Caffe的一个iter是一个batch，不是一个epoch。 2. 使用现有模型存档对网络进行fine_tune的时候，由于改变了输出的number，最后一层必须重新命名，目的…

Caffe 2023年4月8日
000
pytorch loss总结与测试

pytorch loss 参考文献： https://blog.csdn.net/zhangxb35/article/details/72464152?utm_source=itdadao&utm_medium=referral loss 测试 import torch from torch.autograd import Variable ”…

PyTorch 2023年4月6日
000
Tensorflow小技巧：TF_CPP_MIN_LOG_LEVEL

#pythonimport os import tensorflow as tf os.environ[‘TF_CPP_MIN_LOG_LEVEL’] = ‘2’ # or any {‘0’, ‘1’, ‘3’} #C++: (In Terminal) export TF_CPP_MIN_LOG_LEVEL=2 TF_CPP_MIN_LOG_LEVEL默认值…

tensorflow 2023年4月7日
000
循环神经网络

最全的DNN概述论文：详解前馈、卷积和循环神经网络技术

本论文技术性地介绍了三种最常见的神经网络：前馈神经网络、卷积神经网络和循环神经网络。且该文详细介绍了每一种网络的基本构建块，其包括了基本架构、传播方式、连接方式、**函数、反向传播的应用和各种优化算法的原理。本文不仅介绍了这三种神经网络的基本原理与概念，同时还用数学表达式正式地定义了这些概念。这是一份十分全面的神经网络综述论文，机器之心简要摘取了部分章节，更…

2023年4月8日
000

合作推广

合作推广

返回顶部