当前位置:首页 > 大全 >

yolo模型(yolo模型训练时间)

来源:原点资讯(www.yd166.com)时间:2023-04-19 16:04:50作者:YD166手机阅读>>

本文共8000字,建议阅读15分钟

本文为大家介绍了YOLO算法的最全综述。

YOLO官网:

https://github.com/pjreddie/darknet

YOLO v.s Faster R-CNN

1.统一网络:YOLO没有显示求取region proposal的过程。Faster R-CNN中尽管RPN与fast rcnn共享卷积层,但是在模型训练过程中,需要反复训练RPN网络和fast rcnn网络.相对于R-CNN系列的"看两眼"(候选框提取与分类),YOLO只需要Look Once.

2. YOLO统一为一个回归问题,而R-CNN将检测结果分为两部分求解:物体类别(分类问题),物体位置即bounding box(回归问题)。

YOLOv1

论文下载:http://arxiv.org/abs/1506.02640

代码下载:https://github.com/pjreddie/darknet

核心思想:将整张图片作为网络的输入(类似于Faster-RCNN),直接在输出层对BBox的位置和类别进行回归。

实现方法
  • 将一幅图像分成SxS个网格(grid cell),如果某个object的中心 落在这个网格中,则这个网格就负责预测这个object。

yolo模型,yolo模型训练时间(1)

  • 每个网络需要预测B个BBox的位置信息和confidence(置信度)信息,一个BBox对应着四个位置信息和一个confidence信息。confidence代表了所预测的box中含有object的置信度和这个box预测的有多准两重信息:

其中如果有object落在一个grid cell里,第一项取1,否则取0。第二项是预测的bounding box和实际的groundtruth之间的IoU值。

  • 每个bounding box要预测(x, y, w, h)和confidence共5个值,每个网格还要预测一个类别信息,记为C类。则SxS个网格,每个网格要预测B个bounding box还要预测C个categories。输出就是S x S x (5*B C)的一个tensor。(注意:class信息是针对每个网格的,confidence信息是针对每个bounding box的。)
  • 举例说明: 在PASCAL VOC中,图像输入为448x448,取S=7,B=2,一共有20个类别(C=20)。则输出就是7x7x30的一个tensor。整个网络结构如下图所示:

yolo模型,yolo模型训练时间(2)

  • 在test的时候,每个网格预测的class信息和bounding box预测的confidence信息相乘,就得到每个bounding box的class-specific confidence score:

yolo模型,yolo模型训练时间(3)

等式左边第一项就是每个网格预测的类别信息,第二三项就是每个bounding box预测的confidence。这个乘积即encode了预测的box属于某一类的概率,也有该box准确度的信息。

  • 得到每个box的class-specific confidence score以后,设置阈值,滤掉得分低的boxes,对保留的boxes进行NMS处理,就得到最终的检测结果。

简单的概括就是:

(1) 给个一个输入图像,首先将图像划分成7*7的网格

(2) 对于每个网格,我们都预测2个边框(包括每个边框是目标的置信度以及每个边框区域在多个类别上的概率)

(3) 根据上一步可以预测出7*7*2个目标窗口,然后根据阈值去除可能性比较低的目标窗口,最后NMS去除冗余窗口即可

损失函数

在实现中,最主要的就是怎么设计损失函数,让这个三个方面得到很好的平衡。作者简单粗暴的全部采用了sum-squared error loss来做这件事。

这种做法存在以下几个问题:

  • 第一,8维的localization error和20维的classification error同等重要显然是不合理的;
  • 第二,如果一个网格中没有object(一幅图中这种网格很多),那么就会将这些网格中的box的confidence push到0,相比于较少的有object的网格,这种做法是overpowering的,这会导致网络不稳定甚至发散。

解决办法:

  • 更重视8维的坐标预测,给这些损失前面赋予更大的loss weight。
  • 对没有object的box的confidence loss,赋予小的loss weight。
  • 有object的box的confidence loss和类别的loss的loss weight正常取1。

对不同大小的box预测中,相比于大box预测偏一点,小box预测偏一点肯定更不能被忍受的。而sum-square error loss中对同样的偏移loss是一样。

为了缓和这个问题,作者用了一个比较取巧的办法,就是将box的width和height取平方根代替原本的height和width。这个参考下面的图很容易理解,小box的横轴值较小,发生偏移时,反应到y轴上相比大box要大。(也是个近似逼近方式)

yolo模型,yolo模型训练时间(4)

栏目热文

明白了释怀了放下了的句子(是时候该放下了的句子)

明白了释怀了放下了的句子(是时候该放下了的句子)

命运 命里一尺,难求一丈,是你的,不需要争,不是你的,没必要争。上天自会给你最好的安排,既来之,则安之。 金钱 百年之...

2023-02-12 13:18:39查看全文 >>

古风白色九尾猫妖图片(妖猫古风图片)

古风白色九尾猫妖图片(妖猫古风图片)

日本有着悠久而传奇的历史(日本历史对比我大中华那是很短),充满了古老、神秘和黑暗的民间传说。这里盘点下日本比较知名的10...

2022-12-08 18:20:02查看全文 >>

热销产品广告图片(特价促销广告图片)

热销产品广告图片(特价促销广告图片)

特斯拉是一家不做广告的公司,这是众所周知的事实。特斯拉的CEO埃隆·马斯克曾经多次表示,他认为广告是浪费钱和时间,他更愿...

2023-10-21 05:44:04查看全文 >>

新娘卡通图片(卡通新娘新郎图片大全)

新娘卡通图片(卡通新娘新郎图片大全)

钱江晚报·小时新闻记者 王琼 李颖 图片由受访者提供你的婚礼是什么样的?浙江这两个年轻人的婚礼是一场马拉松。刚刚过去的这...

2022-12-18 09:18:00查看全文 >>

女生喜欢一个人朋友圈表现(喜欢一个女生先看他的朋友圈)

女生喜欢一个人朋友圈表现(喜欢一个女生先看他的朋友圈)

爱情有时候真的很奇妙,它会让一个理性的人变得冲动,会让一个沉默的人变得健谈。当一个女人坠入爱河时,她的行为和言语会与平时...

2023-09-27 07:38:58查看全文 >>

牛肉烧西红柿怎么烧法(西红柿炖牛肉的家常做法)

牛肉烧西红柿怎么烧法(西红柿炖牛肉的家常做法)

今天星期六,给刘女士做顿好吃的~By 林嗯哼儿用料番茄 4个土豆 1个牛肉 1000g葱姜 适量香叶 2片生抽 60g盐...

2022-12-15 18:32:29查看全文 >>

ui交互设计师是什么(交互设计师和ui设计师哪个好)

ui交互设计师是什么(交互设计师和ui设计师哪个好)

一、什么是设计1. 设计定义设计,是一种有目标与计划,同时结合技术的创作与创新活动;不只为生活和商业服务,同时也伴有人文...

2022-12-29 06:59:14查看全文 >>

爱奇艺破解版10.1.0永久 苹果(最新版爱奇艺苹果安装)

爱奇艺破解版10.1.0永久 苹果(最新版爱奇艺苹果安装)

掐指一算,还有2天就到国庆小长假了,不知道小伙伴们有何打算?每年一到这时候,小雷就犯了选择困难症,出门旅游还是蹲家里得纠...

2022-12-18 18:01:17查看全文 >>

幼儿园大班简笔画海底世界图片大全(幼儿园大班海底世界简笔画)

幼儿园大班简笔画海底世界图片大全(幼儿园大班海底世界简笔画)

儿童简笔画海底世界步骤图和涂色模板,快为孩子收藏起来吧!小可爱们有其他想画的各种主题元素,都可以给千千留言呀,你们支持点...

2022-12-14 08:58:12查看全文 >>

文档排行