Micro-YOLO:探索目标检测压缩模型的有效方法(附论文下载)

2025年02月15日00:12:03 科技 1935

关注并星标

从此不迷路

计算机视觉研究院

Micro-YOLO:探索目标检测压缩模型的有效方法(附论文下载) - 天天要闻Micro-YOLO:探索目标检测压缩模型的有效方法(附论文下载) - 天天要闻

公众号ID计算机视觉研究院

学习群扫码在主页获取加入方式

Micro-YOLO:探索目标检测压缩模型的有效方法(附论文下载) - 天天要闻

论文地址:https://www.scitepress.org/Papers/2021/102344/102344.pdf

计算机视觉研究院专栏

Column of Computer Vision Institute

深度学习模型在目标检测的性能上取得了重大突破。然而,在传统模型中,例如Faster R-CNN和YOLO,由于计算资源有限和功率预算紧张,这些网络的规模使其难以部署在嵌入式移动设备上。

一、前言

深度学习模型在目标检测的性能上取得了重大突破。然而,在传统模型中,例如Faster R-CNN和YOLO,由于计算资源有限和功率预算紧张,这些网络的规模使其难以部署在嵌入式移动设备上。

Micro-YOLO:探索目标检测压缩模型的有效方法(附论文下载) - 天天要闻

深度学习领域的加速发展极大地促进了目标检测的发展,其在人脸检测、自动驾驶、机器人视觉和视频监控等方面的广泛应用。随着目标检测的蓬勃发展,近年来提出了几种深度卷积神经网络模型,例如R-CNN、SSD和YOLO等。然而,随着网络变得越来越复杂,这些模型的规模不断增加,这使得在现实生活中将这些模型部署到嵌入式设备上变得越来越困难。因此,开发一种高效快速的物体检测模型以在不影响目标检测质量的情况下减小参数大小至关重要。

二、背景

随着目标检测网络系列不断变得更加复杂,减少权重参数和计算成本变得很重要。模型压缩方法分为低秩分解、知识蒸馏、剪枝和量化,其中剪枝已被证明是通过去除冗余参数来降低网络复杂度的有效方法(A survey of model compression and acceleration for deep neural networks)。

为了解决目标检测网络问题,有几种最先进的工作技术可以减少YOLO架构中的参数数量。(YOLO-LITE: a real-time object detection algorithm optimized for non-GPU computers) 开发了YOLO-Lite网络,其中从YOLOv2-tiny中删除了批量归一化层以加速目标检测。该网络在PASCAL VOC 2007和COCO数据集上分别实现了33.81%12.26%的mAP。(Yolo nano: a highly compact you only look once convolutional neural network for object detection) 创建了一个高度紧凑的网络YOLO-nano,它是一个基于YOLO网络的8位量化模型,并在PASCAL VOC 2007数据集上进行了优化。该网络在PASCAL VOC 2007数据集上实现了3.18M模型大小69.1%mAP

三、概要

因此,研究者就提出了一种新的基于轻量级CNN的目标检测模型,即基于YOLOv3-Tiny的Micro-YOLO,它在保持检测性能的同时显着减少了参数数量和计算成本。研究者建议将YOLOv3-tiny网络中的卷积层替换为深度分布偏移卷积(DSConvhttps://arxiv.org/abs/1901.01928v1)和带有squeeze和excitation块的移动反向瓶颈卷积 (MBConv:主要源自于EfficientNet),并设计渐进式通道级剪枝算法以最小化数量参数并最大化检测性能。因此,与原始YOLOv3-tiny网络相比,所提出的Micro-YOLO网络将参数数量减少了3.46倍,乘法累加操作(MAC)减少了2.55倍,同时在COCO数据集上评估的mAP略微减少了0.7%。

四、新框架介绍

Micro-YOLO:探索目标检测压缩模型的有效方法(附论文下载) - 天天要闻

Micro-YOLO

为了减小网络的大小,研究者探索了可选择的轻量级卷积层来替代YOLO网络中的卷积层Conv。MobileNet网络采用两个轻量级卷积层(a)DSConv和(b)MBConv。

Micro-YOLO:探索目标检测压缩模型的有效方法(附论文下载) - 天天要闻

如上图(a) 所示,DSConv执行两种类型的卷积:(i) 深度卷积和 (ii) 逐点卷积,这可以显著降低网络的模型大小和计算成本。上图(b) 所示,MBConv的结构是一个1×1的channel expansion卷积,然后是深度卷积和一个1×1的channel reduction层。它利用squeeze和excitation块,这是一个分支,由squeeze阶段的全局平均池化操作和excitation阶段的两个小FC层组成在深度卷积和通道之间还原层。由于输出通道的数量不等于输入通道的数量,研究者在MBConv中移除了残差连接,MBConv层在输入和输出处提供紧凑的表示,同时在内部将输入扩展到更高维的特征空间以增加非线性变换的表达能力。因此,与DSconv层相比,MBconv层提供了更好的压缩网络,而不会降低检测精度。

这些层之间的计算成本,即Conv层(Cs)、DSConv层(Cds)和MBConv层(Cmb)可以分别用以下公式表示:

Micro-YOLO:探索目标检测压缩模型的有效方法(附论文下载) - 天天要闻

其中k表示内核大小,Cin表示输入通道数,Cout表示输出通道数,W和H表示特征图的宽度和高度,α和β分别表示MBConv中的扩展因子和缩减因子。

Progressive Channel Pruning

在确定新提出的Micro-YOLO网络的架构后,研究者可以通过使用剪枝技术进一步减少权重参数。在提出的工作中,研究者采用了粗粒度剪枝,因为DSConv和MBConv层主要由1×1内核大小组成,这为细粒度剪枝留下了最小的空间。(Rethinking the value of network pruning) 表明修剪后的架构本身,而不是一组继承的“重要”权重,对最终模型的效率更重要,这表明在某些情况下修剪可能是有用的一种架构搜索范式。因此,研究者提出了一种渐进式剪枝方法来在修改后的网络中搜索“更薄”的架构。具体伪代码流程如下:

Micro-YOLO:探索目标检测压缩模型的有效方法(附论文下载) - 天天要闻

五、实验

Micro-YOLO:探索目标检测压缩模型的有效方法(附论文下载) - 天天要闻

新提出的框架图

不同卷积类型和相同内核大小的不同输入通道所需的参数数量

Micro-YOLO:探索目标检测压缩模型的有效方法(附论文下载) - 天天要闻

不同卷积类型的参数量

Micro-YOLO:探索目标检测压缩模型的有效方法(附论文下载) - 天天要闻

内核大小探索结果。不同的条形表示内核大小的不同组合。为简单起见,仅以红色显示最佳内核大小组合,如下图:

Micro-YOLO:探索目标检测压缩模型的有效方法(附论文下载) - 天天要闻

最后看下检测效果:

Micro-YOLO:探索目标检测压缩模型的有效方法(附论文下载) - 天天要闻

© THE END

Micro-YOLO:探索目标检测压缩模型的有效方法(附论文下载) - 天天要闻

转载请联系本公众号获得授权

Micro-YOLO:探索目标检测压缩模型的有效方法(附论文下载) - 天天要闻

计算机视觉研究院学习群等你加入!

ABOUT

计算机视觉研究院

计算机视觉研究院主要涉及深度学习领域,主要致力于目标检测、目标跟踪、图像分割OCR、模型量化、模型部署等研究方向。

研究院每日分享最新的论文算法新框架,提供论文一键下载,并分享实战项目。

研究院主要着重”技术研究“和“实践落地”。

研究院会针对不同领域分享实践过程,让大家真正体会摆脱理论的真实场景,培养爱动手编程爱动脑思考的习惯!

计算机视觉研究院主要涉及AI视觉领域和大模型研究,致力于目标检测、目标分类、图像分割、OCR、模型量化、模型部署等方向。

  • 应用于园区人脸人体检测、车辆车牌检测识别、烟雾烟火检测、抽烟等行为检测

  • 应用于景区溺水检测、丢失儿童询查、车辆违停检测、垃圾满溢检测、烟火检测、人流量统计等

  • 应用于工厂中的入侵检测、周界巡检、工服检测、产品缺陷检测、产品计件统计、AGV自动搬运等

  • 应用于林业畜牧业中的无人机实时检测、牲畜计数、林业面积测量、枯黄枯死树木检测定位、烟雾烟火检测、垃圾检测等

研究院承接各种AI视觉类项目,还有更多领域业务可落地,欢迎来咨询!

Micro-YOLO:探索目标检测压缩模型的有效方法(附论文下载) - 天天要闻Micro-YOLO:探索目标检测压缩模型的有效方法(附论文下载) - 天天要闻Micro-YOLO:探索目标检测压缩模型的有效方法(附论文下载) - 天天要闻Micro-YOLO:探索目标检测压缩模型的有效方法(附论文下载) - 天天要闻

🔗

科技分类资讯推荐

大厂竞相押注的MCP是啥? - 天天要闻

大厂竞相押注的MCP是啥?

当地时间2025年2月27日,马来西亚吉隆坡,阿里巴巴集团云计算部门开发的Qwen AI大型语言模型(LLM)用户查询流程图在阿里云AI技术日活动上展示。视觉中国/图2025年春,AI世界再次开卷新概念。
获黄仁勋高调推荐的AI搜索引擎 最新估值冲击千亿关口 - 天天要闻

获黄仁勋高调推荐的AI搜索引擎 最新估值冲击千亿关口

财联社5月13日讯(编辑 史正丞)据当地媒体报道,美国AI搜索引擎公司Perplexity正接近完成新一轮融资谈判,使得公司估值升至近140亿美元(约合人民币1013亿元)。知情人士称,知名风投机构Accel将牵头本轮融资,预计总额达5亿美
苹果 macOS 15.5 正式发布 - 天天要闻

苹果 macOS 15.5 正式发布

IT之家 5 月 13 日消息,苹果今日向 Mac 电脑用户推送了 macOS 15.5 更新(内部版本号:24F74),本次更新距离上次发布正式版间隔 26 天。 需要注意的是,因苹果各区域节点服务器配置缓存问题,可能有些地方探测到升级更新的时间略有延迟,一般半小时内,不会太久。 本文由机器人发布,IT之家稍后将为大家带来具体更新内容...
106亿营收仅4亿利润:烧钱换流量,押注短视频能否拯救三只松鼠? - 天天要闻

106亿营收仅4亿利润:烧钱换流量,押注短视频能否拯救三只松鼠?

2025年4月25日,三只松鼠正式向港交所递交招股书,计划在香港主板实现“A+H”股双重上市。若此次上市成功,其将成为国内首个跨越沪深港两地的零食巨头。2024年财报显示,三只松鼠营收达106.22亿元,同比增长49.3%,净利润同比增长85.5%至4.08亿元。这一业绩使其稳居中国零食企业零售额第一,但亮眼数据背后,依赖线上渠道、...
权威认证护航出海征程!Intertek 为正泰电源液冷储能户外柜系列产品颁发 ETL、CB、CE等系列证书 - 天天要闻

权威认证护航出海征程!Intertek 为正泰电源液冷储能户外柜系列产品颁发 ETL、CB、CE等系列证书

近日,Intertek天祥集团(以下简称“Intertek”)为上海正泰电源系统有限公司(以下简称“正泰电源”)研发的CPS ESS-125kW/261kWh 液冷储能户外柜系列产品颁发了 ETL、CB、CE等系列证书,正式标志着该系列产品可顺利进入北美和欧洲市场。 颁证仪式在德国慕尼黑Intersolar展会现场正泰电源展台隆重举行, 正泰电源总经理李..
广州积极推动以科技为核心的“华夏社区”项目 - 天天要闻

广州积极推动以科技为核心的“华夏社区”项目

一、科技赋能社区,保障民生稳定 广州“华夏社区”项目以科技为核心,融合人工智能、大数据、物联网等前沿技术,构建智能化社区管理体系。通过智能安防、智慧医疗、便民服务等功能,提升居民生活质量,确保社区安全稳定。 例如,社区引入智能安防系统,实现全天候监控与预警;智慧医疗平台提供在线诊疗、健康监测等服务,方...
‘败家变持家’让我Carry全场的神器,ROG绝神27Pro显示器评测 - 天天要闻

‘败家变持家’让我Carry全场的神器,ROG绝神27Pro显示器评测

哈喽小伙伴们好,我是Stark-C~对于和我一样喜欢玩游戏的玩家来说,在选购显示器似乎都有这样的纠结:一方面,我们再玩《CSGO》或者《使命召唤》这类FPS 游戏时我们希望显示器不影响我们拔枪的速度,能有超高刷新率和低延迟,这样画面就会更加
苹果手机开启新一轮降价!有iPhone 16 Pro降价2000元,能参加“国补”了 - 天天要闻

苹果手机开启新一轮降价!有iPhone 16 Pro降价2000元,能参加“国补”了

苹果手机开启新一轮降价,这次是线下渠道商的价格松动。 有消息称,苹果5月10日向渠道商下发了调价通知,昨日渠道商开始调价。第一财经记者12日走访了深圳两个不同的渠道商门店了解到,苹果iPhone 16系列确实是从昨天开始降价,且最高降价额度都是1400元,苹果官方线下的Apple Store零售店有部分产品享受国补,此外未有额外...
越来越多打工人,挤进春秋航空绿皮机舱 - 天天要闻

越来越多打工人,挤进春秋航空绿皮机舱

文源 | 源Sight作者 | 王言“卖最便宜的机票,当最赚钱的航司”,这是在当前仍处在恢复期的航空业,春秋航空呈现出的反差写照。2024 年,春秋航空盈利表现突出,22.73亿元的净利润,在一众A股上市航司中排在首位。