模型压缩：CNN和Transformer通用，修剪后精度几乎无损，速度提升40%

科技科技 2024-09-06 11:02 江苏

点击蓝字

关注我们

关注并星标

从此不迷路

计算机视觉研究院

公众号ID｜计算机视觉研究院

学习群｜扫码在主页获取加入方式

论文地址：https://arxiv.org/pdf/2401.06426.pdf

计算机视觉研究院专栏

Column of Computer Vision Institute

随着目标检测的蓬勃发展，近年来提出了几种深度卷积神经网络模型，例如R-CNN、SSD和YOLO等。然而，随着网络变得越来越复杂，这些模型的规模不断增加，这使得在现实生活中将这些模型部署到嵌入式设备上变得越来越困难。因此，开发一种高效快速的物体检测模型以在不影响目标检测质量的情况下减小参数大小至关重要。

PART/1

前言

深度学习模型在目标检测的性能上取得了重大突破。然而，在传统模型中，例如Faster R-CNN和YOLO，由于计算资源有限和功率预算紧张，这些网络的规模使其难以部署在嵌入式移动设备上。

深度学习领域的加速发展极大地促进了目标检测的发展，其在人脸检测、自动驾驶、机器人视觉和视频监控等方面的广泛应用。随着目标检测的蓬勃发展，近年来提出了几种深度卷积神经网络模型，例如R-CNN、SSD和YOLO等。然而，随着网络变得越来越复杂，这些模型的规模不断增加，这使得在现实生活中将这些模型部署到嵌入式设备上变得越来越困难。因此，开发一种高效快速的物体检测模型以在不影响目标检测质量的情况下减小参数大小至关重要。

PART/2

摘要总结

今天我们分享的技术，是通过减少网络信道的传统信道修剪方法难以有效地修剪具有深度卷积层和某些有效模块（如流行的反向残差块）的有效CNN模型。由于存在一些归一化层，通过减少网络深度的先验深度修剪方法不适合于修剪一些有效的模型。此外，通过直接移除激活层来微调子网会破坏原始模型权重，阻碍修剪后的模型实现高性能。

为了解决这些问题，研究者提出了一种新的有效模型深度修剪方法。新方法为子网提出了一种新的块修剪策略和渐进训练方法。此外，将修剪方法扩展到视觉Transformer模型。

最终实验结果表明，在各种修剪配置中，新方法始终优于现有的深度修剪方法。将新方法应用于ConvNeXtV1，获得了三个修剪后的ConvNeXtV1模型，这些模型超过了大多数具有可比推理性能的SOTA有效模型。新方法还在视觉Transformer模型上实现了最先进的修剪性能。

PART/3

动机

Network Pruning

神经网络在计算机视觉领域已被广泛应用，表现出非凡的能力。然而，复杂的网络架构对高效的实时部署提出了挑战，并需要大量的计算资源和能源成本。在端侧和边缘侧部署网络具体的挑战：

模型体积大；
FLOPs（float-point operations，浮点操作）；
耗能；
处理器架构和处理速度；
内存占用；
推理时延；

这些挑战可以通过网络压缩等优化来克服。网络剪枝（Network Pruning）是网络压缩主要技术之一，是一种减小内存大小和带宽的重要技术。剪枝就是通过去除网络中冗余的通道（channels），滤波器（filters）,神经元节点（ neurons）, 网络层（layers）以得到一个更轻量级的网络，同时不影响性能。

剪枝的不同分类：

根据网络元素类型，可以分为神经元剪枝和连接剪枝；
根据剪枝前后网络结构是否是改变，可以分为结构化剪枝和非结构化剪枝；
根据在推理阶段是否有剪枝，可以分为静态剪枝和动态剪枝；

结构化剪枝可以包括神经元剪枝和连接剪枝，但是是改变了剪枝前的网络结构。非结构化剪枝并没有改变网络结构，而是将分支权重改为0，这样权重为0的分支对整个网络没有影响，从而相当于减掉了该分支。如果观察到在某些迭代权重为0的分支对本轮迭代作用很大（影响性能），可以动态恢复非结构化剪枝造成的为零权重，提供网络性能。神经元剪枝会改变网络结构，属于结构化剪枝。连接剪枝，在权重设置为0并没有改变网络结构时属于非结构化剪枝，在连接删除改变网络结构时属于结构化剪枝。

Structural Reparameterization

在block内不存在非线性激活函数的情况下，结构重新参数化技术有助于将多个卷积层合并为单个卷积层。这种合并有效地减少了神经网络在推理过程中的内存需求，从而加速了模型推理。RepVGG区分了训练和测试结构，使普通网络能够超越ResNet的性能。此外，DBB将多分支结构合并为一个卷积，显著地超过了传统多分支单元的速度。

Neural Architecture Search (NAS)

既然网络不是设计出来的，我们要搜，那么怎么搜网络结构呢？理解这个问题，你就能了解NAS的最基本的思想。想象你是一个考试命题组的出题人，你要出高考题，那怎么出题呢？首先这是高考，你肯定只能出高中生学过的内容，所以需要框定一个出题的范围，这便是搜索空间。确定了出题范围，我们还需要知道到底怎么出题，到底是出选择题好呢，还是填空题好呢？这是出题的策略，对应到这个问题上，就是搜索策略。现在题也出完了，但是我们还需要知道这个考卷的题目出的好不好，一个好的高考试卷应该有一定的区分度！所以我们需要一个评判的标准去了解这个题目出的好不好，这个标准和可以是专家评议，或者学生调研等等，也就是相当于我们需要给我们一个评价的指标。

围绕搜索空间、搜索策略以及评价搜索的指标三个维度展开搜索最优的网络，先确定在哪些模块（卷积，池化等等）里面搜索组合一个网络，然后用什么样的方式组合我们的网络，最后得出的网络我们如何评价它是否好用。这便是NAS算法自动搜索的基本思想。

PART/4

新框架详解

深度修剪方法旨在通过提出新的具有重新参数化技术的块修剪策略来减少模型深度，而不是直接省略块。如下图所示，块修剪策略在块合并中将复杂而缓慢的块转换为简单而快速的块。对于块，将激活层替换为标识层，将LayerNorm（LN）或GroupNorm（GN）层替换为BatchNorm（BN）层，并在块末尾插入带有BatchNorm层的激活层，以创建重新参数化的条件。然后，重新参数化技术可以合并BatchNorm层、相邻的卷积或全连接层，并跳过连接，如下图所示：

Depth Pruner on CNN

将新方法应用于CNN模型可以参考上图所示的管道。应该先找到基本块，并参考上图中的修剪块来设计相应的修剪块。对于块中的激活层，将其替换为标识层。对于块中不是BatchNorm层的规范化层，将其替换为BatchNorm图层，否则无需执行任何操作。

最后，将在块的末尾插入一个带有BatchNorm层的激活层。如果像ResNet34块这样的位置已经存在激活层，则只需要在块末尾的激活层之后插入BatchNorm层。修剪块完成后，回顾超网训练、子网搜索、子网训练和子网合并过程。将获得修剪后的CNN模型。对于普通的CNN模型，可以定义可以包括两个或多个顺序卷积层的块。

Depth Pruner on Vision Transformer

研究者还将提出的深度修剪器应用于Vision Transformer模型。Vision Transformer块通常具有多头自注意（MHSA）模块和包括两个全连接层的MLP模块。特别是，利用DeiT作为展示修剪流程的案例。如上图所示，为了构建Supernet，在原始模型的LN和活化（GELU）层旁边添加BN旁路，并在剩余添加操作后插入GELU和BN块。经过子网搜索和子网训练，获得了子网，其原始LN和修剪块的GELU操作都被BN取代。添加残余物后，连接GELU&BN块。然后合并子网以获得快速修剪的模型，如上图所示。

PART/5

实验及可视化

下表与一些常见的有效模型进行了比较，因为ConvNeXtV1没有压缩方法。在AMD平台上使用表中较慢的网络EfficientFormerV2-S2作为基准，测试所有网络的速度。作者将模型分为不同 Level ，深度剪枝方法在不同 Level 上实现了可比速度下的更高精度：

在今天分享中，研究者为有效的CNN和Vision Transformer模型提供了一个统一的深度修剪器，以在深度维度上修剪模型。深度修剪器包括四个步骤，即超网训练、子网搜索、子网训练和子网合并。提出了一种新的块修剪方法和渐进训练策略，以更好地利用基线模型权重。在子网合并过程中，使用重新参数化技术使子网变得更浅、更快。将新方法应用于几个CNN模型和transformer模型。SOTA修剪性能证明了新方法的优越性。未来，研究者们将在更多的Transformer模型和任务上探索新方法。

END

转载请联系本公众号获得授权

计算机视觉研究院学习群等你加入！

ABOUT

计算机视觉研究院

计算机视觉研究院主要涉及深度学习领域，主要致力于目标检测、目标跟踪、图像分割、OCR、模型量化、模型部署等研究方向。研究院每日分享最新的论文算法新框架，提供论文一键下载，并分享实战项目。研究院主要着重”技术研究“和“实践落地”。研究院会针对不同领域分享实践过程，让大家真正体会摆脱理论的真实场景，培养爱动手编程爱动脑思考的习惯！

计算机视觉研究院主要涉及AI视觉领域和大模型研究，致力于目标检测、目标分类、图像分割、OCR、模型量化、模型部署等方向。

应用于园区人脸人体检测、车辆车牌检测识别、烟雾烟火检测、抽烟等行为检测

应用于景区溺水检测、丢失儿童询查、车辆违停检测、垃圾满溢检测、烟火检测、人流量统计等

应用于工厂中的入侵检测、周界巡检、工服检测、产品缺陷检测、产品计件统计、AGV自动搬运等

应用于林业畜牧业中的无人机实时检测、牲畜计数、林业面积测量、枯黄枯死树木检测定位、烟雾烟火检测、垃圾检测等

还有更多领域业务可落地，欢迎来咨询！

http://mp.weixin.qq.com/s?__biz=MzU0NTAyNTQ1OQ==&mid=2247537772&idx=3&sn=8c4590fed6a744fe601f60d1492f75d7

计算机视觉研究院

计算机视觉研究院主要涉及AI研究和落地实践，主要致力于目标检测、目标跟踪、图像分割、OCR、模型量化、模型部署等研究方向。研究院每日分享最新的论文算法新框架，提供论文一键下载，并分享实战项目。研究院主要着重”技术研究“和“实践落地”！

最新文章

大型视觉语言模型OMG-LLaVA：图像级、目标级和像素级的推理和理解任务统一

PE-YOLO：解决黑夜中的目标检测难点

NeurIPS 2024 | 真实世界复杂任务，全新基准GTA助力大模型工具调用能力评测

人脸识别精度提升 | 基于Transformer的人脸识别（附源码）

YOLO-S：小目标检测的轻量级、精确的类YOLO网络

FP-DETR：通过完全预训练提升transformer目标检测器

3D大模型助力，15分钟即可训练高质量、个性化的数字人模型，代码已开放

顶会新方向！全新多模态大模型统一分割框架

微软新出框架：Transformer扩展到10亿token（附代码下载）

Drone-YOLO：一种有效的无人机图像目标检测

26申博时间规划！别再按老套路来了，没用

“计算机视觉研究院”商务合作

一文读懂模型的可解释性（附代码）

首个快速知识蒸馏的视觉框架：ResNet50 80.1%精度，训练加速30%

劲爆！YOLOv6又快又准的目标检测框架开源啦（附源代码下载）

今天面试了一个字节女生，当场想给她offer

三区idea最后发了顶会！

特别小的目标检测识别（附论文下载）

基于Transformer的跨模态3D点云目标检测SOTA！易复现！

NeurIPS 2024 | 消除多对多问题，清华提出大规模细粒度视频片段标注新范式VERIFIED

“计算机视觉研究院”商务合作

机场项目：解决飞行物空间大小/纵横比、速度、遮挡等问题引起的实时目标检测问题

不需要标注了？看自监督学习框架如何助力目标检测

RestoreDet：低分辨率图像中目标检测

目标检测创新：一种基于区域的半监督方法，部分标签即可（附原论文下载）

又快又准，即插即用！清华8比特量化Attention，两倍加速于FlashAttention2，各端到端任务均不掉点！

MIT韩松团队长上下文LLM推理高效框架DuoAttention：单GPU实现330万Token上下文推理

50K*16薪，进字节了！

YOLO-S：小目标检测的轻量级、精确的类YOLO网络

“计算机视觉研究院”商务合作

RestoreDet：低分辨率图像中目标检测

CVPR’24｜PanoOcc基于相机的3D全景分割最强SOTA！

利用先进技术保家卫国：深度学习进行小目标检测（适合初学者入门）

245个目标检测开源项目合集，建议收藏！

“计算机视觉研究院”商务合作

完爆YOLO家族？新一代目标检测器又有新突破！

NeurIPS 2024 Oral | 小参数，大作为！揭秘非对称 LoRA 架构的高效性能

YOLO-SLD：一种改进的注意机制YOLO车牌检测

“计算机视觉研究院”商务合作

欢迎加入“计算机视觉研究院”学习群

这篇论文非常火！差分Transformer竟能消除注意力噪声，犹如降噪耳机

Kaggle金牌和CCF A一作哪个更有用？

“计算机视觉研究院”商务合作

发论文别太老实，用对方法一年三篇SCI！

AI智能体引擎加持：天玑9400让「完全体」AI手机提前问世了

大规模参数的更强、更鲁棒的视觉基础模型

多尺度特征融合：为检测学习更好的语义信息（附论文下载）

VB-LoRA高效登顶！仅需0.4%参数量，极限超越LoRA！

这篇论文非常火！差分Transformer竟能消除注意力噪声，犹如降噪耳机

分类

时事

民生

政务

教育

文化

科技

财富

体娱

健康

情感

旅行

百科

职场

楼市

企业

乐活

学术

汽车

时尚

创业

美食

幽默

美体

文摘

原创标签

时事社会财经军事教育体育科技汽车科学房产搞笑综艺明星音乐动漫游戏时尚健康旅游美食生活摄影宠物职场育儿情感小说曲艺文化历史三农文学娱乐电影视频图片新闻宗教电视剧纪录片广告创意壁纸头像心灵鸡汤星座命理教育培训艺术文化金融财经健康医疗美妆时尚餐饮美食母婴育儿社会新闻工业农业时事政治星座占卜幽默笑话独立短篇连载作品文化历史科技互联网

发布位置

广东北京山东江苏河南浙江山西福建河北上海四川陕西湖南安徽湖北内蒙古江西云南广西甘肃辽宁黑龙江贵州新疆重庆吉林天津海南青海宁夏西藏香港澳门台湾美国加拿大澳大利亚日本新加坡英国西班牙新西兰韩国泰国法国德国意大利缅甸菲律宾马来西亚越南荷兰柬埔寨俄罗斯巴西智利卢森堡芬兰瑞典比利时瑞士土耳其斐济挪威朝鲜尼日利亚阿根廷匈牙利爱尔兰印度老挝葡萄牙乌克兰印度尼西亚哈萨克斯坦塔吉克斯坦希腊南非蒙古奥地利肯尼亚加纳丹麦津巴布韦埃及坦桑尼亚捷克阿联酋安哥拉