GPT理解的CV：基于Yolov5的半监督目标检测

科技 2024-11-23 12:03 广西

关注并星标

从此不迷路

计算机视觉研究院

公众号ID｜ComputerVisionGzq

学习群｜扫码在主页获取加入方式

计算机视觉研究院专栏

主要贡献是提出了一种名为“Efficient Teacher”的半监督目标检测算法。与传统的监督学习算法不同，Efficient Teacher利用无标签数据进行训练，并且在训练过程中使用了半监督学习的方法。这种方法可以有效地利用无标签数据，减少过拟合的风险，并且可以提高模型的泛化能力。

注意：本文主要是GPT解读，如有差异请在留言指出！

概要

半监督目标检测（SSOD）已经成功地提高了R-CNN系列和无锚检测器的性能。然而，一级基于锚的检测器缺乏生成高质量或灵活伪标签的结构，导致SSOD中存在严重的不一致性问题。在今天分享中，提出了一个高效的教师框架，用于可扩展和有效的基于单阶段锚的SSOD训练，该框架由密集检测器、伪标签分配器和Epoch适配器组成。Dense Detector是一个基线模型，它以YOLOv5为灵感，使用密集采样技术扩展了RetinaNet。高效教师框架引入了一种新的伪标签分配机制，称为伪标签分配器，它更精细地利用了密集检测器中的伪标签。

Epoch Adaptor是一种为密集探测器提供稳定高效的端到端SSOD训练计划的方法。伪标签分配器防止了在师生相互学习机制期间由大量低质量伪标签引起的可能干扰密集检测器的偏差的发生，并且Epoch适配器利用域和分布自适应来允许密集检测器学习全局分布的一致特征，使得训练与标记数据的比例无关。我们的实验表明，高效教师框架在VOC、COCO标准和COCO附加方面取得了最先进的结果，使用的FLOP比以前的方法更少。据我们所知，这是将SSOD应用于YOLOv5的第一次尝试。

新框架

高效教师（Efficient Teacher）是一种新颖高效的半监督目标检测框架，它显著提高了基于单级锚点的检测器的性能。该框架基于师生相互学习的方法，如下图所示，灵感来自以前的工作。提出的伪标签分配器方法根据伪标签的得分将其分为可靠和不确定的伪标签，其中可靠的伪标签用于默认监督训练，不确定的用于指导软损失学生模型的训练。Epoch-Adaptor方法通过在标记数据和未标记数据之间进行域自适应，并计算每个历元中伪标签的阈值，来加速收敛。在整个培训过程中，教师模型采用指数移动平均（EMA）技术进行更新。

比较RetinaNet和检测聚类器的伪指标分布图，发现：

（a）RetinaNet使用了更少的输入数据，产生了更高的分辨率，暗色表示分数较低；
（b）检测聚类器利用更多的输入数据，根据物体特征和分类结果产生了更强健和更密集的反应。

伪标签过滤是 SSOD 中常用的一种方法，阈值设置太低会产生错误的伪标签，而阈值设置太高则可能排除可靠的伪标签，从而导致分配不佳，进而影响网络训练的效果。为了解决这个问题，我们提出了伪标签分配器方法，该方法根据高低阈值将伪标签分为可靠和不可靠的类别，分别为目标 L 提高单目标 SSOD 中伪标签的质量。

Main epoch 表示整个训练期间不中断，并且在执行期间没有任何新权重的加载。有效教师的训练策略：（a）在标记数据上进行监督训练，然后在未标记数据上进行基于标记的 SSOD 训练；（b）在标记数据上进行监督训练，并在未标记数据上进行基于标记的 SSOD 训练以外的额外基于标记的 SSOD 训练；（c）在标记数据和未标记数据上进行端到端训练，并使用适应域和分布的 Epoch 适配器以改进收敛和特征分布。

实验

Experimental results on COCO-standard (AP50:95)

PASCAL-VOC的实验结果。†表示使用ImageNet预训练骨干来初始化高效教师

© THE END

转载请联系本公众号获得授权

计算机视觉研究院学习群等你加入！

ABOUT

计算机视觉研究院

计算机视觉研究院主要涉及深度学习领域，主要致力于人脸检测、人脸识别，多目标检测、目标跟踪、图像分割等研究方向。研究院接下来会不断分享最新的论文算法新框架，我们这次改革不同点就是，我们要着重”研究“。之后我们会针对相应领域分享实践过程，让大家真正体会摆脱理论的真实场景，培养爱动手编程爱动脑思考的习惯！

往期推荐

🔗

计算机视觉研究院

计算机视觉研究院主要涉及AI研究和落地实践，主要致力于目标检测、目标跟踪、图像分割、OCR、模型量化、模型部署等研究方向。研究院每日分享最新的论文算法新框架，提供论文一键下载，并分享实战项目。研究院主要着重”技术研究“和“实践落地”！

最新文章

从源头消除大模型“幻觉”，性价比吊打传统微调方法

Fast YOLO：用于实时嵌入式目标检测（附论文下载）

旋转角度目标检测的重要性！！！（附源论文下载）

YOLO-S：小目标检测的轻量级、精确的类YOLO网络

最后征稿+连续8届检索 | 第九届控制工程与人工智能国际会议(CCEAI 2025)会议地点已定！

智慧建筑：基于YOLOv7的建筑外墙缺陷检测

轻量级模型，重量级性能，TinyLlama、LiteLlama小模型火起来了

欢迎加入“计算机视觉研究院”学习群

年薪百万or惨遭裁员，AIGC开发者如何破局？

陈天奇团队LLM结构化生成新引擎XGrammar：百倍加速、近零开销

2024全球无人机市场洞察报告

粉丝福利！免费赠书中奖名单

凭什么YOLO是最强目标检测器，一文读懂！

大改Yolo框架 | 能源消耗极低的目标检测新框架（附论文下载）

智能体零样本解决未见过人类设计环境！全靠这个开放式物理RL环境空间

史上最通俗易懂的YOLO系列（v1-v10）模型解读！

更快、更灵活的Transformer图像去雾网络

“计算机视觉研究院”商务合作

利用先进技术保家卫国：深度学习进行小目标检测（适合初学者入门）

机场项目：解决飞行物空间大小/纵横比、速度、遮挡等问题引起的实时目标检测问题

2024新技术：远距离的小目标也可以准确检测

大改Yolo框架 | 能源消耗极低的目标检测新框架（附论文下载）

“计算机视觉研究院”商务合作

RestoreDet：低分辨率图像中目标检测

GPT理解的CV：基于Yolov5的半监督目标检测

机场项目：解决飞行物空间大小/纵横比、速度、遮挡等问题引起的实时目标检测问题

“计算机视觉研究院”商务合作

送书福利《计算机视觉之PyTorch数字图像处理》等你来拿！！！

YOLO-SLD：一种改进的注意机制YOLO车牌检测

多尺度特征融合：为检测学习更好的语义信息（附论文下载）

“计算机视觉研究院”商务合作

YOLO跌落神坛？新一代目标检测器又有新突破！

乌镇“网”事：看这道“光”！站在小镇望世界

欢迎加入“计算机视觉研究院”学习群

快速学会AI核心架构，Transformer！

大模型承重墙，去掉了就开始摆烂！苹果给出了「超级权重」

免费分享顶会的idea方法！！！

无卷积骨干网络：金字塔Transformer，提升目标检测/分割等任务精度（附源代码）

我用捡来的idea发了顶会！！！

揭示Transformer重要缺陷！北大提出傅里叶分析神经网络FAN，填补周期性特征建模缺陷

YoloV：视频中目标实时检测依然很棒（附源代码下载）

ICLR'25审稿质量历史最低？这么多全负正常么

NeurIPS 2024 | 无需训练，一个框架搞定开放式目标检测、实例分割

“计算机视觉研究院”商务合作

Yolo-Z：改进的YOLOv5用于小目标检测（附原论文下载）

多尺度特征融合：为检测学习更好的语义信息（附论文下载）

轻量级模型，重量级性能，TinyLlama、LiteLlama小模型火起来了

“计算机视觉研究院”商务合作

喜提 TPAMI 顶刊！！！

Token化一切，甚至网络！北大&谷歌&马普所提出TokenFormer，Transformer从来没有这么灵活过！

分类

时事

民生

政务

教育

文化

科技

财富

体娱

健康

情感

旅行

百科

职场

楼市

企业

乐活

学术

汽车

时尚

创业

美食

幽默

美体

文摘

原创标签

时事社会财经军事教育体育科技汽车科学房产搞笑综艺明星音乐动漫游戏时尚健康旅游美食生活摄影宠物职场育儿情感小说曲艺文化历史三农文学娱乐电影视频图片新闻宗教电视剧纪录片广告创意壁纸头像心灵鸡汤星座命理教育培训艺术文化金融财经健康医疗美妆时尚餐饮美食母婴育儿社会新闻工业农业时事政治星座占卜幽默笑话独立短篇连载作品文化历史科技互联网

发布位置

广东北京山东江苏河南浙江山西福建河北上海四川陕西湖南安徽湖北内蒙古江西云南广西甘肃辽宁黑龙江贵州新疆重庆吉林天津海南青海宁夏西藏香港澳门台湾美国加拿大澳大利亚日本新加坡英国西班牙新西兰韩国泰国法国德国意大利缅甸菲律宾马来西亚越南荷兰柬埔寨俄罗斯巴西智利卢森堡芬兰瑞典比利时瑞士土耳其斐济挪威朝鲜尼日利亚阿根廷匈牙利爱尔兰印度老挝葡萄牙乌克兰印度尼西亚哈萨克斯坦塔吉克斯坦希腊南非蒙古奥地利肯尼亚加纳丹麦津巴布韦埃及坦桑尼亚捷克阿联酋安哥拉