发布时间:2026/8/26 10:12:58
CARL-YOLOF: 一种用于数字印花织物缺陷检测的高效模型 摘要深度学习模型已成功应用于织物缺陷检测领域。然而由于数字印花织物缺陷检测领域缺乏可用的数据集相关研究仍不充分。此外现有的深度学习模型无法很好地解决两个棘手的挑战。一方面实际生产要求模型在保证实时检测的同时尽可能提高其检测精度。另一方面分类和定位的目标是相互关联的因此对于一个优秀的物体检测模型应建立分类和定位之间的联系。为了解决这些问题本文将分类感知回归损失CARL嵌入到YOLOF中以关联分类和定位任务由此将该模型命名为CARL-YOLOF。所提出模型的性能通过自建的数字印花织物缺陷检测数据集DPFD-DET进行了训练和评估。实验结果表明CARL-YOLOF在COCO评估指标上达到了0.54的AP值相比YOLOF提升了0.04。此外CARL-YOLOF保持了YOLOF的速度优势达到了42 FPS。因此所提出的模型适用于实时数字印花织物缺陷检测。关键词数字印花织物缺陷检测YOLOFCARL深度学习2. 介绍印染工业是纺织工业的重要组成部分而纺织品印花是提升纺织品附加价值的关键工序。数字印花技术作为一种新型印花技术与传统的印花技术如辊筒印花、丝网印花、转移印花等相比能为纺织品提供更逼真、更鲜艳、更自然的印花效果并进一步提升了纺织品的附加价值。同时印花过程中的一系列复杂因素可能对纺织品质量产生不利影响例如坏布上浆染色不均、喷墨印花系统不稳定、蒸化机滴水等这些都会导致印花缺陷如PASS道、PASS道痕、漏墨、空白、重影、毛绒、漏水、浆斑等。图1展示了数字印花织物缺陷的样本。图1. 数字印刷缺陷数据库中的部分示例图像(a) 单条扫描痕迹(b) 多条扫描痕迹(c) 漏墨(d) 空白(e) 重影(f) 绒毛(g) 漏水以及 (h) 纸浆块。因此数字印花织物缺陷检测已成为印染质量监控中有效且不可或缺的一环。近年来将深度学习的理论知识有效应用于织物缺陷检测领域仍是一个热门话题。Peng等人提出了一种先验锚点卷积神经网络PRANNet用于织物缺陷检测以提高织物缺陷的检测和定位精度。Zhu等人提出了一种改进的DenseNet模型以更好地适应资源受限的边缘计算场景。Li和Li基于Cascade R-CNN提出了三种技巧以进一步提高织物缺陷检测的精度。然而由于可用数据集的限制以往织物缺陷的研究对象主要集中在白坯布、纯色布和单纹理色布上而对数字印花织物的研究则非常有限。数字印花织物缺陷检测性能的提升与检测器的发展密切相关。正负锚点的定义和损失函数是检测器的两个核心组成部分它们理论知识的不断丰富对检测器的发展具有重要意义。在正负锚点定义方面我们简要回顾以下几种代表性方法如Max-IoU、ATSS、Uniform-match。首先Max-IoU采用锚点框与真实框之间的IoU交并比作为衡量正负锚点的标准该方法已灵活应用于SSD、BAGS和PISA中。随后ATSS使用动态IoU阈值以便更有效地为每个目标匹配数量稳定的正锚点。与上述方法不同Uniform-match基于真实框与锚点框之间的中心点距离为每个真实框匹配固定数量的正锚点所对应的预测框这提高了模型在稀疏锚点空间中检测每个目标的能力。就目标检测的损失函数而言它具体分为分类损失函数和边界框回归损失函数二者协同完成检测任务。对于分类损失函数通常要求通过难样本挖掘或软采样来提高模型检测正样本的能力。对于边界框回归损失函数通常考虑如何使边界框更好地回归这体现在回归损失函数的发展轨迹中。然而上述两个任务并未建立直接联系因此分类感知回归思想的产生引起了研究人员的广泛关注。本文受YOLOF和CARL的启发提出了CARL-YOLOF来解决上述问题。我们研究的主要贡献可归纳为三个方面a. 与YOLOF相比所提出的CARL-YOLOF实现了更高的检测精度。b. 我们建立了一个数字印花缺陷数据集DPFD-DET为数字印花领域提供了研究样本。c. 与其他先进检测器相比我们的模型更适用于实时数字印花织物缺陷检测。3. YOLOF基线作为当前先进检测器的代表YOLOF与其他检测器相比在速度和精度之间实现了有效平衡其成功源于基于大量消融实验对特征金字塔网络FPN的客观分析。因此可以得出一个结论FPN能够有效提高检测器的精度这主要依赖于分治策略而非多级特征融合。此外FPN的引入会严重阻碍检测器的检测速度因为其复杂的路径连接方式加剧了前向推理过程中的内存访问频率更不用说其他更复杂的路径连接方式了。为了解决这些问题YOLOF提出了结构简单的空洞编码器弥合了空洞编码器与FPN之间的精度差距其结构如图2所示。图2. 扩张编码器示意图。首先应用1×1卷积以4倍的比例进行通道降维。然后使用带空洞的3×3卷积来扩大感受野。此外采用1×1卷积来恢复通道数。最后在输入和输出之间使用捷径连接以探索模型对大尺度物体的感知能力同时保留对原始输入中小尺寸物体的感知能力。4. CARL-YOLOF检测器的功能可以概括为实现两个特定任务即分类和回归。然而仅出色地完成其中任何一个任务并不能直接反映检测器的精度这一事实如图3所示。图3. 缺陷检测结果通过两张图像进行展示。对于图像(a)黑色框标示了实际的油墨渗漏缺陷红色框对应图像的检测结果其中置信度分别为0.98、0.97和0.96的预测框被判定为真阳性True Positive其余预测框被判定为假阳性False Positive。对于图像(b)黑色框标示了实际的纸浆缺陷红色框对应图像的检测结果其中置信度为0.99的预测框被判定为真阳性其余预测框被判定为假阳性。假阳性False Positive被非极大值抑制NMS保留这显著影响了检测器的性能。可以看出假阳性的置信度满足正分数阈值的要求但它们的边界框明显不满足正IoU阈值的要求因此我们尝试构建一个将边界框回归和分类相关联的损失函数以进一步提高检测器的精度。受YOLOF和CARL的启发我们提出了CARL-YOLOF其训练流程如下所示如图4所示CARL-YOLOF的训练流程是基于YOLOF和CARL模块设计的。对于YOLOF它由三个组件构成1主干网络Backbone本文选择ResNet50进行定量研究2颈部网络Neck由四个连续的空洞编码器组成3YOLOF头部Head根据类别数、锚点生成器标准和来自颈部网络的输入通道数进行制定。CARL模块建立了分类和回归之间的联系。具体来说回归分支受到分类损失的监督具有更高预测概率的正锚点会在回归时获得较大的梯度这迫使模型在训练过程中更加关注它们。受YOLOF和CARL的启发所提出的CARL-YOLOF保持了YOLOF精简的网络结构并且嵌入的CARL模块加强了模型对重要样本的关注。因此与YOLOF相比CARL-YOLOF在不影响推理速度的前提下实现了更高的检测精度。CARL模块CARL模块如图4所示它包含两个过程。首先我们根据锚点框和真实框之间的关系定义正负锚点。然后我们建立损失函数来训练模型。对于前者采用Uniform-Match策略来定义正负锚点。具体来说它基于真实框与锚点框之间的中心点距离为每个真实框匹配固定数量的正锚点所对应的预测框这确保了在稀疏锚点空间中存在大量的正样本。对于后者将Focal Loss应用于分类任务以提高模型检测难样本的能力。在边界框回归损失方面我们引入CIoU Loss和CARL来构建分类与回归之间的联系以提高检测器的性能。我们提出的回归损失函数可以表示如下其中程度因子表示回归对重要正锚点的关注程度表示正锚点的预测概率是影响回归任务的尺度因子且0≤≤1。然后我们使用指数函数将转换为并根据所有样本的平均值对其进行重新缩放得到。表示输出的回归偏移量˙表示期望的回归偏移量。是常用的CIoU损失。显然和之间呈正相关。对于正锚点较高的意味着回归损失的额外增加这迫使模型在训练阶段更加关注它们。同样具有较高的正锚点更为重要因为它们是推理阶段在NMS期间首先被保留的。CARL模块迫使所提出的模型更加关注重要样本而非不重要样本与YOLOF相比这进一步提高了检测精度。实验与结果数字印花数据集在本文中我们建立了一个用于数字印花缺陷检测的综合数据集DPFD-DET。为了创建我们的数据集我们首先收集了包含八种缺陷类型PASS道、PASS道痕、漏墨、空白、重影、毛绒、漏水、浆斑的数字印花缺陷图像。接下来由于高分辨率的数字印花织物缺陷图像增加了模型的训练难度我们将缺陷区域随机裁剪为较低的分辨率包括256×256、384×384、416×416、512×512裁剪操作如图5所示。然后我们使用LabelImg软件将收集到的数据集标注为八个类别。最后将数据集按8:1:1的比例划分为训练集、验证集和测试集。每个类别的详细统计数据如表1所示。实现细节和评估指标所有主干网络的初始化权重均从COCO2017数据集上训练好的模型迁移而来。所有其他权重均通过“Xavier”范式初始化。在微调过程中我们将最大轮数设为30并使用SGD作为优化器。对于SGD优化器基础学习率设为0.001权重衰减设为0.0001动量常数设为0.9批大小设为4。所有模型训练均在配备Intel E5-2680v3处理器2.5 GHz、128GB内存和1张NVIDIA GeForce 2080 Ti的深度学习工作站上完成。评估指标。在我们的实验中使用FPS和COCO评估指标,50,75,,,来评估模型性能。1FPS检测速度2COCO指标检测精度评估指标FPS的定义如下其中表示总图像帧数表示总花费时间。为了计算FPS包括推理阶段和后处理阶段批大小设为1输入图像尺寸固定为416×416。整体实验我们使用ResNet50作为主干网络并采用相同的配置来验证我们的实验结果。CARL-YOLOF与其他先进模型在DPFD-DET测试集上的性能对比如表2所示。与YOLOF相比在相同推理速度下CARL-YOLOF在,75,,指标上分别实现了0.04、0.03、0.03、0.04的不同程度提升。与其他模型相比我们的模型在综合指标上表现最佳。此外我们的模型在75和指标上处于领先地位表明它能满足更严格的边界框回归标准并且具有出色的检测大尺度缺陷的能力。然而与Faster-RCNN相比我们的模型在50,,指标上表现较低这源于其更简化的网络结构降低了表达能力。前两列分别显示了模型的框架和主干网络。最后六列分别显示了模型在六个指标,50,75,,,上的精度FPS是在我们的工作站上评估的。所有指标均在固定图像尺寸416×416下测量。超参数消融实验。为了验证CARL模块的超参数k, b对检测精度的影响程度因子采用了三个备选常数值0.5 1 2设置为常数0-1间隔为0.2。通过表3可以总结出一个结论目标检测任务是分类任务和边界框回归任务的统一。具体来说当恒定时超参数通常主导分类概率对边界框回归的影响当恒定时尺度超参数可以反映分类概率对边界框回归影响的比例因此检测器的精度会随着常数的良好选择而提高。大量消融实验已验证CARL中超参数设置为(20.8)时我们的模型能达到最佳检测精度。与YOLOF(1,1)相比指标提升了0.04。图6展示了CARL-YOLOF模型在DPFD-DET测试集上的检测示例。结论在本文中我们提出了用于数字印花织物缺陷检测的CARL-YOLOF模型。该模型在一定程度上有效平衡了检测精度和速度为解决数字印花织物缺陷难以检测的问题提供了理论参考价值。分类感知回归策略可以有效地加强YOLOF模型中分类任务和回归任务之间的联系。实验结果表明采用ResNet50主干网络的CARL-YOLOF在我们自建的DPFD-DET数据集上的,75,,指标上实现了不同程度的提升。此外CARL-YOLOF保持了YOLOF的速度优势达到了42 FPS。因此所提出的模型适用于实时数字印花织物缺陷检测。

相关新闻

2026/8/27 5:48:42

JSON 实战:Python 3.12 解析 10 万行日志,内存占用降低 40%

Python 3.12 高效解析 10 万行 JSON 日志的 5 个关键技巧日志分析是后端开发和数据分析中的常见任务,但处理海量 JSON 日志时,内存占用和解析效率往往成为瓶颈。本文将分享如何利用 Python 3.12 的新特性,在不牺牲可读性的前提下,…

2026/8/22 18:03:39

告别卡顿!用 Python 打造毫秒级“倒计时自动双击神器”

在日常的自动化办公、游戏抢点或是定时任务中,你是否遇到过这样的痛点:普通的定时脚本往往存在几十到上百毫秒的延迟,导致关键时刻总是慢半拍?为了解决这个问题,我用 Python 手写了一款毫秒级倒计时自动双击工具。它不…

2026/8/27 5:46:36

基于PyTorch的图像修复系统:Partial Convolution与U-Net实战解析

简介:深度学习在计算机视觉领域持续突破,图像修复作为其中重要方向,旨在通过语义推断自动补全图像缺失区域。传统方法仅依赖边缘像素扩散,难以应对大面积或带语义内容的缺失。基于深度学习的修复模型能从海量数据中学习高层先验&a…

2026/8/27 5:46:36

机器人打网球有多难?解析具身智能的感知、预测与控制链路

一场人机网球赛,能看懂的门道比新闻标题多得多。前职业网球名将郑洁在现场看得入神,机器人快速冲刺、极限救球、把网球回到场地内的画面,确实足够冲击视觉。但如果你只把它当成一次“机器人表演”,就漏掉了这场比赛背后真正值得拆…

2026/8/27 5:46:36

YOLOv9-gelan-c在茶鲜叶分级中的农业视觉适配

1. 项目概述:为什么茶鲜叶分级非得用YOLOv9-gelan-c?我干茶园智能化落地这行快八年了,从最早用手机拍图人工比对芽头长度,到后来上固定摄像头OpenCV简单阈值分割,再到去年试水YOLOv5s跑鲜叶识别——每一步都踩过坑。今…

2026/8/27 5:46:36

Matlab建模三扳手:eye、ones、zeros实战指南

1. 这不是语法手册,而是建模现场的“工具箱思维”你打开Matlab,想快速生成一个33单位矩阵,敲eye(3)——它立刻出现;需要初始化一个全1的5行4列矩阵做权重初值,ones(5,4)一按回车就到位;调试时临时清空某变量…

2026/8/27 5:46:36

双传感器智能相机在OEM场景下的架构设计与集成实践

做机器视觉方案这么久,我越来越觉得一个道理:很多时候客户嘴上说要“更清晰”,实际想要的是“看得全、看得懂”。单颗传感器像素堆得再高,也只是把画面里的细节放大,视野、光谱、景深这些维度上的信息,它天…

2026/8/27 5:41:36

MATLAB主成分分析实战:从数学原理到数学建模应用

1. 项目概述:为什么主成分分析是数学建模的“降维神器”?在数学建模竞赛和实际数据分析工作中,我们常常会遇到一个令人头疼的问题:数据维度太高。想象一下,你手头有几十个甚至上百个变量来描述一个研究对象&#xff0c…

2026/8/26 9:13:28

[光学原理与应用-521]:对光的错误理解与纠偏

首先光是一种能量的载体和形态,宏观上观察到的光是由无数个微观的光量子组成的,每个光子在产生的瞬间,其在真空的空间中以确定不变的速度沿着一个初始的方向一直向前,在微观层面,每个光量子的运动轨迹是以波函数所展现…

2026/8/25 11:48:27

SIP通话转接原理与REFER方法实战解析

1. 通话转接不是“挂断再拨号”,而是SIP会话的动态重定向你有没有遇到过这样的场景:客服坐席A正在和客户通电话,突然需要把这通对话无缝转给专家坐席B,客户完全感知不到中间的断连——既没听到忙音,也没被要求重新拨号…

2026/8/25 16:56:43

Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

1. 为什么选择Kolla-ansible来部署单节点OpenStack?如果你正在寻找一种能把OpenStack从“概念”快速变成“可用的实验环境”的方法,那么Kolla-ansible几乎是当前最主流、最省心的选择。我见过太多人卡在手动编译依赖、配置服务、处理版本冲突的泥潭里&am…

2026/8/27 0:01:16

Go语言构建企业级AI服务网关:统一管理英伟达等AI接口调用

1. 项目概述:从零构建一个企业级的AI服务网关 最近在帮一个做内容审核的团队做技术架构升级,他们原来的业务里,每天有几十万张图片和短视频需要过审,最初是接了几个开源的AI模型自己部署,但效果和性能一直不太稳定。后…

2026/8/27 0:01:16

LeetCode Hot100(51-60)算法精解与面试技巧

1. 题目背景与核心价值"hot100(51-60)"这个标题看起来像是某个编程题库或算法练习集中的一组题目编号。在技术社区中,类似命名通常指向LeetCode、牛客网等平台的热门题目集合。作为刷过300题的算法老手,我理解这类题目的核心价值在于&#xff…

2026/8/27 0:01:16

CRC校验实战:从模2除法到HJ212协议排错

1. 为什么一个“校验码”能扛住工业现场90%的数据 corruption? 你有没有遇到过这样的场景:嵌入式设备通过RS-485上传温湿度数据,上位机偶尔收到一帧乱码——温度显示成-273℃,湿度跳到999%,但串口波形看起来完全正常&a…

2026/8/26 19:34:06

实测才敢推 AI论文网站 2026最新测评与推荐

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。一、综…

2026/8/26 19:17:08

2026必备!AI论文网站测评:最新推荐与深度对比

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。 一、…

2026/8/26 19:34:05

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的AI论文写作工具,覆盖选题构思、文献整理、内容生成、格式排版等核心场景,真正帮你高效搞定论文难题。 一、全流程王者:一站式搞定论文全链路(一天定稿首…