带标注的墙面红外缺陷数据集,可识别8种类型的缺陷,1874张图,支持yolo,coco json,voc xml,文末有模型训练代码
​带标注的墙面红外缺陷数据集可识别8种类型的缺陷识别率92.5%1874张图支持yolococo jsonvoc xml,文末有模型训练代码模型训练指标参数模型训练图数据集拆分总图数1874 张图数训练集1666 张图验证集105 张图测试集103 张图预处理自动定向应用调整大小拉伸到640x640增强每个训练样本生成 2 份增强样本翻转方式水平翻转、垂直翻转旋转角度范围-15° 15°亮度调节范围-15% 15%曝光度调节范围-10% 10%模糊强度上限1.5 像素数据集标签[‘X_Crack’, ‘Angle’, ‘Network’, ‘Vertical’, ‘Horizontal’, ‘Diagonal’, ‘Branch’, ‘crack’]标签解释crackn. 裂缝、裂纹v. 开裂、产生裂纹Anglen. 角度角缝Branchn. 分支分支裂缝枝状裂纹Diagonaladj./n. 斜向的、对角线斜裂缝Horizontaladj./n. 水平的、横向水平裂缝Networkn. 网状网状裂缝Verticaladj./n. 垂直的、竖向竖向裂缝X_Crackn. X 型裂缝、交叉斜裂缝数据集图片和标注信息示例数据集下载yolo26,yolo v12,yolo v11,yolo v9,yolo v8,yolo v7,coco json,pascal voc xml:https://download.csdn.net/download/pbymw8iwm/93160061YOLO模型训练下载数据集之后解压到当前文件夹然后将 我的仓库 https://gitcode.com/pbymw8iwm/YOLOProject 里的训练模型脚本复制到文件夹下假设你使用的是yolov8来训练你就用python train_yolov8.py​​模糊图片在模型训练中的优势分析该数据集中包含了如果包含了一些模糊图片这并非数据缺陷而是一种精心设计的数据增强策略能为模型训练带来以下显著优势提升模型鲁棒性现实场景中可能发生在运动模糊对焦不准或光线不足的情况下。在训练集中引入模糊样本可以迫使模型学习更本质的特征而不是过度依赖清晰的边缘或纹理细节从而提升模型在复杂、非理想成像条件下的识别能力。模拟真实世界噪声监控摄像头、手机等设备在低光照或快速移动时极易产生模糊。包含此类图片的数据集能让模型提前“见识”并适应这种噪声减少在实际部署时因图像质量下降而导致的性能骤降。防止模型过拟合如果训练集全是高清、摆拍的完美图片模型容易记住这些特定场景下的“干净”特征而对新的、稍有模糊的图片泛化能力差。模糊图片作为一种有效的正则化手段可以增加数据分布的多样性防止模型过拟合到有限的清晰样本上。总结因此数据集中包含的模糊图片与你看到的“水平翻转”、“剪切形变”、“随机遮挡”等增强操作一样都是为了构建一个更接近真实世界复杂分布的数据环境从而训练出更健壮、更泛化、更实用的模型。模型验证测试情况验证测试代码#需要安装pip install ultralyticsfromultralyticsimportYOLOimportcv2# 1. 加载YOLO模型 # 自动下载预训练模型(yolov8n最轻量快速)也可换 yolov8s/m/l/xmodelYOLO(best.pt)# 2. 推理配置 image_path326_jpg.rf.8ad64cc0668df32c4e5f59b50e899e9c.jpg# 你的图片路径save_resultTrue# 是否保存标注后的图# 3. 执行推理 resultsmodel.predict(sourceimage_path,conf0.01,# 置信度阈值低于该值忽略saveFalse,# 关闭默认保存自定义保存verboseFalse# 关闭冗余日志)# 4. 解析结果目标区域 标注信息 print(*50)print(YOLO 推理结果目标区域 标注信息)print(*50)# 获取图片用于绘制框imgcv2.imread(image_path)# 遍历所有检测目标foridx,resultinenumerate(results):boxesresult.boxes# 所有检测框forboxinboxes:# 提取目标区域坐标 # xyxy: 左上角x, 左上角y, 右下角x, 右下角yx1,y1,x2,y2box.xyxy[0].cpu().numpy()# 宽高wx2-x1 hy2-y1# 提取标注信息 cls_idint(box.cls[0])# 类别IDcls_namemodel.names[cls_id]# 类别名称conffloat(box.conf[0])# 置信度# 打印信息 print(f目标{idx1}:)print(f 标注类别{cls_name})print(f 置信度{conf:.2f})print(f 目标区域坐标)print(f 左上角 ({x1:.1f},{y1:.1f}))print(f 右下角 ({x2:.1f},{y2:.1f}))print(f 宽×高{w:.1f}×{h:.1f})print(-*30)# 在图片上绘制检测框 cv2.rectangle(img,(int(x1),int(y1)),(int(x2),int(y2)),(0,255,0),2)cv2.putText(img,f{cls_name}{conf:.2f},(int(x1),int(y1)-10),cv2.FONT_HERSHEY_SIMPLEX,0.5,(0,255,0),2)# 5. 保存/显示结果 ifsave_result:cv2.imwrite(yolo_result.jpg,img)print(✅ 标注图片已保存为yolo_result.jpg)# 显示图片可选cv2.imshow(YOLO Result,img)#cv2.waitKey(0)#cv2.destroyAllWindows()

相关新闻

实战指南:HunyuanVideo-Foley XL - 高效解决视频音效生成的多模态对齐难题

实战指南:HunyuanVideo-Foley XL - 高效解决视频音效生成的多模态对齐难题

实战指南:HunyuanVideo-Foley XL - 高效解决视频音效生成的多模态对齐难题 【免费下载链接】HunyuanVideo-Foley HunyuanVideo-Foley: Multimodal Diffusion with Representation Alignment for High-Fidelity Foley Audio Generation. 项目地址: https://gitcode…

2026/7/21 20:51:21 阅读更多 →
金融AI模型上线后崩溃的7个工程真相

金融AI模型上线后崩溃的7个工程真相

1. 为什么“模型上线”不是终点,而是系统性风险的起点?你有没有经历过这样的场景:模型在Jupyter Notebook里跑得飞起,AUC 0.92,F1 0.87,业务方拍板签字,庆功会都快安排上了——结果上线第三天&a…

2026/7/21 20:51:21 阅读更多 →
typedef、共用体、枚举、存储类型、分文件编程详细内容

typedef、共用体、枚举、存储类型、分文件编程详细内容

一、类型重定义(typedef)typedef 是C语言中的关键字,用于为已有的数据类型定义一个新的名称(别名)。这可以提高代码的可读性和可维护性。1.1 基本用法语法格式:typedef 原类型名 类型新名字;示例&#xff1…

2026/7/21 20:51:21 阅读更多 →

最新新闻

Claude模型不可选问题排查与修复:从配置到网络全流程指南

Claude模型不可选问题排查与修复:从配置到网络全流程指南

在实际使用 Claude 或类似 AI 模型时,经常会遇到模型不可选或连接问题,特别是当项目依赖特定模型版本时。这类问题不仅影响开发效率,还会导致功能无法正常使用。本文将以修复 Fable 模型不可选问题为例,详细介绍从问题定位到解决的…

2026/7/21 23:42:11 阅读更多 →
内容审核的 AI 化边界:哪些该用模型,哪些该用规则

内容审核的 AI 化边界:哪些该用模型,哪些该用规则

内容审核的 AI 化边界:哪些该用模型,哪些该用规则 一、模型万能主义正在让审核系统越来越重 过去两年看过的审核系统方案里,有一个明显的趋势:不管什么审核需求,上来就上 BERT、上多模态大模型、上 Agent 工作流。模型…

2026/7/21 23:42:11 阅读更多 →
AM62Px SoC互连安全:ISC与防火墙配置实战指南

AM62Px SoC互连安全:ISC与防火墙配置实战指南

1. 项目概述:为什么SoC互连安全如此重要?在嵌入式系统开发,尤其是涉及多核异构处理器和复杂外设集成的项目中,我们常常会面临一个核心挑战:如何确保系统内不同功能模块之间的数据访问是安全、有序且受控的?…

2026/7/21 23:42:11 阅读更多 →
HarmonyOS 6.0 分栏布局与折叠适配

HarmonyOS 6.0 分栏布局与折叠适配

分栏布局是平板和折叠屏应用的基本功。手机上用栈式导航,平板上用左右分栏,折叠屏要能在两种模式间无缝切换。HarmonyOS的Navigation组件内置了Split/Stack/Auto三种模式,但真要用好,还得理解底层的适配逻辑。 Navigation三种模式…

2026/7/21 23:42:11 阅读更多 →
Arm AGI CPU架构解析:专为代理式AI设计的数据中心处理器

Arm AGI CPU架构解析:专为代理式AI设计的数据中心处理器

1. Arm AGI CPU的发布背景与核心定位2026年3月,Arm公司正式发布了其首款专为人工智能数据中心设计的AGI CPU产品。这款处理器标志着Arm在计算架构领域的一次重大突破,其设计理念直接回应了当前代理式AI(Agentic AI)工作负载对计算…

2026/7/21 23:42:11 阅读更多 →
排列三玩法解析与166期号码分析

排列三玩法解析与166期号码分析

1. 体彩排列三玩法基础解析排列三作为中国体育彩票的经典数字型玩法,其核心规则是从000-999中选择一个三位数作为投注号码。每期开奖时,从0-9共10个号码球中按顺序摇出3个号码作为开奖号码。玩家需要准确预测开奖号码的顺序和组合才能中奖。排列三的主要…

2026/7/21 23:41:11 阅读更多 →

日新闻

Octane Render与C4D汉化版安装与优化指南

Octane Render与C4D汉化版安装与优化指南

1. Octane Render与C4D的黄金组合:为什么选择这个方案?在三维创作领域,渲染器的选择往往决定了作品的最终呈现质量和工作效率。作为Cinema 4D(C4D)用户,Octane Render的GPU加速特性与实时预览功能&#xff…

2026/7/21 0:00:19 阅读更多 →
GPMC接口设计:异步/同步模式与多路复用配置实战

GPMC接口设计:异步/同步模式与多路复用配置实战

1. GPMC接口设计:从硬件连接到软件配置的全局视角在嵌入式系统开发中,尤其是基于TI Sitara系列如AM263x这类高性能微控制器的项目里,外部存储器的扩展几乎是绕不开的一环。无论是存放大量非易失性代码的NOR Flash,还是作为高速数据…

2026/7/21 0:00:19 阅读更多 →
UE5 GAS框架下RPG被动技能系统:从核心原理到实战实现

UE5 GAS框架下RPG被动技能系统:从核心原理到实战实现

1. 项目概述:UE5 GAS RPG被动技能的核心价值在UE5里用GAS(Gameplay Ability System)做RPG游戏,主动技能像是你手里的武器,按一下打一下,逻辑直接,反馈也快。但被动技能,它更像是你身…

2026/7/21 0:00:19 阅读更多 →

周新闻

Go语言静态资源打包方案对比与实践指南

Go语言静态资源打包方案对比与实践指南

1. 项目背景与核心需求在Go语言开发中,我们经常需要处理静态资源文件的打包问题。无论是Web应用的模板文件、前端资源,还是配置文件、证书等,都需要随程序一起分发。传统做法是将这些文件与编译后的二进制文件放在同一目录下,但这…

2026/7/21 8:48:31 阅读更多 →
Go语言实现高性能LDAP认证服务的架构与实践

Go语言实现高性能LDAP认证服务的架构与实践

1. 项目背景与核心价值LDAP(轻量级目录访问协议)作为企业级身份认证的黄金标准,已经服务了超过80%的财富500强公司。我在金融科技领域实施统一认证体系时,发现传统Java方案存在启动慢、内存占用高等痛点。而Go语言凭借其协程并发模…

2026/7/21 5:34:47 阅读更多 →
【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

更多请点击: https://intelliparadigm.com 第一章:AI面试官实战指南的核心价值与适用场景 AI面试官并非替代人类HR的“黑箱工具”,而是以可解释、可审计、可迭代的方式,赋能招聘全链路的关键基础设施。其核心价值在于将主观经验沉…

2026/7/21 8:25:39 阅读更多 →

月新闻