基于YOLO的施工现场隐患智能识别系统
点击蓝字
关注我们
关注并星标
从此不迷路
计算机视觉研究院


公众号ID|计算机视觉研究院
学习群|扫码在主页获取加入方式
https://pmc.ncbi.nlm.nih.gov/articles/PMC12443295/pdf/pone.0332042.pdf
计算机视觉研究院专栏
Column of Computer Vision Institute
建筑行业事故频发,传统安全巡检效率低、漏检多。本文基于 YOLOv5n 打造轻量化智能隐患识别系统,兼顾精度与速度,成功部署于 Jetson Nano 边缘平台,为工地安全管控提供全新方案。

PART/1
痛点
建筑工地环境复杂、人员密集、工序交叉,传统安全管理存在人员数据缺失、设备布局监管模糊、安全隐患漏检三大核心问题。未规范佩戴安全帽、违规吸烟、脚手架变形、安全网破损、线缆损坏等隐蔽隐患,依靠人工巡检难以实时发现,成为施工安全的重大隐患。常规深度学习模型体积大、算力要求高,无法在工地现场边缘设备部署,实时检测需求长期无法满足。
PART/2
创新
核心突破:YOLOv5n 五大轻量化优化
本研究以YOLOv5n为基础,针对工地小目标多、场景密集、边缘部署的需求,完成 5 项关键改进,实现精度提升 + 模型轻量化双目标:
- ECA 注意力机制:轻量通道注意力,以极小参量提升关键特征提取能力,精准聚焦隐患区域
- Ghost 模块:用低成本线性变换替代部分卷积,大幅削减模型参数量与计算量
- BiFPN 特征融合:替换原 PAN 结构,双向加权融合多尺度特征,小目标检测更精准
- SIoU 损失函数:加入向量角度信息,加速边界框回归收敛,密集场景检测更稳定
- EIoU–NMS:优化冗余检测框过滤逻辑,避免误删、漏检,目标定位更准确

【YOLO-CGBSE 网络架构】
PART/3
实验
实验验证:超轻量模型,精度拉满
研究团队自建两大工地专属数据集,分别针对人员不安全行为和物体不安全状态训练模型:
-
人员不安全行为:涵盖 7 类(正确 / 未戴 / 错误佩戴安全帽、安全带、吸烟、反光背心、人体躯干),增强后共 12530 张图像
-
物体不安全状态:涵盖 5 类(脚手架变形、安全网破损、开裂、缺失、穿孔)
最终训练出两款约 2.5MB 超轻量模型,检测精度表现优异:
-
人员不安全行为检测:mAP@0.5 = 93.6%
-
物体不安全状态检测:mAP@0.5 = 99.5%

【消融实验结果】
消融实验证实,融合五大优化的YOLO-CGBSE模型,在参数量、算力消耗、检测精度上实现最优平衡,对比 YOLOv8n、YOLOv12n 等同量级模型,更适配工地边缘部署。

【检测效果对比】
在无人机视角、高分辨率、遮挡作业等复杂场景下,改进模型的漏检率、误检率远低于原始 YOLOv5n,小目标与密集目标检测稳定性大幅提升。
PART/4
落地价值
边缘部署与应用展望
1. 现场系统落地
以Jetson Nano B01嵌入式平台为核心,搭配高清摄像头、显示屏,搭建工地现场实时隐患检测系统,模型体积仅约 2.5MB,边缘端流畅运行。

【系统框架图】

【现场实测检测效果】
2. 系统核心优势
-
超轻量化:模型≈2.5MB,低算力边缘设备可轻松部署
-
高精度:人员 / 物体隐患检测 mAP@0.5 分别达 93.6%、99.5%
-
实时性:现场实时识别,隐患秒级预警
3. 未来优化方向
-
拓展检测隐患类型(如破损电缆、带电作业绝缘防护缺失等)
-
融合两大数据集,提升模型泛化能力
-
联动自动报警系统,实现隐患分级预警、截图存证
PART/5
总结
本研究将轻量化 YOLO 与工地安全深度融合,破解了边缘端部署难、现场检测精度低的行业痛点,为建筑施工安全智能化管控提供了可落地、可复制的技术方案,助力工地安全从 “人工巡检” 全面迈向 “AI 智防”。
有相关需求的你可以联系我们!


END


转载请联系本公众号获得授权

计算机视觉研究院学习群等你加入!
ABOUT
计算机视觉研究院
计算机视觉研究院主要涉及深度学习领域,主要致力于目标检测、目标跟踪、图像分割、OCR、模型量化、模型部署等研究方向。研究院每日分享最新的论文算法新框架,提供论文一键下载,并分享实战项目。研究院主要着重”技术研究“和“实践落地”。研究院会针对不同领域分享实践过程,让大家真正体会摆脱理论的真实场景,培养爱动手编程爱动脑思考的习惯!
往期推荐
🔗
更多推荐


所有评论(0)