城市河道是城市水生态体系的核心载体,更是保障城市环境卫生、防范内涝灾害、维系生态平衡的关键基础设施。整洁通畅的河道能够有效提升城市市容风貌,保障水系正常循环,降低暴雨汛期城市内涝风险。但在城市常态化运维过程中,河道水面漂浮物、生活垃圾、杂物堆积等问题频发,不仅破坏河道景观、影响城市人居环境,还会堵塞水道、阻碍水体流通,大幅降低河道行洪排涝能力,给城市防汛安全埋下隐患。因此,高效、精准、常态化的河道治理管护工作,是城市精细化治理的重要组成部分。
长期以来,我国城市河道治理普遍依赖传统人工巡检处置模式。各地水务、城管部门通过配置专职河道巡查人员,采用人工徒步巡查的方式排查河道垃圾、淤积、排污等问题,发现隐患后人工上报、现场处置。这种传统运维模式依托人力落地,流程直观、基础保障性强,但在现代化城市治理体系下,短板与局限性日益凸显。人工巡检需要投入大量人力物力,运营成本居高不下,且受人员体能、精力、工作时间限制,无法实现全天候、全覆盖、无间断的河道监测管控。
同时,当前基层河道巡查队伍普遍存在人员年龄结构偏大的问题,传统巡查方式效率偏低、响应速度滞后。在日常管护中,人工巡查易出现盲区、漏查、迟查等问题,难以精准捕捉零散漂浮物、隐蔽垃圾堆积等细微问题;在汛期、暴雨等灾害来临前夕,河道水位、淤积、杂物堵塞情况变化迅速,人工巡检无法快速完成全域排查,难以及时预判风险、处置隐患,极大制约了城市河道应急防汛能力,难以适配新时代城市精细化、智慧化治理的发展需求。
随着人工智能、大数据、视频感知、无人机巡检等数字技术的快速迭代与普及,各行业数字化、智能化转型持续深化,为传统河道治理模式革新提供了全新路径。依托AI智能化技术赋能,构建空陆一体、全域感知、智能预警、闭环处置的智慧河道治理体系,能够彻底破解传统人工巡检的痛点难题,推动城市河道治理从“人工被动巡查”向“智能主动防控”转型升级。
智慧河道治理体系构建以立体化感知网络为基础,整合城市现有河道监控资源与无人机机动巡检能力,形成全方位、无死角的监测格局。一方面,利用河道两岸布设的高清监控摄像头,实时采集河道视频流数据,实现24小时不间断定点监测;另一方面,通过无人机按照预设航线开展机动巡检,快速覆盖河道全域,弥补固定监控点位的视野盲区,适配复杂河段、偏远河段的巡查需求,大幅提升巡检覆盖范围与机动灵活性。
在数据感知基础上,通过搭建专业化河道治理数据集,依托人工精准标注、场景化训练,研发适配河道管护场景的AI智能检测识别模型,并部署于端侧智能设备。该模型可对无人机航拍图像、河道实时视频画面进行自动化、智能化分析,精准识别水面漂浮物、生活垃圾、杂物堆积、河道淤积等各类问题,具备识别精度高、响应速度快、全天候运行的优势,彻底摆脱对人工肉眼巡查的依赖。
基于AI智能识别技术,整套治理体系形成“智能识别-实时预警-平台调度-精准处置-闭环复盘”的全流程工作机制。当系统监测到河道异常问题时,可自动触发预警,将问题位置、隐患类型、现场画面实时推送至中央管控平台。平台依托智能化调度机制,精准匹配就近巡查运维人员,快速派发处置工单,实现问题精准定位、高效处置,有效缩短隐患处理时长,杜绝人工巡查滞后、处置低效等问题。
相较于传统人工治理模式,AI智能化河道治理模式具备全方位、全天候、高效率、低成本、精准化的核心优势。通过数字技术赋能,彻底解决了人工巡检覆盖不全、响应滞后、人力成本高、汛期应急能力弱等痛点,实现河道隐患早发现、早预警、早处置。在日常管护中,能够持续保持河道水体整洁、水道通畅,美化城市水环境;在防汛关键时期,可快速排查河道堵塞隐患,保障水系行洪通畅,有效防范城市内涝风险。
本文正是在这样的思考背景下,想要探索尝试从实验性质的角度出发开发构建智能化的检测识别预警系统,在前面的系列博文中我们已经进行了很多相关的开发实践工作,感兴趣的话可以自行移步阅读即可:
《AI智能化技术赋能城市河道治理的创新应用与实践,基于YOLOv11全系列【n/s/m/l/x】参数模型开发构建复杂河道水面场景下河道表面漂浮物检测预警系统》
本文主要是想要基于最新发布的YOLO26全系列的模型来进行相应的开发实践,首先看下实例效果:

接下来看下实例数据情况:

官方发表的论文如下,在前面的博文中我们进行了阅读记录:
《YOLO26: Key Architectural Enhancements and Performance Benchmarking for Real-time Object Detection》
YOLO26 的关键架构改进:
1、移除分布焦点损失(DFL):DFL 虽然在早期模型中提高了准确性,但增加了计算开销和导出复杂性。YOLO26 通过移除 DFL,简化了边界框回归,提高了效率和跨平台兼容性。
2、端到端无 NMS 推理:传统的 YOLO 模型依赖于非最大抑制(NMS)作为后处理步骤,这增加了延迟并需要手动调整超参数。YOLO26 实现了端到端的无 NMS 推理,直接输出最终检测结果,减少了延迟并简化了部署流程。
3、渐进式损失平衡(ProgLoss)和小目标感知标签分配(STAL):这两种新策略提高了训练的稳定性和小目标的检测准确性。ProgLoss 动态调整损失权重,防止模型过度拟合于主导类别;STAL 优先为小目标分配标签,提高了在复杂环境下的检测性能。
4、MuSGD 优化器:结合了 SGD 和 Muon 优化器的优势,实现了更快、更稳定的收敛,提高了训练效率。
一共提供了n、s、m和l四款不同参数量级的模型。
这里我们保持完全相同的实验参数设置来进行四款模型的开发训练,等待训练完成之后我们来整体进行各项指标的对比分析。
【Precision曲线】 精确率曲线(Precision Curve)是一种用于评估二分类模型在不同阈值下的精确率性能的可视化 工具。它通过绘制不同阈值下的精确率和召回率之间的关系图来帮助我们了解模型在不同阈值下的表现。 精确率(Precision)是指被正确预测为正例的样本数占所有预测为正例的样本数的比例。召回率(Recall)是指被正确预测为正例的样本数占所有实际为正例的样本数的比例。 绘制精确率曲线的步骤如下: 使用不同的阈值将预测概率转换为二进制类别标签。通常,当预测概率大于阈值时,样本被分类为正例,否则分类为负例。 对于每个阈值,计算相应的精确率和召回率。 将每个阈值下的精确率和召回率绘制在同一个图表上,形成精确率曲线。 根据精确率曲线的形状和变化趋势,可以选择适当的阈值以达到所需的性能要求。 通过观察精确率曲线,我们可以根据需求确定最佳的阈值,以平衡精确率和召回率。较高的精确率意味着较少的误报,而较高的召回率则表示较少的漏报。根据具体的业务需求和成本权衡,可以在曲线上选择合适的操作点或阈值。 精确率曲线通常与召回率曲线(Recall Curve)一起使用,以提供更全面的分类器性能分析,并帮助评估和比较不同模型的性能。

【Recall曲线】 召回率曲线(Recall Curve)是一种用于评估二分类模型 在不同阈值下的召回率性能的可视化工具。它通过绘制不同阈值下的召回率和对应的精确率之间的关系图来帮助我们了解模型在不同阈值下的表现。 召回率(Recall)是指被正确预测为正例的样本数占所有实际为正例的样本数的比例。召回率也被称为灵敏度(Sensitivity)或真正例率(True Positive Rate)。 绘制召回率曲线的步骤如下: 使用不同的阈值将预测概率转换为二进制类别标签。通常,当预测概率大于阈值时,样本被分类为正例,否则分类为负例。 对于每个阈值,计算相应的召回率和对应的精确率。 将每个阈值下的召回率和精确率绘制在同一个图表上,形成召回率曲线。 根据召回率曲线的形状和变化趋势,可以选择适当的阈值以达到所需的性能要求。 通过观察召回率曲线,我们可以根据需求确定最佳的阈值,以平衡召回率和精确率。较高的召回率表示较少的漏报,而较高的精确率意味着较少的误报。根据具体的业务需求和成本权衡,可以在曲线上选择合适的操作点或阈值。 召回率曲线通常与精确率曲线(Precision Curve)一起使用,以提供更全面的分类器性能分析,并帮助评估和比较不同模型的性能。

【mAP0.5】 mAP0.5,也被称为mAP@0.5或AP50,指的是当Intersection over Union(IoU)阈值为0.5时的平均精度 (mean Average Precision)。IoU是一个用于衡量预测边界框与真实边界框之间重叠程度的指标,其值范围在0到1之间。当IoU值为0.5时,意味着预测框与真实框至少有50%的重叠部分。 在计算mAP0.5时,首先会为每个类别计算所有图片的AP(Average Precision),然后将所有类别的AP值求平均,得到mAP0.5。AP是Precision-Recall Curve曲线下面的面积,这个面积越大,说明AP的值越大,类别的检测精度就越高。 mAP0.5主要关注模型在IoU阈值为0.5时的性能,当mAP0.5的值很高时,说明算法 能够准确检测到物体的位置,并且将其与真实标注框的IoU值超过了阈值0.5。

【mAP0.5:0.95】 mAP0.5:0.95,也被称为mAP@[0.5:0.95]或AP@[0.5:0.95],表示在IoU阈值从0.5到0.95变化时,取各个阈值对应的mAP的平均值。具体来说,它会在IoU阈值从0.5开始,以0.05为步长,逐步增加到0.95,并在每个阈值下计算mAP,然后将这些mAP值求平均。 这个指标考虑了多个IoU阈值下的平均精度,从而更全面、更准确地评估模型性能。当mAP0.5:0.95的值很高时,说明算法在不同阈值下的检测结果均非常准确,覆盖面广,可以适应不同的场景和应用需求。 对于一些需求比较高的场合,比如安全监控等领域,需要保证高的准确率和召回率,这时mAP0.5:0.95可能更适合作为模型的评价标准。 综上所述,mAP0.5和mAP0.5:0.95都是用于评估目标检测模型性能的重要指标,但它们的关注点有所不同。mAP0.5主要关注模型在IoU阈值为0.5时的性能,而mAP0.5:0.95则考虑了多个IoU阈值下的平均精度,从而更全面、更准确地评估模型性能。

【loss曲线】 在深度学习的训练过程中,loss函数用于衡量模型预测结果与实际标签之间的差异。loss曲线则是通过记录每个epoch(或者迭代步数)的loss值,并将其以图形化的方式展现出来,以便我们更好地理解和分析模型的训练过程。

【F1值曲线】 F1值曲线是一种用于评估二分类模型在不同阈值下的性能的可视化工具。它通过绘制不同阈值下的精确率(Precision)、召回率(Recall)和F1分数的关系图来帮助我们理解模型的整体性能。 F1分数是精确率和召回率的调和平均值,它综合考虑了两者的性能指标。F1值曲线可以帮助我们确定在不同精确率和召回率之间找到一个平衡点,以选择最佳的阈值。 绘制F1值曲线的步骤如下: 使用不同的阈值将预测概率转换为二进制类别标签。通常,当预测概率大于阈值时,样本被分类为正例,否则分类为负例。 对于每个阈值,计算相应的精确率、召回率和F1分数。 将每个阈值下的精确率、召回率和F1分数绘制在同一个图表上,形成F1值曲线。 根据F1值曲线的形状和变化趋势,可以选择适当的阈值以达到所需的性能要求。 F1值曲线通常与接收者操作特征曲线(ROC曲线)一起使用,以帮助评估和比较不同模型的性能。它们提供了更全面的分类器性能分析,可以根据具体应用场景来选择合适的模型和阈值设置。

整体对比分析来看:不难发现四款不同参数量级的模型最终达到了较为相似的结果,没有拉开非常大的差距,这里综合参数量考虑我们最终选定了s系列的模型来作为线上的推理 计算模型。接下来看下s系列模型的详细情况。
【离线推理实例】


【Batch实例】

【混淆矩阵】

【F1值曲线】

【Precision曲线】

【PR曲线】

【Recall曲线】

【训练可视化】

数字化、智慧化是城市水环境治理的必然趋势。AI技术与河道治理场景的深度融合,重构了城市河道管护工作流程,优化了治理资源配置,大幅提升了河道治理的精细化、智能化、现代化水平。未来,随着人工智能、数字孪生、大数据分析等技术的持续升级,智慧河道治理体系将不断完善,进一步实现河道风险预判、水质动态监测、治理成效智能分析等功能,持续夯实城市水生态安全屏障,为城市高质量发展、人居环境提质、防汛安全保障提供坚实支撑。
网硕互联帮助中心




评论前必须登录!
注册