机器听觉-AI声学与声纹识别

声纹检测在管道泄漏中的应用:从工业管网到城市水务

作者:贺中义发布于 2026-09-1010分钟
声纹检测管道泄漏检测供水管网漏损声学检测管网监测
声纹检测在管道泄漏中的应用:从工业管网到城市水务

摘要:管道泄漏检测长期面临同一个悖论:声学是最有效的技术手段,却也是最难标准化的。供水管网漏损率已被列为国家节水型城市的底线指标(CJJ 92 规定核算后 ≤9%),但"听音法依赖老师傅经验、相关仪成本高、噪声记录仪误报多"的现实没有根本改变。本文梳理管道声学检测从听音棒到 AI 声纹的技术谱系,拆解工业管网与城市水务之间四个必须重新校准的物理变量,并给出水务场景的三个可落地切入点。适合管网运维、智慧水务规划与设备选型的工程人员。

引言:一个被低估的难题

城市公共供水管网漏损,是世界性难题。

2022 年 2 月,住房和城乡建设部办公厅与国家发展改革委办公厅联合印发《关于加强公共供水管网漏损控制的通知》,明确到 2025 年,全国城市公共供水管网漏损率力争控制在 9% 以内。这一指标随后进入《国家节水型城市评选标准》,成为底线指标——意味着不达标直接失去评选资格。

"9% 以内"这个数字,看起来不高。但要知道,国内相当一部分城市的实际漏损率长期在两位数运行,老旧城区与城乡结合部片区更高。

漏损不只是水量损失。它同时意味着:

• 供水安全风险:管道破损处是外界污染物入侵的通道

• 公共安全风险:地下空洞、路面塌陷,很多源于长期暗漏冲刷

• 直接经济损失:水厂处理好的成品水,白白漏进了土壤

于是问题回到技术层面:怎么在大面积埋地管网里,把漏点找出来?

________________________________________

01 管道泄漏的声学本质:为什么"听得到"不等于"听得准"

先讲清楚物理前提。

管道内带压流体从破口喷出,会产生两个物理现象:

1. 湍流噪声——流体喷出时形成湍流,辐射宽频噪声

1. 管壁振动——喷流冲击与压力波动激发管壁振动,沿管壁向两侧传播

这两个现象,构成了所有声学检漏方法的基础。只要能捕获管壁振动或喷流噪声,就能间接判断漏点的存在与位置。

听起来直接,难点在三个地方:

难点一:信号弱,且衰减快

漏水声波的有效频段通常在 100 Hz – 5000 Hz 之间。这个频段的信号在传播中最容易被土壤吸收——尤其高频部分,埋深每增加一段,高频衰减就多一分。埋深 2 米以上的漏点,传到地面的往往只剩下低频段。

难点二:每种管材的声速都不一样

这是最容易被忽略、也最影响定位精度的变量:

管材 声波传播速度 对检测的影响

铸铁管 约 1200 m/s 传播远,利于定位

钢管 约 1300 m/s 传播远,但易受电噪声干扰

PE 塑料管 约 350 m/s 衰减极快,高频几乎传不出,检测难度陡增

PE 管在现代供水管网里的占比越来越高(尤其新建小区、城乡结合部支管)。它的声学特性与金属管不在一个量级——同样的检测方法和参数,在铸铁管上工作良好,换到 PE 管上可能完全失效。

难点三:环境噪声的干扰是结构性的

管网周边的噪声源几乎是恒定的:

• 城市交通(低频、连续)

• 水泵机组工频振动(周期性、稳定)

• 二次供水设备运行噪声

• 沿街商铺设备、施工噪声

这些噪声与漏点信号的频段高度重叠。所以问题不是"信号太小听不见",而是"目标信号和干扰信号混在一起,分不开"。

这就解释了为什么"听得到"和"听得准"是两件事:传统听音法靠人耳在噪声中筛选目标信号,本质上是把判断责任交给了经验——这也是它无法规模化的根本原因。

________________________________________

02 技术谱系:从听音棒到 AI 声纹

管道声学检测的技术演进,大致经历了五个阶段:

第一代:机械听漏棒

一根金属杆,一端抵住阀门、消火栓或管道暴露点,一端贴耳。结构简单、无需供电、成本极低。

局限同样明显:完全依赖人耳主观判断,无法识别微小暗漏与深埋漏点,在嘈杂环境下基本失效。

第二代:电子听漏仪

加入传感器与放大器,灵敏度显著提升,可捕捉中小量级漏点。

但这一代没有噪声过滤能力,抗干扰性差,检测数据无法存储和追溯。结果高度依赖操作人员经验,新人上手难度大。

第三代:数字相关仪

这是目前供水管网检漏的主力装备。

原理是互相关分析:在疑似漏水管段两端各安装一枚高灵敏度压电加速度传感器(通常装在阀门井或消火栓),管壁传播的漏水声波被转换为电信号;主机对两路信号做数字滤波后,计算互相关函数,得到两路信号的时延差 Δt,再根据声速 V 反推漏点位置:

其中 D 为两传感器间距,L 为漏点距近端传感器的距离。

数字相关仪把定位精度提升到 0.1–0.3 米,成为行业标准工具。但它有三个现实门槛:

• 需要管段两端都有可安装传感器的接入点

• 需要知道该管段准确的声速参数(管材、管径、埋深都影响)

• 设备成本与操作门槛都较高

第四代:多探头噪声记录仪

固定安装在管网节点上,24 小时连续监听,通过"夜间最小流量时段"的低噪窗口识别异常声源。

这一代的关键进步是从"被动巡检"转向"主动监测"——不再等巡检周期到了才去听,而是让管网一直处在监听状态。

代价是:节点数量与成本成正比,且大量节点产生的告警需要人工复核,误报率是规模化部署的主要阻力。

第五代:AI 声纹识别

在噪声记录仪的基础上叠加机器学习:不再靠人工设阈值,而是用模型自动甄别"车流扰动、水泵工频、施工噪声"等干扰声源,只把真正符合漏水特征的事件推给人。

主流做法是预训练声纹库路线:厂商采集海量现场声学样本(公开资料中已有"数十万条管网漏水声纹样本"级别的表述),训练通用模型,客户部署后直接使用。

这条路线的工程价值是明确的:大幅降低对人工经验的依赖。但它也有一个前提假设,而这个假设在现实中经常不成立——下一节展开。

________________________________________

03 一个被忽略的前提:漏点样本永远不够

预训练声纹库路线的隐含假设是:"漏水声"是一种可以跨管网迁移的稳定特征。

这个假设在多大程度上成立,取决于漏点信号的一致性。而现实中,影响同一处漏点声纹特征的变量至少有:

• 管材(铸铁 / 钢 / PE / PVC,声速差 3–4 倍)

• 管径与壁厚

• 埋深与土壤类型(砂土 / 黏土 / 回填土,吸声特性不同)

• 管内压力与流速(压力 0.2 MPa 与 0.5 MPa,喷流噪声强度差异显著)

• 漏口形态(孔洞 / 裂缝 / 接口渗漏,辐射特性完全不同)

• 周边噪声基底(主干道旁的管网与郊区管网的可用信噪比天差地别)

这些变量组合起来,使得"一套模型打遍全城管网"很难成立。 更现实的情况是:通用模型在典型工况下能给出参考,但要在某个具体片区内做到低误报,仍然需要针对该片区做适配。

而对模型做适配,就回到了工业 AI 最经典的那个困境——你需要该片区的漏点样本。

问题是,漏点样本从哪来?

• 漏点是异常事件,一个维护良好的片区,一年可能只发生几处

• 漏点出现后会被快速修复,修复完信号就消失了

• 不可能为了训练模型,在管网上人为制造漏点

这就是工业声学场景的共性矛盾:异常样本天然稀缺,而监督学习要求先有大量异常样本。

这个矛盾在产线质检里表现为"攒不出足够的不良品",在管网检漏里表现为"攒不出足够的漏点录音"。本质是同一个问题。

________________________________________

04 从工业管网到城市水务:四个必须重新校准的变量

工业管道场景(如蒸汽管网、厂区工艺管道)与城市供水管网,在声学检测上共享同一套物理原理,但有四个关键差异,决定了方案不能直接照搬。

变量一:集中式 vs 分布式

工业管网的检测点是集中的——一个厂区、一条管线,可以部署固定式高精度设备,用较高的单位成本换取检测质量。

城市供水管网是分布式的:数百公里的管线、成千上万个节点,任何方案都必须先把单节点成本压到可持续的水平,否则铺不开。

变量二:可达性

工业管道通常有明确的巡检通道、阀门井、支架平台,设备安装与维护相对可控。

城市管网埋在路面下,很多节点位于车行道、绿化带、小区内部。安装需要开挖或占道许可,维护成本高。 这要求设备必须具备长期免维护能力——包括供电自持、通信可靠、防误报。

变量三:噪声基底完全不同

工业园区的主要干扰是设备运转噪声,频谱相对稳定、可预测。

城市管网要面对的是:交通流(早晚高峰差异巨大)、施工(突发、不规律)、商业活动、二次供水机组。噪声基底是非平稳的,任何基于"固定阈值"或"稳定背景"的方法都会失效。

变量四:判断标准不一样

产线质检的判断标准是"这个工件合格 / 不合格"——二分类,单一工件。

管网监测的判断标准是"这一段管网里有没有漏点、大概在哪"——这是区域级、多节点协同的问题。单个节点的告警价值有限,必须结合节点间的空间关系与时间相关性才能定位。

小结:工业管网的经验可以迁移的是方法论(声学特征提取、抗噪处理、跨平台一致性),不能直接迁移的是部署形态与判断逻辑。

________________________________________

05 水务场景的四个可落地切入点

基于上述差异,水务领域的声学检测有几个务实的切入点——它们不一定都需要"全城管网全覆盖"这样的大工程。

切入点一:工业水系统(厂区内闭环)

这是与既有工业经验最接近、也最容易见效的场景:工厂的循环水系统、冷却水管道、消防水管网、污水处理厂内的工艺管道。

特点是:范围可控、可达性好、能部署固定式设备。工业客户对"管网健康监测"的付费意愿也明确——因为这些管道一旦泄漏,直接影响生产。

切入点二:DMA 分区计量 + 声学复核

分区计量(DMA)解决的是"哪个片区有问题",不解决"具体在哪一段"。而声学检测解决的正是后者。

两者组合的价值在于:用 DMA 把排查范围从全城管网缩小到一个小区、一条支线,再用声学设备精确锁定。 这使得声学设备不需要全域铺开,只需要按需部署在重点片区——成本门槛一下子降下来了。

(广州黄埔区的实践可作为参照:通过构建四级分区计量体系,该区公共供水管网漏损率下降了 7.41 个百分点。分区计量的价值已被验证,而它下游的"最后一公里精确定位"正是声学方案的用武之地。)

切入点三:老旧管网与高风险管段的重点监测

不必追求全线覆盖。把有限的设备投向已知高风险的管段——管龄超过 20 年的铸铁管、历史漏点密集区、地质沉降区、重载交通下方的管道。

这是典型的风险导向部署:用 20% 的节点覆盖 80% 的风险。

切入点四:PE 管等非金属管道的专项方案

PE 管声速只有金属管的三分之一左右、高频衰减极快,是现有方法公认的难点。

正因为难,这里反而存在技术差异化的空间:谁能把 PE 管场景做扎实,谁就能拿到增量市场——而 PE 管在新建管网里的占比还在上升。

________________________________________

06 落地建议:分三步走

对准备引入声学检测的水务单位,建议按以下路径推进,避免一次性大规模部署的风险:

第一步:单片区验证(1–2 个月)

选一个管网条件明确、漏损率偏高、边界清晰的独立片区(优先选 DMA 已建成的分区),部署有限数量的监测点,用已知漏点验证检出率与误报率。

关键动作:在验证期同步采集该片区正常运行的声学基线——这是后续所有模型的基础。

第二步:基线学习与模型本地化(1–3 个月)

这一步是区分不同技术路线的分水岭:

• 若走预训练库路线:直接调用厂商通用模型,接受其在该片区的泛化误差

• 若走基线学习路线:用第一步采集的正常运行声纹建立该片区的"健康基线",凡是偏离基线的报为异常

后者不需要漏点样本,恰好绕开了"漏点稀缺"这个根本矛盾。代价是需要在验证期投入一些基线采集工作。

第三步:按风险扩面(持续)

验证通过后,不追求全域铺开,而是按风险等级把成功经验复制到同类片区——同样的管材、同样的埋深条件、同样的噪声环境。

同类片区之间的模型迁移成功率,远高于跨类型迁移。

________________________________________

结语:技术路线的分歧,本质是对"样本"的回答

回到本文开头那个悖论:声学是管道检漏最有效的技术手段,却最难标准化。

难在哪?难在"漏点样本永远不够"这个前提上。

于是行业出现了两条技术路线:

预训练声纹库路线 基线学习路线

依赖 海量厂商侧漏点样本 客户侧正常运行样本

优势 开箱可用,无需本地数据积累 无需漏点样本,本地适配性强

局限 跨管网泛化存在误差,需现场适配 需要验证期采集基线

适合 通用场景、快速覆盖 重点片区、高精度要求

这两条路线不是对立的,而是互补的——这正是工业声学 AI 在管网场景里的现实格局。

真正决定方案成败的,往往不是算法本身,而是那些更朴素的问题:设备能不能长期免维护地跑下去?误报能不能压到运维人员愿意接受?数据能不能接进客户已有的系统?

这些问题的答案,不在论文里,在现场。

________________________________________

作者:贺中义 单位:上海创单电子科技有限公司(ISSAUTO)

需要定制化解决方案?

技术专家一对一沟通,深入了解您的需求

联系我们