水厂混凝剂(PAC)投加量长期依赖班组经验试投:原水浊度平稳时尚可维持,一旦遭遇汛期、藻类暴发或季节性水质突变,人工调整响应滞后,往往出现两种后果——投加不足导致沉后浊度逼近甚至突破管控上限,或为保水质过量投加推高药耗。同时水厂 SCADA 系统已积累多年分钟级运行数据,但仅用于监视与报表,从未参与投加决策。本项目旨在基于历史运行数据建立投加量预测模型,为现场提供可量化、可解释的投加参考。
行业场景与业务背景:面向市政供水与污水处理行业。PAC 药耗是水厂日常运行中最主要的可控成本项之一,沉后浊度则是直接关系出水水质的关键管控指标,二者存在强耦合关系:投加不足风险水质,投加过量则推高成本并增加污泥处理负担。行业普遍已建成 SCADA 系统,具备原水浊度、进水流量、pH 等参数的分钟级采集能力,为数据驱动建模提供了数据基础。项目面向生产现场实际使用,部署于水厂内网,无需 GPU。
1. SCADA 数据接入与清洗模块
对接水厂 SCADA 系统,采集原水浊度、进水流量、pH、温度等分钟级运行数据,处理缺失值、异常跳变与停机工况剔除,按时间对齐不同采集频率的数据源,形成建模可用的标准数据集。
2. 加药量预测模块
核心功能。采用"机理模型 + 数据驱动模型"双轨方案:机理模型依据原水浊度、进水流量、目标沉后浊度等工艺参数,按混凝机理推算理论投加量作为可解释基线;数据驱动模型基于历史数据训练轻量回归模型,学习理论值与实测最优投加之间的残差,做动态修正。二者融合输出推荐投加量。
3. 模型版本管理与对比验证模块
记录 V1 至 V6 共 6 个版本的特征调整与结构改动,每个版本均保留验证结果;支持新旧模型在 1000 条样本上逐条比对预测值与实际投加量,量化改进幅度,避免模型迭代变成黑箱。
4. 时序数据存储模块
预测结果与实际投加数据写入时序数据库,支持历史回溯、预测偏差统计与效果评估,为模型持续优化提供反馈闭环。
5. 可视化与接口模块
Vue 管理端展示推荐投加量曲线、与实际投加量的偏差对比、历史查询与导出;FastAPI 提供标准化预测接口,支持与自控系统对接。
技术栈:Python、Pandas、NumPy、scikit-learn(线性回归等轻量算法)、FastAPI、InfluxDB / ClickHouse、Vue 3、Docker。
架构:数据层对接 SCADA 与时序数据库,负责采集、清洗与特征工程;模型层为双轨预测服务,机理计算与数据驱动模型分离部署、独立可维护;服务层通过 FastAPI 对外提供预测接口;应用层由 Vue 管理端承载可视化与查询。整体容器化部署,普通服务器即可运行,无需 GPU。
实现难点:
滞后效应建模。加药后到沉后浊度响应存在时间滞后,直接用同一时刻的原水参数预测投加量会失真,需在特征工程中引入滞后窗口与 Δt 对齐。
工况差异处理。不同季节、不同原水条件下投加规律差异明显,单一模型泛化能力不足,通过工况分桶与派生特征解决。
可解释性约束。现场班组不会采用无法解释的黑箱结果,纯数据驱动模型即便精度更高也难落地,因此必须保留机理模型作为可解释基线。
迭代验证机制。模型改动必须可量化评估,建立了 1000 条固定样本的对比验证流程,每一版改动都有留痕。
亮点:采用双轨建模而非端到端黑箱——机理部分保证结果可解释、班组敢用,数据驱动部分保证能跟上水质变化,在"现场可信"和"自适应"之间取得平衡;模型轻量、易维护、无需 GPU,普通服务器即可稳定运行;6 个版本的迭代过程与验证结果完整留档,具备持续演进能力。
声明:本文仅代表作者观点,不代表本站立场。如果侵犯到您的合法权益,请联系我们删除侵权资源!如果遇到资源链接失效,请您通过评论或工单的方式通知管理员。未经允许,不得转载,本站所有资源文章禁止商业使用运营!

下载安装【程序员客栈】APP
实时对接需求、及时收发消息、丰富的开放项目需求、随时随地查看项目状态
评论