京公网安备 11010802034615号
经营许可证编号:京B2-20210330
智慧水务与大数据应用
智慧水务是通过数采仪、无线网络、水质水压表等在线监测设备实时感知城市供排水系统的运行状态,并采用可视化的方式有机整合水务管理部门与供排水设施,形成“城市水务物联网”,并可将海量水务信息进行及时分析与处理,并做出相应的处理结果辅助决策建议,以更加精细和动态的方式管理水务系统的整个生产、管理和服务流程,从而达到“智慧”的状态。在水资源短缺、水污染加剧的形势下,智慧水务正成为市场的热点。
根据预测,我国智慧水务市场规模超千亿。我国智慧水务的市场很大,但目前的市场也是无序的。归结起来,主要体现在三个方面:
目前对于智慧水务尚无一个行业通则的标准,有的中国水务企业对智慧水务的概念认识不清,以为“数字化改造”就是智慧水务;有的企业在投资智慧水务的过程中总想一蹴而就;
在一些项目的执行过程中,市政管网资料分散,很多数据或是丢失或是不连通,有非常多的数据孤岛需要去打通;
管网信息化、自动化、智能化欠缺等。目前,还有很多作业操作基本依赖人工,基本数据靠人工收集,出现的问题靠人工分析等。
大数据推进智慧水务建设
大数据指具有4V特性的数据:Volume海量、Velocity 增长快、Variety多样化、Value价值动态。为了分析处理大数据,相应产生的“块级虚拟化、挖掘建模、机器自学习......”等新技术,称为大数据技术。大数据技术大大解放了人们的分析能力。
可以分析更多的数据,甚至是相关的所有数据,而不再依赖于随机抽样;
研究数据如此之多,以至于不再热衷于追求精确度;
不必拘泥于对因果关系的探究,而可以在相关关系中发现大数据的潜在价值。
从智慧供电到智慧供水
法国电力集团EDF是全球领先的电力基础设施服务提供商。为推进智慧供电,公司在全法安装3500万智能电表,每10分钟抄表一次采集个体家庭的用电负荷数据,并对用户用电负荷曲线进行集中处理。公司专门成立企业数据分析中心,整合电表数据、气象数据、用电合同信息及电网数据等,来对销售管理提供运营分析支撑,例如:预测各类一级市场和大众市场内中小企业和家庭住户的电力消耗和需求趋势,营业收入,成本和利润率,从而帮助营销部门更为精确地找准目标客户,推出更具盈利性的新产品……总体上,EDF通过对数据资产分析利用,实现了精确定位目标客户、推出更具盈利性的新产品、扩大企业市场份额、提升客户服务响应速度、提升企业商业运作灵活度等一系列成效。
在法国电力集团的经验中,包括了诸如:引入并强化数据分析处理能力、由专业的大数据运营机构开展运营管理支撑等措施。而我们首先要注意到搜集数据、完善数据基础,积累数据资产的重要性。EDF通过智能表计的安装,实现精细化测量,在对消费者提供服务过程中,积累数据资源。通过将用电数据、合同数据、电网数据等各类数据融合,进行专业分析与管理,实现紊乱的数据资源向有效的数据资产的转化。同为能源企业,智慧水务的建设也可以从表计数据的规范处理和应用起步。美国加州智能精细化供水管理的开展过程中,供水公司就十分强调对智能水表数据的采集和应用。他们联合科技企业,加快普及智能水表,以“每小时收集近7亿个数据点”的规模收集海量的细粒度数据(ne-grained data);并把这些信息与数十个关于住房地点、房龄、气候和入住率的数据点整合到一起进行分析、预测,为用户提供水务互联网服务:给用户提供个性化用水报告、为节水行为打分、提示花园灌溉许可日期和许可量……在水资源极度紧张的状况下,加州智慧水务项目仍实现了平均5%的节水幅度。
大数据是推进智慧水务建设的核心问题。如果缺乏大数据分析处理,智慧水务的“大脑”就不够发达,“智商”就不够高,能力就不够强。大数据处理、挖掘模型等技术相对通用,但产生出融合智慧的基础数据,却需要一点一滴地积累。当前建设智慧水务,积累有效的“海量数据”已成为当务之急。
有效的数据采集是进行大数据分析的前提基础
为有效地采集数据、丰富信息流,必须不断地研发、改进技术以增强设备的采集能力,加大流量、水质、水压等方面各类新型传感设备的应用部署和普及。水表遍布千家万户,水表流量数据中蕴含着社会生产生活各方面的丰富信息,是行业天然的数据价值源泉。但我国目前的智能远传水表,不仅规模有限,并且在数据采集方面上仍只单纯要求“替代人工抄表,完成简单的水费收费”的功能,不仅未能体现投资价值,更难以满足未来的大数据需求,从而产生“未来重复投资、拖延水务企业智慧化进程”的风险。
智慧水务需要高密度、高精度、高价值的水务数据的大规模海量积累;在某些特定场景,比如特种工业企业水资源消耗监测时,对数据的采集和实时性的要求更为苛刻,要求“实时、完整、精确地采集到流量过程曲线数据”。为达到这些智慧应用场景的支撑要求,智能水表需要向1L级(0.001m3)、分钟级的流量数据采集精度和颗粒细度目标努力,这一要求对行业的技术、工艺都提出了较高的挑战。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
很多数据分析师画过趋势图、做过业绩预测,但当被问到“这个月销售额增长20%,到底是长期趋势自然增长,还是促销活动的短期 ...
2026-08-21在数据分析与数据可视化工作中,直方图是展示数据分布特征、离散程度、集中区间的核心图表,能够直观呈现数值数据的频次分布规律 ...
2026-08-20在数据分析领域有一句核心准则:垃圾数据进,垃圾数据出。数据清洗是数据分析、数据建模、数据可视化之前的必经前置工序,也是保 ...
2026-08-20 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-08-20在Python数据分析与数据清洗工作中,Pandas是最核心的数据处理库,DataFrame是结构化数据的标准存储格式。在实时数据采集、循环 ...
2026-08-19在零售行业大数据分析与精细化运营领域,纸尿裤旁摆放啤酒是最经典、最具代表性的商业案例。两种看似毫无关联的商品,一个是婴幼 ...
2026-08-19 很多数据分析师能熟练地计算指标、搭建标签体系,但当被问到“画像到底在解决什么问题”“画像和标签是什么关系”“画像如何 ...
2026-08-19在数据分析、业务监控、质量检测与风险管控工作中,数据波动性是衡量数据稳定性、业务健康度、结果可信度的核心依据。数据波动代 ...
2026-08-18很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当导致 ...
2026-08-18在数据分析、业务评价、产品评级、用户分层与综合决策场景中,单一指标往往无法全面、客观地评价事物整体水平。现实中的评价对象 ...
2026-08-18在数理统计、假设检验、数据分析与机器学习领域中,卡方分布(χ²分布)是继正态分布、t分布之后最重要的连续型概率分布之一。 ...
2026-08-17在Python数据清洗、文本校验、账号密码规则校验、脏数据过滤、字符串规整化处理中,正则表达式是最高效、最常用的文本匹配工具。 ...
2026-08-17 很多分析师每天和数据打交道,但当被问到“标签是什么”“标签和指标有什么区别”“标签体系如何设计”时,却常常答不上来。 ...
2026-08-17手游行业具备用户迭代快、竞争激烈、用户粘性易流失的典型特征。随着新游持续上线、玩家审美升级、玩法疲劳等问题出现,存量用户 ...
2026-08-14在数字化产品运营、商业数据分析、业务增长管理中,零散的指标统计无法支撑系统性的业务决策。单一的点击率、转化率、销量数据只 ...
2026-08-14 很多数据分析师每天都在写SQL,但当被问到“数据查询语言(DQL)的本质是什么”“SELECT语句中各子句的书写顺序与实际执行顺 ...
2026-08-14在数据库数据分析、数据清洗、报表统计与业务查询场景中,日期时间是最高频、最核心的基础字段。数据库中存储的日期格式多样,包 ...
2026-08-13在数据统计分析与数据清洗工作中,箱线图是一种简洁高效、客观性强的数据可视化图表,能够直观呈现数据集的分布特征、离散程度和 ...
2026-08-13 很多数据分析师写过无数个SELECT查询,但当被问到“如何新建一张表来固化中间数据”“创建视图和创建物理表有什么区别”“视 ...
2026-08-13在自动化办公、数据采集、定时统计、日志清理、系统监控等场景中,程序往往需要按照固定时间间隔重复执行指定任务,这种运行机制 ...
2026-08-12