
中国工业大数据的实践与思考
先分享一下我对工业大数据的理解。
简单来讲,工业大数据就是在工业领域信息化相关应用中所产生的海量数据,注意这里的“相关应用”意味着不仅包括企业内和产业链,还包括客户用户和互联网上的数据。
2012年,GE公司率先明确了“工业大数据”的概念。同年麦肯锡的报告中给出了一个有趣的事实:那就是在虚拟经济占主导地位的美国,其工业界蕴含的数据总量反而是最大的。
同时GE公司的报告还揭示了工业大数据所蕴含的巨大价值。
那么,为什么今天提出“工业大数据”?我感觉有几个重要背景,第一是数字化装备和产品的普及,第二装备和产品网络化连接的普及(互联网),第三是企业向服务型制造转型,第四“从摇篮到摇篮”制造的必然要求。无疑“智慧互联设备”、“工业4.0”和“工业互联网”都顺应了这样一个趋势。
下面汇报我自己对工业大数据的几点思考:
工业大数据从哪里来?工业大数据来源于产品生命周期的各个环节,包括市场、设计、制造、服务、再利用各个环节,每个环节都会有大数据,“全”生命周期汇合起来的数据更大,当然企业外、产业链外的“跨界”数据也是工业大数据“不可忽视”的重要来源。
其次,工业大数据和企业已有数据之间的关系?传统企业信息化的“四大件”,广义PLM系统(包括CAX)支持产品开发、ERP系统负责“人财物、产供销”、SCM系统协调供应链,CRM系统关照企业客户和用户,这些系统一般架构在关系数据库系统之上,显然这些系统中的数据是工业大数据,是其中的“20%”部分。
第三,工业大数据和业务流程的关系?传统企业信息化项目一般是从梳理业务流程起步的,流程“主动”、数据“被动”。而工业大数据环境下,要求企业快速满足个性化用户需求,企业僵化的“长流程”,难以适应“实时决策”的要求,需要变“流程驱动”为“数据驱动”,至少是“混合驱动”,“流程”和“数据”深度融合。上述表现,就是我们说的“流程碎片化”,数据成为连接这些“碎片”的媒介。
最后一个思考是,工业大数据有没有“交钥匙”工程?新世纪以来,我国工业界经历了轰轰烈烈的信息化浪潮,“不搞信息化等死,搞了信息化找死”,后半句话告述我们,“信息化”是有难度和风险的,所以“交钥匙”工程成了广大企业所期望的方式。
我个人的观点,工业大数据不存在“交钥匙”工程(至少现在),原因如下:
1) 工业大数据项目主要不是针对“现有业务”,而是针对“未来业务”、“创新业务”的,其魅力在于创新性、不确定性;
2) 工业大数据现在还处在“科学”阶段,人们对数据价值的“提取”方法、技术与工具尚不成熟,特别是以物理规律为发现目标的工业大数据处理更是刚刚起步;
3) 人们普遍认同的“领域专家”、“统计专家”和“软件专家”组成的协同团队,是当前“大数据”深度应用的有效方法。
最后,和大家分享一下我们在工业大数据方面的“小实践”:
在工业产品全生命周期的各个阶段都有大数据,比如设计阶段引入用户社区数据,制造阶段使用机床在线测量数据,在市场营销阶段使用社交网络数据等。在这里,和大家分享一下使用过程中产生的装备工况大数据。
首先,工况大数据平台不是单独存在的,需要嵌入企业已有信息系统,比如客户服务系统,需要将大数据系统与SQL系统进行融合协同应用,有时需要切换原来的数据管理系统,在实践中我们总结出“四阶段”切换方案。
根据我们的实践,工况大数据的典型应用场景如下页面所示:
首先看时空监管的例子。当得到工况数据以后,首先是对一般运营进行监管,不同于传统的运营监管,在大数据技术支持下,运营是成套设备互相协同的运营,例如:以搅拌站为例,通过收集位置数据、油位数据可以对搅拌车运输的过程进行优化调度,从而避免拥堵、减少等待、降低能耗。
再举个例子,我们知道液压系统是工程机械的核心系统之一,导致故障的原因有很多,例如:密封套腐蚀,内壁刮花,密封环损坏,阀块受损,等等。有了工况大数据就可以寻找深层次原因。
有了工况大数据,我们通大规模过比对开工指标,从典型取值、波动幅度、回传密度多个维度进行分析,自动搜索推荐与故障车辆关系密切的特征工况,发现这些故障车辆的每分钟换向次数在变化幅度上高度相关。
再通过引入互联网上的行政区划数据和历年高铁建设数据(企业外部数据),可以得出这样一个结论,这些典型故障均发生在2012年~2013年期间在建重大工程“杭深高铁”沿线,这为我们寻找更深层次的原因提供了重要线索。
最后,我们可以通过大规模工况数据透视宏观装备应用情况,可以根据这些信息,进行易损配件需求的预测,优化调配我们的服务资源,甚至我们可以推测各地宏观经济情况。
这里我想说,工业大数据刚刚起步,需要冷静思考,坚持应用驱动,最终实现我们的目标。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
线性相关点分布的四种基本类型:特征、识别与实战应用 在数据分析与统计学中,“线性相关” 是描述两个数值变量间关联趋势的核心 ...
2025-09-25深度神经网络神经元个数确定指南:从原理到实战的科学路径 在深度神经网络(DNN)的设计中,“神经元个数” 是决定模型性能的关 ...
2025-09-25在企业数字化进程中,不少团队陷入 “指标困境”:仪表盘上堆砌着上百个指标,DAU、转化率、营收等数据实时跳动,却无法回答 “ ...
2025-09-25MySQL 服务器内存碎片:成因、检测与内存持续增长的解决策略 在 MySQL 运维中,“内存持续增长” 是常见且隐蔽的性能隐患 —— ...
2025-09-24人工智能重塑工程质量检测:核心应用、技术路径与实践案例 工程质量检测是保障建筑、市政、交通、水利等基础设施安全的 “最后一 ...
2025-09-24CDA 数据分析师:驾驭通用与场景指标,解锁数据驱动的精准路径 在数据驱动业务的实践中,指标是连接数据与决策的核心载体。但并 ...
2025-09-24在数据驱动的业务迭代中,AB 实验系统(负责验证业务优化效果)与业务系统(负责承载用户交互与核心流程)并非独立存在 —— 前 ...
2025-09-23CDA 业务数据分析:6 步闭环,让数据驱动业务落地 在企业数字化转型中,CDA(Certified Data Analyst)数据分析师的核心价值,并 ...
2025-09-23CDA 数据分析师:以指标为钥,解锁数据驱动价值 在数字化转型的浪潮中,“用数据说话” 已成为企业决策的共识。但数据本身是零散 ...
2025-09-23当 “算法” 成为数据科学、人工智能、业务决策领域的高频词时,一种隐形的认知误区正悄然蔓延 —— 有人将分析结果不佳归咎于 ...
2025-09-22在数据分析、金融计算、工程评估等领域,“平均数” 是描述数据集中趋势最常用的工具之一。但多数人提及 “平均数” 时,默认指 ...
2025-09-22CDA 数据分析师:参数估计助力数据决策的核心力量 在数字化浪潮席卷各行各业的当下,数据已成为驱动业务增长、优化运营效率的核 ...
2025-09-22训练与验证损失骤升:机器学习训练中的异常诊断与解决方案 在机器学习模型训练过程中,“损失曲线” 是反映模型学习状态的核心指 ...
2025-09-19解析 DataHub 与 Kafka:数据生态中两类核心工具的差异与协同 在数字化转型加速的今天,企业对数据的需求已从 “存储” 转向 “ ...
2025-09-19CDA 数据分析师:让统计基本概念成为业务决策的底层逻辑 统计基本概念是商业数据分析的 “基础语言”—— 从描述数据分布的 “均 ...
2025-09-19CDA 数据分析师:表结构数据 “获取 - 加工 - 使用” 全流程的赋能者 表结构数据(如数据库表、Excel 表、CSV 文件)是企业数字 ...
2025-09-19SQL Server 中 CONVERT 函数的日期转换:从基础用法到实战优化 在 SQL Server 的数据处理中,日期格式转换是高频需求 —— 无论 ...
2025-09-18MySQL 大表拆分与关联查询效率:打破 “拆分必慢” 的认知误区 在 MySQL 数据库管理中,“大表” 始终是性能优化绕不开的话题。 ...
2025-09-18DSGE 模型中的 Et:理性预期算子的内涵、作用与应用解析 动态随机一般均衡(Dynamic Stochastic General Equilibrium, DSGE)模 ...
2025-09-17Python 提取 TIF 中地名的完整指南 一、先明确:TIF 中的地名有哪两种存在形式? 在开始提取前,需先判断 TIF 文件的类型 —— ...
2025-09-17