京公网安备 11010802034615号
经营许可证编号:京B2-20210330
中国工业大数据的实践与思考
先分享一下我对工业大数据的理解。
简单来讲,工业大数据就是在工业领域信息化相关应用中所产生的海量数据,注意这里的“相关应用”意味着不仅包括企业内和产业链,还包括客户用户和互联网上的数据。
2012年,GE公司率先明确了“工业大数据”的概念。同年麦肯锡的报告中给出了一个有趣的事实:那就是在虚拟经济占主导地位的美国,其工业界蕴含的数据总量反而是最大的。
同时GE公司的报告还揭示了工业大数据所蕴含的巨大价值。
那么,为什么今天提出“工业大数据”?我感觉有几个重要背景,第一是数字化装备和产品的普及,第二装备和产品网络化连接的普及(互联网),第三是企业向服务型制造转型,第四“从摇篮到摇篮”制造的必然要求。无疑“智慧互联设备”、“工业4.0”和“工业互联网”都顺应了这样一个趋势。
下面汇报我自己对工业大数据的几点思考:
工业大数据从哪里来?工业大数据来源于产品生命周期的各个环节,包括市场、设计、制造、服务、再利用各个环节,每个环节都会有大数据,“全”生命周期汇合起来的数据更大,当然企业外、产业链外的“跨界”数据也是工业大数据“不可忽视”的重要来源。
其次,工业大数据和企业已有数据之间的关系?传统企业信息化的“四大件”,广义PLM系统(包括CAX)支持产品开发、ERP系统负责“人财物、产供销”、SCM系统协调供应链,CRM系统关照企业客户和用户,这些系统一般架构在关系数据库系统之上,显然这些系统中的数据是工业大数据,是其中的“20%”部分。
第三,工业大数据和业务流程的关系?传统企业信息化项目一般是从梳理业务流程起步的,流程“主动”、数据“被动”。而工业大数据环境下,要求企业快速满足个性化用户需求,企业僵化的“长流程”,难以适应“实时决策”的要求,需要变“流程驱动”为“数据驱动”,至少是“混合驱动”,“流程”和“数据”深度融合。上述表现,就是我们说的“流程碎片化”,数据成为连接这些“碎片”的媒介。
最后一个思考是,工业大数据有没有“交钥匙”工程?新世纪以来,我国工业界经历了轰轰烈烈的信息化浪潮,“不搞信息化等死,搞了信息化找死”,后半句话告述我们,“信息化”是有难度和风险的,所以“交钥匙”工程成了广大企业所期望的方式。
我个人的观点,工业大数据不存在“交钥匙”工程(至少现在),原因如下:
1) 工业大数据项目主要不是针对“现有业务”,而是针对“未来业务”、“创新业务”的,其魅力在于创新性、不确定性;
2) 工业大数据现在还处在“科学”阶段,人们对数据价值的“提取”方法、技术与工具尚不成熟,特别是以物理规律为发现目标的工业大数据处理更是刚刚起步;
3) 人们普遍认同的“领域专家”、“统计专家”和“软件专家”组成的协同团队,是当前“大数据”深度应用的有效方法。
最后,和大家分享一下我们在工业大数据方面的“小实践”:
在工业产品全生命周期的各个阶段都有大数据,比如设计阶段引入用户社区数据,制造阶段使用机床在线测量数据,在市场营销阶段使用社交网络数据等。在这里,和大家分享一下使用过程中产生的装备工况大数据。
首先,工况大数据平台不是单独存在的,需要嵌入企业已有信息系统,比如客户服务系统,需要将大数据系统与SQL系统进行融合协同应用,有时需要切换原来的数据管理系统,在实践中我们总结出“四阶段”切换方案。
根据我们的实践,工况大数据的典型应用场景如下页面所示:
首先看时空监管的例子。当得到工况数据以后,首先是对一般运营进行监管,不同于传统的运营监管,在大数据技术支持下,运营是成套设备互相协同的运营,例如:以搅拌站为例,通过收集位置数据、油位数据可以对搅拌车运输的过程进行优化调度,从而避免拥堵、减少等待、降低能耗。
再举个例子,我们知道液压系统是工程机械的核心系统之一,导致故障的原因有很多,例如:密封套腐蚀,内壁刮花,密封环损坏,阀块受损,等等。有了工况大数据就可以寻找深层次原因。
有了工况大数据,我们通大规模过比对开工指标,从典型取值、波动幅度、回传密度多个维度进行分析,自动搜索推荐与故障车辆关系密切的特征工况,发现这些故障车辆的每分钟换向次数在变化幅度上高度相关。
再通过引入互联网上的行政区划数据和历年高铁建设数据(企业外部数据),可以得出这样一个结论,这些典型故障均发生在2012年~2013年期间在建重大工程“杭深高铁”沿线,这为我们寻找更深层次的原因提供了重要线索。
最后,我们可以通过大规模工况数据透视宏观装备应用情况,可以根据这些信息,进行易损配件需求的预测,优化调配我们的服务资源,甚至我们可以推测各地宏观经济情况。
这里我想说,工业大数据刚刚起步,需要冷静思考,坚持应用驱动,最终实现我们的目标。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
数据分析师一天的工作,80% 的时间围绕表格结构数据展开。从一张销售明细表到一份完整的分析报告,表格结构数据贯穿始终。但你真 ...
2026-04-16在机器学习无监督学习领域,Kmeans聚类因其原理简洁、计算高效、可扩展性强的优势,成为数据聚类任务中的主流算法,广泛应用于用 ...
2026-04-16在机器学习建模实践中,特征工程是决定模型性能的核心环节之一。面对高维数据集,冗余特征、无关特征不仅会增加模型训练成本、延 ...
2026-04-16在数字化时代,用户是产品的核心资产,用户运营的本质的是通过科学的指标监测、分析与优化,实现“拉新、促活、留存、转化、复购 ...
2026-04-15在企业数字化转型、系统架构设计、数据治理与AI落地过程中,数据模型、本体模型、业务模型是三大核心基础模型,三者相互支撑、各 ...
2026-04-15数据分析师的一天,80%的时间花在表格数据上,但80%的坑也踩在表格数据上。 如果你分不清数值型和文本型的区别,不知道数据从哪 ...
2026-04-15在人工智能与机器学习落地过程中,模型质量直接决定了应用效果的优劣——无论是分类、回归、生成式模型,还是推荐、预测类模型, ...
2026-04-14在Python网络编程、接口测试、爬虫开发等场景中,HTTP请求的发送与响应处理是核心需求。Requests库作为Python生态中最流行的HTTP ...
2026-04-14 很多新人学完Python、SQL,拿到一张Excel表还是不知从何下手。 其实,90%的商业分析问题,都藏在表格的结构里。 ” 引言:为 ...
2026-04-14在回归分析中,因子(即自变量)的筛选是构建高效、可靠回归模型的核心步骤——实际分析场景中,往往存在多个候选因子,其中部分 ...
2026-04-13在机器学习模型开发过程中,过拟合是制约模型泛化能力的核心痛点——模型过度学习训练数据中的噪声与偶然细节,导致在训练集上表 ...
2026-04-13在数据驱动商业升级的今天,商业数据分析已成为企业精细化运营、科学决策的核心手段,而一套规范、高效的商业数据分析总体流程, ...
2026-04-13主讲人简介 张冲,海归统计学硕士,CDA 认证数据分析师,前云南白药集团资深数据分析师,自媒体 Python 讲师,全网课程播放量破 ...
2026-04-13在数据可视化与业务分析中,同比分析是衡量业务发展趋势、识别周期波动的核心手段,其核心逻辑是将当前周期数据与上年同期数据进 ...
2026-04-13在机器学习模型的落地应用中,预测精度并非衡量模型可靠性的唯一标准,不确定性分析同样不可或缺。尤其是在医疗诊断、自动驾驶、 ...
2026-04-10数据本身是沉默的,唯有通过有效的呈现方式,才能让其背后的规律、趋势与价值被看见、被理解、被运用。统计制图(数据可视化)作 ...
2026-04-10在全球化深度发展的今天,跨文化传播已成为连接不同文明、促进多元共生的核心纽带,其研究核心围绕“信息传递、文化解读、意义建 ...
2026-04-09在数据可视化领域,折线图是展示时序数据、趋势变化的核心图表类型之一,其简洁的线条的能够清晰呈现数据的起伏规律。Python ECh ...
2026-04-09在数据驱动的时代,数据分析早已不是“凭经验、靠感觉”的零散操作,而是一套具备固定逻辑、标准化流程的系统方法——这就是数据 ...
2026-04-09长短期记忆网络(LSTM)作为循环神经网络(RNN)的重要改进模型,凭借其独特的门控机制(遗忘门、输入门、输出门),有效解决了 ...
2026-04-08