京公网安备 11010802034615号
经营许可证编号:京B2-20210330
数据分析师在物联网的哪个环节?
物联网(Internet of Things)用最简单的一句话就是各种感知器的广泛应用,具体来说,要实现“物-物互联”,主要分三个层次:
(1)感知层:由各种传感器以及传感器网关构成,包括二氧化碳浓度传感器、温度传感器、湿度传感器、二维码标签、RFID 标签和读写器、摄像头、GPS等感知终端。感知层的作用相当于人的眼耳鼻喉和皮肤等神经末梢,它是物联网识别物体、采集信息的来源,其主要功能是识别物体,采集信息。
(2)网络层:由各种私有网络、互联网、有线和无线通信网、网络管理系统和云计算平台等组成,相当于人的神经中枢和大脑,负责传递和处理感知层获取的信息。
(3)应用层:物联网和用户(包括人、组织和其他系统)的接口,它与行业需求结合,利用云计算、模式识别等智能技术对数据进行处理分析。
比如,监测飞机喷气引擎中一些不易察觉的警报信号,以此来预测哪些设备需要进行维护,甚至能提前一个月预测其维护需求,预测准确率达到70%,这可以极大减少飞行延误。这也是跟我们数据分析师最相关一层。
聚焦在应用层,看数据分析师如何发挥他们的“雄才大略”:
刚刚说的飞机喷气引擎的例子,这个实际上是GE(通用电气)机器学习专家AnilVarma正在做的事情。这些传感器将温度、压力和电压等数据实时传输回GE进行分析。虽然资料中没有提及具体的算法,但数说君认为应该是:结合业务经验,构建一定的模型或者指标,监测“危险”信号,预测未来一段时间内的维护需求——一个典型的数据分析师的任务。
实际上,GE在这一块已经相当领先,涉及各个领域,比如GE与加拿大一家电力公司通过分析卫星影像、天气地图当地停电记录等数据预测树木修剪的热点地区(掉落的树枝是雷电导致停电的主要原因之一)。
GE全球董事长伊梅尔特戏言:“GE昨天还是一家制造业公司,一觉醒来已经成为一家软件和数据公司了。”
那么GE对数据人才是怎样的?数说君在GE的官网上搜集了一些人才需求,以数据科学家 Data Scientist为例,这个职位在上海:
职位:
The Data Scientist will work in the Digital Foundry addressing statistical, machine learning and data understanding problems in a commercial technology and consultancy development environment. In this role, you will contribute to the development and deployment of modern machine learning, operational research, semantic analysis, and statistical methods for finding structure in large data sets.
主要涉及机器学习、运筹学、语义分析、大数据的数据结构方法等。
要求:
Basic Qualifications:
Bachelor’s Degree in a “STEM” major (Science, Technology, Engineering, Mathematics)
Minimum 2 years analytics development in a commercial setting
Demonstrated skill in the use of one or more analytic software tools or languages (e.g., SAS, SPSS, R, Python)
Demonstrated skill at data cleansing, data quality assessment, and using analytics for data assessment
Demonstrated skill in the use of applied analytics, deive statistics, and predictive analytics on industrial datasets
简单而言就是STEM专业(科学、技术、工程、数学)的学士以上,至少2年工作经验、掌握统计软件如R、SAS、SPSS、Python,有数据清洗、数据质量评估和分析的技能,可以对工业数据进行应用分析、描述统计以及预测分析等。
我们非常熟悉的SAS公司,也在物联网上进行了布局,实际上,SAS已经推出了专门的物联网分析产品。
SAS®物联网分析(SAS® Analytics for IoT)是在SAS成熟的数据分析产品基础上组合而成的全新套装产品,成功将SAS大数据分析的核心技术应用到了物联网连接的传感器和设备上。SAS物联网分析结合了流技术、数据分析和其他领域专长,把物联网数据转化为深刻洞察。
例如SAS可向企业提供稳健的维保需求预测方案,实现当即制定个性化产品,促使企业采取具有商业价值的行动等。
SAS物联网分析可以帮助企业解读快速流转并积累的数据,协助客户根据数据信息做出正确决策。由此产生的收益,例如安全性和产品质量的提高、人身伤害的减少等,能转化为更有益的利润。制造业、能源、零售业等相关行业都可以从SAS®物联网分析中获益。
科尼集团是一家工业起重机制造商,利用SAS,他们分析设备和客户数据,以及使用情况、撞击数据,把大数据同可靠性分析与模拟相结合,提高预测能力。
另外在农业上,我们也介绍过在畜牧场、农场如何使用传感器进行监测分析的例子(Farmeron:农场主的数据分析工具;德强农场—一家国内大数据农场)。
从以上内容,我们稍稍提炼一下数据分析师在物联网大数据的实践技能:
1)语义引擎、多元数据融合技术
物联网中数据的存储方式、组织结构以及时效性呈现出多样性。我们需要一系列的工具去解析、提取、分析数据,语义引擎需要被设计成能够从“文档”中智能提取信息。
2)海量数据挖掘技术
MapReduce架构可以作为海量数据资源知识元挖掘算法的统一处理机制,在Hadoop分布式系统平台上,能够实现分类、聚类和关联知识挖掘等算法,深入数据内部,挖掘价值,这些算法不仅要处理大数据的量,也要处理大数据的速度。
3)可视化分析
近随着处理的数据量越来越大,可视化的需求越高越高。对体量大、多源的物联网数据而言,可视化呈现是一个非常重要的技能。
4)预测分析能力
预测是物联网的一个重要应用,无论是农业产量、物流,还是工业设备维护,预测效果直接显像在应用层面。
12年GE发布的报告显示,每提高1%的燃油效率,航空业每年能节省20亿美元,而能源行业则能节省40亿美元。到2020年全球工业互联网年产值将达到2250亿美元,大大超越消费物联网1700亿美元的产值。
最后,物联网是个陌生又有点熟悉的行业,对我而言更多的是一个学习的态度,非常非常希望能有这方面的专家赐文指导。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数据工作的全流程中,数据清洗是最基础、最耗时,同时也是最关键的核心环节,无论后续是做常规数据分析、可视化报表,还是开展 ...
2026-03-20在大数据与数据驱动决策的当下,“数据分析”与“数据挖掘”是高频出现的两个核心概念,也是很多职场人、入门学习者容易混淆的术 ...
2026-03-20在CDA(Certified Data Analyst)数据分析师的全流程工作闭环中,统计制图是连接严谨统计分析与高效业务沟通的关键纽带,更是CDA ...
2026-03-20在MySQL数据库优化中,分区表是处理海量数据的核心手段——通过将大表按分区键(如时间、地域、ID范围)分割为多个独立的小分区 ...
2026-03-19在商业智能与数据可视化领域,同比、环比增长率是分析数据变化趋势的核心指标——同比(YoY)聚焦“长期趋势”,通过当前周期与 ...
2026-03-19在数据分析与建模领域,流传着一句行业共识:“数据决定上限,特征决定下限”。对CDA(Certified Data Analyst)数据分析师而言 ...
2026-03-19机器学习算法工程的核心价值,在于将理论算法转化为可落地、可复用、高可靠的工程化解决方案,解决实际业务中的痛点问题。不同于 ...
2026-03-18在动态系统状态估计与目标跟踪领域,高精度、高鲁棒性的状态感知是机器人导航、自动驾驶、工业控制、目标检测等场景的核心需求。 ...
2026-03-18“垃圾数据进,垃圾结果出”,这是数据分析领域的黄金法则,更是CDA(Certified Data Analyst)数据分析师日常工作中时刻恪守的 ...
2026-03-18在机器学习建模中,决策树模型因其结构直观、易于理解、无需复杂数据预处理等优势,成为分类与回归任务的首选工具之一。而变量重 ...
2026-03-17在数据分析中,卡方检验是一类基于卡方分布的假设检验方法,核心用于分析分类变量之间的关联关系或实际观测分布与理论期望分布的 ...
2026-03-17在数字化转型的浪潮中,企业积累的数据日益庞大且分散——用户数据散落在注册系统、APP日志、客服记录中,订单数据分散在交易平 ...
2026-03-17在数字化时代,数据分析已成为企业决策、业务优化、增长突破的核心支撑,从数据仓库搭建(如维度表与事实表的设计)、数据采集清 ...
2026-03-16在数据仓库建设、数据分析(尤其是用户行为分析、业务指标分析)的实践中,维度表与事实表是两大核心组件,二者相互依存、缺一不 ...
2026-03-16数据是CDA(Certified Data Analyst)数据分析师开展一切工作的核心载体,而数据读取作为数据生命周期的关键环节,是连接原始数 ...
2026-03-16在用户行为分析实践中,很多从业者会陷入一个核心误区:过度关注“当前数据的分析结果”,却忽视了结果的“泛化能力”——即分析 ...
2026-03-13在数字经济时代,用户的每一次点击、浏览、停留、转化,都在传递着真实的需求信号。用户行为分析,本质上是通过收集、整理、挖掘 ...
2026-03-13在金融、零售、互联网等数据密集型行业,量化策略已成为企业挖掘商业价值、提升决策效率、控制经营风险的核心工具。而CDA(Certi ...
2026-03-13在机器学习建模体系中,随机森林作为集成学习的经典算法,凭借高精度、抗过拟合、适配多场景、可解释性强的核心优势,成为分类、 ...
2026-03-12在机器学习建模过程中,“哪些特征对预测结果影响最大?”“如何筛选核心特征、剔除冗余信息?”是从业者最常面临的核心问题。随 ...
2026-03-12