京公网安备 11010802034615号
经营许可证编号:京B2-20210330
过年回家妈妈教你什么是大数据分析_数据分析师培训
“大数据分析”这么高大上,妈妈怎么会懂呢?
不信?听听妈妈怎么说——会做饭就会大数据分析!
那么问题来了?做饭和大数据有什么关系呢?请听下面分析:
第一阶段:
菜地里的毛菜(原始系统的数据,有错误,不精准,毛菜有泥巴,有黄叶子),相当于ERP,PDM系统里面的原始数据。
第二阶段:
从菜地里采集到家,分门别类的堆在一起(初步去掉泥巴,黄叶子,分类堆放),相当于从原系统到ODS,ODS的意思是操作数据,即原始系统中的操作数据的一个副本,与原始数据是一模一样的,叫贴源,这个过程就叫数据采集、清洗、转换,即ETL干的事情,这个阶段叫初加工。
第三阶段:
把拿回家的各种菜洗净,去皮,按大小分类,去掉小的、烂的蔬菜,可以卖给超市了,对BI项目来说,就是从ODS到数据仓库的过程,数据的精加工过程,去伪存真,也要用到ETL来清洗转换,对缺项的数据补充完整,比如合并数据,合并字段,增加主数据描述字段,补充分类等。
第四阶段:
从菜农卖到超市,超市还要经过一次加工,比如包装成一小包一小包的,把蔬菜放在一起,水果放在一起,便于顾客直接购买,这一步就是从数据仓库到数集市的过程,数据集市就是包好、称好的净菜,价签已经打好的了,顾客直接付款可以拿走了,从数据仓库到数据集市就是形成一个一个的数据立方体,这个立方体的数据是加工好的,可以单独发布出去,离线使用,相当于一个execl数据文件,你可以用EXECL工具打开,也可以用WPS打开,打开以后,可以用表格表示,也可以用图表表示。
第五阶段:
妈妈配菜,妈妈根据家人一天要吃的菜肴规划,挑选各种各样的菜、肉组合在一起,有的直接可以食用,有的需要再加工,即烹调,然后端出来摆到餐桌上,家人只需要带一张嘴即可享用,对BI项目来说,就是报表的制作过程,业务分析人员,根据领导的要求,按照各个主题需求,从各个数据立方体中、或者一部分从数据仓库中取一些数据组合起来,并且定义展现方式,即把报表做好,发布出来,放到门户上,给与权限控制,哪些人可以享用这桌美味,这就是报表制作这个阶段干的事情,所以说,业务人员是否可以拖拽制作报表,关键看前面的数据立方体准备好没有,相当于是这样的,不是人人都是烹调高手,但是超市里面有很多配好的菜(葱姜蒜都有了),你只要拿回去放放锅里炒5分钟或者蒸煮10分钟,端出来即可,不难吧。至于加工的工具是微软家的锅还是IBM家的灶,或者oracle家的飘,有什么关系呢,这些都是报表制作工具(烹调工具而已)。
第六阶段
享受美味佳肴,把做好的一桌筵席,放到门户上,当然是给有权限的人享受,这就是管理驾驶舱噻。
通过上面的分析,懂的为什么会做饭的人就会做大数据分析了,简单吧,所以过年回家和妈妈学做饭,学会了就懂得高大上的大数据分析。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
数据分析师一天的工作,80% 的时间围绕表格结构数据展开。从一张销售明细表到一份完整的分析报告,表格结构数据贯穿始终。但你真 ...
2026-04-16在机器学习无监督学习领域,Kmeans聚类因其原理简洁、计算高效、可扩展性强的优势,成为数据聚类任务中的主流算法,广泛应用于用 ...
2026-04-16在机器学习建模实践中,特征工程是决定模型性能的核心环节之一。面对高维数据集,冗余特征、无关特征不仅会增加模型训练成本、延 ...
2026-04-16在数字化时代,用户是产品的核心资产,用户运营的本质的是通过科学的指标监测、分析与优化,实现“拉新、促活、留存、转化、复购 ...
2026-04-15在企业数字化转型、系统架构设计、数据治理与AI落地过程中,数据模型、本体模型、业务模型是三大核心基础模型,三者相互支撑、各 ...
2026-04-15数据分析师的一天,80%的时间花在表格数据上,但80%的坑也踩在表格数据上。 如果你分不清数值型和文本型的区别,不知道数据从哪 ...
2026-04-15在人工智能与机器学习落地过程中,模型质量直接决定了应用效果的优劣——无论是分类、回归、生成式模型,还是推荐、预测类模型, ...
2026-04-14在Python网络编程、接口测试、爬虫开发等场景中,HTTP请求的发送与响应处理是核心需求。Requests库作为Python生态中最流行的HTTP ...
2026-04-14 很多新人学完Python、SQL,拿到一张Excel表还是不知从何下手。 其实,90%的商业分析问题,都藏在表格的结构里。 ” 引言:为 ...
2026-04-14在回归分析中,因子(即自变量)的筛选是构建高效、可靠回归模型的核心步骤——实际分析场景中,往往存在多个候选因子,其中部分 ...
2026-04-13在机器学习模型开发过程中,过拟合是制约模型泛化能力的核心痛点——模型过度学习训练数据中的噪声与偶然细节,导致在训练集上表 ...
2026-04-13在数据驱动商业升级的今天,商业数据分析已成为企业精细化运营、科学决策的核心手段,而一套规范、高效的商业数据分析总体流程, ...
2026-04-13主讲人简介 张冲,海归统计学硕士,CDA 认证数据分析师,前云南白药集团资深数据分析师,自媒体 Python 讲师,全网课程播放量破 ...
2026-04-13在数据可视化与业务分析中,同比分析是衡量业务发展趋势、识别周期波动的核心手段,其核心逻辑是将当前周期数据与上年同期数据进 ...
2026-04-13在机器学习模型的落地应用中,预测精度并非衡量模型可靠性的唯一标准,不确定性分析同样不可或缺。尤其是在医疗诊断、自动驾驶、 ...
2026-04-10数据本身是沉默的,唯有通过有效的呈现方式,才能让其背后的规律、趋势与价值被看见、被理解、被运用。统计制图(数据可视化)作 ...
2026-04-10在全球化深度发展的今天,跨文化传播已成为连接不同文明、促进多元共生的核心纽带,其研究核心围绕“信息传递、文化解读、意义建 ...
2026-04-09在数据可视化领域,折线图是展示时序数据、趋势变化的核心图表类型之一,其简洁的线条的能够清晰呈现数据的起伏规律。Python ECh ...
2026-04-09在数据驱动的时代,数据分析早已不是“凭经验、靠感觉”的零散操作,而是一套具备固定逻辑、标准化流程的系统方法——这就是数据 ...
2026-04-09长短期记忆网络(LSTM)作为循环神经网络(RNN)的重要改进模型,凭借其独特的门控机制(遗忘门、输入门、输出门),有效解决了 ...
2026-04-08