
一张图读懂数据分析
前两天看到一张图,很好的诠释了从数据到数据分析的过程,今天分享给大家。
这四个步骤直译过来就是:数据-信息-展示-知识。不过图中的信息量远不止这八个字这么简单。可以说这张图体现了数据分析精髓,读透了就懂数据分析了。
——————-| 壹 |——————-
现实比图1更残酷,往往鸡蛋里面是混着蛋壳滴!数据源质量参差不齐,各种垃圾数据,各种无效数据。很多初级分析人员就用这样的数据开始劳作了。难道你们不知道还有一种工作叫数据清洗或数据整理么?建立在垃圾数据基础上的分析能是分析么?
有次见一个小表妹在分析VIP顾客的平均年龄(备注:时尚女装品牌),她用所有VIP会员年龄总和除以会员总数就得到了平均年龄。so easy,在excel表格里面几秒钟就能搞定。我想这样的平均年龄她一定会写到会员月度报告中去吧,领导们也会相信这是真的。正好想和这个妹妹聊会儿天,于是对她说你能用透视表筛选一下看看年龄段在60岁以上15岁以下的会员有多少吗?表妹不会透视表的年龄分段功能,于是我又手把手的教会了她。
该品牌的目标顾客年龄是25-35岁,不看不知道一看吓一跳,居然有6.9%的会员年龄是60+或15-(想想一个80岁的老太太会拉高不少平均年龄值滴)。这些就是会员年龄的垃圾数据,出现这种情况多半是店铺数据录入的时候没把好关,当然这个企业本身也不重视这些基础数据的收集。
——————-| 贰 |——————-
有些人的数据分析终止于图中的第二步,分析结果只是信息的堆积。无数次看见下属给领导的数据分析报告,各种数据,各种表格,密密麻麻的好几张sheet。领导要的结论呢?
“领导你自己看”(下属在心理面这样说)。
这种只有数据没有结论的数据分析报告充斥着我们的日常工作,受害者都是企业的管理者。
分析的时候将有价值的数据整合成信息只是数据分析的一个步骤,只罗列数据不叫分析,那个只是数据的搬运工。你们想做一辈子的搬运工吗?
将有价值的数据整合成有价值的信息是这个步骤的核心内容。
——————-| 叁 |——————-
有些人的数据分析终止于图中的第三步(展示),数据展现形式大于内容,空有漂亮的图表而无实质内容。这里面分成两类,一类是追求漂亮型,每张图表都有漂亮的配色,高大上的自定义数据图,把数据打扮成一个个花枝招展的春姑娘。
第二类是朴素型,有些人做了一辈子的图表只用过三种图:曲线图,饼图,柱状图(我把它们叫三俗图)。其实excel中的图表有很多,条形图、雷达图,股价图,堆积图等,还有变异的漏斗图,双轴图等等。可供选择的太多了,这种人就是懒!
数据展示要讲逻辑,图表必须要用最简单的逻辑把结论告诉受众,而不是简单的做成图就完了。时间序列,优先顺序,重要程度等都是图表可以利用的逻辑。
考大家一下,下面这张图你能发现几个错误或不符合逻辑的地方?
如果能找到3个以上问题的同学可以毕业了!大家可以在文章最后以评论的方式说出你找到图表的逻辑问题有哪些?
俗话说:千言万语不如一张图,但是好的图表才会自己说话!
——————-| 肆 |——————-
亮点总是在最后面,正如第四张图描述的一样,好的数据分析成果大部分会被受众吸收,转化成他们的知识(盘子里面只会剩下一点点面包屑)。没有前三个步骤的铺垫,转化的可能就不是知识而是糟粕了。
数据分析的目的是什么?你真的认真思索过这个问题吗?没有的请马上面壁三分钟然后再往下看。
1、认清事实
2、找出规律
3、预测未来
4、洞悉关系
这是我总结的数据分析的四大主要目的,无论是哪一个目的,最终你都是需要将分析成果让受众吸收。受众可以是别人,也可以是自己。数据分析人员的日常工作大部分是在认清事实和找出规律,而预测未来和洞悉关系占的比重很少。
我们在做数据分析报告的时候,一定要有价值的结论,并且准确无误的将结论传递给受众,否则大家都是在浪费时间。记住上面做汉堡的这张图,你不仅仅是为了汉堡好看,而是让对方吃进肚子里去才是目的。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
CDA数据分析师与数据指标:基础概念与协同逻辑 一、CDA 数据分析师:数据驱动时代的核心角色 1.1 定义与行业价值 CDA(Certified ...
2025-08-22Power Query 移动加权平均计算 Power Query 移动加权平均设置全解析:从原理到实战 一、移动加权平均法的核心逻辑 移动加权平均 ...
2025-08-22描述性统计:CDA数据分析师的基础核心与实践应用 一、描述性统计的定位:CDA 认证的 “入门基石” 在 CDA(Certified Data Analy ...
2025-08-22基于 Python response.text 的科技新闻数据清洗去噪实践 在通过 Python requests 库的 response.text 获取 API 数据后,原始数据 ...
2025-08-21基于 Python response.text 的科技新闻综述 在 Python 网络爬虫与 API 调用场景中,response.text 是 requests 库发起请求后获取 ...
2025-08-21数据治理新浪潮:CDA 数据分析师的战略价值与驱动逻辑 一、数据治理的多维驱动引擎 在数字经济与人工智能深度融合的时代,数据治 ...
2025-08-21Power BI 热力地图制作指南:从数据准备到实战分析 在数据可视化领域,热力地图凭借 “直观呈现数据密度与分布趋势” 的核心优势 ...
2025-08-20PyTorch 矩阵运算加速库:从原理到实践的全面解析 在深度学习领域,矩阵运算堪称 “计算基石”。无论是卷积神经网络(CNN)中的 ...
2025-08-20数据建模:CDA 数据分析师的核心驱动力 在数字经济浪潮中,数据已成为企业决策的核心资产。CDA(Certified Data Analyst)数据分 ...
2025-08-20KS 曲线不光滑:模型评估的隐形陷阱,从原因到破局的全指南 在分类模型(如风控违约预测、电商用户流失预警、医疗疾病诊断)的评 ...
2025-08-20偏态分布:揭开数据背后的非对称真相,赋能精准决策 在数据分析的世界里,“正态分布” 常被视为 “理想模型”—— 数据围绕均值 ...
2025-08-19CDA 数据分析师:数字化时代的价值创造者与决策智囊 在数据洪流席卷全球的今天,“数据驱动” 已从企业战略口号落地为核心 ...
2025-08-19CDA 数据分析师:善用 Power BI 索引列,提升数据处理与分析效率 在 Power BI 数据分析流程中,“数据准备” 是决定后续分析质量 ...
2025-08-18CDA 数据分析师:巧用 SQL 多个聚合函数,解锁数据多维洞察 在企业数据分析场景中,单一维度的统计(如 “总销售额”“用户总数 ...
2025-08-18CDA 数据分析师:驾驭表格结构数据的核心角色与实践应用 在企业日常数据存储与分析场景中,表格结构数据(如 Excel 表格、数据库 ...
2025-08-18PowerBI 累计曲线制作指南:从 DAX 度量到可视化落地 在业务数据分析中,“累计趋势” 是衡量业务进展的核心视角 —— 无论是 “ ...
2025-08-15Python 函数 return 多个数据:用法、实例与实战技巧 在 Python 编程中,函数是代码复用与逻辑封装的核心载体。多数场景下,我们 ...
2025-08-15CDA 数据分析师:引领商业数据分析体系构建,筑牢企业数据驱动根基 在数字化转型深化的今天,企业对数据的依赖已从 “零散分析” ...
2025-08-15随机森林中特征重要性(Feature Importance)排名解析 在机器学习领域,随机森林因其出色的预测性能和对高维数据的适应性,被广 ...
2025-08-14t 统计量为负数时的分布计算方法与解析 在统计学假设检验中,t 统计量是常用的重要指标,其分布特征直接影响着检验结果的判断。 ...
2025-08-14