
大数据当然需要大量、海量的数据,但究竟是不是有些研究者和论者所说的无限数据,是一个重大疑问。
要懂得从大数据中还原数据真实,《决战大数据:驾驭未来商业的利器》一书传达的这个观点给笔者留下了深刻印象。大数据当然需要大量、海量的数据,但究竟是不是有些研究者和论者所说的无限数据,是一个重大疑问。信息搜集需要成本,还将面临用户隐私意识等障碍。更大的成本来源于存储和分析。
信息和数据分布从来就遵循幂律特点,如果数据挖掘以拒绝遗漏为原则,将产生大量的无意义劳动消耗,因为根据一部分数据其实就可以得出足够推导出80%-90%的结论。再者,大数据分析的重要意义在于改善实时分析,对数据搜集及处理速度有很高的要求,譬如电商企业不得不切实提高与用户的有效互动,要尽可能依据掌握并不全面的用户数据给出推荐,并就疑难及时响应。相反,如果数据处理和响应总带有迟滞性,企业希望搜集到足够的、全面的用户数据再给予响应,就必然错过时机。
海量数据还可能包含大量看上去彼此矛盾,甚至根本就带有误导性的数据内容。《决战大数据:驾驭未来商业的利器》一书的作者是阿里巴巴集团商业智能部副总裁、数据委员会会长车品觉,他在书中描绘了消费者通过智能手机等终端购物的一种常见场景:消费者早上看到某款好看的衣服,想要购买,在网上搜出大批量的相关商品;正在挑选时,被叫去开会,在开会时打开手机应用,发现了有诱惑力的促销广告,就下单购买了另外一类商品(比如手机)。
这起场景中,消费者先后使用了手机端和PC端,如果均保持同一个用户名的登录状态,其搜索数据和最终购买数据汇集在一起显然会让许多数据分析师抓狂。如果企业要求数据分析师从这些数据挖掘、还原用户的真实需求,难度可想而知。如果这一个消费者在手机端、PC端还使用不同用户名,又该搜集哪些、多少数据,才能做到辨识其身份?
车品觉指出,“大数据的真正价值是将数据用于形成主动收集数据的良性循环,以带动更多的数据进入这个自循环中”。要做到这一点必然是困难的,上述场景非常常见,直接原因是普通消费者使用互联网具有多场景,完全可能灵活的轮换使用PC端、手机端、智能穿戴设备等终端;往深了说,移动互联网时代,很多人的注意力是高度涣散的。许多时候,用户可能长时间停留于某个页面,这并不能表明其一定是在专心停留阅读,更大的可能在于消费者这时有事走开了,或者切换到别的终端界面。因此,数据挖掘分析必须承认这种手段的相对有效性、局限性。
书中提出,数据具有5大价值:识别与串联价值(根据大数据中的核心数据对用户真实身份、真实行为进行还原)、描述价值(在特定框架内找出核心用户、紧密购买行为数据)、时间价值(在特定时间段分析历史数据)、预测价值、产出数据的价值。这其中提到的特定框架,也就是说从海量数据中根据关联性,提取核心有用数据的范围。比如一个企业要判断是否继续使用导航网站的广告,就要明确导航网站引进的新老用户比、引进的新老用户的投入产出比和转化率、推断一旦撤去广告会带来的流失影响,还要对竞争对手进行行为分析预测(对方可能加强导航广告投入),这些限定因素将使得数据提取及后续分析就不会毫无章法。
这本书第二部分对阿里巴巴的大数据实践作了基本介绍。阿里巴巴成长到今天的规模,还能继续驾驭宏大的产品线和业务范围,电商行业内外有识之士都认为这应归功于阿里巴巴能够很好的实现数据化运营,可以通过海量数据成功实现即便是细小范围内的业务对比、细分及趋势预估。车品觉分享指出,阿里巴巴数据化运营落地是从“人”做起,利用好了“混、通、晒”三板斧。“混”就是让数据分析师与业务部门的人经常“混”在一起,这是确保两大部门培养商业和数字直觉的前提;“通”就是打通“混”的数据;在此基础上,让数据得以最有效的获取、使用、分享、协同、连接和组合,就是“晒”。
车品觉认为,2011年起,阿里巴巴已经开始从数据化运营向运营数据发展,形成了良性循环,走到了运营数据的外三板斧“存、管、用”。“存”指的是搜集并存储有效数据;“管”涵盖了数据的安全管理、让数据更趋准确稳定、更好运用数据等范畴;“用”,就是要从数据本身实现分裂和重组,推动颠覆性创新。书中就此对“用”这一层次,结合作者长期以来的从业实践及对京东、一号店等其他知名电商企业运营经验的观察,展开了颇为深入的梳理剖析。文章来源:CDA数据分析师培训官网
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
2025 年,数据如同数字时代的 DNA,编码着人类社会的未来图景,驱动着商业时代的运转。从全球互联网用户每天产生的2.5亿TB数据, ...
2025-06-052025 年,数据如同数字时代的 DNA,编码着人类社会的未来图景,驱动着商业时代的运转。从全球互联网用户每天产生的2.5亿TB数据, ...
2025-05-27CDA数据分析师证书考试体系(更新于2025年05月22日)
2025-05-26解码数据基因:从数字敏感度到逻辑思维 每当看到超市货架上商品的排列变化,你是否会联想到背后的销售数据波动?三年前在零售行 ...
2025-05-23在本文中,我们将探讨 AI 为何能够加速数据分析、如何在每个步骤中实现数据分析自动化以及使用哪些工具。 数据分析中的AI是什么 ...
2025-05-20当数据遇见人生:我的第一个分析项目 记得三年前接手第一个数据分析项目时,我面对Excel里密密麻麻的销售数据手足无措。那些跳动 ...
2025-05-20在数字化运营的时代,企业每天都在产生海量数据:用户点击行为、商品销售记录、广告投放反馈…… 这些数据就像散落的拼图,而相 ...
2025-05-19在当今数字化营销时代,小红书作为国内领先的社交电商平台,其销售数据蕴含着巨大的商业价值。通过对小红书销售数据的深入分析, ...
2025-05-16Excel作为最常用的数据分析工具,有没有什么工具可以帮助我们快速地使用excel表格,只要轻松几步甚至输入几项指令就能搞定呢? ...
2025-05-15数据,如同无形的燃料,驱动着现代社会的运转。从全球互联网用户每天产生的2.5亿TB数据,到制造业的传感器、金融交易 ...
2025-05-15大数据是什么_数据分析师培训 其实,现在的大数据指的并不仅仅是海量数据,更准确而言是对大数据分析的方法。传统的数 ...
2025-05-14CDA持证人简介: 万木,CDA L1持证人,某电商中厂BI工程师 ,5年数据经验1年BI内训师,高级数据分析师,拥有丰富的行业经验。 ...
2025-05-13CDA持证人简介: 王明月 ,CDA 数据分析师二级持证人,2年数据产品工作经验,管理学博士在读。 学习入口:https://edu.cda.cn/g ...
2025-05-12CDA持证人简介: 杨贞玺 ,CDA一级持证人,郑州大学情报学硕士研究生,某上市公司数据分析师。 学习入口:https://edu.cda.cn/g ...
2025-05-09CDA持证人简介 程靖 CDA会员大咖,畅销书《小白学产品》作者,13年顶级互联网公司产品经理相关经验,曾在百度、美团、阿里等 ...
2025-05-07相信很多做数据分析的小伙伴,都接到过一些高阶的数据分析需求,实现的过程需要用到一些数据获取,数据清洗转换,建模方法等,这 ...
2025-05-06以下的文章内容来源于刘静老师的专栏,如果您想阅读专栏《10大业务分析模型突破业务瓶颈》,点击下方链接 https://edu.cda.cn/g ...
2025-04-30CDA持证人简介: 邱立峰 CDA 数据分析师二级持证人,数字化转型专家,数据治理专家,高级数据分析师,拥有丰富的行业经验。 ...
2025-04-29CDA持证人简介: 程靖 CDA会员大咖,畅销书《小白学产品》作者,13年顶级互联网公司产品经理相关经验,曾在百度,美团,阿里等 ...
2025-04-28CDA持证人简介: 居瑜 ,CDA一级持证人国企财务经理,13年财务管理运营经验,在数据分析就业和实践经验方面有着丰富的积累和经 ...
2025-04-27