京公网安备 11010802034615号
经营许可证编号:京B2-20210330
做好这十项便可以开启你的大数据分析之旅
如果你的公司正着手开启你的大数据分析之旅,不要烦恼:你不是一个人,这条船上大有人在。但是你需要加倍努力才能赶上数据分析的领头羊们。
近来2015Teradata合作伙伴大会、2015SAS数据分析大会和CAO(首席分析官)峰会相继举办,而这篇文章是从这些行业大会的讨论中总结出来的十个小窍门。
1. 避免华而不实
现在企业可以从传感器、智能手机中获取比以前多得多的数据,但相应的做出成果的压力也就更大了。陷入热潮特别是一些闪亮的新技术宣传热潮是很容易的。但是靠大数据技术真正获得成功却不是易事,仅仅掌握某项技能是不足以让成功一蹴而就的。今天的大数据领导者们已经在数据分析行业工作长达十年甚至更久,他们有成功的基础。
ThinkBig创始人Ron Bodkin说:“很多时候,落伍者仅仅关注‘银弹’(注:银弹喻指一种极端有效的解决方案),他们希望自己能够掌握一种技术从而各种问题均迎刃而解。这当然是痴人说梦。”他的公司已经在去年被Teradata收购。
2. 不要盲目崇拜数据
据说数据已成为一种新“货币”并展现了自身价值。这样说可能有点夸大其词。数据公司应该只收集其需要的数据来解决业务问题即可,而不是像一头贪婪嗜财的巨龙一样大量囤积数据。
麦肯锡消费市场分析中心的首席营运官Matt Ariker说“数据本身能够成为一种竞争优势,当然你也可能让分析毫无意义。我已经老了,我在宝洁公司开始分析师生涯。那时我们会花费12周来分析两周的促销活动。你真的很需要思考这样几个问题:那些高质量的问题究竟是什么意思,你该如何来整合结构化和非结构化数据以及整理总结你的流程化分析问题的方法。否则你将一无所获。
3. 首先考虑商业案例
一些公司在数据分析之初,会收集所有能到手的数据,然后全部放入自己的数据池中,妄想可以有一种有魔力的算法让自己一键获得业务解决方案。但是他们往往难以有所收获。
Bodkin说“人们往往有这样的误解:数据科学家们的工作就是在周一到办公室之后说‘我又可以无所限制地做些什么有趣的事呢?’而据我所知,没有什么公司会拿出巨额预算进行无限制的数据探索。(他们会参考一些已有商业案例)”
4. 形成数据分析文化
你可以在最纯净的数据集上用最优秀的算法来创造出惊艳的结论,但那毫无意义,除非你的业务伙伴相信你所做的数据分析具有价值,并且相信那些数据和结论。这需要你建立一种数据分析文化。
Teradata实验室主席Oliver Ratzenberger说:“如果你分析那些领先的数据分析竞争者们就会发现,他们花费了过去的10到15年时间来形成自己的数据分析文化。有些公司曾说过自己将在接下来的90年里完成在数据分析项目上从‘爬行’到‘疾跑’的蜕变。这和技术无关,这是在说他们数据分析文化的形成。”
5. 快速失败积累出最终的成功
数据科学是一个往复循环的过程。在你成功把数据变成有价值的结论并实施他们之前,你总会经历各种各样的失败。最近的许多大数据领域的突破性进展,例如Apache Spark都是专注于加速这个过程。
但是大数据从业者不应该为了失败而失败,故意陷入这个失败尝试的循环过程。麦肯锡的Ariker说:“你可以进行多项测试,失败的现实仅仅预示着你会更快的失败。你所有的灵活的数据分析过程都是基于公司支持和假设驱动的。你的失败是为了改进数据分析过程并获得更好的结论,而不是不顾结果地去享受数据分析的过程。
6. 保证最高管理层在数据分析的一环
和管理层分享你的数据分析的成果是必要的,不仅是为了确保他们不会插手你以后的数据分析项目,也是为了保证你在分析管理层关注的问题 。
宝洁公司领导人,商业智能和数据分析领导者David Dittmann在最近的CAO峰会上说:“我们学到的一点是,你必须一直给管理层展现数据价值。而如果你一直缺席管理层的业务讨论会,我想你的工作会出现方向性的根本错误。”
7. 管理很无聊却是必要的
没有什么比一场有关数据分析进程和改变管理方式的讨论更让人犯困了。但是在这样一个快节奏的大数据时代,处理好所有部分不仅仅是细节问题,它更是长期成功的基石。
能够在30天里对一件事保持敏锐是很重要的。Teradata的Ratzenberger说:“但是你需要有能够这么做的基础。包括产品系列,错误处理和版本控制的集成管理是必要的。有些部分在开始的30或90天里是起作用的,但是你还需要保持其在随后依然有效。你有一副好牌在手,就需要你好好把握,一旦你出错一张,随之而来的可能就是满盘皆输。”
8. 保持全程思考
你可能有一个最好的预测模型。但是,除非它可以在现实世界中有效并且有较好的效益,否则它将毫无价值,只是对公司时间和资源的浪费。
麦肯锡的Ariker说:“如果你跑去对经理说‘好消息,我们的大数据平台可以生产很多数据产品,但是我需要再雇1500个人’,那估计你第二天得找份新工作了。你必须一直思考流程化数据处理和效益的平衡,并确保你在研究一个高质量问题的同时考虑好答案。”
9. 积少成多
在大数据领域,一气呵成地处理所有问题听上去是异常诱人的。你想要依据众多变量来建模解决业务问题,所以你去收集了有关各个业务的众多数据,然而你的算法却在剔除合适的结论。想法是美好的,结果却不尽如人意。
肯尼索州立大学的应用统计和数据科学教授Jennifer Lewis Priestley讲了一个故事:有个数学专业的学生建立了一个极好而又极差的模型,这个模型有非常高的准确率,但是产生了2500个预测器。“这毫无意义。你不可能去操作2500个预测器。所以我让那个学生去筛选出四个我可以实际使用的预测器”她在2015SAS数据分析大会上说。
10. 不要去猎取“独角兽”
精通统计学、科技和商业的数据科学家们被称作“独角兽”,因为他们是如此的稀有(事实上并不存在独角兽,因为他们是神话生物,但那是另外的故事了)。
尽管这样的数据科学家确实存在,但这不值得你浪费时间去挖他们来你的公司。ThinkBig的Bodkin说:“我所有的客户都在尝试着挖人。但是你无法从一个人身上就得到想要的价值,你只能从一个团队——一个高效的数据科学团队得到你想要的数据分析结果。”
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在 CDA 数据分析师能力体系中,透视分析是数据探索、多维度汇总、业务复盘的核心基础技能。无论是 Excel 数据透视表,还是 Power ...
2026-07-03在市场竞争日趋激烈、获客成本持续攀升的当下,企业粗放式的“广撒网”获客模式早已无法适配经营需求。企业经营的核心逻辑,已经 ...
2026-07-03 很多数据分析师精通Excel函数和数据透视表,但当被问到“数据从哪里来”“表和视图有什么区别”“数据库管理系统和SQL是什么 ...
2026-07-03【核心关键词】运营、企业、核心、客户、新技术、数字化运营、数据分析、传统企业、人工录入、生产系统、技术人员、数据安全、 ...
2026-07-02在产品开发、项目立项、业务拓展、运营优化的工作中,市场调查、竞品分析、需求调研是三大核心基础工作。很多从业者容易将三者混 ...
2026-07-02 很多企业团队并非缺乏指标,而是陷入“指标失控”:仪表盘上堆满实时跳动的数据,却无法回答“当前瓶颈在哪、下一步该做什么 ...
2026-07-02在MySQL数据库运维与开发工作中,当单表数据量达到千万级、亿级后,会出现查询卡顿、索引失效、写入性能下降等问题。为优化性能 ...
2026-07-01在信息化建设、系统开发、数据分析、需求梳理的工作场景中,业务模型与逻辑模型是两个最基础、也最容易混淆的核心概念。很多项目 ...
2026-07-01 很多数据分析师能熟练计算各种指标,但当被问到“这些指标之间是什么关系”“为什么要选这个指标而不是那个”“指标体系的整 ...
2026-07-01【核心关键词】报表、数据源、客户、营销、业绩、销售、时效性、函数、可视化、运营、数据分析、数据报表、业务部门、数据运营 ...
2026-06-30在数据分析、商业预测、经济统计、运维监控等领域中,绝大多数业务数据都具备时间连续性特征,例如月度销售额、日度客流量、季度 ...
2026-06-30 很多数据分析师每天盯着GMV、DAU、转化率,但当被问到“哪些指标在所有行业都适用”“哪些指标只对电商有意义”“二者如何搭 ...
2026-06-30在 SQL Server 安装、服务启动、数据库文件操作等场景中,经常会遇到 “实例已在使用” 类报错,不同触发场景的原因与处理方式差 ...
2026-06-29在Excel数据统计、财务核算、销售复盘、库存盘点等办公场景中,经常需要在数据透视表中实现一列数据乘以另一列数据的计算需求, ...
2026-06-29在数据分析中,指标是连接业务与数据的核心语言。它并非一个简单的数字,而是一个将模糊的业务需求(如“提升用户粘性”)转化为 ...
2026-06-29【核心关键词】大数据、零售商、消费者、供应链、运营、企业、产品、客户、数据模型、大数据平台、数据开发、系统运维、业务逻 ...
2026-06-26在物流配送、供应链履约、终端供货等业务场景中,送货率是衡量企业履约能力、服务质量、供应链稳定性的核心业务指标,直接关联客 ...
2026-06-26 很多数据分析师精通描述性统计,能熟练计算均值、中位数、标准差,但当被问到“用500个样本如何推断10万用户的真实满意度” ...
2026-06-26在数字化管理与数据化运营体系中,指标是连接原始数据与业务决策的核心载体。零散的原始数据只是无意义的数值堆砌,无法直接反映 ...
2026-06-25在Excel数据汇总、财务统计、业务复盘等日常办公场景中,经常需要完成逐行相乘、整体汇总求和的计算需求,最典型的场景就是:单 ...
2026-06-25