八大趋势看透大数据分析的未来_数据分析师考试
Intuit公司负责数据工程的副总裁Bill Loconzolo已两脚踏入了数据湖。而Smarter Remarketer的首席数据科学家Dean Abbott也径直走进了云中。当我们说到大数据[注]和分析的前沿时,它既包括数据湖(以原生格式存储海量数据),当然也包括云计算[注]。尽管这些技术选项距离成熟还很远,但我们肯定不能选择一味的等待和观望。 现实情况虽然是,各种大数据工具在不断涌现,但Hadoop平台的前途尚未达到让企业能够依赖的程度,Loconzolo说。然而大数据和分析技术演变得如此之快,企业必须做出抉择,要么涉足其中,要么就得冒落后的风险。
在过去,新兴技术可能需要几年时间才能成熟。而现在,解决方案的迭代和升级只需要几个月,甚至几周时间,那么,在你的观察名单或者实验室里,最重要的新兴技术和趋势是什么呢?当我们用这样的问题去问很多IT高管、咨询师和行业分析师时,得到了如下的答案。 1、云中的大数据分析 Hadoop框架和一组工具可用于处理非常大的数据集,它最初是为了物理机集群而设计的。
但现在情况有了变化。Forrest分析师Brian Hopkins说:“如今已有很多技术可用于处理云中的数据。”实例包括亚马逊Redshift所托管的BI数据仓库、谷歌BigQuery数据分析服务、IBM Bluemix云平台,以及亚马逊Kinesis数据处理服务等。大数据的未来状态将是企业端和云端的某种混合态。 从事零售业分析与营销服务的SaaS[注]厂商Smarter Remarketer最近已从其内部的Hadoop和MongoDB数据库基础架构转移到了亚马逊Redshift云数据仓库上。
该公司主要收集线上和线下的零售销售数据、消费者统计数据及实时行为数据,然后对其作分析,帮助零售商创建有针对性的消息发送,以便吸引顾客的响应(某些情况下可能是实时的响应)。 Abbortt称,Redshift对于Smarter Remarketer的数据需求来说,更具成本效益,特别是其针对结构化数据的范围广泛的报表功能。作为一种托管服务,Redshift既可扩展,使用起来也相对简单。
它在虚拟机上的扩展成本要比购买由我们自己管理的物理机便宜不少。 Intuit也开始谨慎地在向云分析转移,因为它需要一个安全、稳定和可审计的环境。这家财务软件公司一方面计划在自己私有的Intuit分析云中保留一切资源,另一方面,又在与亚马逊和Cloudera合作,计划构建一个公私混合的、高度可用而且安全的分析云,Loconzolo说。对于像Intuit这样销售在云中运行的产品厂商来说,向云的迁移是不可避免的。一旦在企业端分析数据的成本高到无法承受时,就只能把所有的数据迁到云中去。
2、Hadoop:新的企业数据操作系统 Hopkins认为,各种分布式分析框架,如MapReduce,正在演变为分布式资源管理器,它们会逐渐地将Hadoop转变为一种通用的数据操作系统。有了Hadoop这样的分布式文件存储系统,你就能执行很多不同的数据操控和分析任务。
这种变化对企业来说意义何在呢?和SQL一样,MapReduce、内存计算、流处理、图形分析和其他类型的工作负载都能够以适当的性能在Hadoop上运行,越来越多的企业会把Hadoop当作企业数据集中库来使用。这样的能力,即针对Hadoop上的数据执行多种不同类型查询和操控的能力,将使其成为一种低成本的通用平台,企业想要分析的任何数据都可以放在其上进行分析。Hopkins说。 Intuit已经开始在构建自己的Hadoop基础。“我们的战略是利用MapReduce和Hadoop,构造Hadoop分布式文件系统,长期目标是让人和产品之间所有类型的互动得以产生,”Loconzolo说。
3、大数据湖 传统的数据库理论会告诉你,在进入任何数据之前,首先得设计好数据集。而数据湖,也称企业数据湖或企业数据集中库,可能会彻底改变传统模式,普华永道美国咨询业务负责人兼首席技术专家Chris Curran说。也就是说,我们会将各种数据资源倾倒进一个大的Hadoop仓库中去,而不会事先设计什幺数据模型。
相反地,我们会提供各种工具,再配上对数据湖中现存数据的顶层定义,供人们去分析数据。这样,人们就可随着对数据湖的逐步深入而构建起自己的数据视图。这正是构建一个大规模数据库的增量化的、有机的模型。
不过,这种方法也存在不足,那就是对数据分析人员的技术要求较高。 Loconzolo说,作为Intuit分析云的一个组成部分,Intuit也有一个数据湖,包括用户的点击流数据、企业数据和第三方数据,但重点是围绕数据湖对工具进行所谓的“民主化”,让商业人士都能有效地使用它。Loconzolo说,在Hadoop里构建一个数据湖,他的一个担心是Hadoop平台并未真正实现企业就绪。我们希望它具备数十年来传统企业数据库所具备的所有功能――监控访问控制、数据加密、保护数据,并可跟踪数据从源到目标的传递路径。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
以下的文章内容来源于刘静老师的专栏,如果您想阅读专栏《刘静:10大业务分析模型突破业务瓶颈》,点击下方链接 https://edu.cda ...
2025-04-23大咖简介: 刘凯,CDA大咖汇特邀讲师,DAMA中国分会理事,香港金管局特聘数据管理专家,拥有丰富的行业经验。本文将从数据要素 ...
2025-04-22CDA持证人简介 刘伟,美国 NAU 大学计算机信息技术硕士, CDA数据分析师三级持证人,现任职于江苏宝应农商银行数据治理岗。 学 ...
2025-04-21持证人简介:贺渲雯 ,CDA 数据分析师一级持证人,互联网行业数据分析师 今天我将为大家带来一个关于用户私域用户质量数据分析 ...
2025-04-18一、CDA持证人介绍 在数字化浪潮席卷商业领域的当下,数据分析已成为企业发展的关键驱动力。为助力大家深入了解数据分析在电商行 ...
2025-04-17CDA持证人简介:居瑜 ,CDA一级持证人,国企财务经理,13年财务管理运营经验,在数据分析实践方面积累了丰富的行业经验。 一、 ...
2025-04-16持证人简介: CDA持证人刘凌峰,CDA L1持证人,微软认证讲师(MCT)金山办公最有价值专家(KVP),工信部高级项目管理师,拥有 ...
2025-04-15持证人简介:CDA持证人黄葛英,ICF国际教练联盟认证教练,前字节跳动销售主管,拥有丰富的行业经验。在实际生活中,我们可能会 ...
2025-04-14在 Python 编程学习与实践中,Anaconda 是一款极为重要的工具。它作为一个开源的 Python 发行版本,集成了众多常用的科学计算库 ...
2025-04-14随着大数据时代的深入发展,数据运营成为企业不可或缺的岗位之一。这个职位的核心是通过收集、整理和分析数据,帮助企业做出科 ...
2025-04-11持证人简介:CDA持证人黄葛英,ICF国际教练联盟认证教练,前字节跳动销售主管,拥有丰富的行业经验。 本次分享我将以教培行业为 ...
2025-04-11近日《2025中国城市长租市场发展蓝皮书》(下称《蓝皮书》)正式发布。《蓝皮书》指出,当前我国城市住房正经历从“增量扩张”向 ...
2025-04-10在数字化时代的浪潮中,数据已经成为企业决策和运营的核心。每一位客户,每一次交易,都承载着丰富的信息和价值。 如何在海量客 ...
2025-04-09数据是数字化的基础。随着工业4.0的推进,企业生产运作过程中的在线数据变得更加丰富;而互联网、新零售等C端应用的丰富多彩,产 ...
2025-04-094月7日,美国关税政策对全球金融市场的冲击仍在肆虐,周一亚市早盘,美股股指、原油期货、加密货币、贵金属等资产齐齐重挫,市场 ...
2025-04-08背景 3月26日,科技圈迎来一则重磅消息,苹果公司宣布向浙江大学捐赠 3000 万元人民币,用于支持编程教育。 这一举措并非偶然, ...
2025-04-07在当今数据驱动的时代,数据分析能力备受青睐,数据分析能力频繁出现在岗位需求的描述中,不分岗位的任职要求中,会特意标出“熟 ...
2025-04-03在当今数字化时代,数据分析师的重要性与日俱增。但许多人在踏上这条职业道路时,往往充满疑惑: 如何成为一名数据分析师?成为 ...
2025-04-02最近我发现一个绝招,用DeepSeek AI处理Excel数据简直太爽了!处理速度嘎嘎快! 平常一整天的表格处理工作,现在只要三步就能搞 ...
2025-04-01你是否被统计学复杂的理论和晦涩的公式劝退过?别担心,“山有木兮:统计学极简入门(Python)” 将为你一一化解这些难题。课程 ...
2025-03-31