
大数据系统与关系型数据的共存
大数据在2011年崭露头角,2012年一飞冲天,它可能会以一种戏剧性的方式改变数据管理的很多方面。大数据系统给管理和操纵计算机数据、连续提取、转换和加载功能、运作商业智能、动态大数据以及基于云的数据仓库等等都带来了变化。
不过,随着大数据进入2013年,已经没有什么系统技术能比NoSQL数据库和Hadoop框架更活跃了,看起来这两款产品还有更大的发展空间。根据MarketAnalysis.com 2012年的一份报告看,单单是Hadoop-MapReduce市场,预计复合年增长率将达到58%,在2018年将达到22亿美元。
NoSQL和Hadoop的出现主要是为应对非结构化数据的,比如文本数据或者web日志。就像Apache Hadoop一样,这些技术通常是从开源起步,逐渐成为新的商业产品。
Judith Hurwitz是Hurwitz and Associates公司的总裁兼CEO,该公司位于美国马萨诸塞州,她认为大数据架构和大规模并行处理大大改变了数据景象。她说:在此之前,即便数据真的对公司很重要,人们也没有能力获取巨大数据量并进行实时分析。
她认为:现在,不现实的东西正变得实用。这种情况已经把数据带出了舒适区。
SQL受创,即将回击
我们可以在网站上看到,2012年伊始,对主流关系型数据库陷入困境的预测就出现了。部分预言已成为现实。SQL关系型数据库在与未来几年可能成为其替代品的产品经过一系列斗争之后,现在(或者很快)似乎面临着关于处理整个企业大数据量过滤的最为剧烈的竞争。
这一趋势背后的推动力是企业对以更快的速率获取更多非结构化数据的渴望,这样企业才能更加依靠数据驱动做出决策。惯用的处理方式正在改变,以适应最好的新技术。
这些来自2012年特定数据管理供应商的举动展现出大数据和Hadoop对关系型数据冲击的现状:
IBM公司还在继续创立小型数据和分析公司,尽管比2011年少了些。蓝色巨人的努力方向从小的改进(比如,针对DB2 10的NoSQL图形库和InfoSphere Warehouse 10)到非常巨大的PureData系统装置,目的都是为了给企业搞定大数据。
甲骨文公司在年初推出了大数据设备。这一发布是紧跟着Oracle NoSQL数据库2.0之后发布的,Oracle NoSQL数据库2.0已经自动实现重新平衡,新的应用编程接口可以处理大型对象,与Oracle数据库有更紧密的集成,支持直接用SQL查询Oracle NoSQL数据库记录。
微软公司展示了Hadoop对Windows Azure和Windows Server支持的预览;Teradata公司发布了其Aster大数据分析产品;而Informatica公司发布了PowerCenter套件的大数据版,据说消除了Hadoop手工编码的需求,并把编程任务带入了Informatica开发环境。
SQL在2012年可能只有一两次回击,但是它积极应对市场挑战的举动有重要意义。在非主流NoSQL和Hadoop方面比较专业的公司更新了他们去年的SQL认证。一个典型的例子是Hadoop创立了Cloudera公司,该公司期望增强SQL与Impala的协作程度(Impala是一款Hadoop软件产品,支持标准SQL做交互式查询)。
大数据的变动
这样的举动可能代表了一定的势头人们看到SQL和NoSQL一起被提及的机会更多了。在某种程度上,SQL在早期大数据喧闹的讨论中有点被淡化了。
Ronnie Beggs是美国旧金山SQLstream公司的副总裁,该公司是一家流媒体数据库制造商。他说:在过去的几年里,由于大数据运动,SQL已经不再挂在每个人的嘴边了。同时,他还说:大数据和NoSQL双剑合璧,已经冲击到了主流。
他还表示,在2013年,我们应该会看到明显的变化,并提到近几年在使NoSQL数据库更好地适应SQL风格的开发方面所作出的各种努力。
Beggs说:它是不断变化的。我们接下来这一年会看到SQL的回归,它将成为所有大数据平台的接口。
这种发展走向了Hadoop框架、NoSQL和SQL方法的共存,这标志着在大数据的成熟度方面迈出了新的一步。2013年,大数据有可能从一个热门话题变为切实的实践。
Colin White是美国俄勒冈州Ashland BI研究机构的总裁和创始人,他说:我认为人们正努力通过大数据的炒作,来真正理解业务价值。在2013年,我认为我们将看到人们从大数据中获得业务价值的优秀案例。问题不在于大数据本身,而在于你的运用。
虽然企业对新技术有着广泛的兴趣,但不是所有公司都会以同样的程度全面部署大数据系统。关于这一点,在最近TechTarget举办的一次重点银行会议上,一位集成服务经理也有所提及。
他认为银行业只有部分涉足了基本的大数据,而不是全部。银行和其它领域只看到了大数据的数量,而没有留意到它的非结构性。至少目前还是这样。
他谈到:大数据的含义有两部分。第一部分是它们的量很大,第二部分是数据为非结构化。银行明显属于第一部分。但是我们不会去收集tweets,至少目前还没有。我们还在观望,等待金融数据服务市场的应对。(文章来自:CDA数据分析师)
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
2025 年,数据如同数字时代的 DNA,编码着人类社会的未来图景,驱动着商业时代的运转。从全球互联网用户每天产生的2.5亿TB数据, ...
2025-06-052025 年,数据如同数字时代的 DNA,编码着人类社会的未来图景,驱动着商业时代的运转。从全球互联网用户每天产生的2.5亿TB数据, ...
2025-05-27CDA数据分析师证书考试体系(更新于2025年05月22日)
2025-05-26解码数据基因:从数字敏感度到逻辑思维 每当看到超市货架上商品的排列变化,你是否会联想到背后的销售数据波动?三年前在零售行 ...
2025-05-23在本文中,我们将探讨 AI 为何能够加速数据分析、如何在每个步骤中实现数据分析自动化以及使用哪些工具。 数据分析中的AI是什么 ...
2025-05-20当数据遇见人生:我的第一个分析项目 记得三年前接手第一个数据分析项目时,我面对Excel里密密麻麻的销售数据手足无措。那些跳动 ...
2025-05-20在数字化运营的时代,企业每天都在产生海量数据:用户点击行为、商品销售记录、广告投放反馈…… 这些数据就像散落的拼图,而相 ...
2025-05-19在当今数字化营销时代,小红书作为国内领先的社交电商平台,其销售数据蕴含着巨大的商业价值。通过对小红书销售数据的深入分析, ...
2025-05-16Excel作为最常用的数据分析工具,有没有什么工具可以帮助我们快速地使用excel表格,只要轻松几步甚至输入几项指令就能搞定呢? ...
2025-05-15数据,如同无形的燃料,驱动着现代社会的运转。从全球互联网用户每天产生的2.5亿TB数据,到制造业的传感器、金融交易 ...
2025-05-15大数据是什么_数据分析师培训 其实,现在的大数据指的并不仅仅是海量数据,更准确而言是对大数据分析的方法。传统的数 ...
2025-05-14CDA持证人简介: 万木,CDA L1持证人,某电商中厂BI工程师 ,5年数据经验1年BI内训师,高级数据分析师,拥有丰富的行业经验。 ...
2025-05-13CDA持证人简介: 王明月 ,CDA 数据分析师二级持证人,2年数据产品工作经验,管理学博士在读。 学习入口:https://edu.cda.cn/g ...
2025-05-12CDA持证人简介: 杨贞玺 ,CDA一级持证人,郑州大学情报学硕士研究生,某上市公司数据分析师。 学习入口:https://edu.cda.cn/g ...
2025-05-09CDA持证人简介 程靖 CDA会员大咖,畅销书《小白学产品》作者,13年顶级互联网公司产品经理相关经验,曾在百度、美团、阿里等 ...
2025-05-07相信很多做数据分析的小伙伴,都接到过一些高阶的数据分析需求,实现的过程需要用到一些数据获取,数据清洗转换,建模方法等,这 ...
2025-05-06以下的文章内容来源于刘静老师的专栏,如果您想阅读专栏《10大业务分析模型突破业务瓶颈》,点击下方链接 https://edu.cda.cn/g ...
2025-04-30CDA持证人简介: 邱立峰 CDA 数据分析师二级持证人,数字化转型专家,数据治理专家,高级数据分析师,拥有丰富的行业经验。 ...
2025-04-29CDA持证人简介: 程靖 CDA会员大咖,畅销书《小白学产品》作者,13年顶级互联网公司产品经理相关经验,曾在百度,美团,阿里等 ...
2025-04-28CDA持证人简介: 居瑜 ,CDA一级持证人国企财务经理,13年财务管理运营经验,在数据分析就业和实践经验方面有着丰富的积累和经 ...
2025-04-27