京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据泡沫正无限膨胀
在当今企业中80%的数据都是非结构化数据,这些数据每年都按指数增长60%。大数据将挑战企业的存储架构、数据中心的基础设施等,也会引发数据仓库、数据挖掘、商业智能、云计算等应用的连锁反应。未来企业会将更多的TB级(1TB=1024GB)数据集用于商务智能和商务分析。到2020年,全球数据使用量预计将暴增44倍,达到35.2ZB(1ZB=10亿TB)。大数据正在彻底改变IT世界。10月几大科技巨头的举动使更多人意识到所谓的高科技泡沫——即“大数据”正在无限的膨胀。
微软与Hortonworks合作开发Hadoop
早在今年2月,微软的HPC开发团队就公布了被称为“Dryad”的分布式计算平台。这也标志着微软向Windows HPC Server用户提供了能够进行海量数据处理的工具。微软推出Dryad的目就是鼓励开发者们在Windows或者.Net平台上编写大规模的并行应用程序。在当时这也被视为微软在大数据领域与Hadoop对抗的有力产品。
但微软却于10月12日在西雅图举行的SQL PASS 2011峰会上出乎所有人预料的宣布将与从雅虎分拆出来的Hortonworks合作开发Hadoop,并将在Apache Hadoop上实现搭建Windows Azure以及Windows Server平台。同时基于Hadoop的Windows Server还会与微软现有的BI工具联合处理任务。
微软与Hortonworks深度合作的目标是借助Hortonworks在此领域的专长帮助最大化将Hadoop集成到微软的产品之中。同时两家的合作可帮助简化下载、安装和配置等几个Hadoop的相关技术。包括HDFS、Hive、Pig。这将有利于企业通过Hadoop拓宽自身的业务。微软还将编写新的ODBC驱动程序并扩展自己现有的查询系统到Hive。这样一来用户将能够直接从Excel、PowerView执行Hadoop查询。
Red Monk分析师Stephen O'Grady也很看好Windows和Hadoop的结合。他表示这将是非常具有吸引力的,这将吸引大量的Windows用户。微软在此领域具有竞争的实力。
大数据领域 Oracle硬件、软件齐发力
Oracle作为全球最大的关系型数据库提供商也不甘寂寞,在其产品链条中加入了被称为“NoSQL Database”的NoSQL数据库。NoSQL Database是Oracle在2011 Oracle全球大会上宣布推出的Oracle Big Data Appliance的一个组成部分。Big Data Appliance是一个集成了Hadoop、NoSQL Database、Oracle数据库Hadoop适配器、Oracle数据库Hadoop装载器及R语言的系统。
而Oracle的在大数据领域的投入还远不止这些。他们不仅在软件层面推出了Oracle Big Data Appliance,在硬件层面Oracle还推出Exalytics。Exalytics目标非常明确,就是针对大数据。Oracle推出的In-Memory计算就是在Big Data时代能够提供海量信息——包括结构化、半结构化、数据集及非结构化数据的分析。同时Exalytics还能够支持混合的数据源——包括Oracle数据库、Teradata、微软SQL Server以及独立的Essbase数据库共同使用。
并且Exalytics的硬件和软件配置也相当强悍:1TB内存和48核心的处理器;支持OBIEE 11g;200GB/s带宽的TimesTen并行内存数据库;支持内存并行处理的Essbase OLAP服务器;新的面向高带宽分析的用户界面以及最快的连通Exadata的Infiniband连接。
以往,Oracle在云计算领域一直显得有些保守,但随着Oracle在此次大会在硬件和软件两个层面同时推出强有力的产品。这也标志着Oracle在云计算领域迈出了划时代的一步。
IBM将DB2与NoSQL数据库有机结合
同样是在10月,在IBM举办的IOD 2011大会上,IBM数据库服务器部门副总裁Curt Cotner宣布IBM将在明年推出内置NoSQL技术的DB2旗舰级数据库管理系统。
IBM在NoSQL技术领域已具备了一些经验,其自身的Rational Jazz协作软件交付平台就是使用了“triplestore”技术,而“triplestore”技术同NoSQL数据库中所涉及到的技术大致相同。triplestore技术允许用户简洁并快速的检索元数据和其他相关信息。
不过IBM Rational团队最终发现triple并不具备其所想要的可用性特征,例如故障转移、横向扩展到多个节点等等。IBM Rational团队发现如果其在短时间内接收大量的triple,NoSQL存储的索引将会锁住数据库。Rational团队实际上是从开源社区中借用NoSQL triplestore,然后进行修改,使其嵌入到DB2数据库中,通过这样的修改将能够使用DB2索引、日志、高可用性解决方案以及DB2数据库中所有的功能。
Cotner表示经过修改后的NoSQL功能在DB2数据库中运行速度将会比之前的开源产品快4倍以上,同时还可以消除可用性以及可扩展性带来的问题。现今NoSQL功能还在开发过程中,不过Rational团队将会在未来为DB2集成更多NoSQL的功能。
大数据在企业的未来
管理大数据的能力将成为那些越来越多地使用新形式信息——比如文本、社交媒体——的企业的核心能力。这种能力将帮助企业寻找最好的模式来支持商业决策,即所谓的基于模式的战略。作为一种变化引擎,基于模式的战略将充分利用模式寻找流程中所有的维度。然后,它为新商业解决方案的建模提供基础,让企业更好地适应新的环境。处理大数据的增长并利用大数据的能力将成为许多企业的优先任务,否则未来几年他们将受制于这些数据和他们的竞争对手。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数字化商业环境中,数据已成为企业优化运营、抢占市场、规避风险的核心资产。但商业数据分析绝非“堆砌数据、生成报表”的简单 ...
2026-01-20定量报告的核心价值是传递数据洞察,但密密麻麻的表格、复杂的计算公式、晦涩的数值罗列,往往让读者望而却步,导致核心信息被淹 ...
2026-01-20在CDA(Certified Data Analyst)数据分析师的工作场景中,“精准分类与回归预测”是高频核心需求——比如预测用户是否流失、判 ...
2026-01-20在建筑工程造价工作中,清单汇总分类是核心环节之一,尤其是针对楼梯、楼梯间这类包含多个分项工程(如混凝土浇筑、钢筋制作、扶 ...
2026-01-19数据清洗是数据分析的“前置必修课”,其核心目标是剔除无效信息、修正错误数据,让原始数据具备准确性、一致性与可用性。在实际 ...
2026-01-19在CDA(Certified Data Analyst)数据分析师的日常工作中,常面临“无标签高维数据难以归类、群体规律模糊”的痛点——比如海量 ...
2026-01-19在数据仓库与数据分析体系中,维度表与事实表是构建结构化数据模型的核心组件,二者如同“骨架”与“血肉”,协同支撑起各类业务 ...
2026-01-16在游戏行业“存量竞争”的当下,玩家留存率直接决定游戏的生命周期与商业价值。一款游戏即便拥有出色的画面与玩法,若无法精准识 ...
2026-01-16为配合CDA考试中心的 2025 版 CDA Level III 认证新大纲落地,CDA 网校正式推出新大纲更新后的第一套官方模拟题。该模拟题严格遵 ...
2026-01-16在数据驱动决策的时代,数据分析已成为企业运营、产品优化、业务增长的核心工具。但实际工作中,很多数据分析项目看似流程完整, ...
2026-01-15在CDA(Certified Data Analyst)数据分析师的日常工作中,“高维数据处理”是高频痛点——比如用户画像包含“浏览次数、停留时 ...
2026-01-15在教育测量与评价领域,百分制考试成绩的分布规律是评估教学效果、优化命题设计的核心依据,而正态分布则是其中最具代表性的分布 ...
2026-01-15在用户从“接触产品”到“完成核心目标”的全链路中,流失是必然存在的——电商用户可能“浏览商品却未下单”,APP新用户可能“ ...
2026-01-14在产品增长的核心指标体系中,次日留存率是当之无愧的“入门级关键指标”——它直接反映用户对产品的首次体验反馈,是判断产品是 ...
2026-01-14在CDA(Certified Data Analyst)数据分析师的业务实操中,“分类预测”是高频核心需求——比如“预测用户是否会购买商品”“判 ...
2026-01-14在数字化时代,用户的每一次操作——无论是电商平台的“浏览-加购-下单”、APP的“登录-点击-留存”,还是金融产品的“注册-实名 ...
2026-01-13在数据驱动决策的时代,“数据质量决定分析价值”已成为行业共识。数据库、日志系统、第三方平台等渠道采集的原始数据,往往存在 ...
2026-01-13在CDA(Certified Data Analyst)数据分析师的核心能力体系中,“通过数据建立模型、实现预测与归因”是进阶关键——比如“预测 ...
2026-01-13在企业数字化转型过程中,业务模型与数据模型是两大核心支撑体系:业务模型承载“业务应该如何运转”的逻辑,数据模型解决“数据 ...
2026-01-12当前手游市场进入存量竞争时代,“拉新难、留存更难”成为行业普遍痛点。对于手游产品而言,用户留存率不仅直接决定产品的生命周 ...
2026-01-12