京公网安备 11010802034615号
经营许可证编号:京B2-20210330
采用大数据技术占领竞争高地
在Talend Connect大会上,一名IT业内分析专家指出,企业若不抓住大数据带来的机会,将很有可能在同行中遭到淘汰。
Jeff Kelly是Wikibon.org的首席研究员,也是SiliconANGLE的编辑。他说,诸如Hadoop和MapReduce这样的大数据技术才刚刚起步;很多人由于技术有限或观念陈旧,仍然将它们拒之门外。然而,在不久的将来,当软件使用门槛变低大量企业开始采用的时候,这些今天已经采用了大数据技术的企业将再次占领高地。到那时,他们会具备更丰富的信息来进行决策,也会比其他企业赚到更多的钱。
作为曾就职于TechTarget的记者,Kelly说:“我们已经研究大数据两三年了,得到的结论就是,大数据是目前业内赢取竞争优势最有力的武器。当我们得出这个结论时,我们意识到了它的轰动性。事实的确如此,我们实在想不出有哪一个行业不会受到大数据的影响。”
“大数据”这个词今天常在对机器生成的海量结构化与非结构化信息、社交媒体网站和移动设备的形容中用到。除此之外,它也用来形容可从信息中提取出有用商业洞察的存储、管理和分析技术。比较熟知的大数据管理技术包括:Apache Hadoop分布式文件系统、MapReduce、Hive、Pig和Mahout.
数据指向性的优势
在Talend Connect大会上大谈决策制定流程中业务数据指向性问题的不止Kelly一人,Tony
Fraser也是其中之一。Fraser是Ogilvy &
Mather(一家大型公关广告公司)旗下营销公司Neo@Ogilvy的创立人之一,也是技术合伙人。
Fraser说:“我们做的是数字广告。只要你能想到的领域,我们都有涉及。”
Fraser在发言中举出实例,说明了数据指向性决策为他们公司成功带来的帮助。其一是,巴黎酒店和拉斯维加斯赌场与Neo@Ogilvy合作,吸引更多的顾客。Neo@Ogilvy首先通过社交媒体和旅游网站针收集顾客对巴黎酒店的正面评价,发现大多数都与Bellagio酒店喷泉的景色和街道对面的赌场相关。根据这个信息,公司团队投放了一期电子广告,内容为喷泉旁的巴黎酒店。
Fraser说:“广告一投放出去,酒店的预定人数激增。”
大数据运用的障碍
Kelly称,大数据管理技术的概念早已传播到大街小巷,但为什么真正使用它的企业却很少呢?主要有两个原因。
第一,Hadoop与其他大数据软件的使用极其困难,而正确使用技能的培训尚未出台。目前,企业只有高薪聘请相关专业的博士才能对大数据方程式进行分析。
Kelly说:“一个Oracle DBA不一定具备管理、部署与监控Hadoop的技能。比如,一个分析层面的数据工程师需要编写MapReduce,而这样的工作可与SQL查询的编写完全不同。”
第二,目前大部分企业还缺少实施大数据的概念和计划。
现今的许多大型企业都已习惯于通过数据仓库与BI报表技术来获取业务信息。然而,Kelly认为,BI或数据仓库模型是通过数据分析对过去进行评估,而大数据技术是通过数据分析对未来进行预测。
他说:“对于这些企业来说,大数据运用需要一种观念上的转变;你需要信任数据并跟着它指的方向前进。大数据的意义就在于向前看、做出预测,然后行动。”
大数据管理的普及
Kelly认为,大数据管理和分析与其他新兴技术无异,最终都会普及,或者说会变得大众化。但是,这也需要一个过程。
由于大数据技术的复杂度对很多刚刚接触的企业都是不小的挑战,所以这些新的应用工具和软件技术需要被简化。Talend、Hortonworks和Cloudera等公司目前都在简化大数据技术的难度。Kelly说,大数据技术还需要很多革新,以让用户更简单地进行部署和管理、对Hadoop集群进行防护并在流程与数据源之间创建集成。
“现在你想成为一个顶级数据程序员,就必须具备编写MapReduce、SAS或其他语言程序的复杂技术。所以,我们需要研发出可以剔除部分专业性的工具;这样一来,即使你没有博士学位,也可以编写大数据程序了。”
大数据的普及少不了对用户的大量技能培训,内容包括大数据架构、Hadoop部署管理、数据集成与MapReduce的编程等。
Kelly说:“我们需要全面解决存在问题。一方面简化工具与技术;另一方面加强人员的培训,使DBA和业务分析师能够胜任‘大数据时代’的工作。”
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
【核心关键词】软件、洞察力、大数据、产品、经验、硬件、流量、创新、决策、数据安全、网络安全、数据分析、决策制定、数据挖 ...
2026-06-18在方案选型、效果复盘、产品评估、供应商筛选等各类业务决策场景中,仅凭单一指标下结论往往会陷入 “以偏概全” 的误区。多维度 ...
2026-06-18 很多数据分析师精通Excel单元格操作,但当被问到“表结构数据的基本处理单位是什么”“字段和记录的本质区别”“为什么表结 ...
2026-06-18在数据分析、用户运营与业务增长的工作体系中,漏斗拆解是最基础也最高频的问题定位方法。很多业务场景下,我们只能看到最终的转 ...
2026-06-17在数据库开发、数据清洗与报表统计场景中,数值类型转换为日期是高频刚需操作。业务系统常以 Unix 时间戳、整型日期(如20240617 ...
2026-06-17 数据分析师八成以上的时间在和数据表格打交道,但许多人拿到Excel后习惯性地先算、先分析,结果回头发现漏了一列关键数据, ...
2026-06-17【核心关键词】数据库、电商、知识、产品、数据产品、监管业务、产品经理、业务系统、用户行为分析、用户分析、数据分析、电商 ...
2026-06-16在 Python 动态类型与面向对象的编程体系中,变量定义与类实例化是构建代码逻辑的两大核心基石。变量是数据存储、传递与运算的基 ...
2026-06-16 很多数据分析师每天与Excel打交道,但当被问到“表格结构数据和表结构数据有什么区别”“数据类型误判会引发哪些分析错误” ...
2026-06-16在 MySQL 查询性能优化体系中,索引是降低查询耗时、提升数据库吞吐的核心手段。其中联合索引与覆盖索引是实际开发中最高频的两 ...
2026-06-15在数据仓库建设与商业智能分析体系中,维度建模是应用最广泛的建模方法论,而事实表与维度表是维度建模的两大核心构件,共同构成 ...
2026-06-15 很多数据分析师能熟练计算指标,但当被问到“这家企业的核心业务目标是什么”“如何把模糊的战略目标拆解为可量化的指标”“ ...
2026-06-15在数据分析、业务监控、运营复盘等场景中,列值趋势计算是核心需求之一。无论是分析销售额的月度增长、用户活跃的变化趋势、库存 ...
2026-06-12在数字经济深度渗透的当下,消费者的购买行为已从过去的 “被动接受” 转变为 “主动决策”。流量红利消退、获客成本攀升、用户 ...
2026-06-12CDA三级认证是三个级别中的塔尖,全面考察数据战略、团队领导和复杂项目的综合能力。它所对应的《敏捷数据挖掘》教材,不再局限 ...
2026-06-12在游戏产业的商业逻辑中,付费玩家是支撑游戏生存与发展的核心支柱。行业普遍遵循 “二八定律”:20% 的付费玩家贡献了游戏 80% ...
2026-06-11【核心关键词】企业、定位、传统、产品、互联网、可视化、业务侧、数字化、结构化、数据分析、传统制造业、市场状态、发展空间 ...
2026-06-11 解读《CDA二级教材:量化策略分析(2025)》的全景结构与学习逻辑 ” CDA二级认证是企业招聘数据分析师时最常提及的证书门槛 ...
2026-06-11【核心关键词】药企、可视化、营销、分类、数据分析师、销售数据、业务人员、指导方向、分析报告、营销数据、营销医生 【专访摘 ...
2026-06-10在统计学分析、问卷调研、实验验证、业务复盘等场景中,卡方检验与 T 检验是应用最广泛的两类基础假设检验方法。前者专门处理分 ...
2026-06-10