京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据:从“技术驱动”转向“应用驱动”
继物联网、云计算之后,大数据已经成为当前信息技术产业最受关注的概念之一。大数据时代的来临,使得领域和行业边界愈加模糊,应用创新超越技术本身,生产模式向服务化转变,数据作为一种资产为企业带来新商业价值,数据开放让政府治理和个人福祉都面临着机遇和挑战……无论个人、企业组织、社会团体,还是国家和经济体,都能藉此实现大数据梦想。
当前,全球大数据产业正处于蓬勃发展的孕育期和机遇期。核心关键技术正在加快发展和更新换代,各类解决方案提供商加大力度宣传造势,尤其是围绕电信、航空、交通、生物、城市管理等重点领域描绘美好蓝图,力求推动行业应用和商业模式创新,抢占产业增长点。与此同时,小微企业和创业者对大数据热情高涨,期望借此机会实现高速成长的梦想。由于整个大数据产业开始转向应用创新阶段,高成长的预期让各方都对未来抱以乐观的态度。
从“技术驱动”转向“应用驱动”
作为一个独立的产业,大数据的产业体系框架表现为“两纵三横”:“两纵”基于技术的基础程度,分为底层技术和应用层技术,前者是共性、基础性技术,如Hadoop框架、Hbase数据库、Mahout算法集等;后者是“二次开发”行为,包括各类个性化方案、产品与服务。“三横”基于处理的流程顺序,分为基础设施、分析系统和应用工具,也可进一步细化为数据的采集、存储、处理、分析、服务五方面。目前,“两纵三横”的产业体系已经趋于成熟,能够应对绝大多数的产业应用需求。
广义的大数据应用本质上是一种“增值分析”,前景有着近似无限的可能,不受任何行业、资源、地域、用户的约束。从这个层面看,各产业领域未来发展方向几乎都能和大数据挂钩。以“十二五”国家战略性新兴产业发展规划为例,很多技术前沿的描述和布局,均与大数据相一致或关联,或是可以通过大数据实现。如新一代信息技术产业布局了物联网、移动终端设备、云计算、海量数据处理软件;节能环保产业布局了高效储能、节能监测和能源计量;生物医药产业布局了生物资源样本库、基因测序,以及基于物联网的远程健康管理服务等。
由于大数据技术兴起于互联网时代,互联网的快速发展与其持有的开放、共享、合作等观念密切相关,因而大数据技术的创新也引入了互联网的这种价值观。例如有不少大数据技术是开源的,可无偿供给全世界的开发者使用和改进。开源项目、开源社区和开放性创新联盟组织的成熟更是推动了大数据核心技术的发展,催生了多种用于存储、处理和分析大数据的新产品。这一过程有效降低了产业技术的壁垒,推动更多的企业和创业者介入,进一步加快了技术应用转化的过程,有助于产业的迅速成长。
虽然大数据产业的“技术驱动”色彩十分明显,与“应用驱动”阶段尚有一段距离,但这一转变过程正在加速进行。
细化的产业竞争策略逐步成型
大数据产业是典型的知识密集型服务业,除了基础设施环节会带来一定能耗之外,其余环节均为零能耗、高附加值。其在初始资本、法规监管等方面的准入门槛极低,但对人才资源的要求较高。为此,产业竞争呈现出数量大、水平高的特点,企业竞争策略逐步分化。
尽管大数据从业者正在急剧增加--几乎所有的信息技术企业都在此领域布局,同时创业者持续不断地进入,竞争者甚多,然而由此带来的并非过度竞争,而是良性竞争,最终将推动技术的创新和价值的实现。
这主要归功于两个原因:一是高创新的属性。大数据技术是信息技术领域中的高附加值环节,以谷歌、亚马逊等为代表的大数据企业,无论是在技术先进性、创新活跃度还是在市场份额上,都在全球处于领先位置。二是高增长的预期。作为企业个体,在产业急速成长的预期之下,基本都选择了追求专业性的策略,依靠产品性能和服务取胜,而摈弃了追求低成本的策略。
在竞争过程中,不同类型的竞争者各具优势。按照技术的变革性与应用水平,主要分化为三类竞争者:一是“互联网颠覆者”,谷歌以及各类大数据开源项目发展了全新的基础技术与数据库构架,依靠免费、开源的所谓互联网模式,彻底改变了原有的技术标准与游戏规则,颠覆了以往各自为阵的信息技术产业。
二是“初生牛犊”,在新的规则面前,大公司与创业者处在同一条起跑线上,一些拥有核心人才与市场嗅觉的创业企业,在特定工具、专业平台方面迅速抢占先机,填补市场空白,获得快速发展,在产业链中拥有了一席之地。
三是“系统集成商”,像微软、IBM这样的传统IT巨头拥有强大的资金、研发能力和市场资源。他们能够敏锐意识到自我革命的紧迫性并马上采取应对举措,积极收购大数据相关企业,将收购获得的技术产品组装为面向行业的应用解决方案,并加强大数据商业营销。
另外,政府也是大数据产业的重要一环,主要体现在政府对公共数据的开放上这将使政府在促进产业发展上扮演更加重要的角色。
2009年,刚上任的美国总统奥巴马签署的首份总统备忘录即为《透明和开放的政府》,随后建立了统一的政府数据开放门户网站:Data.Gov,逐步开放政府拥有的公共数据,并提供多种应用程序接口,供开发者创建特色应用。截至2014年初,该网站开放的数据集已经超过了85000项,汇集了1200余个应用程序和软件工具、手机插件,其中超过300个是由个人或民间组织开发。新的商业模式和企业随之产生,如FlightCaster公司基于美国交通统计局、联邦航空局交通管制中心警报、美国气象局和航班运行状况信息网站FlightStats的数据,提供航班晚点预报,比航空公司的正式通知早6个小时,且准确率达到85%-90%.
数据驱动型的商业模式创新
数据驱动型的商业模式有如雨后春笋,在全球大量涌现。按照数据的获取、管理、分析、应用环节的区分方式,可以将大数据的商业模式分为数据托管和交易平台、关系挖掘和沉淀价值利用、数据社交和跨界连接三种类型。
数据托管和交易平台模式应用已有数十年之久,是发展最为成熟、最为普遍的大数据商业模式,本质是发挥规模效应,降低单个企业在数据信息存储和寻找上的投入成本。主要业务形态有空间出租托管、数据商店、数据市场等,典型的代表企业为亚马逊、EMC2、DropBox.
近年来引入“云”的概念,从简单的数据存储,逐步扩展到数据聚合平台,最终形成云服务;而以独特数据资源进行的整合朝着纵向产业链上下游整合和横向多种产业整合两个方向发展,促使了一站式数据商店和数据交易平台的出现。如亚马逊、微软等企业均建立了可以交易应用程序和高级数据集的数据商店,目前已有数万亿个数据点、数千个订阅、数百个应用程序。
关系挖掘是媒体热炒的主流大数据商业模式,也是数据科学的主要应用模式。核心是通过数据发现隐藏的相关性,最终用于指导商业、精准化服务与辅助决策。
实现这种模式需要一些先决条件,主要是面向数据的处理分析环节:一是目标领域的完全量化,如互联网广告领域,从广告点击到用户购买行为,均有完整详实的数据记录;二是数据处理能力的大幅提升,要能够处理非关系型数据,并在海量条件下保持实时快速的性能。该模式的难点在于需要颠覆常规的用户思维和需求逻辑,典型类型是沉淀价值的利用,将一些通常无意义的数据甚至是垃圾数据进行利用,最终得出有价值的结论。
例如,谷歌公司利用数十亿用户搜索时的错误拼写记录来提升其拼写检查器的智能性。就目前而言,基于关系挖掘的大数据模式尚未成熟,但承载了社会各界的较高期望:这种模式将有助于驱动产业转型和发展新兴产业,如推动生物医药等研发密集型产业、企业咨询等知识密集型产业向数据密集型产业转型,推动零售、交通等传统服务业向现代服务业转型,推动传统制造业向智能制造业转型等。
与前两种模式不同,数据社交和跨界连接模式直接面向每一个社会个体,本质上是充分挖掘物理世界的个体资源,将其变成虚拟世界的一个节点,与其他的节点进行连接、交互和交易,从而大大降低各类商业化业务的推广成本,并形成新兴业态。这种模式正在走向成熟,最典型的代表就是O2O.
例如微信成为了连接线上线下、开展移动支付的重要入口;打车软件有效降低了供需双方的信息不对称,提升了出租车市场的智能化程度;可穿戴设备将人体的讯息进一步量化,并提供决策建议;苹果Passbook软件为用户提供了一个智能的电子卡包。推行这种模式也有几个必要条件,主要是针对数据的采集传输环节:移动化,需要带有位置服务、能够发射无线信号的智能终端;稳定连接,需要高速、泛在的外部网络环境;在线支付,依靠用户最终的支付行为实现盈利;持续感知能力,需要先进的传感器技术、低功耗芯片技术以及电池技术作为保障。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
近日,由 CDA 数据科学研究院重磅发布的《2026 全球数智化人才指数报告》,被中国教育科学研究院官方账号正式收录, ...
2026-04-22在数字化时代,客户每一次点击、浏览、下单、咨询等行为,都在传递其潜在需求与决策倾向——这些按时间顺序串联的行为轨迹,构成 ...
2026-04-22数据是数据分析、建模与业务决策的核心基石,而“数据清洗”作为数据预处理的核心环节,是打通数据从“原始杂乱”到“干净可用” ...
2026-04-22 很多数据分析师每天盯着GMV、转化率、DAU等数字看,但当被问到“什么是指标”“指标和维度有什么区别”“如何搭建一套完整的 ...
2026-04-22在数据分析与业务决策中,数据并非静止不变的数值,而是始终处于动态波动之中——股市收盘价的每日涨跌、企业月度销售额的起伏、 ...
2026-04-21在数据分析领域,当研究涉及多个自变量与多个因变量之间的复杂关联时,多变量一般线性分析(Multivariate General Linear Analys ...
2026-04-21很多数据分析师精通描述性统计,能熟练计算均值、中位数、标准差,但当被问到“用500个样本如何推断10万用户的真实满意度”“这 ...
2026-04-21在数据处理与分析的全流程中,日期数据是贯穿业务场景的核心维度之一——无论是业务报表统计、用户行为追踪,还是风控规则落地、 ...
2026-04-20在机器学习建模全流程中,特征工程是连接原始数据与模型效果的关键环节,而特征重要性分析则是特征工程的“灵魂”——它不仅能帮 ...
2026-04-20很多数据分析师沉迷于复杂的机器学习算法,却忽略了数据分析最基础也最核心的能力——描述性统计。事实上,80%的商业分析问题, ...
2026-04-20在数字化时代,数据已成为企业决策的核心驱动力,数据分析与数据挖掘作为解锁数据价值的关键手段,广泛应用于互联网、金融、医疗 ...
2026-04-17在数据处理、后端开发、报表生成与自动化脚本中,将 SQL 查询结果转换为字符串是一项高频且实用的操作。无论是拼接多行数据为逗 ...
2026-04-17面对一份上万行的销售明细表,要快速回答“哪个地区卖得最好”“哪款产品增长最快”“不同客户类型的购买力如何”——这些看似复 ...
2026-04-17数据分析师一天的工作,80% 的时间围绕表格结构数据展开。从一张销售明细表到一份完整的分析报告,表格结构数据贯穿始终。但你真 ...
2026-04-16在机器学习无监督学习领域,Kmeans聚类因其原理简洁、计算高效、可扩展性强的优势,成为数据聚类任务中的主流算法,广泛应用于用 ...
2026-04-16在机器学习建模实践中,特征工程是决定模型性能的核心环节之一。面对高维数据集,冗余特征、无关特征不仅会增加模型训练成本、延 ...
2026-04-16在数字化时代,用户是产品的核心资产,用户运营的本质的是通过科学的指标监测、分析与优化,实现“拉新、促活、留存、转化、复购 ...
2026-04-15在企业数字化转型、系统架构设计、数据治理与AI落地过程中,数据模型、本体模型、业务模型是三大核心基础模型,三者相互支撑、各 ...
2026-04-15数据分析师的一天,80%的时间花在表格数据上,但80%的坑也踩在表格数据上。 如果你分不清数值型和文本型的区别,不知道数据从哪 ...
2026-04-15在人工智能与机器学习落地过程中,模型质量直接决定了应用效果的优劣——无论是分类、回归、生成式模型,还是推荐、预测类模型, ...
2026-04-14