京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据产品到底应该是什么形态
大数据很时髦,但企业如何操作,如何落地,才是真正要面对的,好在现在我们看到很多朋友开始思考这样的实操性问题,本文将从大数据产品形态角度帮助我们理清一些概念。
嗨,朋友,看到这个标题请先别主观排斥,跟你一样,我也反感动辄乱谈大数据,为了后续的沟通愉快,先做下这里的“大数据“指向,特指符合4V特点的大数据,即:
1,数据体量巨大;
2,数据类型繁多;
3,价值密度低;
4,处理速度快。
所以,本文的“大数据”既不是有些人口中的海量数据,也不是非结构化数据,更不是什么相关与因果,这里不谈什么是大数据,只谈谈大数据的产品形态与商业逻辑,抛砖引玉,期待交流。
一、大数据的产品特性
顾名思义,“大数据产品”应该是基于大数据而设计出的产品,那么理应符合大数据的特点,毕竟基因在那,那么回顾下大数据与(传统)数据有哪些具体区别。
(传统)数据是通过问卷调查收集数据,或者是已存储的历史经营数据,比如财务数据、销售数据这些,至于数据量级,可能就是一台server的存储级别。
而大数据是海量,这个海量并不是某个时间断点的量级总结,而是持续有更新,持续有增量,那么就决定了可以”制造”出大数据产品的应该不是传统企业,而是类似电信、银行、微博这样的平台级机构,或者依附于平台级企业的第三方机构,亦或者是更宏观层面的政府管理机构。
这些机构拥有大量用户,可以源源不断的产生UGC数据,因此存储和计算成本必然会随之上涨,也就决定了大数据产品的甲乙方级别,屌丝可能会被无情的淘汰出局。这些数据不仅仅是数值型的结构化数据,还包括文本内容、图片、音视频等非结构化数据。
在处理速度上,(传统)数据使用excel或者spss,前期有严谨的方法论,后期有完善的分析处理过程,从数据的收集到最后报表/报告的产出,这个周期可能在至少一周以上,而大数据因为有了hadoop/storm等IT技术的支持,在处理速度上可以保证在小时级延迟,甚至更快。
这里需要补充一点的是,大数据产品是否要快速计算?个人觉得应该是,这里的快速是相对快,不一定非要实时,毕竟在收集、存储、计算上花了更多的成本,策略如果不及时发现,也对不起那些集群啊。
那么是否说大数据就一定比(传统)数据好了?不一定,引用祝建华老师《文科教授眼中的大数据》里的一段话,“理论上讲大数据指的应该就是总体数据。但实际上,由于技术、商业、保密和其它原因,除了少数大数据的原始拥有者,对于绝大多数的第三方来讲,现在大家讲的大数据,基本上都不是总体数据而是局部数据。注意,这种局部数据,哪怕占了总体的很大一个百分比(70%、80%),既不是总体数据、也不是抽样数据。因为哪怕是缺了10%、20%的个案,局部数据跟总体也许就有很大的差别。”
所以在总体代表性上,(传统)数据可以较好的代表整体,而大数据可能会出现偏差。但是,这个偏差并不影响大数据产品的商业应用,举个例子,微博上每天都有各种口碑和舆情,如果涉及某个企业的负面舆情突然趋势走高,即使在不能代表总体的情况下,你能认为这个态势不值得警惕么?当然是不能。并且,大数据产品对使用者的要求更高了,不光关注活跃的数据,还得关注沉默的数据。
由此,大数据产品所具备的特性应当是:
1、数据量级更多;
2、数据处理速度更快;
3、数据类型多样;
4、使用者要求更高。
那么,大数据产品究竟长啥样?
二、大数据的产品形态
先说一个亲身经历,在家收看好声音导师考核的汪峰场,之前一直很期待这场,毕竟汪峰的风格理念偏重社会观察,偏重人文洞察,但看到快一半的时候,却发现很乏味,想换台,没有那英那场更黏我,如果说看上一场脸部肌肉是松弛的话,那这一场则是紧绷的,”上苍、思念、回忆、故人、泪水….”当这些碎片词语不断的充斥在我的耳边时,真的不觉得这是一个娱乐节目,一个比一个悲凉,我的诉求很简单,像看周星驰无厘头电影一样,开心一下足矣,哪怕没有任何的教育意义。
随后我发了一条微博吐糟,引来众多附议。我想这应该是不少受众当时的心态,但不代表对汪峰场的整体评价。那么,试想一下,如果你是好声音的竞争对手,在此刻很实时的洞察到了用户的心情反馈,再通过合适的路径传递出营销信息,受众是否会换台?答案是未知的,但想象空间是巨大的。
这个场景很恰如其分的给我们描绘出了大数据的产品形态。首先他需要在平台级机构(微博)上监控海量数据(微博内容),这些数据是非结构化的,通过实时计算获得洞察(拥有不满情绪的是少量群体还是大量群体,是真实声音还是噪音污染),并快速应用(推送营销信息)。
这样的例子还有很多,特别是在营销环境里,受众的情绪不是线性稳定的,可能十分钟前还是心情愉悦的,而十分钟后,则是心情紧张的,不利于接受你的品牌信息并形成记忆,这些情绪的变化是随机动态的,因环境的变化而随之变化。还有哪些属于大数据产品呢,仅以我所了解的互联网领域为例,DSP、RTB、推荐系统,另外就是宏观的情报系统了,比如联合国的全球脉动项目。
三、总结
综上所述,大数据的产品形态应该是,运行在平台级机构之上,通过对持续性海量增加的多结构类型数据,进行快速计算产生策略,结合使用者的经验认知及时应用,进而产生价值形成商业闭环,一切不以此为特性的大数据产品都是耍流氓!
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在日常办公中,数据透视表是Excel、WPS等表格工具中最常用的数据分析利器——它能快速汇总繁杂数据、挖掘数据关联、生成直观报表 ...
2026-02-28有限元法(Finite Element Method, FEM)作为工程数值模拟的核心工具,已广泛应用于机械制造、航空航天、土木工程、生物医学等多 ...
2026-02-28在数字化时代,“以用户为中心”已成为企业运营的核心逻辑,而用户画像则是企业读懂用户、精准服务用户的关键载体。CDA(Certifi ...
2026-02-28在Python面向对象编程(OOP)中,类方法是构建模块化、可复用代码的核心载体,也是实现封装、继承、多态特性的关键工具。无论是 ...
2026-02-27在MySQL数据库优化中,索引是提升查询效率的核心手段—— 面对千万级、亿级数据量,合理创建索引能将查询时间从秒级压缩到毫秒级 ...
2026-02-27在数字化时代,企业积累的海量数据如同散落的珍珠,若缺乏有效的梳理与分类,终将难以发挥实际价值。CDA(Certified Data Analys ...
2026-02-27在问卷调研中,我们常遇到这样的场景:针对同一批调查对象,在不同时间点(如干预前、干预后、随访期)发放相同或相似的问卷,收 ...
2026-02-26在销售管理的实操场景中,“销售机会”是核心抓手—— 从潜在客户接触到最终成交,每一个环节都藏着业绩增长的关键,也暗藏着客 ...
2026-02-26在CDA数据分析师的日常工作中,数据提取、整理、加工是所有分析工作的起点,而“创建表”与“创建视图”,则是数据库操作中最基 ...
2026-02-26在机器学习分析、数据决策的全流程中,“数据质量决定分析价值”早已成为行业共识—— 正如我们此前在运用机器学习进行分析时强 ...
2026-02-25在数字化时代,数据已成为企业决策、行业升级的核心资产,但海量杂乱的原始数据本身不具备价值—— 只有通过科学的分析方法,挖 ...
2026-02-25在数字化时代,数据已成为企业核心资产,而“数据存储有序化、数据分析专业化、数据价值可落地”,则是企业实现数据驱动的三大核 ...
2026-02-25在数据分析、机器学习的实操场景中,聚类分析与主成分分析(PCA)是两种高频使用的统计与数据处理方法。二者常被用于数据预处理 ...
2026-02-24在聚类分析的实操场景中,K-Means算法因其简单高效、易落地的特点,成为处理无监督分类问题的首选工具——无论是用户画像分层、 ...
2026-02-24数字化浪潮下,数据已成为企业核心竞争力,“用数据说话、用数据决策”成为企业发展的核心逻辑。CDA(Certified Data Analyst) ...
2026-02-24CDA一级知识点汇总手册 第五章 业务数据的特征、处理与透视分析考点52:业务数据分析基础考点53:输入和资源需求考点54:业务数 ...
2026-02-23CDA一级知识点汇总手册 第四章 战略与业务数据分析考点43:战略数据分析基础考点44:表格结构数据的使用考点45:输入数据和资源 ...
2026-02-22CDA一级知识点汇总手册 第三章 商业数据分析框架考点27:商业数据分析体系的核心逻辑——BSC五视角框架考点28:战略视角考点29: ...
2026-02-20CDA一级知识点汇总手册 第二章 数据分析方法考点7:基础范式的核心逻辑(本体论与流程化)考点8:分类分析(本体论核心应用)考 ...
2026-02-18第一章:数据分析思维考点1:UVCA时代的特点考点2:数据分析背后的逻辑思维方法论考点3:流程化企业的数据分析需求考点4:企业数 ...
2026-02-16