
中国式大数据都是骗人的_数据分析师考试
大数据是仅次于互联网思维之外最热的词,大数据原来的意思是互联网或者移动互联网让人们收集数据变得更加方便,这种方便又可以直接转换为某种直观的相关把握,从而便于决策。
比如谷歌搜索里面趋势项目在印度应对疟疾的作用,谷歌比印度官方还更早地知道了疟疾扩散的路径和放大程度。还有一个著名的例子是百货公司的销售数据发现尿布和啤酒的相关关系,男人为自己的婴儿买尿布顺便会买几罐啤酒,那么正确的货品摆放是将尿布和啤酒放在一起,这样会提高销售额。
这些都是比较正面的例子,人们被这些例子所打动,觉得大数据真的很好很好,不需要深究因果,就可以做出正确的关联性判断,从而美化生活。
但是大数据在中国,尤其在中国最火爆的领域,比如手机、电商、娱乐等等诸多领域都变了味道,大数据变成了一种大造假,它的基本逻辑是,通过制造一个令人吃惊的数据,达到欺骗或者吆喝的目的,从而榨取整个社会残余的一点点信任。笔者觉得,中国大数据已经变成了互联网思维骗术的最核心部分。
举几个例子吧。比如一家著名的智能手机生产商,它们基本都是采取电商模式,不走任何线下渠道或者定制机,他们最常见的举动就是在双11或者自己的某某节上宣布,几秒之内就销售了多少部手机,一天之内就是百万部,它的手机永远都是秒内售磬,弄得没买到的人都不知道时间去了哪儿?
在苹果iPhone最热的时候,这家手机公司也跟苹果一样,采取粉丝大清早起来就排队的模式,弄得争议很大,因为买iPhone在美国也排队在欧洲也排队在亚洲也排队,几乎变成了一种全球化现象,大家都觉得这是真的。而这家手机商在中国玩雇佣排队,就令人感到很奇怪,所以有争议。这家不断进步的手机商也很聪明,随后将精力主要放在线上,开启了线上秒杀模型。
线上有几个特点,第一是节省店面成本;第二是收集需求,有需求才发货,这端不动那端也不动,很互联网思维。第三点没有人说,可以造交易量的假。比如发售手机100万部,预估兴奋的屌丝大约30万,那么70万部就可以自己买,通过账户打钱来买,因为买的是自己的东西,钱落入的账户也是自己的账户,在德隆时代的股票市场,这叫自买自卖自弹自唱。弄得很热火,也吸收小散进去看看。
当然,卖手机比弄股票还是厚道一些,无非是让潜在好奇的人也进去看看,觉得不错买一部,不至于套牢这么严重,况且人家手机的确很便宜。但这其中的内在道理是一样的,线上交易无论是天猫还是自己的电商平台,都是可以“造大数据”的。
业内基本都领会了这三点做法,笔者看到其他的一些国产手机商都开始学习这套模式,笔者有100%信心展望:未来各手机商宣布卖出的手机量之和肯定高于整体手机出货量,就像中国的GDP统计一样,各省统计出来的GDP之和,远远统计局做的总量抽样估计,这种宏观上的中国式统计景观,已经大面积地出现在微观企业的互联网思维中。
中国式大数据的核心关键词,除了展示自己的东西如何牛之外,主要是通过数据来影响消费者,达到数据操控和数据干扰的目的。
再简单举个例子,现在很多做电影电视或者做书的,都喜欢做一个预定的app,意思是如果观众读者先预定了电影票或者期书,那么到了真实购买阶段,是有很大的折扣的。但一般来说,他们都会将观众或者读者的数量弄得很高,制造出很红火的样子,他们的目的不是为了收集未来需求,而是要影响院线或者出版社:你看,观众和读者这么踊跃,意味着该片或者该书是非常牛的,你们院线或者出版社要拿出最好的放映资源或者出版推广资源来做——“大数据”变成了一种影响力或者操纵力。
在一些更草根的领域里面,大数据黑幕更是泛滥。现在最草根最惊愕的领域是自媒体融资领域,动不动一个小公号就宣布自己融资百万或者千万,估值上亿。当然,不否认这个世界的确存在很多傻钱,有些媒体人的资源的确还不错,融点小钱也不在话下,但是傻钱也不是你们想得那样。比如笔者亲自看到的案例是这样的:一个信息类的app项目估值,融资方的确给了点小钱,不到100万,但被吆喝成2千万,只占20%的股份,这意味着该项目估值已经达到了亿级,融资方是这么告诉该项目的创始人,100万省点花,够你们这点人干一年,你们要努力干,等未来市场更热一点,找一个更傻的人做B轮融资,就算成本价,也能算上1亿,大家都赚了。所以,现在这个估值钱可以少点,但口气绝不能小点。未来的盈利模式是有可能做大,但主要精力用于博傻。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在使用 Excel 数据透视表进行多维度数据汇总时,折叠功能是梳理数据层级的核心工具 —— 通过点击 “+/-” 符号可展开明细数据或 ...
2025-09-28在使用 Pandas 处理 CSV、TSV 等文本文件时,“引号” 是最容易引发格式混乱的 “隐形杀手”—— 比如字段中包含逗号(如 “北京 ...
2025-09-28在 CDA(Certified Data Analyst)数据分析师的技能工具箱中,数据查询语言(尤其是 SQL)是最基础、也最核心的 “武器”。无论 ...
2025-09-28Cox 模型时间依赖性检验:原理、方法与实战应用 在生存分析领域,Cox 比例风险模型(Cox Proportional Hazards Model)是分析 “ ...
2025-09-26检测因子类型的影响程度大小:评估标准、实战案例与管控策略 在检测分析领域(如环境监测、食品质量检测、工业产品合规性测试) ...
2025-09-26CDA 数据分析师:以数据库为基石,筑牢数据驱动的 “源头防线” 在数据驱动业务的链条中,“数据从哪里来” 是 CDA(Certified D ...
2025-09-26线性相关点分布的四种基本类型:特征、识别与实战应用 在数据分析与统计学中,“线性相关” 是描述两个数值变量间关联趋势的核心 ...
2025-09-25深度神经网络神经元个数确定指南:从原理到实战的科学路径 在深度神经网络(DNN)的设计中,“神经元个数” 是决定模型性能的关 ...
2025-09-25在企业数字化进程中,不少团队陷入 “指标困境”:仪表盘上堆砌着上百个指标,DAU、转化率、营收等数据实时跳动,却无法回答 “ ...
2025-09-25MySQL 服务器内存碎片:成因、检测与内存持续增长的解决策略 在 MySQL 运维中,“内存持续增长” 是常见且隐蔽的性能隐患 —— ...
2025-09-24人工智能重塑工程质量检测:核心应用、技术路径与实践案例 工程质量检测是保障建筑、市政、交通、水利等基础设施安全的 “最后一 ...
2025-09-24CDA 数据分析师:驾驭通用与场景指标,解锁数据驱动的精准路径 在数据驱动业务的实践中,指标是连接数据与决策的核心载体。但并 ...
2025-09-24在数据驱动的业务迭代中,AB 实验系统(负责验证业务优化效果)与业务系统(负责承载用户交互与核心流程)并非独立存在 —— 前 ...
2025-09-23CDA 业务数据分析:6 步闭环,让数据驱动业务落地 在企业数字化转型中,CDA(Certified Data Analyst)数据分析师的核心价值,并 ...
2025-09-23CDA 数据分析师:以指标为钥,解锁数据驱动价值 在数字化转型的浪潮中,“用数据说话” 已成为企业决策的共识。但数据本身是零散 ...
2025-09-23当 “算法” 成为数据科学、人工智能、业务决策领域的高频词时,一种隐形的认知误区正悄然蔓延 —— 有人将分析结果不佳归咎于 ...
2025-09-22在数据分析、金融计算、工程评估等领域,“平均数” 是描述数据集中趋势最常用的工具之一。但多数人提及 “平均数” 时,默认指 ...
2025-09-22CDA 数据分析师:参数估计助力数据决策的核心力量 在数字化浪潮席卷各行各业的当下,数据已成为驱动业务增长、优化运营效率的核 ...
2025-09-22训练与验证损失骤升:机器学习训练中的异常诊断与解决方案 在机器学习模型训练过程中,“损失曲线” 是反映模型学习状态的核心指 ...
2025-09-19解析 DataHub 与 Kafka:数据生态中两类核心工具的差异与协同 在数字化转型加速的今天,企业对数据的需求已从 “存储” 转向 “ ...
2025-09-19