京公网安备 11010802034615号
经营许可证编号:京B2-20210330
人类不知道的,远远比知道的更有意义大数据能不能预测“黑天鹅”?还是等失联的飞机找到再说吧
“黑天鹅事件”与“大数据时代”,可算是现下流行的两个高冷词汇。
其实“黑天鹅”并不是什么新词。据说,17世纪的欧洲人认为所有的天鹅都是白色的,因为他们从来没有见过其他颜色的天鹅,当然,我到现在也没见过其他颜色的天鹅。到了18世纪初,欧洲人远渡重洋来到澳洲,一上岸就惊奇地发现,居然有的天鹅是黑色的!欧洲人吓尿了,因为他们之前那么坚信自己的判断。可残酷的事实让欧洲人的信念土崩瓦解,他们跑回老家奔走相告:妈妈,原来世界上也有黑天鹅啊……史称“黑天鹅事件”。
“黑天鹅”的出现预示着,世界上永远存在不可预测的重大和罕见事件,意料之外,一旦出现却有可能改变一切。人类总是过于相信自己的经验,希望自己的判断、决定和计划能如期而至,但是现实总是让我们手足无措。无论是泰坦尼克号的沉没、第二次世界大战、9·11袭击、美国的次贷危机、互联网浪潮等等,都不是人为能够预测出来的,但这些事件的发生,对人类历史发展的进程产生了重大的影响。
甚至普通人日常生活中的选择,也存在很多黑天鹅现象。我有两个朋友,一个坚韧不拔,对公司不抛弃不放弃,十几年过去了,一路从程序员成长为技术副总裁,然后公司因为一个突如其来的财务丑闻倒闭了;另一个朋友总是在选择中跳槽,在跳槽中选择,最后在一家公司工作了两年后,公司上市了,这家伙还去纳斯达克敲了钟!大家可以感受一下,然后静下心来想一想,你所生活过的这十几年,或几十年,哪些日子是在计划中度过的?
当然,很多人会说我们现在有了大数据相关的技术,我们的信息浩如烟海,如果说过去的数据用筐装就够了,现在得用列车和舰艇运输,我们用千百万台连接到一起的计算机对这些数据进行计算、加工和统计,难道还预测不出一两只黑天鹅来吗?在自然界的物种领域,当世的科技和讯息的传播几乎已经不会再犯17世纪欧洲人的错误了。但是,“黑天鹅事件”,依然难以预测。
讲一个寓言故事吧。有一头不在风口的猪,自打出世以来就在猪圈这样一个世外桃源生活,每天会来一些站立行走的生物,时不时扔一些好吃的进来,小猪觉得日子惬意极了。它高兴了就去泥里打滚,忧伤了就趴在猪圈的护栏上看夕阳西下,春去秋来,岁月不争。经过数百天的大数据分析,小猪觉得日子会一直这样过下去,直到他从小猪长成了肥猪……在春节前的一个下午,一次血腥的杀戮改变了猪的信念:尼玛大数据都是骗人的啊……惨叫戛然而止。
无论是你的个人收入、知名度,还是你的Google 搜索量、血压、牙患、股票价格都有可能是“黑天鹅事件”,它们在过去的几百天之内只发生了微小的变化,并且具备一定的趋势,你以为事情会一直这样发展下去了,就像太阳每天从东边升起、西边坠落一样自然,但是到了1001天的时候,砰的一声,一个过去从未有过的巨大变化发生了!比如,前些天“康师傅”就被立案调查了。
人类不知道的远远比知道的更有意义。历史永远不是线性发展,每一次跳跃前行中都有“黑天鹅”的身影。这或许才是“黑天鹅”要告诉我们的真相。
那么普通人如何面对“黑天鹅现象”呢?如果我说“他强任他强,清风抚山冈;他横由他横,明月照大江”,大家会不会点赞呢?料想是不会的,所以我的看法是:
1.保持独立的人格和思考,持续提升个人能力。在改变历史进程的“黑天鹅事件”中,个人的作用可能微乎其微,但是在生活中就有用了。比如你早晨起了床,刷了牙,吃了早饭,为自己的梨形身材套上合身的西装并扎好领带,高高兴兴去上班,然后发现自己失业了。没关系,哥一身是胆满腹经纶左右手都能编程,分分钟找到下家并薪资翻倍。
2.努力让自己的生活发生正面的“黑天鹅事件”,寻找报酬具有突破性的职业和工作,工作成果不受时间限制,也不是按件记酬。比如我,现在就寄希望成为图书销售百万的技术作家神马的……
3.通过反证接近真相。当所有人都认为某件事的发生是理所当然的,不要急着附和,往其他方向看一看想一想,不是有句老话吗,我不能证明这件事是正确的,但我可以证明它是错误的。不是说不能过马路,而是说不要闭着眼睛过马路。
等等,说了半天,大数据是干吗的?就目前数据计算能力,大数据主要应用于经营决策、智能推荐、定向营销、机器学习和人工智能等方面,至于预测“黑天鹅事件”,还是等失联的飞机找到再说吧。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在神经网络模型搭建中,“最后一层是否添加激活函数”是新手常困惑的关键问题——有人照搬中间层的ReLU激活,导致回归任务输出异 ...
2025-12-05在机器学习落地过程中,“模型准确率高但不可解释”“面对数据噪声就失效”是两大核心痛点——金融风控模型若无法解释决策依据, ...
2025-12-05在CDA(Certified Data Analyst)数据分析师的能力模型中,“指标计算”是基础技能,而“指标体系搭建”则是区分新手与资深分析 ...
2025-12-05在回归分析的结果解读中,R方(决定系数)是衡量模型拟合效果的核心指标——它代表因变量的变异中能被自变量解释的比例,取值通 ...
2025-12-04在城市规划、物流配送、文旅分析等场景中,经纬度热力图是解读空间数据的核心工具——它能将零散的GPS坐标(如外卖订单地址、景 ...
2025-12-04在CDA(Certified Data Analyst)数据分析师的指标体系中,“通用指标”与“场景指标”并非相互割裂的两个部分,而是支撑业务分 ...
2025-12-04每到“双十一”,电商平台的销售额会迎来爆发式增长;每逢冬季,北方的天然气消耗量会显著上升;每月的10号左右,工资发放会带动 ...
2025-12-03随着数字化转型的深入,企业面临的数据量呈指数级增长——电商的用户行为日志、物联网的传感器数据、社交平台的图文视频等,这些 ...
2025-12-03在CDA(Certified Data Analyst)数据分析师的工作体系中,“指标”是贯穿始终的核心载体——从“销售额环比增长15%”的业务结论 ...
2025-12-03在神经网络训练中,损失函数的数值变化常被视为模型训练效果的“核心仪表盘”——初学者盯着屏幕上不断下降的损失值满心欢喜,却 ...
2025-12-02在CDA(Certified Data Analyst)数据分析师的日常工作中,“用部分数据推断整体情况”是高频需求——从10万条订单样本中判断全 ...
2025-12-02在数据预处理的纲量统一环节,标准化是消除量纲影响的核心手段——它将不同量级的特征(如“用户年龄”“消费金额”)转化为同一 ...
2025-12-02在数据驱动决策成为企业核心竞争力的今天,A/B测试已从“可选优化工具”升级为“必选验证体系”。它通过控制变量法构建“平行实 ...
2025-12-01在时间序列预测任务中,LSTM(长短期记忆网络)凭借对时序依赖关系的捕捉能力成为主流模型。但很多开发者在实操中会遇到困惑:用 ...
2025-12-01引言:数据时代的“透视镜”与“掘金者” 在数字经济浪潮下,数据已成为企业决策的核心资产,而CDA数据分析师正是挖掘数据价值的 ...
2025-12-01数据分析师的日常,常始于一堆“毫无章法”的数据点:电商后台导出的零散订单记录、APP埋点收集的无序用户行为日志、传感器实时 ...
2025-11-28在MySQL数据库运维中,“query end”是查询执行生命周期的收尾阶段,理论上耗时极短——主要完成结果集封装、资源释放、事务状态 ...
2025-11-28在CDA(Certified Data Analyst)数据分析师的工具包中,透视分析方法是处理表结构数据的“瑞士军刀”——无需复杂代码,仅通过 ...
2025-11-28在统计分析中,数据的分布形态是决定“用什么方法分析、信什么结果”的底层逻辑——它如同数据的“性格”,直接影响着描述统计的 ...
2025-11-27在电商订单查询、用户信息导出等业务场景中,技术人员常面临一个选择:是一次性查询500条数据,还是分5次每次查询100条?这个问 ...
2025-11-27