京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据要开拓的下一个疆域是个人
大数据和个人数据正汇集到一起,构筑互联网上最令人惊叹的消费者产品。它们会预测你的需要,存储你的记忆——如果你允许它们这么做的话。
你会用你的个人数据换取对未来的一瞥吗?安德烈亚斯·韦恩德(Andreas Weigend)就这么做了。
韦恩德曾是亚马逊网站的首席科学官,现任斯坦福大学社会数据实验室主管。他给我说了一个他自己的故事。某天,他在天亮时分醒来,准备去机场搭乘从上海飞来的航班。这时,他刚开始使用的应用程序Google Now告诉他,这趟航班延误了。
这个软件会在用户的Gmail邮箱、日程表,以及地图和航班时刻表之类的数据库里四下查看。它在韦恩德的出行计划中发现了这个小差错,于是提醒他不需要赶时间。韦恩德登机时,飞机上的其他人都已经在机场枯坐了好几个小时,要等飞机的一个备用部件运抵。
韦恩德提供消费者行为方面的咨询,也就这些内容授课。他语速很快。对他来说,他经历的这类小插曲显示了“一个基于10倍数据的社会所具有的能力”。他说,如果上个世纪的标志性成就是对有形物质互动的观察能力(想想X光和雷达技术),那么本世纪的标志性能力将是通过人们与他人分享的个人数据来研究他们。
像Google Now这样所谓的预期系统是未来技术的例子之一。我们已经看到了大数据给广告这类可以一次测量数百万人的行为的业务所带来的转变。现在数据科学家们正在思考大数据如何能够帮助个人。及时通知一架联航班机的飞行情况可能是比较乏味的应用之一。但是,想象一下这样的数据模式:它能告诉你该找什么工作,或者在你感觉不适之前就提醒你可能感冒了。
计算机能够获得的个人数据正在极大膨胀,推动了这样的趋势。根据咨询公司IDC的统计,全世界创造的数字数据每两年增加一倍,而其中大部分是由消费者生成的:电影下载、IP语音电话、电子邮件、手机位置显示等等。但其中仅有约0.5%的数据被分析过。
“存在着那么多数据可以拿来服务于个人的需要,而且是可负担的,”在伦敦大学学院研习社交网络的数据学家帕特里克·沃尔夫(Patrick Wolfe)说,“统计学的优势来自于把人们汇集在一起,但这之后,锦上添花的事是把你的发现个人化。”
谷歌、Facebook、LinkedIn这些硅谷的数据精炼厂把合并大数据和个人数据作为一个目标已经有些日子了。这种合并创造出广告商可以使用的工具,也创造出尤其“让人上瘾”的产品。毕竟,有什么比你自己更有趣呢?Facebook告诉你谁可能是你的朋友。你给Google Now的数据越多,它会为你服务得更好。
暴露更多个人数据似乎无可避免。韦恩德说,随着装载了加速器、摄像头和GPS的智能手机的销量大增,“人们已经获得了收集和传送个人数据的装备”。而这可能只是刚开始。已经有一小批技术爱好者发起了“自我量化”运动:在自己身上装上传感器、计步器,甚至植入葡萄糖监测器。在本期商业报告中,我们将介绍搜索引擎Wolfram Alpha的创造者斯蒂芬·沃尔弗拉姆(Stephen Wolfram)。沃尔弗拉姆参与一个大型的自我跟踪项目已有多年。他把自己的电子邮件、敲击电脑键盘,甚至身体运动的情况都记录归档。他对预测性应用程序感兴趣,称它们为“个人分析”。他认为,就像他的搜索引擎试图组织、整理全世界所有的事实,“在个人分析中,你需要做的是试着把某个人的人生方方面面的信息聚集起来。”
沃尔弗拉姆说,现有的障碍是一些最有用的数据没被捕捉到,至少不能被轻易获得。部分原因是技术上的:缺乏整合。但大量数据是由Facebook、苹果和Fitbit(一个流行的计步器的生产商)这类私人公司存储着。现在,个人数据的价值日益显见,争端正在酝酿中。加州议员们今年提出了“知情权”(Right to Kow)法案,要求公司向个人公布他们储藏的“个人信息”,也就是每次追踪方位和IP地址的数字拷贝。
这项法案是要求隐私保护和问责的社会运动的一部分。与此同时,它也对数据提供者和数据运用者之间的经济关系做出了重新安排。人们想更多地从大数据直接获益,对此业界做出了怎样的回应?
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在全球化深度发展的今天,跨文化传播已成为连接不同文明、促进多元共生的核心纽带,其研究核心围绕“信息传递、文化解读、意义建 ...
2026-04-09在数据可视化领域,折线图是展示时序数据、趋势变化的核心图表类型之一,其简洁的线条的能够清晰呈现数据的起伏规律。Python ECh ...
2026-04-09在数据驱动的时代,数据分析早已不是“凭经验、靠感觉”的零散操作,而是一套具备固定逻辑、标准化流程的系统方法——这就是数据 ...
2026-04-09长短期记忆网络(LSTM)作为循环神经网络(RNN)的重要改进模型,凭借其独特的门控机制(遗忘门、输入门、输出门),有效解决了 ...
2026-04-08在数据分析全流程中,数据质量是决定分析结论可靠性的核心前提,而异常值作为数据集中的“异类”,往往会干扰统计检验、模型训练 ...
2026-04-08在数字经济飞速发展的今天,数据已渗透到各行各业的核心场景,成为解读趋势、优化决策、创造价值的核心载体。而数据分析,作为挖 ...
2026-04-08在数据分析全流程中,数据处理是基础,图形可视化是核心呈现手段——前者负责将杂乱无章的原始数据转化为干净、规范、可分析的格 ...
2026-04-07在数据分析与统计推断中,p值是衡量假设检验结果显著性的核心指标,其本质是在原假设(通常为“无效应”“无差异”)成立的前提 ...
2026-04-07在数字经济深度渗透的今天,数据已成为企业生存发展的核心资产,企业的竞争本质已转变为数据利用能力的竞争。然而,大量来自生产 ...
2026-04-07Python凭借简洁的语法、丰富的生态库,成为算法开发、数据处理、机器学习等领域的首选语言。但受限于动态类型、解释性执行的特性 ...
2026-04-03在深度学习神经网络中,卷积操作是实现数据特征提取的核心引擎,更是让模型“看懂”数据、“解读”数据的关键所在。不同于传统机 ...
2026-04-03当数字化转型从企业的“战略口号”落地为“生存之战”,越来越多的企业意识到,转型的核心并非技术的堆砌,而是数据价值的深度挖 ...
2026-04-03在日常办公数据分析中,数据透视表凭借高效的汇总、分组功能,成为Excel、WPS等办公软件中最常用的数据分析工具之一。其中,“计 ...
2026-04-02在数字化交互的全场景中,用户的每一次操作都在生成动态的行为轨迹——电商用户的“浏览商品→点击详情→加入购物车”,内容APP ...
2026-04-02在数字化转型深度推进的今天,企业数据已成为驱动业务增长、构建核心竞争力的战略资产,而数据安全则是守护这份资产的“生命线” ...
2026-04-02在数据驱动决策的浪潮中,数据挖掘与数据分析是两个高频出现且极易被混淆的概念。有人将二者等同看待,认为“做数据分析就是做数 ...
2026-04-01在数据驱动决策的时代,企业与从业者每天都会面对海量数据——电商平台的用户行为数据、金融机构的信贷风险数据、快消品牌的营销 ...
2026-04-01在数字化转型的浪潮中,企业数据已从“辅助运营的附属资源”升级为“驱动增长的核心资产”,而一套科学、可落地的企业数据管理方 ...
2026-04-01在数字化时代,每一位用户与产品的交互都会留下可追溯的行为轨迹——电商用户的浏览、加购、下单,APP用户的注册、登录、功能使 ...
2026-03-31在日常数据统计、市场调研、学术分析等场景中,我们常常需要判断两个分类变量之间是否存在关联(如性别与消费偏好、产品类型与满 ...
2026-03-31