京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据让未来生活充满无限可能,未来可能不用苦苦学外语了
初中开始接触摄影,从胶片相机玩到数码单反,今年28岁的的陈伟一直是身边朋友公认的摄影大师,“对于摄影最前沿的东西没有不知道的。”但在近日举行的生态文明贵阳国际论坛“云上贵州大数据年会高峰论坛”中,《大数据时代》的作者、英国籍著名教授维克托·舍恩伯格的一场主题演讲,让陈伟听傻眼了。
未来,按一次快门得到一张照片的传统将被颠覆,更“潮”的方式是使用一台大数据照相机,每一次拍摄都得到一张影像模糊的大数据照片,这张照片收集了镜头中所有景物的数据,后期在电脑中根据自己的需要把焦点放在不同的物体上,再任意调节每一个点的曝光,最后得到自己想要的照片。舍恩伯格说:“一次拍摄多次选择,大数据就是让生活能有更好多种选择的可能。”
听了舍恩伯格的演讲,陈伟自言自语地念叨着自己“已经不够‘潮’了”。
令陈伟吃惊的远远不止这些,大数据和语言的结合会碰撞出怎样的火花?陈伟觉得,语言是世界上最灵活的一门学科,一句话不同角度理解就有不同的意思,大数据恐怕难以和语言翻译搭上边。
中国工程院院士邬贺铨介绍说,利用积累的一些大数据资料已经可以分析出人类用不同语言想表达出的意思,“微软正在准备开发26种语言翻译的手机,将来你这边打电话讲中文,在手机上单击英文模式,海外朋友听到的就是已经翻译过的英文。”他笑道,“未来可能不用苦苦学外语了。”
大数据之所以能实现语言在线自动翻译转化,关键点在于大数据之间关联性分析。舍恩伯格表示,如果大量的数据没有分析出关联性,那所谓的大数据只能是一堆垃圾。
他举例说,一家名为Doulingo的公司开发了一个免费语言学习网站和众包文字翻译平台,收集了大量人们学习的数据,通过大数据分析发现不同语言之间思维方式的差异。这样的数据分析结果运用到翻译中就会大大提高准确性和效率。学完一定量的单词和语法知识后,DuoLingo平台会在练习中让不同的用户翻译同一个句子。平台不会直接采纳某位用户的翻译,而是比对各个用户对同一个句子的翻译相似度,将相似度都很高的句子内容综合,确定下正确的答案,除此之外,用户也对其他人的翻译进行投票,这样DuoLingo就能综合考量出最恰当的翻译。
舍恩伯格认为,大数据是解决语言障碍的优质途径,数据分析能力的提高,将给全世界带来无障碍的交流与沟通。
如果说工业革命时期电话、电灯、飞机、汽车等一系列发明将我们的生活带入“自动化”时代,那么大数据时代生活就将把我们带入“智能化”时代。
“家是一个城市的最小单元,家居智能化反映一个城市智慧的水平。”中国普天战略投融资管理部总经理陈庆方认为。家里供暖、空调、照明甚至窗帘什么时候开关、门和窗如何接入安全保护系统、不同家庭之间怎么实现可视化联络,甚至一个房间在不同的气候条件下播放什么样的音乐最合适,这一切,都可以用智能家居这套系统来解决。在陈庆方口中,这虽然是未来城市中智慧生活的样子,但这一切的功能在当下都能够实现。
“未来所有汽车都可以实现无人驾驶,只要你设定好路线就行。”舍恩伯格分享了自己对未来智慧城市的期待。他说,Google目前有一款无人驾驶的大数据汽车,可以在输入目的地之后进行自动驾驶,驾驶过程中,汽车不断收集道路的宽度、车流量、身边汽车距离、障碍物等数据,并且进行一秒钟几百万次的数据运行处理,从而选择出最优质的路线到达目的地。
“每一个人的基因信息在我们细胞里面的总和是6乘10的23次方,比现在已知世界上数据的总和还多,基因信息才是真正的大数据。”华大基因创始人汪建说,“人的生老病死都是基因决定,基因的大数据研究能为有效的疾病预防治疗提供支持。”
汪建说,当今中国每10秒钟就有一个人因为心脑血管病死亡,高学历、高工资基本上等于高血压、高血脂,通过基因数据分析减少心脑血管病发生和死亡率,可能让数字降低到每60秒钟才有一个人因此死亡。
事实上,大数据时代下的智慧医疗,正是通过大量人体数据的分析,对疾病发展趋势进行预测。
陈庆方认为,智慧医疗系统还可以为医院和养老院提供更好的解决方案。他举例说,老年人手上戴实时监测个人生命体征的腕表,这个腕表与通信系统相联络,如果老年人突发各种症状,比如走失、摔倒,可以通过腕表迅速找到老人,并连通救护机构,第一时间为周边施救者提供专业的救助信息支持。
在大数据堪比黄金的今天,英特尔中国研究院院长吴甘沙认为只有让数据流动起来,才能滋养数据社会,真正发挥作用。
吴甘沙举例说,一西方国家的安全部门有恐怖分子的名单,为了了解恐怖分子行踪,便去问航空公司要乘客登记记录,航空公司不给,因为这涉及乘客隐私问题,反过来,航空公司为了降低安全风险又去安全部门要恐怖分子的名单,安全部门认为这是国家机密拒绝提供。
双方都不愿意给出数据,但是双方都有数据需求,这事实上是一个非常经典的问题。在大数据时代的今天,吴甘沙认为政府和社会必须做到数据共享才能共赢。未来很可能会催生许多大数据交易市场,而大数据中蕴含了大量私密性、保密性信息,什么样的大数据信息可以进行买卖?需要政府和社会提前思考,同时提早研究,建立法律来进行约束。
邬贺铨说,如果政府能够适当开放所掌控的数据,全世界都会从政府开放的数据当中受益。麦肯锡公司认为这大概会给全球经济每年带来23000亿到53000亿的红利。
邬贺铨认为,最终从大数据产业中受益的还是企业和政府,而对每个人来说,进入大数据、智慧城市、物联网、移动互联网和云计算的时代,就意味着让未来生活充满无限畅想的可能。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数字化商业环境中,数据已成为企业优化运营、抢占市场、规避风险的核心资产。但商业数据分析绝非“堆砌数据、生成报表”的简单 ...
2026-01-20定量报告的核心价值是传递数据洞察,但密密麻麻的表格、复杂的计算公式、晦涩的数值罗列,往往让读者望而却步,导致核心信息被淹 ...
2026-01-20在CDA(Certified Data Analyst)数据分析师的工作场景中,“精准分类与回归预测”是高频核心需求——比如预测用户是否流失、判 ...
2026-01-20在建筑工程造价工作中,清单汇总分类是核心环节之一,尤其是针对楼梯、楼梯间这类包含多个分项工程(如混凝土浇筑、钢筋制作、扶 ...
2026-01-19数据清洗是数据分析的“前置必修课”,其核心目标是剔除无效信息、修正错误数据,让原始数据具备准确性、一致性与可用性。在实际 ...
2026-01-19在CDA(Certified Data Analyst)数据分析师的日常工作中,常面临“无标签高维数据难以归类、群体规律模糊”的痛点——比如海量 ...
2026-01-19在数据仓库与数据分析体系中,维度表与事实表是构建结构化数据模型的核心组件,二者如同“骨架”与“血肉”,协同支撑起各类业务 ...
2026-01-16在游戏行业“存量竞争”的当下,玩家留存率直接决定游戏的生命周期与商业价值。一款游戏即便拥有出色的画面与玩法,若无法精准识 ...
2026-01-16为配合CDA考试中心的 2025 版 CDA Level III 认证新大纲落地,CDA 网校正式推出新大纲更新后的第一套官方模拟题。该模拟题严格遵 ...
2026-01-16在数据驱动决策的时代,数据分析已成为企业运营、产品优化、业务增长的核心工具。但实际工作中,很多数据分析项目看似流程完整, ...
2026-01-15在CDA(Certified Data Analyst)数据分析师的日常工作中,“高维数据处理”是高频痛点——比如用户画像包含“浏览次数、停留时 ...
2026-01-15在教育测量与评价领域,百分制考试成绩的分布规律是评估教学效果、优化命题设计的核心依据,而正态分布则是其中最具代表性的分布 ...
2026-01-15在用户从“接触产品”到“完成核心目标”的全链路中,流失是必然存在的——电商用户可能“浏览商品却未下单”,APP新用户可能“ ...
2026-01-14在产品增长的核心指标体系中,次日留存率是当之无愧的“入门级关键指标”——它直接反映用户对产品的首次体验反馈,是判断产品是 ...
2026-01-14在CDA(Certified Data Analyst)数据分析师的业务实操中,“分类预测”是高频核心需求——比如“预测用户是否会购买商品”“判 ...
2026-01-14在数字化时代,用户的每一次操作——无论是电商平台的“浏览-加购-下单”、APP的“登录-点击-留存”,还是金融产品的“注册-实名 ...
2026-01-13在数据驱动决策的时代,“数据质量决定分析价值”已成为行业共识。数据库、日志系统、第三方平台等渠道采集的原始数据,往往存在 ...
2026-01-13在CDA(Certified Data Analyst)数据分析师的核心能力体系中,“通过数据建立模型、实现预测与归因”是进阶关键——比如“预测 ...
2026-01-13在企业数字化转型过程中,业务模型与数据模型是两大核心支撑体系:业务模型承载“业务应该如何运转”的逻辑,数据模型解决“数据 ...
2026-01-12当前手游市场进入存量竞争时代,“拉新难、留存更难”成为行业普遍痛点。对于手游产品而言,用户留存率不仅直接决定产品的生命周 ...
2026-01-12