京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据时代DT+成为大趋势
大数据及其本质特征
大数据是指以服务于决策为目的,需要新型数据处理模式才能对其内容进行采集、存储、管理和分析的海量、高增长率和多样化的信息资本。
大数据具有如下本质特征:一是根本目的是服务于决策,大数据能够帮助各类组织和个人大幅度提升决策能力,做出更好的决策和判断。二是量度大,大数据通常是指100T以上的数据量,这难以依靠传统的计算手段有效计算,而必须依靠新的计算手段和数据挖掘工具。三是频率高,大数据是用户参与互动而产生的数据,根据用户的网络痕迹来及时地了解用户的相关数据,这种数据是按照天甚至小时来计算的高频数据。而传统的数据频率都很低,很多数据是按照月甚至按照年份来计算的。四是速度快,大数据是实时性的数据,能够实时反应。例如,在百度搜索框输入一个关键词,能够瞬间呈现,而传统的数据收集方式则是严重滞后的。五是维度丰富多样,大数据是全样本数据、多维度数据、非结构化数据,既包括普通的结构化数据,又包括视频和音频等非结构化数据。正是因为大数据的维度多样性,其也更为复杂。六是永远在线。在线是大数据的前提条件,从这个角度来说,大数据是永远在线的,能够随时被调用的。大数据通过分析各种网络终端上的用户痕迹,能够更好地分析用户的行为、情感、思想、爱好与需求,来更好地进行决策和分析。七是本质是信息资本。大数据是能够为政府和企业带来未来经济利益的信息资源,其本质是信息资产,而且随着大数据的应用越来越广,其价值会越来越大。因此,不应该仅仅把大数据看成成本,而应把其看成和土地、资本、人才等一样的新生产要素。
政府数据公开是大数据发展的保障
大数据的重要组成部分是政府数据,因此政府数据公开的程度和广度将在很大程度上决定着大数据的发展水平。目前,美国等西方发达国家大力推进数据开放运动,在数据公开程度上居于世界前列。2011年9月20日,美国、巴西、印度尼西亚、墨西哥、挪威、菲律宾、南非、英国等八个国家(G8)联合签署了《开放数据声明》,在纽约发起“开放政府联盟”(OGP),以向本国社会开放更多的信息。2013年6月,八国集团首脑签署了《开放数据宪章》,制定开放数据行动方案,并设定了开放数据宪章的五大原则:开放数据为默认;为激励创新发布数据;为改善治理发布数据;注重数量和质量;让所有人可用。尤其需要指出的是,其中最重要的一条就是“开放为默认,不开放为特例”的原则,这就约束政府部门尽最大可能地公开所有数据,而反观我国,由于政府数据开放的程度很低,各部门基于自身的利益,基本上采取的是“开放为特例,不开放为默认”的原则,这也导致形成一个个的“信息孤岛”。
2007年,国务院通过了《中华人民共和国政府信息公开条例》,国务院办公厅印发的《2015年政府信息公开工作要点》更加明确地强调推进行政权力清单、财政资金、公共服务、国有企业、环境保护等九大领域的信息公开工作。2015年8月19日,国务院总理李克强主持召开国务院常务会议,通过《关于促进大数据发展的行动纲要》。目前,我国的政府数据开放存在着四大挑战:一是开放与安全,在实践中,很多人以数据安全为由来反对数据开放,这是一种很片面的观点;二是人才和文化,我国的数据人才在量和质上都存在重大缺陷,而且也没有形成“数据文化”;三是政策标准不统一;四是政策法规不健全。
在政府数据开放方面,我国存在三大主要问题:一是我国尚未建立起全国统一的大数据平台,导致形成一个个的信息孤岛,影响了政府数据开放的成效;二是我国的数据污染很严重,很多原始数据存在夸大或瞒报现象;三是一些地方没有把大数据当成政府公共服务的重要部分,而当成盈利的资源。
大数据蕴藏着新哲学思想和优势
首先,大数据拓展了新的哲学思想。大数据既能处理“因果关系”又能处理“相关关系”,即不仅能够回答“为什么”又能回答“是什么”。在小数据时代,只能通过抽样调查的方式来回答“为什么”。而大数据则能通过全样本的方式来回答“是什么”,即发现相关关系,这能够帮助我们更好地认识和了解世界。例如,沃尔玛发现在尿布旁边放上啤酒能够提高啤酒的销量,就把尿布和啤酒混搭销售。毫无疑问,尿布和啤酒之间并无因果关系,而二者在一起就形成很好的相关关系。
其次,大数据分析具有显著优势。一是大数据能够实现分析的高度智能化,既能实现信息收集和分析的智能化,又能实现数据与用户需求的有效匹配。二是及时、迅速。大数据分析改变之前的市场调研和数据分析相对滞后的模式和方式,能够及时、迅速地进行分析。例如,传统的市场调研一般耗时几个月,而基于互联网的大数据调研则只需要几天就能得到调研结果。三是成本相对较低。由于可以大量使用技术手段,其成本相应较低。一般来说,传统的市场调研方式,每一份问卷都需要近百元,而互联网调研一份问卷只需要4元左右。
大数据实施的三大关键点
首先,数据的可获得度。目前在国内,大数据的发展严重受制于政府信息的公开性不够,很多数据难以获得,导致难以实现真正的大数据挖掘和分析,这就要求政府及时开放更多的数据,以提高数据的可获得度。
其次,进行科学的模型建构。模型的科学性直接决定着数据分析的质量,这就要求有高超的建模水平,当然数据量越多也有助于模型的合理构建。
第三,利用专家对观点进行提炼。为决策提供依据的基于数据挖掘的独到、高质量的观点,高度依赖于高质量的数据解释,这就体现了行业专家的价值。
在大数据时代,大数据已经成为整个社会的底层架构和标配,其上的一切都必须按照大数据的要求进行重构,大数据在解决大问题方面尤为有效,目前在语音搜索、智慧城市建设、互联网金融治理等方面取得了长足的进展,未来更多的领域都必将被大数据所革命和重构。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
CDA一级知识点汇总手册 第四章 战略与业务数据分析考点43:战略数据分析基础考点44:表格结构数据的使用考点45:输入数据和资源 ...
2026-02-22CDA一级知识点汇总手册 第三章 商业数据分析框架考点27:商业数据分析体系的核心逻辑——BSC五视角框架考点28:战略视角考点29: ...
2026-02-20CDA一级知识点汇总手册 第二章 数据分析方法考点7:基础范式的核心逻辑(本体论与流程化)考点8:分类分析(本体论核心应用)考 ...
2026-02-18第一章:数据分析思维考点1:UVCA时代的特点考点2:数据分析背后的逻辑思维方法论考点3:流程化企业的数据分析需求考点4:企业数 ...
2026-02-16在数据分析、业务决策、科学研究等领域,统计模型是连接原始数据与业务价值的核心工具——它通过对数据的规律提炼、变量关联分析 ...
2026-02-14在SQL查询实操中,SELECT * 与 SELECT 字段1, 字段2,...(指定个别字段)是最常用的两种查询方式。很多开发者在日常开发中,为了 ...
2026-02-14对CDA(Certified Data Analyst)数据分析师而言,数据分析的核心不是孤立解读单个指标数值,而是构建一套科学、完整、贴合业务 ...
2026-02-14在Power BI实操中,函数是实现数据清洗、建模计算、可视化呈现的核心工具——无论是简单的数据筛选、异常值处理,还是复杂的度量 ...
2026-02-13在互联网运营、产品迭代、用户增长等工作中,“留存率”是衡量产品核心价值、用户粘性的核心指标——而次日留存率,作为留存率体 ...
2026-02-13对CDA(Certified Data Analyst)数据分析师而言,指标是贯穿工作全流程的核心载体,更是连接原始数据与业务洞察的关键桥梁。CDA ...
2026-02-13在机器学习建模实操中,“特征选择”是提升模型性能、简化模型复杂度、解读数据逻辑的核心步骤——而随机森林(Random Forest) ...
2026-02-12在MySQL数据查询实操中,按日期分组统计是高频需求——比如统计每日用户登录量、每日订单量、每日销售额,需要按日期分组展示, ...
2026-02-12对CDA(Certified Data Analyst)数据分析师而言,描述性统计是贯穿实操全流程的核心基础,更是从“原始数据”到“初步洞察”的 ...
2026-02-12备考CDA的小伙伴,专属宠粉福利来啦! 不用拼运气抽奖,不用复杂操作,只要转发CDA真题海报到朋友圈集赞,就能免费抱走实用好礼 ...
2026-02-11在数据科学、机器学习实操中,Anaconda是必备工具——它集成了Python解释器、conda包管理器,能快速搭建独立的虚拟环境,便捷安 ...
2026-02-11在Tableau数据可视化实操中,多表连接是高频操作——无论是将“产品表”与“销量表”连接分析产品销量,还是将“用户表”与“消 ...
2026-02-11在CDA(Certified Data Analyst)数据分析师的实操体系中,统计基本概念是不可或缺的核心根基,更是连接原始数据与业务洞察的关 ...
2026-02-11在数字经济飞速发展的今天,数据已成为核心生产要素,渗透到企业运营、民生服务、科技研发等各个领域。从个人手机里的浏览记录、 ...
2026-02-10在数据分析、实验研究中,我们经常会遇到小样本配对数据的差异检验场景——比如同一组受试者用药前后的指标对比、配对分组的两组 ...
2026-02-10在结构化数据分析领域,透视分析(Pivot Analysis)是CDA(Certified Data Analyst)数据分析师最常用、最高效的核心实操方法之 ...
2026-02-10