
“数字中国”:领跑大数据时代
按照维基百科的定义,大数据是指无法在容许的时间内用常规软件工具对其内容进行抓取、管理和处理的数据集合。
“大数据除了规模大外,还有复杂的一面。”中国工程院院士毛二可向《中国科学报》记者举了个例子:比如医生要了解某种疾病在全世界有多少例,怎么治?大数据可以告诉你在某一问题上怎么做是最科学的。
毛二可的科研工作经历了在图书馆查资料、从互联网上获取信息,再到大数据分析的阶段,他认为,大数据提供了一种比过去效率提高很多倍的方法和手段。
Hadoop创始人、大数据之父Doug Cutting曾表示,本世纪我们取得的许多进展,将会来自我们对所生成数据的更多理解。
实践证明,数据驱动的科学研究已经成为新的范式,同时我们还有数据驱动产业的创新,像滴滴打车、共享单车、微信、O2O零售等,都是大数据时代的产物。
正像中国航天系统科学与工程研究院院长薛惠锋说的,在这个时代,虚拟数字空间与现实世界平行存在、精准映射、深度交融,使一切物质皆可用数据量化,一切行为皆可用数据写真,一切关联皆可用数据表征,一切趋势皆可用数据预测。
超学科人才培养是首要问题
数据是基础性资源,也是重要生产力。复旦大学教授毛扬勇表示,全球范围内,运用大数据推动经济发展、完善社会治理、提升政府服务和监管能力正成为趋势。
18年前,习近平总书记以“战略+”的高瞻远瞩,顺应互联网发展的历史潮流,在福建率先提出了“数字福建”的构想。今天,这一伟大创新不仅在八闽大地落地生根,而且上升为重大战略,“数字中国”的建设已经成为推动经济社会发展的强大引擎。
毛扬勇认为,实施国家大数据战略,是综合国际环境、技术趋势和中国形势作出的战略决策,必须把握大数据带来的战略机会,提升政府治理能力、实现经济转型升级。
“大数据要在中国强起来,第一个解决的问题就是‘人’。”毛扬勇接受《中国科学报》采访时直言,“发展大数据需要人才,而且需要我们自己来培养。”
2013年《哈佛商业评论》提出,“数据科学家是21世纪最性感的职业。”但遗憾的是,大数据人才短缺已成为全球性的问题。2012年麦肯锡曾预测,未来6年,仅在美国本土就可能面临缺乏14万至19万具备深入分析数据能力人才的情况。
“在数据学科还不成熟的情况下,不应将数据科学作为单个学科来看待。”毛扬勇表示,事实上,数据科学的广泛交叉性,决定了其人才培养的广泛交叉性。在人才培养方面要打破原有的学科限制,数据人才所需要的知识结构是涵盖和横跨不同学科,融合多学科的研究方法,甚至取代并超越它们,是一种新的视角和一种新的学习体验,即超学科。
让“大数据”化为“大智慧”
数字空间是个开放的复杂巨系统。系统之间、层次之间、地域之间、行业之间存在复杂的数据交互和关联关系,加之“人”的因素介入,使这一系统更为复杂。“这需要钱学森的开放复杂巨系统的思想。”中国工程院院士俞梦孙说。
他认为,大数据不是单纯的技术问题,“数字中国”建设过程中,一定要遵循系统科学的思想。
我们看到,互联网与大数据已经成为一类新的战略性人造资源融入到现代农业、先进制造业和服务业的创新发展过程中,极大地促进了我国供给侧结构性改革。
对此,中国中钢股份有限公司副总经理宫敬升深有体会。“泛泛地谈大数据是不行的,一定要把大数据、新的技术与传统的产业结合起来,才能有生命力。”他接受《中国科学报》采访时坦言,“作为传统产业的企业,我们对大数据和智能化是非常渴望的,希望能够依靠大数据来焕发企业的生命力。”
当前的“大数据时代”,还处在解决简单系统的初级阶段。薛惠锋认为,加快建设“数字中国”,必须保持战略清醒,不能人云亦云、亦步亦趋,要敢于颠覆、善于跨越。真正实现物理空间向“数字中国”“信息中国”“智能中国”“智慧中国”的升华,需要具备钱学森的“深、广、久、独”,让“大数据”化为“大智慧”,朝“后数据时代”迈进。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
Excel 数据聚类分析:从操作实践到业务价值挖掘 在数据分析场景中,聚类分析作为 “无监督分组” 的核心工具,能从杂乱数据中挖 ...
2025-09-10统计模型的核心目的:从数据解读到决策支撑的价值导向 统计模型作为数据分析的核心工具,并非简单的 “公式堆砌”,而是围绕特定 ...
2025-09-10CDA 数据分析师:商业数据分析实践的落地者与价值创造者 商业数据分析的价值,最终要在 “实践” 中体现 —— 脱离业务场景的分 ...
2025-09-10机器学习解决实际问题的核心关键:从业务到落地的全流程解析 在人工智能技术落地的浪潮中,机器学习作为核心工具,已广泛应用于 ...
2025-09-09SPSS 编码状态区域中 Unicode 的功能与价值解析 在 SPSS(Statistical Product and Service Solutions,统计产品与服务解决方案 ...
2025-09-09CDA 数据分析师:驾驭商业数据分析流程的核心力量 在商业决策从 “经验驱动” 向 “数据驱动” 转型的过程中,商业数据分析总体 ...
2025-09-09R 语言:数据科学与科研领域的核心工具及优势解析 一、引言 在数据驱动决策的时代,无论是科研人员验证实验假设(如前文中的 T ...
2025-09-08T 检验在假设检验中的应用与实践 一、引言 在科研数据分析、医学实验验证、经济指标对比等领域,常常需要判断 “样本间的差异是 ...
2025-09-08在商业竞争日益激烈的当下,“用数据说话” 已从企业的 “加分项” 变为 “生存必需”。然而,零散的数据分析无法持续为业务赋能 ...
2025-09-08随机森林算法的核心特点:原理、优势与应用解析 在机器学习领域,随机森林(Random Forest)作为集成学习(Ensemble Learning) ...
2025-09-05Excel 区域名定义:从基础到进阶的高效应用指南 在 Excel 数据处理中,频繁引用单元格区域(如A2:A100、B3:D20)不仅容易出错, ...
2025-09-05CDA 数据分析师:以六大分析方法构建数据驱动业务的核心能力 在数据驱动决策成为企业共识的当下,CDA(Certified Data Analyst) ...
2025-09-05SQL 日期截取:从基础方法到业务实战的全维度解析 在数据处理与业务分析中,日期数据是连接 “业务行为” 与 “时间维度” 的核 ...
2025-09-04在卷积神经网络(CNN)的发展历程中,解决 “梯度消失”“特征复用不足”“模型参数冗余” 一直是核心命题。2017 年提出的密集连 ...
2025-09-04CDA 数据分析师:驾驭数据范式,释放数据价值 在数字化转型浪潮席卷全球的当下,数据已成为企业核心生产要素。而 CDA(Certified ...
2025-09-04K-Means 聚类:无监督学习中数据分群的核心算法 在数据分析领域,当我们面对海量无标签数据(如用户行为记录、商品属性数据、图 ...
2025-09-03特征值、特征向量与主成分:数据降维背后的线性代数逻辑 在机器学习、数据分析与信号处理领域,“降维” 是破解高维数据复杂性的 ...
2025-09-03CDA 数据分析师与数据分析:解锁数据价值的关键 在数字经济高速发展的今天,数据已成为企业核心资产与社会发展的重要驱动力。无 ...
2025-09-03解析 loss.backward ():深度学习中梯度汇总与同步的自动触发核心 在深度学习模型训练流程中,loss.backward()是连接 “前向计算 ...
2025-09-02要解答 “画 K-S 图时横轴是等距还是等频” 的问题,需先明确 K-S 图的核心用途(检验样本分布与理论分布的一致性),再结合横轴 ...
2025-09-02