京公网安备 11010802034615号
经营许可证编号:京B2-20210330
“数字中国”:领跑大数据时代
按照维基百科的定义,大数据是指无法在容许的时间内用常规软件工具对其内容进行抓取、管理和处理的数据集合。
“大数据除了规模大外,还有复杂的一面。”中国工程院院士毛二可向《中国科学报》记者举了个例子:比如医生要了解某种疾病在全世界有多少例,怎么治?大数据可以告诉你在某一问题上怎么做是最科学的。
毛二可的科研工作经历了在图书馆查资料、从互联网上获取信息,再到大数据分析的阶段,他认为,大数据提供了一种比过去效率提高很多倍的方法和手段。
Hadoop创始人、大数据之父Doug Cutting曾表示,本世纪我们取得的许多进展,将会来自我们对所生成数据的更多理解。
实践证明,数据驱动的科学研究已经成为新的范式,同时我们还有数据驱动产业的创新,像滴滴打车、共享单车、微信、O2O零售等,都是大数据时代的产物。
正像中国航天系统科学与工程研究院院长薛惠锋说的,在这个时代,虚拟数字空间与现实世界平行存在、精准映射、深度交融,使一切物质皆可用数据量化,一切行为皆可用数据写真,一切关联皆可用数据表征,一切趋势皆可用数据预测。
超学科人才培养是首要问题
数据是基础性资源,也是重要生产力。复旦大学教授毛扬勇表示,全球范围内,运用大数据推动经济发展、完善社会治理、提升政府服务和监管能力正成为趋势。
18年前,习近平总书记以“战略+”的高瞻远瞩,顺应互联网发展的历史潮流,在福建率先提出了“数字福建”的构想。今天,这一伟大创新不仅在八闽大地落地生根,而且上升为重大战略,“数字中国”的建设已经成为推动经济社会发展的强大引擎。
毛扬勇认为,实施国家大数据战略,是综合国际环境、技术趋势和中国形势作出的战略决策,必须把握大数据带来的战略机会,提升政府治理能力、实现经济转型升级。
“大数据要在中国强起来,第一个解决的问题就是‘人’。”毛扬勇接受《中国科学报》采访时直言,“发展大数据需要人才,而且需要我们自己来培养。”
2013年《哈佛商业评论》提出,“数据科学家是21世纪最性感的职业。”但遗憾的是,大数据人才短缺已成为全球性的问题。2012年麦肯锡曾预测,未来6年,仅在美国本土就可能面临缺乏14万至19万具备深入分析数据能力人才的情况。
“在数据学科还不成熟的情况下,不应将数据科学作为单个学科来看待。”毛扬勇表示,事实上,数据科学的广泛交叉性,决定了其人才培养的广泛交叉性。在人才培养方面要打破原有的学科限制,数据人才所需要的知识结构是涵盖和横跨不同学科,融合多学科的研究方法,甚至取代并超越它们,是一种新的视角和一种新的学习体验,即超学科。
让“大数据”化为“大智慧”
数字空间是个开放的复杂巨系统。系统之间、层次之间、地域之间、行业之间存在复杂的数据交互和关联关系,加之“人”的因素介入,使这一系统更为复杂。“这需要钱学森的开放复杂巨系统的思想。”中国工程院院士俞梦孙说。
他认为,大数据不是单纯的技术问题,“数字中国”建设过程中,一定要遵循系统科学的思想。
我们看到,互联网与大数据已经成为一类新的战略性人造资源融入到现代农业、先进制造业和服务业的创新发展过程中,极大地促进了我国供给侧结构性改革。
对此,中国中钢股份有限公司副总经理宫敬升深有体会。“泛泛地谈大数据是不行的,一定要把大数据、新的技术与传统的产业结合起来,才能有生命力。”他接受《中国科学报》采访时坦言,“作为传统产业的企业,我们对大数据和智能化是非常渴望的,希望能够依靠大数据来焕发企业的生命力。”
当前的“大数据时代”,还处在解决简单系统的初级阶段。薛惠锋认为,加快建设“数字中国”,必须保持战略清醒,不能人云亦云、亦步亦趋,要敢于颠覆、善于跨越。真正实现物理空间向“数字中国”“信息中国”“智能中国”“智慧中国”的升华,需要具备钱学森的“深、广、久、独”,让“大数据”化为“大智慧”,朝“后数据时代”迈进。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在Python开发中,HTTP请求是与外部服务交互的核心场景——调用第三方API、对接微服务、爬取数据等都离不开它。虽然requests库已 ...
2025-12-12在数据驱动决策中,“数据波动大不大”是高频问题——零售店长关心日销售额是否稳定,工厂管理者关注产品尺寸偏差是否可控,基金 ...
2025-12-12在CDA(Certified Data Analyst)数据分析师的能力矩阵中,数据查询语言(SQL)是贯穿工作全流程的“核心工具”。无论是从数据库 ...
2025-12-12很多小伙伴都在问CDA考试的问题,以下是结合 2025 年最新政策与行业动态更新的 CDA 数据分析师认证考试 Q&A,覆盖考试内容、报考 ...
2025-12-11在Excel数据可视化中,柱形图因直观展示数据差异的优势被广泛使用,而背景色设置绝非简单的“换颜色”——合理的背景色能突出核 ...
2025-12-11在科研实验、商业分析或医学研究中,我们常需要判断“两组数据的差异是真实存在,还是偶然波动”——比如“新降压药的效果是否优 ...
2025-12-11在CDA(Certified Data Analyst)数据分析师的工作体系中,数据库就像“数据仓库的核心骨架”——所有业务数据的存储、组织与提 ...
2025-12-11在神经网络模型搭建中,“最后一层是否添加激活函数”是新手常困惑的关键问题——有人照搬中间层的ReLU激活,导致回归任务输出异 ...
2025-12-05在机器学习落地过程中,“模型准确率高但不可解释”“面对数据噪声就失效”是两大核心痛点——金融风控模型若无法解释决策依据, ...
2025-12-05在CDA(Certified Data Analyst)数据分析师的能力模型中,“指标计算”是基础技能,而“指标体系搭建”则是区分新手与资深分析 ...
2025-12-05在回归分析的结果解读中,R方(决定系数)是衡量模型拟合效果的核心指标——它代表因变量的变异中能被自变量解释的比例,取值通 ...
2025-12-04在城市规划、物流配送、文旅分析等场景中,经纬度热力图是解读空间数据的核心工具——它能将零散的GPS坐标(如外卖订单地址、景 ...
2025-12-04在CDA(Certified Data Analyst)数据分析师的指标体系中,“通用指标”与“场景指标”并非相互割裂的两个部分,而是支撑业务分 ...
2025-12-04每到“双十一”,电商平台的销售额会迎来爆发式增长;每逢冬季,北方的天然气消耗量会显著上升;每月的10号左右,工资发放会带动 ...
2025-12-03随着数字化转型的深入,企业面临的数据量呈指数级增长——电商的用户行为日志、物联网的传感器数据、社交平台的图文视频等,这些 ...
2025-12-03在CDA(Certified Data Analyst)数据分析师的工作体系中,“指标”是贯穿始终的核心载体——从“销售额环比增长15%”的业务结论 ...
2025-12-03在神经网络训练中,损失函数的数值变化常被视为模型训练效果的“核心仪表盘”——初学者盯着屏幕上不断下降的损失值满心欢喜,却 ...
2025-12-02在CDA(Certified Data Analyst)数据分析师的日常工作中,“用部分数据推断整体情况”是高频需求——从10万条订单样本中判断全 ...
2025-12-02在数据预处理的纲量统一环节,标准化是消除量纲影响的核心手段——它将不同量级的特征(如“用户年龄”“消费金额”)转化为同一 ...
2025-12-02在数据驱动决策成为企业核心竞争力的今天,A/B测试已从“可选优化工具”升级为“必选验证体系”。它通过控制变量法构建“平行实 ...
2025-12-01