京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据时代需注重数据管控
新世纪以来,信息和数据呈爆炸性增长态势,世界进入大数据时代。按信息单位计算,现在全世界每天发送的数据量达40亿个或更多,我们的数字世界已拥有超过1.8万亿吉比特的数据,并且仍将以每年40%以上的速度增长。大数据正在通过各种方式对人类经济社会发展的各个领域产生重要影响。
随着数据量的高速增长,数据的内在价值日益受到关注。数据量激增已经给各行各业带来深刻影响,以数据为研究基础的社会科学也不例外。目前,虽然文献的知识本质并没有随时代的变化而变化,但其符号、载体和记录复制方式正在发生翻天覆地变化;电子形式或网络空间中的文献正在向综合化方向发展,数字化、多媒体、可视化等正在成为文献记录、保存和传播的发展方向。面对这种形势,社会科学的研究方法、研究内容和学科疆界也在发生变化。在这一进程中, 我们面临的一个突出问题就是数据和信息的质量及其管理。虽然大数据无处不在,但社会科学研究者能够利用的毕竟只是其中极小一部分。一方面是数据和信息资源的数量无限增长,另一方面是人类对这些海量数据和信息资源的认知与利用能力还远远跟不上;一方面是有用资源具有明显稀缺性,另一方面又存在大量低质量的冗余信息。在海量数据和信息面前,如果没有数据管控,没有数据和知识挖掘、发现、组织、导航、表达的科学化管理过程,科研人员就有可能迷失在数据和信息的汪洋大海中。
当前,数据管控已成为学术研究尤其是社会科学研究中一个极为重要的问题。只有通过数据管控,加强对数据特别是分布式数据的观察和管理,充分利用网格计算等信息技术来搜集、加工、整合、共享及传播相关数据,才能达到数据和知识利用的精准化、科学化和最大化。比如,知识发现软件工具可以帮助社会科学研究者从结构化数据或非结构化的复杂数据中提取有用和便于理解的知识。文献信息服务的实践表明,包括图书馆在内的文献信息服务机构,由于掌握着大量科研数据,正是对科研数据实施动态管控的最佳信息组织。通过数据管控,可以为科研人员提供超越时空的图书馆泛化服务,即移动性的数据、信息和知识获取场所,零时差的获取时间,多样化的获取工具。
在大数据时代,鉴于离散型的文献和文献检索方法已无法满足社会科学研究者对专题性、指向性强的学术文献的需求,文献信息服务机构应推进集成式检索,优化数据挖掘技术、知识发现技术,提供定制化、个性化、知识化服务。尤其是建立面向科技创新基地、科研院所、课题组乃至个人的学科化服务机制,进一步拓宽文献信息服务范围,提升服务层次,加快学术交流和信息、知识的传播速度,提高文献信息资源的利用率和共享率,使文献信息服务机构的服务更直接、更有针对性,更好地服务于创新研究。
目前,我们对大数据的探索只是刚刚开始,科学认识和把握大数据与经济社会发展的内在关系、与信息和知识管理的内在关系,可能是包括文献信息工作者在内的整个学术界在今后相当长一段时间的重要课题。因此,文献信息工作者不能停留在低层次、低水平重复的传统内容生产模式上,而应适应大数据时代的新形势,推进知识生产过程的有序化、结构化。
人类正处在一个强调知识和信息的时代。培根曾提出“知识就是力量”,后来学术界又提出“信息就是力量”。现在,又有学者提出“共享知识就是力量”,强调把信息管理、信息共享提升到知识管理和知识共享的阶段。利用互联网来构建知识社会,在网络环境下实现知识交流与共享,这体现了时代的进步,有着丰富的时代内涵。在大数据时代,我们应做好数据管控,把“共享知识就是力量”的理念贯彻到知识服务实践中。
CDA学员免费下载查看报告全文:2026全球数智化人才指数报告【CDA数据科学研究院】.pdf
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在大数据技术飞速迭代、数字营销竞争日趋激烈的今天,“精准触达、高效转化、成本可控”已成为企业营销的核心诉求。传统广告投放 ...
2026-04-24在游戏行业竞争白热化的当下,用户流失已成为制约游戏生命周期、影响营收增长的核心痛点。据行业报告显示,2024年移动游戏平均次 ...
2026-04-24 很多业务负责人开会常说“我们要数据驱动”,最后却变成“看哪张报表数据多就用哪个”,往往因为缺乏一套结构性的方法去搭建 ...
2026-04-24在Power BI数据可视化分析中,切片器是连接用户与数据的核心交互工具,其核心价值在于帮助使用者快速筛选目标数据、聚焦分析重点 ...
2026-04-23以数为据,以析促优——数据分析结果指导临床技术改进的实践路径 临床技术是医疗服务的核心载体,其水平直接决定患者诊疗效果、 ...
2026-04-23很多数据分析师每天盯着GMV、DAU、转化率,但当被问到“哪些指标是所有企业都需要的”“哪些指标是因行业而异的”“北极星指标和 ...
2026-04-23近日,由 CDA 数据科学研究院重磅发布的《2026 全球数智化人才指数报告》,被中国教育科学研究院官方账号正式收录, ...
2026-04-22在数字化时代,客户每一次点击、浏览、下单、咨询等行为,都在传递其潜在需求与决策倾向——这些按时间顺序串联的行为轨迹,构成 ...
2026-04-22数据是数据分析、建模与业务决策的核心基石,而“数据清洗”作为数据预处理的核心环节,是打通数据从“原始杂乱”到“干净可用” ...
2026-04-22 很多数据分析师每天盯着GMV、转化率、DAU等数字看,但当被问到“什么是指标”“指标和维度有什么区别”“如何搭建一套完整的 ...
2026-04-22在数据分析与业务决策中,数据并非静止不变的数值,而是始终处于动态波动之中——股市收盘价的每日涨跌、企业月度销售额的起伏、 ...
2026-04-21在数据分析领域,当研究涉及多个自变量与多个因变量之间的复杂关联时,多变量一般线性分析(Multivariate General Linear Analys ...
2026-04-21很多数据分析师精通描述性统计,能熟练计算均值、中位数、标准差,但当被问到“用500个样本如何推断10万用户的真实满意度”“这 ...
2026-04-21在数据处理与分析的全流程中,日期数据是贯穿业务场景的核心维度之一——无论是业务报表统计、用户行为追踪,还是风控规则落地、 ...
2026-04-20在机器学习建模全流程中,特征工程是连接原始数据与模型效果的关键环节,而特征重要性分析则是特征工程的“灵魂”——它不仅能帮 ...
2026-04-20很多数据分析师沉迷于复杂的机器学习算法,却忽略了数据分析最基础也最核心的能力——描述性统计。事实上,80%的商业分析问题, ...
2026-04-20在数字化时代,数据已成为企业决策的核心驱动力,数据分析与数据挖掘作为解锁数据价值的关键手段,广泛应用于互联网、金融、医疗 ...
2026-04-17在数据处理、后端开发、报表生成与自动化脚本中,将 SQL 查询结果转换为字符串是一项高频且实用的操作。无论是拼接多行数据为逗 ...
2026-04-17面对一份上万行的销售明细表,要快速回答“哪个地区卖得最好”“哪款产品增长最快”“不同客户类型的购买力如何”——这些看似复 ...
2026-04-17数据分析师一天的工作,80% 的时间围绕表格结构数据展开。从一张销售明细表到一份完整的分析报告,表格结构数据贯穿始终。但你真 ...
2026-04-16