京公网安备 11010802034615号
经营许可证编号:京B2-20210330
为何要从数据管理,进化到大数据治理_数据分析师
最近参加了“中国优秀首席信息官(CIO)评选”的颁奖大会,现场很多人都在谈大数据,其中有传统行业、有银行、也有医院。我注意到大部分演讲嘉宾均集中讨论如何应用大数据,或是如何用数据进行创新。
但跟以往的很多会议一样,我很少听到数据作为原材料应该怎么管理。
你可能会说,银行业、通讯业等不是早就在做数据管理了吗?
的确,数据管理(data management)并非新鲜,20年前就有人在做了。但在数据呈指数级增长之下,我们现在讲的数据已跟以往不一样。不仅是数据的大小,而且包括数据的内容、来源、结构等都很不一样。
以往我们可能根本不敢想象,Facebook的日均新增数据量已达到600T。与此同时,无数以往不可能出现的算法和应用也随之呈爆炸式增长。
数据在创新;算法在创新;应用也在创新。我们不禁会问,以往的数据管理思路,能适应新形势的要求吗?
自上而下管理费时失事
在一些传统银行,若你需要看某个数据,就必须拿着申请单找一堆人签字,最后,从一个类似医院取药的视窗中,将按照流程签满字的纸递给数据管理员。
而这个管理员会告诉你,你要等几个小时才可拿到数据。
因他要从一大堆备份中,找出你要的数据,加载完后才能给你。这就是传统的数据管理方式:严格按照自上而下的流程进行,甚至要做到滴水不漏。
后来,这个银行发生了一个对他们来说具有时代意义的改变——那个帮你找数据的管理员,变成了机器人。虽然机器人的效率大大提升了,但数据管理的本质却没有变化。
在大数据时代,数据将会促成新技术的发展,以及更多新数据的产生。
开放的网络环境、频繁的数据更新、丰富的数据种类,加上数据保护的需求激增、数据生态圈的物种增多、流动性加快……这些复杂多变又未知的环境,对于中央式管理是极大的挑战。
试想,若还是按照以往的方式,会出现怎样的情形?
也许,数据的审批人会比数据的使用者还多;也许,数据的创新会停滞不前;也许,数据的应用价值会比现在晚几年才被发现……
数据治理须人人参与
因此,我们必须意识到,数据治理不等同于数据管理,绝非依靠自上而下的贯彻执行便可解决。
相反,数据治理需要每个人的参与和协同,要求每个人都有意识去治理好数据。而且数据治理本身也可以变成应用和创新,成为更多应用和创新的“水、电、煤”。
在数据产生价值之前,不管看数据还是直接应用数据,首先都要注意:数据有没有?数据准不准?粒度细不细?是否稳定的?
若行政总裁每天看的数据都是错误的,或者不是稳定产出的,那么企业依赖数据的决策将付出极高代价。
所以企业若不做数据治理,或者还是按照以往的思维来管理数据,那么,日后对数据的依赖愈深,便可能愈快出问题。
数据治理的新思路,不仅是指组织结构上要从由上而下变成全体协同,而且要在技术上创新,提供更智能的治理工具,帮助大家提高数据质量、保护数据安全及有效控制数据成本。
最后我想说,大数据时代的数据治理,一定是将有形的管理策略化成无形的智能产品,从一纸命令变成根植在每个人脑中的信念和下意识的习惯。我们要用大数据的思维方式,用数据来治理数据。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数字化时代,每一位用户与产品的交互都会留下可追溯的行为轨迹——电商用户的浏览、加购、下单,APP用户的注册、登录、功能使 ...
2026-03-31在日常数据统计、市场调研、学术分析等场景中,我们常常需要判断两个分类变量之间是否存在关联(如性别与消费偏好、产品类型与满 ...
2026-03-31在CDA(Certified Data Analyst)数据分析师的职场实战与认证考核中,“可解释性建模”是核心需求之一——企业决策中,不仅需要 ...
2026-03-31多层感知机(MLP,Multilayer Perceptron)作为深度学习中最基础、最经典的神经网络模型,其结构设计直接决定了模型的拟合能力、 ...
2026-03-30在TensorFlow深度学习实战中,数据集的加载与预处理是基础且关键的第一步。手动下载、解压、解析数据集不仅耗时费力,还容易出现 ...
2026-03-30在CDA(Certified Data Analyst)数据分析师的日常工作中,“无监督分组、挖掘数据内在聚类规律”是高频核心需求——电商场景中 ...
2026-03-30机器学习的本质,是让模型通过对数据的学习,自主挖掘规律、实现预测与决策,而这一过程的核心驱动力,并非单一参数的独立作用, ...
2026-03-27在SQL Server数据库操作中,日期时间处理是高频核心需求——无论是报表统计中的日期格式化、数据筛选时的日期类型匹配,还是业务 ...
2026-03-27在CDA(Certified Data Analyst)数据分析师的能力体系与职场实操中,高维数据处理是高频且核心的痛点——随着业务场景的复杂化 ...
2026-03-27在机器学习建模与数据分析实战中,特征维度爆炸、冗余信息干扰、模型泛化能力差是高频痛点。面对用户画像、企业经营、医疗检测、 ...
2026-03-26在这个数据无处不在的时代,数据分析能力已不再是数据从业者的专属技能,而是成为了职场人、管理者、创业者乃至个人发展的核心竞 ...
2026-03-26在CDA(Certified Data Analyst)数据分析师的能力体系中,线性回归是连接描述性统计与预测性分析的关键桥梁,也是CDA二级认证的 ...
2026-03-26在数据分析、市场研究、用户画像构建、学术研究等场景中,我们常常会遇到多维度、多指标的数据难题:比如调研用户消费行为时,收 ...
2026-03-25在流量红利见顶、获客成本持续攀升的当下,营销正从“广撒网”的经验主义,转向“精耕细作”的数据驱动主义。数据不再是营销的辅 ...
2026-03-25在CDA(Certified Data Analyst)数据分析师的全流程工作中,无论是前期的数据探索、影响因素排查,还是中期的特征筛选、模型搭 ...
2026-03-25在当下数据驱动决策的职场环境中,A/B测试早已成为互联网产品、运营、营销乃至产品迭代优化的核心手段,小到一个按钮的颜色、文 ...
2026-03-24在统计学数据分析中,尤其是分类数据的分析场景里,卡方检验和显著性检验是两个高频出现的概念,很多初学者甚至有一定统计基础的 ...
2026-03-24在CDA(Certified Data Analyst)数据分析师的日常业务分析与统计建模工作中,多组数据差异对比是高频且核心的分析场景。比如验 ...
2026-03-24日常用Excel做数据管理、台账维护、报表整理时,添加备注列是高频操作——用来标注异常、说明业务背景、记录处理进度、补充关键 ...
2026-03-23作为业内主流的自助式数据可视化工具,Tableau凭借拖拽式操作、强大的数据联动能力、灵活的仪表板搭建,成为数据分析师、业务人 ...
2026-03-23