
不久前,国家统计局与11家大数据企业签署了战略合作框架协议。作为行业中的翘楚,这些企业各有各的特点。如阿里巴巴、1号店都是国内最著名的零售网购企业,五八同城是知名的求职就业平台,百度拥有最大的中文搜索引擎……战略合作协议取不同企业的共性,表达了合作的愿望和意向,明确要共同研究探讨建立大数据应用的统计标准,包括指标定义、口径、范围、分类、计算方法、代码等;共同研究确定利用企业数据完善、补充政府统计数据的内容、形式及实施步骤,包括数据采集、处理、分析、挖掘、发布等;并在各方一致同意的其他方面开展合作。
无疑,签署协议表明合作有了一个良好的实质性的开端。但是,在政府统计中应用大数据确实是一项非常复杂、难度极大的工作。特别是要把庞大、海量、类型不同、标准各异的非结构化数据转化成结构化数据,从统计制度方法到数据处理技术、以及具体的组织运作,都面临着极大的挑战。因此,需要认真梳理现有的大数据企业及数据类型,并分析其对政府统计带来的影响,由简单到复杂,分层次逐步渐进式推进。
第一个层次,相对简单、投资少见效快的项目,可以先上快上。年内早些时候,在参观百度总部的时候,有管理人员曾向我们介绍:原来如搜索北京地区天气预报,显示出的是中央气象台、北京市气象局等相关网站和一些发布天气预报的消息,需要继续点击才能查询到天气信息;而与气象部门合作,只要输入有关的关键词,数日的气象信息马上就可以显示出来,使用户能够得到更加准确、方便的服务。他们表示,与统计部门完全可以采取相同形式的合作。确实,目前搜索某些年度、季度、月度主要指标数据,可能会出现成百上千条相关信息,用户或者要从浩瀚消息中去粗取精、去伪存真,或许要登录统计部门的网站点击再点击,一步步地找到自己需要的统计信息。如果与最大的中文搜索引擎合作,查询许多统计指标就可以一次性到位。这难道不是服务型统计建设的一项切实有效的措施吗?
第二个层次,比较成熟的大数据产品,可以先拿过来。诸多大数据企业,都基于自身业务中源源不断产生的大数据,研制开发了自己的大数据产品,有些已经在业界乃至社会上产生了较大的影响力。如阿里集团旗下企业开发的淘宝价格指数(ispi)、天猫物流指数,如昆明泛亚的有色金属交易价格指数,都属于企业推出的相对成熟稳定的产品。虽然这些产品在覆盖面、代表性、稳定性等方面,与政府统计部门的同类指标数据相比还有差距,但其却在实时性、超前性方面具有优势。所以,如果能够对其计算过程作一些了解剖析,如果方法确实科学可行,能够说明一定的问题,不妨将其纳入政府统计相关数据的发布体系中来,作为政府统计的一个补充,提供社会各界的用户参考。
第三个层次,工作量大、技术难度大的工作,可以逐步稳步推进。与企业合作,在政府统计中应用大数据,最主要、最重要、也是难度最大的工作就是,如何把网上生成的海量数据作为政府统计的数据源,导入政府统计的统一数据处理平台,并进行加工处理,生成所需要的专业统计数据,如价格数据,如商品零售数据。一方面,需要从制度方法入手。选择有影响和代表性的电商,了解其产品分类及标准,深入研究与政府统计在标准、代码、口径、范围等方面的差异,探讨统一或衔接的可能性及办法;另一方面,需要从数据处理技术入手。选择在大数据处理方面技术领先的企业,提出在网上抓取、导入大数据,并与政府统计实现对接、转换,进而按政府统计的要求进行加工处理和分析的业务需求,了解技术型企业在技术处理方面的满足程度。
第四个层次,理论、科技含量高的工作,可以有选择地进行。比如与有关企业合作,通过网上数据和关键词搜索,建立经济模型,开展经济形势分析、预警预测分析,为宏观乃至微观层面的决策提供参考依据。可以结合经济社会的发展情势,有选择地确定研究题目,共同进行数据处理,并进行分析研究,推出研究成果。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
2025 年,数据如同数字时代的 DNA,编码着人类社会的未来图景,驱动着商业时代的运转。从全球互联网用户每天产生的2.5亿TB数据, ...
2025-06-052025 年,数据如同数字时代的 DNA,编码着人类社会的未来图景,驱动着商业时代的运转。从全球互联网用户每天产生的2.5亿TB数据, ...
2025-05-27CDA数据分析师证书考试体系(更新于2025年05月22日)
2025-05-26解码数据基因:从数字敏感度到逻辑思维 每当看到超市货架上商品的排列变化,你是否会联想到背后的销售数据波动?三年前在零售行 ...
2025-05-23在本文中,我们将探讨 AI 为何能够加速数据分析、如何在每个步骤中实现数据分析自动化以及使用哪些工具。 数据分析中的AI是什么 ...
2025-05-20当数据遇见人生:我的第一个分析项目 记得三年前接手第一个数据分析项目时,我面对Excel里密密麻麻的销售数据手足无措。那些跳动 ...
2025-05-20在数字化运营的时代,企业每天都在产生海量数据:用户点击行为、商品销售记录、广告投放反馈…… 这些数据就像散落的拼图,而相 ...
2025-05-19在当今数字化营销时代,小红书作为国内领先的社交电商平台,其销售数据蕴含着巨大的商业价值。通过对小红书销售数据的深入分析, ...
2025-05-16Excel作为最常用的数据分析工具,有没有什么工具可以帮助我们快速地使用excel表格,只要轻松几步甚至输入几项指令就能搞定呢? ...
2025-05-15数据,如同无形的燃料,驱动着现代社会的运转。从全球互联网用户每天产生的2.5亿TB数据,到制造业的传感器、金融交易 ...
2025-05-15大数据是什么_数据分析师培训 其实,现在的大数据指的并不仅仅是海量数据,更准确而言是对大数据分析的方法。传统的数 ...
2025-05-14CDA持证人简介: 万木,CDA L1持证人,某电商中厂BI工程师 ,5年数据经验1年BI内训师,高级数据分析师,拥有丰富的行业经验。 ...
2025-05-13CDA持证人简介: 王明月 ,CDA 数据分析师二级持证人,2年数据产品工作经验,管理学博士在读。 学习入口:https://edu.cda.cn/g ...
2025-05-12CDA持证人简介: 杨贞玺 ,CDA一级持证人,郑州大学情报学硕士研究生,某上市公司数据分析师。 学习入口:https://edu.cda.cn/g ...
2025-05-09CDA持证人简介 程靖 CDA会员大咖,畅销书《小白学产品》作者,13年顶级互联网公司产品经理相关经验,曾在百度、美团、阿里等 ...
2025-05-07相信很多做数据分析的小伙伴,都接到过一些高阶的数据分析需求,实现的过程需要用到一些数据获取,数据清洗转换,建模方法等,这 ...
2025-05-06以下的文章内容来源于刘静老师的专栏,如果您想阅读专栏《10大业务分析模型突破业务瓶颈》,点击下方链接 https://edu.cda.cn/g ...
2025-04-30CDA持证人简介: 邱立峰 CDA 数据分析师二级持证人,数字化转型专家,数据治理专家,高级数据分析师,拥有丰富的行业经验。 ...
2025-04-29CDA持证人简介: 程靖 CDA会员大咖,畅销书《小白学产品》作者,13年顶级互联网公司产品经理相关经验,曾在百度,美团,阿里等 ...
2025-04-28CDA持证人简介: 居瑜 ,CDA一级持证人国企财务经理,13年财务管理运营经验,在数据分析就业和实践经验方面有着丰富的积累和经 ...
2025-04-27