京公网安备 11010802034615号
经营许可证编号:京B2-20210330
伦敦德比大数据:切尔西往绩占优 降盘不降水
面对大数据的考验,传统媒体站在十字路口。一方面,新闻的内容正在发生变化,数据可以拓展新闻报道的内容,挖掘有价值的联系和规律。另一方面,新闻的呈现方式也在发生变化,可视化的程度更高。然而,利用大数据做新闻,记者还面临着一系列值得注意的问题。而我国新闻媒体运用大数据报道新闻方面尚处于初级探索阶段,需要借鉴国际同行的经验。
大数据新闻报道魅力何在?
【背景】今年春运期间,在央视综合频道《晚间新闻》栏目中,一则名为“据说春运”的专题报道引发观众好评如潮。随着HTML5的异军突起,数据新闻的表现形式越发多样化。而从2009年开始,包括英国《卫报》、财新传媒在内的国内外媒体已先后组建了数据新闻团队,可视化新闻已经从“配角”变为“主角”,从“噱头”变为“看头”。
主持人:与传统新闻相比,大数据新闻有何特色?
郭俊义:对大数据的采集和挖掘,为新闻报道开辟了一个全新的领域。从新闻报道的内容来说,传统的新闻报道是需要有记者去实地采访,形成文字稿,或者视频片,然后再经过编辑后期的加工才能出来。但是大数据新闻基本不需要用传统的采访方式,它通过跟拥有大数据源或者大数据挖掘技术的互联网公司合作,就能从中挖掘出新闻。另外从新闻报道的表现方式来看,大数据新闻是通过可视化的方式来呈现,这些可视化手段让以往单调和抽象的数据更易被受众接受。
沈浩:我们身处移动互联网时代,每个人的上网行为,比如购物、社交、看新闻、出行等数据都可以被实时抓取,这些都为大数据新闻提供了丰富的新闻素材。此外,相比于传统新闻报道,大数据新闻更加善于抓住每个个体,比如像今日头条,它能更多地为每个个体进行新闻的“私人定制”,实现点对点的传播,而不再是传统的点对面的新闻传播。
喻国明:传统的新闻报道本身有它自身的价值,它对个体的观察,对现场的描述等都是它的长处,但有限的样本调查报道会影响新闻报道的客观性。比如说一个政策公布之后,一名记者如果用传统的方式,去走访一些他认为比较有代表性的采访者,例如教师、干部、群众、工人、农民等等,把他们的意见采集到一起进行整理,并认为这样就很有代表性了,能够反映各界人士的心声。但其实这样的采访方式由于带有太多的主观因素,得出的结论很容易产生偏差。大数据新闻报道则基于对大量庞杂数据的分析,样本会更加全面,使报道结果能相对客观一些。
数据一定不会说谎吗?
【背景】在当今互联网普及的社会中,几乎每一个人都会和统计数字接触,但有时貌似精确的统计数字在被人利用后,也会成为迷惑他人的工具。美国统计学家达莱尔·哈夫的《统计数字会撒谎》一书被中国网友称作“数据打假手册”,他在书中建议,在看到统计数字后,你应当首先问自己5个问题:“谁说的”“他是如何知道的”“遗漏了什么”“是否有人偷换了概念”“这个资料有意义吗”。
主持人:相比于传统的新闻报道,大数据新闻在样本选择上要庞大得多,这是否意味着大数据新闻报道一定比传统新闻报道更加客观?
郭俊义:与传统新闻一样,大数据新闻报道同样面对新闻的真实性、规范性等新闻伦理的问题。甚至在一些大数据新闻报道中,也需要用传统的新闻报道介入以核实信息的准确性。比如我们在《据说春运》的制作过程中,有一期百度大数据显示,从成都流向北京的人流量非常大,但按常理说,过年人流都是从大城市流向中小城市的,于是我们立即请成都站的记者去实地进行采访和拍摄,结果发现车上很多都是老年人,原来他们是从成都出发去北京的孩子身边过年。
喻国明:并不是所有的数据新闻都是准确客观的。数据新闻在制作的过程中会有指标选择、样本采集、分析方法、表述方式等一系列步骤,在此过程中都会面临一些主观因素的干扰。
沈浩:在大数据研究中有一个词叫作“脏数据”。比如在社交网络上存在大量的“水军”,通过“注水”发帖来扰乱网民的真实想法。那我们在研究中如果使用了因此而得来的数据,就会造成数据分析结果的偏差。
能否成为常规报道方式?
【背景】9月5日,国务院印发《促进大数据发展行动纲要》,其中指出,到2018年底前,建成国家政府数据统一开放平台,率先在信用、交通、医疗、卫生、就业、社保、地理、文化等重要领域实现公共数据资源合理适度向社会开放。2020年底前,逐步实现信用、交通、医疗等民生保障服务相关领域的政府数据集向社会开放。
喻国明:大数据新闻报道目前还处于起步阶段,面临很多挑战。第一是大数据的来源是受限制的,一些政府的统计数据,尤其是涉及民生的,目前很多都没有开放给公众。第二是数据来源的单一性,大数据不仅仅是数据的规模大、量大,大数据信息还涉及品类的多样性,比如你要研究人的社会活动,那你不仅仅是要看他的交往数据,而且最好还能看到他的购买数据等等。可以说,全世界到目前为止,针对大数据新闻报道,并没有找到一个完整、统一的规范和彻底的解决方案。
郭俊义:大数据新闻在未来会有越来越多的用武之地,特别是在很多跟民生密切相关的领域。比如上海外滩踩踏事故中的调查报告提到,当天执勤的民警曾经用肉眼看到过人流量过于密集,后来我在想,如果我们当时能有一个人流量的数据流动图,或许以后再遇到此类状况就能避免悲剧的发生。事后我找到腾讯公司,跟他们要到了当天在外滩的人流量数据图,并且对比事故发生的前一天和后一天,做了一个GIF人流量变化的动图,对比非常明显。如果以后的媒体能更多地跟大数据公司合作,会更好地彰显新闻的服务功能。
沈浩:新学期开学我们迎来了中国传媒大学第一届数据新闻专业的学生,这些新生在未来4年除了要学习传统的新闻知识,还要学习统计、编程、数据可视化制作等针对数据新闻的专业知识。其实放眼全球,必备的统计、编程、制图技能已经成为优秀记者的“标配”,这是一个未来的发展趋势。其实我们两年前就已经在校内开设了针对大二学生的数据新闻的实验班,虽然他们明年才正式毕业,但已经被很多媒体提前预订,这证明这类人才非常有市场。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在日常办公中,数据透视表是Excel、WPS等表格工具中最常用的数据分析利器——它能快速汇总繁杂数据、挖掘数据关联、生成直观报表 ...
2026-02-28有限元法(Finite Element Method, FEM)作为工程数值模拟的核心工具,已广泛应用于机械制造、航空航天、土木工程、生物医学等多 ...
2026-02-28在数字化时代,“以用户为中心”已成为企业运营的核心逻辑,而用户画像则是企业读懂用户、精准服务用户的关键载体。CDA(Certifi ...
2026-02-28在Python面向对象编程(OOP)中,类方法是构建模块化、可复用代码的核心载体,也是实现封装、继承、多态特性的关键工具。无论是 ...
2026-02-27在MySQL数据库优化中,索引是提升查询效率的核心手段—— 面对千万级、亿级数据量,合理创建索引能将查询时间从秒级压缩到毫秒级 ...
2026-02-27在数字化时代,企业积累的海量数据如同散落的珍珠,若缺乏有效的梳理与分类,终将难以发挥实际价值。CDA(Certified Data Analys ...
2026-02-27在问卷调研中,我们常遇到这样的场景:针对同一批调查对象,在不同时间点(如干预前、干预后、随访期)发放相同或相似的问卷,收 ...
2026-02-26在销售管理的实操场景中,“销售机会”是核心抓手—— 从潜在客户接触到最终成交,每一个环节都藏着业绩增长的关键,也暗藏着客 ...
2026-02-26在CDA数据分析师的日常工作中,数据提取、整理、加工是所有分析工作的起点,而“创建表”与“创建视图”,则是数据库操作中最基 ...
2026-02-26在机器学习分析、数据决策的全流程中,“数据质量决定分析价值”早已成为行业共识—— 正如我们此前在运用机器学习进行分析时强 ...
2026-02-25在数字化时代,数据已成为企业决策、行业升级的核心资产,但海量杂乱的原始数据本身不具备价值—— 只有通过科学的分析方法,挖 ...
2026-02-25在数字化时代,数据已成为企业核心资产,而“数据存储有序化、数据分析专业化、数据价值可落地”,则是企业实现数据驱动的三大核 ...
2026-02-25在数据分析、机器学习的实操场景中,聚类分析与主成分分析(PCA)是两种高频使用的统计与数据处理方法。二者常被用于数据预处理 ...
2026-02-24在聚类分析的实操场景中,K-Means算法因其简单高效、易落地的特点,成为处理无监督分类问题的首选工具——无论是用户画像分层、 ...
2026-02-24数字化浪潮下,数据已成为企业核心竞争力,“用数据说话、用数据决策”成为企业发展的核心逻辑。CDA(Certified Data Analyst) ...
2026-02-24CDA一级知识点汇总手册 第五章 业务数据的特征、处理与透视分析考点52:业务数据分析基础考点53:输入和资源需求考点54:业务数 ...
2026-02-23CDA一级知识点汇总手册 第四章 战略与业务数据分析考点43:战略数据分析基础考点44:表格结构数据的使用考点45:输入数据和资源 ...
2026-02-22CDA一级知识点汇总手册 第三章 商业数据分析框架考点27:商业数据分析体系的核心逻辑——BSC五视角框架考点28:战略视角考点29: ...
2026-02-20CDA一级知识点汇总手册 第二章 数据分析方法考点7:基础范式的核心逻辑(本体论与流程化)考点8:分类分析(本体论核心应用)考 ...
2026-02-18第一章:数据分析思维考点1:UVCA时代的特点考点2:数据分析背后的逻辑思维方法论考点3:流程化企业的数据分析需求考点4:企业数 ...
2026-02-16