京公网安备 11010802034615号
经营许可证编号:京B2-20210330
伦敦德比大数据:切尔西往绩占优 降盘不降水
面对大数据的考验,传统媒体站在十字路口。一方面,新闻的内容正在发生变化,数据可以拓展新闻报道的内容,挖掘有价值的联系和规律。另一方面,新闻的呈现方式也在发生变化,可视化的程度更高。然而,利用大数据做新闻,记者还面临着一系列值得注意的问题。而我国新闻媒体运用大数据报道新闻方面尚处于初级探索阶段,需要借鉴国际同行的经验。
大数据新闻报道魅力何在?
【背景】今年春运期间,在央视综合频道《晚间新闻》栏目中,一则名为“据说春运”的专题报道引发观众好评如潮。随着HTML5的异军突起,数据新闻的表现形式越发多样化。而从2009年开始,包括英国《卫报》、财新传媒在内的国内外媒体已先后组建了数据新闻团队,可视化新闻已经从“配角”变为“主角”,从“噱头”变为“看头”。
主持人:与传统新闻相比,大数据新闻有何特色?
郭俊义:对大数据的采集和挖掘,为新闻报道开辟了一个全新的领域。从新闻报道的内容来说,传统的新闻报道是需要有记者去实地采访,形成文字稿,或者视频片,然后再经过编辑后期的加工才能出来。但是大数据新闻基本不需要用传统的采访方式,它通过跟拥有大数据源或者大数据挖掘技术的互联网公司合作,就能从中挖掘出新闻。另外从新闻报道的表现方式来看,大数据新闻是通过可视化的方式来呈现,这些可视化手段让以往单调和抽象的数据更易被受众接受。
沈浩:我们身处移动互联网时代,每个人的上网行为,比如购物、社交、看新闻、出行等数据都可以被实时抓取,这些都为大数据新闻提供了丰富的新闻素材。此外,相比于传统新闻报道,大数据新闻更加善于抓住每个个体,比如像今日头条,它能更多地为每个个体进行新闻的“私人定制”,实现点对点的传播,而不再是传统的点对面的新闻传播。
喻国明:传统的新闻报道本身有它自身的价值,它对个体的观察,对现场的描述等都是它的长处,但有限的样本调查报道会影响新闻报道的客观性。比如说一个政策公布之后,一名记者如果用传统的方式,去走访一些他认为比较有代表性的采访者,例如教师、干部、群众、工人、农民等等,把他们的意见采集到一起进行整理,并认为这样就很有代表性了,能够反映各界人士的心声。但其实这样的采访方式由于带有太多的主观因素,得出的结论很容易产生偏差。大数据新闻报道则基于对大量庞杂数据的分析,样本会更加全面,使报道结果能相对客观一些。
数据一定不会说谎吗?
【背景】在当今互联网普及的社会中,几乎每一个人都会和统计数字接触,但有时貌似精确的统计数字在被人利用后,也会成为迷惑他人的工具。美国统计学家达莱尔·哈夫的《统计数字会撒谎》一书被中国网友称作“数据打假手册”,他在书中建议,在看到统计数字后,你应当首先问自己5个问题:“谁说的”“他是如何知道的”“遗漏了什么”“是否有人偷换了概念”“这个资料有意义吗”。
主持人:相比于传统的新闻报道,大数据新闻在样本选择上要庞大得多,这是否意味着大数据新闻报道一定比传统新闻报道更加客观?
郭俊义:与传统新闻一样,大数据新闻报道同样面对新闻的真实性、规范性等新闻伦理的问题。甚至在一些大数据新闻报道中,也需要用传统的新闻报道介入以核实信息的准确性。比如我们在《据说春运》的制作过程中,有一期百度大数据显示,从成都流向北京的人流量非常大,但按常理说,过年人流都是从大城市流向中小城市的,于是我们立即请成都站的记者去实地进行采访和拍摄,结果发现车上很多都是老年人,原来他们是从成都出发去北京的孩子身边过年。
喻国明:并不是所有的数据新闻都是准确客观的。数据新闻在制作的过程中会有指标选择、样本采集、分析方法、表述方式等一系列步骤,在此过程中都会面临一些主观因素的干扰。
沈浩:在大数据研究中有一个词叫作“脏数据”。比如在社交网络上存在大量的“水军”,通过“注水”发帖来扰乱网民的真实想法。那我们在研究中如果使用了因此而得来的数据,就会造成数据分析结果的偏差。
能否成为常规报道方式?
【背景】9月5日,国务院印发《促进大数据发展行动纲要》,其中指出,到2018年底前,建成国家政府数据统一开放平台,率先在信用、交通、医疗、卫生、就业、社保、地理、文化等重要领域实现公共数据资源合理适度向社会开放。2020年底前,逐步实现信用、交通、医疗等民生保障服务相关领域的政府数据集向社会开放。
喻国明:大数据新闻报道目前还处于起步阶段,面临很多挑战。第一是大数据的来源是受限制的,一些政府的统计数据,尤其是涉及民生的,目前很多都没有开放给公众。第二是数据来源的单一性,大数据不仅仅是数据的规模大、量大,大数据信息还涉及品类的多样性,比如你要研究人的社会活动,那你不仅仅是要看他的交往数据,而且最好还能看到他的购买数据等等。可以说,全世界到目前为止,针对大数据新闻报道,并没有找到一个完整、统一的规范和彻底的解决方案。
郭俊义:大数据新闻在未来会有越来越多的用武之地,特别是在很多跟民生密切相关的领域。比如上海外滩踩踏事故中的调查报告提到,当天执勤的民警曾经用肉眼看到过人流量过于密集,后来我在想,如果我们当时能有一个人流量的数据流动图,或许以后再遇到此类状况就能避免悲剧的发生。事后我找到腾讯公司,跟他们要到了当天在外滩的人流量数据图,并且对比事故发生的前一天和后一天,做了一个GIF人流量变化的动图,对比非常明显。如果以后的媒体能更多地跟大数据公司合作,会更好地彰显新闻的服务功能。
沈浩:新学期开学我们迎来了中国传媒大学第一届数据新闻专业的学生,这些新生在未来4年除了要学习传统的新闻知识,还要学习统计、编程、数据可视化制作等针对数据新闻的专业知识。其实放眼全球,必备的统计、编程、制图技能已经成为优秀记者的“标配”,这是一个未来的发展趋势。其实我们两年前就已经在校内开设了针对大二学生的数据新闻的实验班,虽然他们明年才正式毕业,但已经被很多媒体提前预订,这证明这类人才非常有市场。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在用户从“接触产品”到“完成核心目标”的全链路中,流失是必然存在的——电商用户可能“浏览商品却未下单”,APP新用户可能“ ...
2026-01-14在产品增长的核心指标体系中,次日留存率是当之无愧的“入门级关键指标”——它直接反映用户对产品的首次体验反馈,是判断产品是 ...
2026-01-14在CDA(Certified Data Analyst)数据分析师的业务实操中,“分类预测”是高频核心需求——比如“预测用户是否会购买商品”“判 ...
2026-01-14在数字化时代,用户的每一次操作——无论是电商平台的“浏览-加购-下单”、APP的“登录-点击-留存”,还是金融产品的“注册-实名 ...
2026-01-13在数据驱动决策的时代,“数据质量决定分析价值”已成为行业共识。数据库、日志系统、第三方平台等渠道采集的原始数据,往往存在 ...
2026-01-13在CDA(Certified Data Analyst)数据分析师的核心能力体系中,“通过数据建立模型、实现预测与归因”是进阶关键——比如“预测 ...
2026-01-13在企业数字化转型过程中,业务模型与数据模型是两大核心支撑体系:业务模型承载“业务应该如何运转”的逻辑,数据模型解决“数据 ...
2026-01-12当前手游市场进入存量竞争时代,“拉新难、留存更难”成为行业普遍痛点。对于手游产品而言,用户留存率不仅直接决定产品的生命周 ...
2026-01-12在CDA(Certified Data Analyst)数据分析师的日常工作中,“挖掘变量间的关联关系”是高频核心需求——比如判断“用户停留时长 ...
2026-01-12在存量竞争时代,用户流失率直接影响企业的营收与市场竞争力。无论是电商、互联网服务还是金融行业,提前精准预测潜在流失用户, ...
2026-01-09在量化投资领域,多因子选股是主流的选股策略之一——其核心逻辑是通过挖掘影响股票未来收益的各类因子(如估值、成长、盈利、流 ...
2026-01-09在CDA(Certified Data Analyst)数据分析师的工作场景中,分类型变量的关联分析是高频需求——例如“用户性别与商品偏好是否相 ...
2026-01-09数据库中的历史数据,是企业运营过程中沉淀的核心资产——包含用户行为轨迹、业务交易记录、产品迭代日志、市场活动效果等多维度 ...
2026-01-08在电商行业竞争日趋激烈的当下,数据已成为驱动业务增长的核心引擎。电商公司的数据分析师,不仅是数据的“解读官”,更是业务的 ...
2026-01-08在数据驱动决策的链路中,统计制图是CDA(Certified Data Analyst)数据分析师将抽象数据转化为直观洞察的关键载体。不同于普通 ...
2026-01-08在主成分分析(PCA)的学习与实践中,“主成分载荷矩阵”和“成分矩阵”是两个高频出现但极易混淆的核心概念。两者均是主成分分 ...
2026-01-07在教学管理、学生成绩分析场景中,成绩分布图是直观呈现成绩分布规律的核心工具——通过图表能快速看出成绩集中区间、高分/低分 ...
2026-01-07在数据分析师的工作闭环中,数据探索与统计分析是连接原始数据与业务洞察的关键环节。CDA(Certified Data Analyst)作为具备专 ...
2026-01-07在数据处理与可视化场景中,将Python分析后的结果导出为Excel文件是高频需求。而通过设置单元格颜色,能让Excel中的数据更具层次 ...
2026-01-06在企业运营、业务监控、数据分析等场景中,指标波动是常态——无论是日营收的突然下滑、用户活跃度的骤升,还是产品故障率的异常 ...
2026-01-06