京公网安备 11010802034615号
经营许可证编号:京B2-20210330
伦敦德比大数据:切尔西往绩占优 降盘不降水
面对大数据的考验,传统媒体站在十字路口。一方面,新闻的内容正在发生变化,数据可以拓展新闻报道的内容,挖掘有价值的联系和规律。另一方面,新闻的呈现方式也在发生变化,可视化的程度更高。然而,利用大数据做新闻,记者还面临着一系列值得注意的问题。而我国新闻媒体运用大数据报道新闻方面尚处于初级探索阶段,需要借鉴国际同行的经验。
大数据新闻报道魅力何在?
【背景】今年春运期间,在央视综合频道《晚间新闻》栏目中,一则名为“据说春运”的专题报道引发观众好评如潮。随着HTML5的异军突起,数据新闻的表现形式越发多样化。而从2009年开始,包括英国《卫报》、财新传媒在内的国内外媒体已先后组建了数据新闻团队,可视化新闻已经从“配角”变为“主角”,从“噱头”变为“看头”。
主持人:与传统新闻相比,大数据新闻有何特色?
郭俊义:对大数据的采集和挖掘,为新闻报道开辟了一个全新的领域。从新闻报道的内容来说,传统的新闻报道是需要有记者去实地采访,形成文字稿,或者视频片,然后再经过编辑后期的加工才能出来。但是大数据新闻基本不需要用传统的采访方式,它通过跟拥有大数据源或者大数据挖掘技术的互联网公司合作,就能从中挖掘出新闻。另外从新闻报道的表现方式来看,大数据新闻是通过可视化的方式来呈现,这些可视化手段让以往单调和抽象的数据更易被受众接受。
沈浩:我们身处移动互联网时代,每个人的上网行为,比如购物、社交、看新闻、出行等数据都可以被实时抓取,这些都为大数据新闻提供了丰富的新闻素材。此外,相比于传统新闻报道,大数据新闻更加善于抓住每个个体,比如像今日头条,它能更多地为每个个体进行新闻的“私人定制”,实现点对点的传播,而不再是传统的点对面的新闻传播。
喻国明:传统的新闻报道本身有它自身的价值,它对个体的观察,对现场的描述等都是它的长处,但有限的样本调查报道会影响新闻报道的客观性。比如说一个政策公布之后,一名记者如果用传统的方式,去走访一些他认为比较有代表性的采访者,例如教师、干部、群众、工人、农民等等,把他们的意见采集到一起进行整理,并认为这样就很有代表性了,能够反映各界人士的心声。但其实这样的采访方式由于带有太多的主观因素,得出的结论很容易产生偏差。大数据新闻报道则基于对大量庞杂数据的分析,样本会更加全面,使报道结果能相对客观一些。
数据一定不会说谎吗?
【背景】在当今互联网普及的社会中,几乎每一个人都会和统计数字接触,但有时貌似精确的统计数字在被人利用后,也会成为迷惑他人的工具。美国统计学家达莱尔·哈夫的《统计数字会撒谎》一书被中国网友称作“数据打假手册”,他在书中建议,在看到统计数字后,你应当首先问自己5个问题:“谁说的”“他是如何知道的”“遗漏了什么”“是否有人偷换了概念”“这个资料有意义吗”。
主持人:相比于传统的新闻报道,大数据新闻在样本选择上要庞大得多,这是否意味着大数据新闻报道一定比传统新闻报道更加客观?
郭俊义:与传统新闻一样,大数据新闻报道同样面对新闻的真实性、规范性等新闻伦理的问题。甚至在一些大数据新闻报道中,也需要用传统的新闻报道介入以核实信息的准确性。比如我们在《据说春运》的制作过程中,有一期百度大数据显示,从成都流向北京的人流量非常大,但按常理说,过年人流都是从大城市流向中小城市的,于是我们立即请成都站的记者去实地进行采访和拍摄,结果发现车上很多都是老年人,原来他们是从成都出发去北京的孩子身边过年。
喻国明:并不是所有的数据新闻都是准确客观的。数据新闻在制作的过程中会有指标选择、样本采集、分析方法、表述方式等一系列步骤,在此过程中都会面临一些主观因素的干扰。
沈浩:在大数据研究中有一个词叫作“脏数据”。比如在社交网络上存在大量的“水军”,通过“注水”发帖来扰乱网民的真实想法。那我们在研究中如果使用了因此而得来的数据,就会造成数据分析结果的偏差。
能否成为常规报道方式?
【背景】9月5日,国务院印发《促进大数据发展行动纲要》,其中指出,到2018年底前,建成国家政府数据统一开放平台,率先在信用、交通、医疗、卫生、就业、社保、地理、文化等重要领域实现公共数据资源合理适度向社会开放。2020年底前,逐步实现信用、交通、医疗等民生保障服务相关领域的政府数据集向社会开放。
喻国明:大数据新闻报道目前还处于起步阶段,面临很多挑战。第一是大数据的来源是受限制的,一些政府的统计数据,尤其是涉及民生的,目前很多都没有开放给公众。第二是数据来源的单一性,大数据不仅仅是数据的规模大、量大,大数据信息还涉及品类的多样性,比如你要研究人的社会活动,那你不仅仅是要看他的交往数据,而且最好还能看到他的购买数据等等。可以说,全世界到目前为止,针对大数据新闻报道,并没有找到一个完整、统一的规范和彻底的解决方案。
郭俊义:大数据新闻在未来会有越来越多的用武之地,特别是在很多跟民生密切相关的领域。比如上海外滩踩踏事故中的调查报告提到,当天执勤的民警曾经用肉眼看到过人流量过于密集,后来我在想,如果我们当时能有一个人流量的数据流动图,或许以后再遇到此类状况就能避免悲剧的发生。事后我找到腾讯公司,跟他们要到了当天在外滩的人流量数据图,并且对比事故发生的前一天和后一天,做了一个GIF人流量变化的动图,对比非常明显。如果以后的媒体能更多地跟大数据公司合作,会更好地彰显新闻的服务功能。
沈浩:新学期开学我们迎来了中国传媒大学第一届数据新闻专业的学生,这些新生在未来4年除了要学习传统的新闻知识,还要学习统计、编程、数据可视化制作等针对数据新闻的专业知识。其实放眼全球,必备的统计、编程、制图技能已经成为优秀记者的“标配”,这是一个未来的发展趋势。其实我们两年前就已经在校内开设了针对大二学生的数据新闻的实验班,虽然他们明年才正式毕业,但已经被很多媒体提前预订,这证明这类人才非常有市场。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数字化时代,用户是产品的核心资产,用户运营的本质的是通过科学的指标监测、分析与优化,实现“拉新、促活、留存、转化、复购 ...
2026-04-15在企业数字化转型、系统架构设计、数据治理与AI落地过程中,数据模型、本体模型、业务模型是三大核心基础模型,三者相互支撑、各 ...
2026-04-15数据分析师的一天,80%的时间花在表格数据上,但80%的坑也踩在表格数据上。 如果你分不清数值型和文本型的区别,不知道数据从哪 ...
2026-04-15在人工智能与机器学习落地过程中,模型质量直接决定了应用效果的优劣——无论是分类、回归、生成式模型,还是推荐、预测类模型, ...
2026-04-14在Python网络编程、接口测试、爬虫开发等场景中,HTTP请求的发送与响应处理是核心需求。Requests库作为Python生态中最流行的HTTP ...
2026-04-14 很多新人学完Python、SQL,拿到一张Excel表还是不知从何下手。 其实,90%的商业分析问题,都藏在表格的结构里。 ” 引言:为 ...
2026-04-14在回归分析中,因子(即自变量)的筛选是构建高效、可靠回归模型的核心步骤——实际分析场景中,往往存在多个候选因子,其中部分 ...
2026-04-13在机器学习模型开发过程中,过拟合是制约模型泛化能力的核心痛点——模型过度学习训练数据中的噪声与偶然细节,导致在训练集上表 ...
2026-04-13在数据驱动商业升级的今天,商业数据分析已成为企业精细化运营、科学决策的核心手段,而一套规范、高效的商业数据分析总体流程, ...
2026-04-13主讲人简介 张冲,海归统计学硕士,CDA 认证数据分析师,前云南白药集团资深数据分析师,自媒体 Python 讲师,全网课程播放量破 ...
2026-04-13在数据可视化与业务分析中,同比分析是衡量业务发展趋势、识别周期波动的核心手段,其核心逻辑是将当前周期数据与上年同期数据进 ...
2026-04-13在机器学习模型的落地应用中,预测精度并非衡量模型可靠性的唯一标准,不确定性分析同样不可或缺。尤其是在医疗诊断、自动驾驶、 ...
2026-04-10数据本身是沉默的,唯有通过有效的呈现方式,才能让其背后的规律、趋势与价值被看见、被理解、被运用。统计制图(数据可视化)作 ...
2026-04-10在全球化深度发展的今天,跨文化传播已成为连接不同文明、促进多元共生的核心纽带,其研究核心围绕“信息传递、文化解读、意义建 ...
2026-04-09在数据可视化领域,折线图是展示时序数据、趋势变化的核心图表类型之一,其简洁的线条的能够清晰呈现数据的起伏规律。Python ECh ...
2026-04-09在数据驱动的时代,数据分析早已不是“凭经验、靠感觉”的零散操作,而是一套具备固定逻辑、标准化流程的系统方法——这就是数据 ...
2026-04-09长短期记忆网络(LSTM)作为循环神经网络(RNN)的重要改进模型,凭借其独特的门控机制(遗忘门、输入门、输出门),有效解决了 ...
2026-04-08在数据分析全流程中,数据质量是决定分析结论可靠性的核心前提,而异常值作为数据集中的“异类”,往往会干扰统计检验、模型训练 ...
2026-04-08在数字经济飞速发展的今天,数据已渗透到各行各业的核心场景,成为解读趋势、优化决策、创造价值的核心载体。而数据分析,作为挖 ...
2026-04-08在数据分析全流程中,数据处理是基础,图形可视化是核心呈现手段——前者负责将杂乱无章的原始数据转化为干净、规范、可分析的格 ...
2026-04-07