京公网安备 11010802034615号
经营许可证编号:京B2-20210330
口碑不错的电视剧却没有换来高收视率,原本表现平平的电视节目,毫无缘由的情况下收视率突然大幅上涨……近年来,随着电视行业的竞争越来越激烈,作为行业内“通用货币”的收视率,出现了越来越多让人看不懂的数据曲线,而“被污染的收视率”也成为不少业内人士口诛笔伐的对象。
近日,北京歌华有线电视网络股份有限公司(简称“歌华有线”)宣布,全国首个收视数据实时采集分析系统“歌华发布”已经建成,这引起了业界广泛关注。电视界业内人士纷纷希望,这个基于大数据的分析系统,能够提供一份没有污染的绿色收视率。
大样本,覆盖北京八成电视用户
一个城市有多少人在看电视?一个栏目真实的收视率是多少?过去,由于采集成本的限制,这些问题只能依据每个城市的数百个用户样本,通过抽样调查分析得出。现在,歌华有线大样本收视数据研究中心推出的“歌华发布”,让全市80%的电视用户都拥有了“发言权”。
据歌华有线副总经理罗小布介绍,大样本是“歌华发布”与传统收视率调查最大的不同点。据他介绍,目前北京市约有500万电视用户,其中400万用户已经使用了高清交互数字电视机顶盒,“我们的数据采集和分析可以记录每一位高清交互数字电视机顶盒用户的每一步操作行为,这就意味着我们的样本覆盖了全市的八成电视用户。”
这种“大数据”的采集和分析方式,在尼尔森大中华区副总裁李昕看来“无异于一场革命”。他解释说,“歌华发布”对超过400万终端的收视行为、页面访问、业务使用、广告曝光等数据进行实时采集,不仅可以使收视率数据的误差更小,而且,更大的样本量也意味着更详尽的数据。比如,一部电视剧的哪个情节、哪几分钟最受关注,都可以准确地呈现出来。
更真实,无人为干预开机率不重复
让业内人士和电视观众困扰的,不仅是收视样本不科学带来的误差,还有调查样本用户被收买而产生的收视率造假事件。“歌华发布”能否克服这一弊端?罗小布满怀信心:“一方面,我们利用的是高清交互数字机顶盒双向互动的技术特点,数据可以自动回传并被采集,全程由计算机自动完成,没有任何人为干预;另一方面,我们的样本超过400万用户,人为的造假操作起来也不太可能。”
就在最近,一条“北京地区电视开机率从三年前的70%下降至30%”的传闻甚嚣尘上。“歌华发布”则发布了另一个完全不同的数据:近两年来,北京地区高清交互用户平均每日的开机率保持在60%以上。相去甚远的两个数据,引来了网友的疑问:很多人收看电视的习惯是只关掉电视机,而机顶盒并没有完全关闭,“歌华发布”的数据是否把这种情况也统计在内了呢?
对此,罗小布强调,“歌华发布”电视开机率的计算方式,与以往相比已经有所调整,“现在每天凌晨4点左右,歌华有线会向高清交互数字机顶盒用户发信息:如果持续收看节目需要按遥控器的任意键,若用户没有操作,机顶盒将会自动关机。这就保证了开机率的统计不会重复,并且是有效的。”
他还特别补充了最新的收视数据,11月26日并非周末,但北京地区有线电视用户不重复开机率也达到了65.6%,每户的平均收视时长为208分钟,这与此前公布的数据并没有太大差异。
个性化,为用户“定制”收视指南
众所周知,收视率是电视台节目设置、编排以及广告商调整广告投放策略的重要参考。但“歌华发布”基于大数据的收视分析,却能挖掘出更大的价值。国家新闻出版广电总局科技司司长王效杰就指出,这一系统能做到对用户全面客观的收视行为进行分析,反过来再利用这些数据,也能为用户提供更好的服务。
据歌华有线新媒体中心主任助理吉钰丽介绍,歌华有线大样本收视数据研究中心统计的不仅有直播数据,还对回看业务、点播业务进行收视情况统计。“越是真正喜欢的节目,采用回看、点播方式收看的观众越多。因此,这两项的统计数据其实更能反映观众的实际偏好。”吉钰丽说。
正是基于这样全面的数据统计,系统能为高清交互数字机顶盒用户提供个性化的收视指南。吉钰丽举例说,当你点播了一部影视剧后,系统会自动推进“你可能也喜欢的”,这种个性化的“定制”推荐还在完善中,今后会越来越精确。
不过,“歌华发布”的数据服务目前还仅限于北京地区。据透露,明年歌华有线将联合全国有线电视网络公司,共同搭建全国收视数据调查研究中心。此外,歌华有线大样本收视数据研究中心还将逐步实现宽带用户数据、互联网电视数据、手机电视数据的采集,可提供占有率、忠诚度、用户黏性等多维度的收视数据指标。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
CDA数据分析师 出品 作者:李诗怡 1. 事实表 vs 维度表 对比维度 事实表 维度表 核心问题 记录“业务发生了什么事” 描述 ...
2026-10-02做数据聚合时,PySpark的groupBy()确实能完成统计,这也是它的本职工作。但它有一个根本性局限:每一组数据,最终只能返回一行 ...
2026-10-01热力地图是数据可视化中极具辨识度与实用性的空间分析图表,结合地理空间维度与数据密度特征,通过颜色深浅、色阶渐变直观展示数 ...
2026-09-30 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-09-30同样是“银行数据岗”,在国有大行总行数据中心、在一家城商行的零售部、在银行系金融科技子公司、在保险公司,工作内容、成长节 ...
2026-09-29在数据分析与统计学研究中,数据往往不是独立存在的,不同变量之间普遍存在相互关联、相互影响的关系。相关性统计分析是挖掘变量 ...
2026-09-29 导读:大多数人只把 dataclasses 当成偷懒工具,用来少写 __init__、__repr__ 这类魔法方法。但它的能力远不止于此。本文带 ...
2026-09-29 很多数据分析师能熟练地计算指标、搭建标签体系,但当被问到“画像到底在解决什么问题”“画像和标签是什么关系”“画像如何 ...
2026-09-29在MySQL数据库运维与业务开发中,行业普遍存在“数据达到千万级就必须分表”的说法。但在实际生产环境中,千万条数据并不是强制 ...
2026-09-28CDA数据分析师 出品 作者:李诗怡 1. 5W1H 分析法 定义:经典系统性思维框架,通过六个核心维度对问题进行全方位拆解与剖析,确 ...
2026-09-28 很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当 ...
2026-09-28CDA数据分析师 出品 作者:李诗怡 1. 用户标签体系 定义: 通过一系列高度精炼的特征标识,对用户属性、行为与偏好进行量化刻画 ...
2026-09-24Pandas是Python生态中用于表格数据处理的核心库,广泛应用于数据清洗、统计运算、报表输出、数据分析建模等场景。在处理极大数值 ...
2026-09-24随着数字经济快速发展,数据已成为核心生产要素,各行各业的业务沉淀、用户行为、设备运行、市场交易均产生海量数据。数据处理作 ...
2026-09-24 很多分析师每天和数据打交道,但当被问到“标签是什么”“标签和指标有什么区别”“标签体系如何设计”时,却常常答不上来。 ...
2026-09-24在时序数据分析中,大部分业务数据并非持续平稳变化,而是会在某些时间节点出现突然抬升、断崖下跌、趋势反转、波动异变等现象, ...
2026-09-23在统计学与数据分析中,研究多组数据差异最常用的方法为单因素方差分析与事后多重比较。很多数据分析初学者容易混淆两者功能,认 ...
2026-09-23 很多数据分析师每天都在写 SQL,但当被问到“DQL 的本质是什么”“SELECT 子句的书写顺序与执行顺序为何不同”“INNER JOIN ...
2026-09-23 很多数据分析师写过无数个SELECT查询,但当被问到“如何新建一张表来固化中间数据”“创建视图和创建物理表有什么区别”“视 ...
2026-09-22CDA数据分析师 出品 作者:李诗怡 1. 金字塔原理 定义: 一种“先总后分、先结论后原因”的思考和表达方式。顶层为核心观点,中 ...
2026-09-22