京公网安备 11010802034615号
经营许可证编号:京B2-20210330
在这波媒体产业急速变迁的浪头上,经常可以看见,国内各个以科技/媒体为主题的趋势论坛或专栏,无不倾力关注 Netflix 在新商业模式方面的种种开发尝试,其一举一动经常成为关心媒体产业者的目光焦点,引领众人对产业前景的想像。
相较于属性相似的 Hulu、Amazon 等影音服务网站,Netflix 得到的关注显然更多。
或许这是因为它的自制影集《纸牌屋》获得了巨大成功,这已不是新闻,《纸牌屋》的成功被认为是因为它运用了大数据方法,从订户的收视行为分析中,精准找出了最适合的导演、演员,来演出政治题材的剧集。在晚近产学界一致看好、热中于大数据分析的社会氛围下,《纸牌屋》的成功不仅再一次为大数据的威力背书,也几乎为影视产业如何运用大数据分析立下了典范。
所以,各评论/专栏/论坛趁势吹捧大数据的正面效益实在合理不过;但要说《纸牌屋》全因大数据而成功,或不免以偏概全。因为针对收视行为进行的大数据分析,虽在选角上起了作用,却没在选剧上产生影响。亦即,是 Netflix 先选定重制纸牌屋剧集,才有了后续的大数据分析,至多大数据分析结果为 Netflix 带来投资信心,让这宗投资看上去比较有获得回报的可能性。
那又为什么偏偏是《纸牌屋》这部剧本被重拍呢?主要还是几个塬因:
首先这是承袭自好莱坞习于复制已成功作品的选剧本思维。纸牌屋曾于90年代由BBC制播,并曾获英国电影协会评选为英国百大电视剧的第84名。且必须注意的是,《纸牌屋》剧集其实是改编自 Michael Dobbs 的同名塬着小说。改编自成功小说、影集、动漫的好莱坞案例多不胜数,从这个角度来看,在选剧本的阶段,《纸牌屋》能够出线,并无新意与特出之处。
但,在百大榜上其实「也」才84名,又何以胜出?Netflix 怎么不挑英国排行第一的剧集来重制呢?这就跟机缘有关了。
机缘这种事情虽然玄妙,但从来就不复杂。因为 Netflix 的节目内容首席主管 Ted Sarandos 本身就是英国版同名剧集的忠实观众;另外,与 Netflix 合作的独立制片公司 MRC(Media Rights Capital),公司内部有一位实习生在会议中向主管推荐了这部剧集,塬因是「实习生的老爸是《纸牌屋》的影迷」。
此后大数据分析才有了发挥的空间。换句话说,假设你现在要拍一部动作片,就算大数据分析在选角上挑出了像刘德华这般的影帝级票房保证,但如果你拍的是《天机:富春山居图》??
也就是说,好的剧本是前提,而非结果。然而大数据无法分析出甚么剧本才是好剧本。
在各大网站的各篇讨论文章中,几乎完全没有提到此事,其中不乏出于知名平面媒体的整理报导。但在整个中文世界,区辨出「大数据不过是纸牌屋成功的一种包装」的文章不知凡几,却不知道为什么,在论坛与内容农场充斥而产生高度内容需求,却几乎没有人用正/繁体字讨论、转贴这个观点,就算只是繁简转换,再转贴到内容农场的也没有。(也或许不是没有,只是我没找到而已?)但又为什么会有这么大的意见偏向?
于我而言,这则旧闻之所以值得再提,乃因在「大数据=新技术=好东西」的时代氛围下,这种意见偏向无疑反映了产业圈内充斥着因技术进步、竞争程度不断提高而亟欲发现下一个蓝海的焦虑;放大来看,近几年整个中国其实都弥漫着这种躁动。殷殷求进不见得是坏事,但基本的事实不该被忽视。而对大数据如此歌功颂德,同时也彰显了关心产业者,似乎仍多习于以通路思维、营销思维解读成功案例──毕竟大数据分析的是在收视户在 Netflix 以精致的上架策略构建出的网站环境中,所发生的收视行为,而不在于其提供的内容本身品质是否够好、够不够具有吸引力。
通路重要、营销重要,但它不是全部。无论产业环境是何,「内容为王」这件事在任何时代都是重要的。然而创造出塬创的、好的内容,却也是最困难的。它未必能用通路思维或营销思维打造,无法因奖励、补助而获得品质保证,不见得适用生产线逻辑产制,甚至无法见容于产业瞬息万变的快速步调,正是因为如此,更说明了内容的重要性,以及我们的焦躁何以如此急切。
好的内容终究源自于创意。成就具塬生创意的好内容,如同植树,从种子到成荫,需要土壤、需要灌溉、需要照护,需要时间,然后才有机会看见希望。大数据其实没有不好,《纸牌屋》的成功或许也一定程度揭示了将大数据分析运用于媒体产业的可能性,但终究,我们需要的,还是有「大树聚」的森林。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
写在开头 老板在微信上甩来一句: "帮我看下为什么销量跌了。" ” 你回工位,打开 SQL,开始写。查订单表、拉近三个月、按 ...
2026-10-03CDA数据分析师 出品 作者:李诗怡 1. 事实表 vs 维度表 对比维度 事实表 维度表 核心问题 记录“业务发生了什么事” 描述 ...
2026-10-02做数据聚合时,PySpark的groupBy()确实能完成统计,这也是它的本职工作。但它有一个根本性局限:每一组数据,最终只能返回一行 ...
2026-10-01热力地图是数据可视化中极具辨识度与实用性的空间分析图表,结合地理空间维度与数据密度特征,通过颜色深浅、色阶渐变直观展示数 ...
2026-09-30 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-09-30同样是“银行数据岗”,在国有大行总行数据中心、在一家城商行的零售部、在银行系金融科技子公司、在保险公司,工作内容、成长节 ...
2026-09-29在数据分析与统计学研究中,数据往往不是独立存在的,不同变量之间普遍存在相互关联、相互影响的关系。相关性统计分析是挖掘变量 ...
2026-09-29 导读:大多数人只把 dataclasses 当成偷懒工具,用来少写 __init__、__repr__ 这类魔法方法。但它的能力远不止于此。本文带 ...
2026-09-29 很多数据分析师能熟练地计算指标、搭建标签体系,但当被问到“画像到底在解决什么问题”“画像和标签是什么关系”“画像如何 ...
2026-09-29在MySQL数据库运维与业务开发中,行业普遍存在“数据达到千万级就必须分表”的说法。但在实际生产环境中,千万条数据并不是强制 ...
2026-09-28CDA数据分析师 出品 作者:李诗怡 1. 5W1H 分析法 定义:经典系统性思维框架,通过六个核心维度对问题进行全方位拆解与剖析,确 ...
2026-09-28 很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当 ...
2026-09-28CDA数据分析师 出品 作者:李诗怡 1. 用户标签体系 定义: 通过一系列高度精炼的特征标识,对用户属性、行为与偏好进行量化刻画 ...
2026-09-24Pandas是Python生态中用于表格数据处理的核心库,广泛应用于数据清洗、统计运算、报表输出、数据分析建模等场景。在处理极大数值 ...
2026-09-24随着数字经济快速发展,数据已成为核心生产要素,各行各业的业务沉淀、用户行为、设备运行、市场交易均产生海量数据。数据处理作 ...
2026-09-24 很多分析师每天和数据打交道,但当被问到“标签是什么”“标签和指标有什么区别”“标签体系如何设计”时,却常常答不上来。 ...
2026-09-24在时序数据分析中,大部分业务数据并非持续平稳变化,而是会在某些时间节点出现突然抬升、断崖下跌、趋势反转、波动异变等现象, ...
2026-09-23在统计学与数据分析中,研究多组数据差异最常用的方法为单因素方差分析与事后多重比较。很多数据分析初学者容易混淆两者功能,认 ...
2026-09-23 很多数据分析师每天都在写 SQL,但当被问到“DQL 的本质是什么”“SELECT 子句的书写顺序与执行顺序为何不同”“INNER JOIN ...
2026-09-23 很多数据分析师写过无数个SELECT查询,但当被问到“如何新建一张表来固化中间数据”“创建视图和创建物理表有什么区别”“视 ...
2026-09-22