京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据创业,绕开BAT,找准红利方可成功
随着大数据时代的到来,其中产业链的红利也将逐渐呈现,催生了诸多相关的创业项目。笔者以一家定义为大数据加工、分析、流通的创业公司“云见”为例,探讨下数据在流通过程中增值的可能性。
大数据的红利在哪?
处在大数据最上游的是数据产生端,其中最有代表性的是BAT这样的企业。与数据生存者对应的另一端是需求端,即服务主体,同样是包括政府、机构、企业、个人。而处在中间的则是数据的处理加工商,如云见这类公司。
那么,红利在哪里呢?首先,数据生产端红利已尽。BAT因为自有数据资源可以自嗨,比如百度有“百度迁徙”、“百度精算”;阿里有 “阿里云”、“支付宝-花呗”;腾讯有 “腾讯云分析”,BAT自产自销模式代表了大部分拥有数据源的玩家。
那么剩下的红利就集中在了中间部分,其中有两种模式:
模式一:与业务场景结合,做产业类平台,如同花顺、恒生电子。
模式二:数据的再加工利用,即从运营商、互联网公司获取原始数据信息来进行分析,再提供给用户关于价值和趋势的信息以换取价值。
相比于模式一的深耕,模式二因为进入门槛、资源要求度都相对较低,所以云见选择以这种形式进行切入。
既然类似云见这样的小微企业,先天没有数据源的优势,那么如何让数据在流通过程中增值呢?
让数据在流通过程中增值的方法
(1)降低数据来源的成本
最普遍的方法包括通过第三方购买数据、爬虫爬回数据、合作方授权数据、免费的开放数据。数据获取中肯定要付出人力、资金成本,所以解决数据源是大数据创业公司首要面临的问题。
目前行业做得较创新的是“数据堂”,这家作为挂牌新三板的第一个大数据资源公司,采用“众包”形式,由服务企业提出需求,数据堂直接通过众客堂采集数据。同时,众客堂用户也是处理数据的方式,可甄别数据真伪和有效性。
当然,相比于成熟型的数据公司,云见还未具备这样的数据采集实力,所以其倾向于用合作授权数据的形式,低成本获得独家数据源。
(2)着眼于未来的数据加工
数据加工包括整理合并、优化、排错等方面,数据本身庞杂无章,精炼后的数据能够发掘其中的规律性而进行精准应用。当然,这只是数据加工的通用价值,大数据创业公司关键要解决数据价值深化或兑现的问题。
云见做出两个选择:
与垂直领域对接发现价值
因为消费升级、移动互联网的人口红利消失,那些大规模的对受众社会属性不加区分的水平产品很难生产。在大数据时代,通用型信息的价值正减小,任何拥有数据加工能力的人都可说出用户画像,但针对垂直领域的数据价值需求则需深耕才能解决。
预测未来比看见现在更重要
云见从成立之初就专注在“算法”上,用模式识别的方式形成自己的经验库以预测用户的未来行为,区别于竞争对手赚解决方案服务费的方式,这也符合其技术驱动型团队的特点——更看中“稳”而不是“快”。
(3)用“mall”的形式
作为大数据元老级公司的“数据堂”15年推出了国内第一家网上数据商城“Data Mall”,数据商城的形式最大化地提高了数据交易效率,简单理解就是在通用的入口,用户可以进行重复消费;同时,平台方通过商城获得接入用户的机会,用户成为“传感器”——作为流量入口,又将数据反馈至商城上,担任消费端和供给端的双重角色。
云见也在筹建这样的“轻模式”,除了上述提及的优势,考虑到基于用户需求的非标准化特性,API接口(应用程序编程接口)本身是很难进行标准化的,所以“mall”的呈现方式在一定程度上解决了API形式上的标准化,同时,“mall”改变了传统打包服务的模式,减少在销售、推广、人力上的成本。
当然,大数据创业的成功还有一部分因素是依赖在大势上。
(4)政策上的大势
2015年7月,国务院办公厅发布《关于运用大数据加强对市场主体服务和监管的若干意见》,这是顺应大数据时代潮流,运用现代信息技术加强政府公共服务和市场监管,推动简政放权和政府职能转变的重要政策文件。
文件表示将充分认识运用大数据加强对市场主体服务和监管的重要性、运用大数据提高为市场主体服务水平、运用大数据加强和改进市场监管、推进政府和社会信息资源开放共享、提高政府运用大数据的能力和积极培育和发展社会化征信服务等。
(5)行业上的机会
目前较有代表性的大数据公司是“数据堂”和“聚合数据”,共同特点是拥有如BAT量级的大B用户。但相当部分的小B企业以及政府决策、公共服务、金融、电信等领域对数据存在需求,再加上数据供给端也出现了多元化的现状,所以大数据行业本身很难做到一家独大,类似于云见这样较小型的数据处理公司还是有机会在其中馋食大数据的红利。
创业的机会在哪里
池静若认为现在大数据产业链才开始发展,大众都把目光聚焦在大数据的两端:一是谁拥有这些数据,二是这些数据到底如何使用。但仅仅在两端是不能解决大数据问题的。
大数据产业的大量机会出现在中间环节,包括采集、聚合、机器学习加工后的数据通过智能管道合法流入到用户的手里。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在神经网络模型搭建中,“最后一层是否添加激活函数”是新手常困惑的关键问题——有人照搬中间层的ReLU激活,导致回归任务输出异 ...
2025-12-05在机器学习落地过程中,“模型准确率高但不可解释”“面对数据噪声就失效”是两大核心痛点——金融风控模型若无法解释决策依据, ...
2025-12-05在CDA(Certified Data Analyst)数据分析师的能力模型中,“指标计算”是基础技能,而“指标体系搭建”则是区分新手与资深分析 ...
2025-12-05在回归分析的结果解读中,R方(决定系数)是衡量模型拟合效果的核心指标——它代表因变量的变异中能被自变量解释的比例,取值通 ...
2025-12-04在城市规划、物流配送、文旅分析等场景中,经纬度热力图是解读空间数据的核心工具——它能将零散的GPS坐标(如外卖订单地址、景 ...
2025-12-04在CDA(Certified Data Analyst)数据分析师的指标体系中,“通用指标”与“场景指标”并非相互割裂的两个部分,而是支撑业务分 ...
2025-12-04每到“双十一”,电商平台的销售额会迎来爆发式增长;每逢冬季,北方的天然气消耗量会显著上升;每月的10号左右,工资发放会带动 ...
2025-12-03随着数字化转型的深入,企业面临的数据量呈指数级增长——电商的用户行为日志、物联网的传感器数据、社交平台的图文视频等,这些 ...
2025-12-03在CDA(Certified Data Analyst)数据分析师的工作体系中,“指标”是贯穿始终的核心载体——从“销售额环比增长15%”的业务结论 ...
2025-12-03在神经网络训练中,损失函数的数值变化常被视为模型训练效果的“核心仪表盘”——初学者盯着屏幕上不断下降的损失值满心欢喜,却 ...
2025-12-02在CDA(Certified Data Analyst)数据分析师的日常工作中,“用部分数据推断整体情况”是高频需求——从10万条订单样本中判断全 ...
2025-12-02在数据预处理的纲量统一环节,标准化是消除量纲影响的核心手段——它将不同量级的特征(如“用户年龄”“消费金额”)转化为同一 ...
2025-12-02在数据驱动决策成为企业核心竞争力的今天,A/B测试已从“可选优化工具”升级为“必选验证体系”。它通过控制变量法构建“平行实 ...
2025-12-01在时间序列预测任务中,LSTM(长短期记忆网络)凭借对时序依赖关系的捕捉能力成为主流模型。但很多开发者在实操中会遇到困惑:用 ...
2025-12-01引言:数据时代的“透视镜”与“掘金者” 在数字经济浪潮下,数据已成为企业决策的核心资产,而CDA数据分析师正是挖掘数据价值的 ...
2025-12-01数据分析师的日常,常始于一堆“毫无章法”的数据点:电商后台导出的零散订单记录、APP埋点收集的无序用户行为日志、传感器实时 ...
2025-11-28在MySQL数据库运维中,“query end”是查询执行生命周期的收尾阶段,理论上耗时极短——主要完成结果集封装、资源释放、事务状态 ...
2025-11-28在CDA(Certified Data Analyst)数据分析师的工具包中,透视分析方法是处理表结构数据的“瑞士军刀”——无需复杂代码,仅通过 ...
2025-11-28在统计分析中,数据的分布形态是决定“用什么方法分析、信什么结果”的底层逻辑——它如同数据的“性格”,直接影响着描述统计的 ...
2025-11-27在电商订单查询、用户信息导出等业务场景中,技术人员常面临一个选择:是一次性查询500条数据,还是分5次每次查询100条?这个问 ...
2025-11-27