京公网安备 11010802034615号
经营许可证编号:京B2-20210330
如何利用互联网大数据这桶万金油
互联网金融在中国的喷发式成长带动了个人信用征信的强大需求,新型征信市场体系的建立又带动了大数据产业的发展,在这条逻辑严密的互联网金融生态链条上,如何充分合规利用大数据成为扼颈之虞。
中国互联网金融行业协会的最新统计数据显示,2014年底中国的互联网金融规模已突破10万亿。而中国拥有40亿银行卡用户,其中仅4亿信用卡,4亿银行卡中,还有大约2亿为沉睡的僵尸卡,相对6亿智能手机用户,互联网金融的未来市场潜力依然十分巨大。
在日前由新浪财经及新浪战略合作部主办的“当大数据爱上金融”闭门沙龙上,我爱卡信用宝创始人兼CEO涂志云认为,如果从时间维度来衡量,中国互联网金融行业发展基本与美国同步,但金融信贷水平与美国相差20十年,飞步向前的行业和征信体系的滞缓,很有可能成为互联网金融产业发展路上的一个大坑。
产业界的一个长期主流观点认为,互联网大数据是绕开征信体系监管和政策门槛的一桶万金油,来自用户非结构性行为的互联网大数据可以对用户静态特征和动态特征的描述和预测,不同数据的跨界碰撞和融合拼接。是互联网金融征信体系的一桶万金油。
随着互联网拥有海量的大数据信息以及云计算等数据处理技术的不断进步,可以提供互联网金融征信产品的机构已不仅仅限于传统的专业征信中心或征信公司,在强大的市场需求刺激下,一批专门针对P2P网贷、网络微贷的互联网金融专业征信机构或“准征信机构”开始出现并迅速发展。
但这可以帮助中国征信体系快速超越20年差距,赶上互联网金融产业的步伐吗?
互联网金融的本质仍然是金融,必须按照金融的发展规律运行。五道口金融学院金融大数据研究室总监杨威认为,大数据并不局限于互联网数据,仅凭互联网数据,并不能解决所有问题,需要避免互联网数据万能论,用传统结合创新,从数据走向业务,或是一条可行的道路。
例如,涂志云曾参与全球的五家国家级别的征信机构开发基础上国家标准的个人信用评分模型的建立。他认为,中国现有的信用评分是个人行为的概括,真正的信用评分不是一个对过去的总结和概括,而是对未来信用行为和违约行为的一个预测。所以,无论是央行还是民营征信公司,都可以利用互联网大数据建立一套可落地参考的征信体系:所有的分数给一个对应的违约率或坏账率。
但现实情况是,目前没有一个中国机构具备这个能力。据了解,央行正在开发类似这样的评分体系,现在为止还没有正式推向市场。
这恰恰是民营互联网征信公司的机会,也是挑战所在。
互联网征信公司百融金服副总裁冯宗欣认为,民营机构在互联网金融征信市场的机会很大。人民银行征信中心有3亿人的信用记录,占中国总人口的25%,仍有75%的人没有有效的信用记录,这将导致大多数人的融资需求很难得到满足。
这家公司从六年前成立开始,探索金融大数据结构的脚步从互联网逐步延伸到了金融机构、来自于线下零售,包括社交,包括媒体,包括航空、教育、运营商、品牌商等多个维度。
“单维度的数据叫数据,不叫大数据。”冯宗欣强调。和其他征信机构的步伐一致,百服金融的征信业务步伐正在向欺诈评分、催收评分等领域拓展。
这显然是大势所趋。优势在于融合线上线下、结构性和非结构性、过去和未来等多维度的数据,形成一个动态的大数据分析库。挑战在于包括央行和银行金融体系亦在银行传统之外,研究来自传感器、媒体、其他行业数据的结合,这个市场跑马圈地之势刚刚开始,谁能最后留下取决于多方面因素。
互联网金融热潮之下,中国强大的市场需求和落后的征信体系形成巨大反差反差,但这也成就了中国互联网金融创业者利用科技、利用大数据在征信领域里面做一次真正的创新和变革的巨大机会,逼迫中国在未来10年的时间走完美国过去30年的路。
互联网重构了金融,大数据重塑了信用。但这条路依然很长。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
CDA数据分析师 出品 作者:李诗怡 定义: 用户增长核心分析框架,刻画用户从接触产品到自发推荐的全生命周期,五个递进环节构建 ...
2026-09-15在数字化营销与精细化用户运营时代,企业传统的广撒网式营销模式成本高、转化率低,已无法适配精准商业竞争需求。客户画像作为大 ...
2026-09-15 很多数据分析师精通描述性统计,能熟练计算均值、中位数、标准差,但当被问到“用500个样本如何推断10万用户的真实满意度” ...
2026-09-15在MySQL数据库数据查询与数据分析中,GROUP BY与ORDER BY是使用频率极高的核心关键字。二者语法结构相似,常搭配使用,但核心功 ...
2026-09-14随着数字化治理、智慧运营、数字孪生技术的普及,数字体征成为衡量业务状态、系统运行、城市治理与企业经营健康度的核心体系。数 ...
2026-09-14 很多数据分析师沉迷于复杂的模型和算法,却忽略了数据分析的一项基础能力——描述性统计。事实上,大量商业分析问题,用描述 ...
2026-09-14在MySQL数据库运维与开发实践中,经常出现一种典型现象:数据库实际存储的数据量很小,数据表条数少、文件体积低,但服务器整体 ...
2026-09-11 很多数据分析师能熟练计算均值、标准差,但当被问到“总体和样本有什么区别”“参数和统计量有什么关系”“数据级别的高低如 ...
2026-09-11CDA数据分析师 出品 作者:李诗怡 定义: 将同一时间段内因具备相同属性或共同经历的用户划分为群体,分析其留存与生命周期价值 ...
2026-09-11在零售、商超、餐饮、线下门店等实体商业运营中,客流与销售额是衡量门店经营状态的两大核心指标。销售额是门店经营的最终结果, ...
2026-09-10在数据可视化体系中,柱形图是最基础、应用最广泛的图表类型,其中**累计柱形图(堆积柱状图)**是兼顾整体总量与内部结构的核心 ...
2026-09-10 许多数据分析师精通Excel函数和SQL查询,但当面对一张上万行的销售明细表,要快速回答“哪个地区销量最高”“哪款产品增长最 ...
2026-09-10在Python Pandas数据分析中,DataFrame是承载结构化数据的核心载体,数据清洗、数据修正、条件赋值、字段更新等实操场景,都离不 ...
2026-09-09 很多数据分析师掌握了Excel函数、会写SQL查询,但当被问到“数据从哪里来”“数据加工有哪些步骤”“如何使用分析工具连接数 ...
2026-09-09卡方检验(Chi-Square Test)是统计学中针对分类数据的经典显著性检验方法,核心用于判断两个离散分类变量是否相互独立、数据实 ...
2026-09-09CDA数据分析师 出品 作者:李诗怡 1. 销售漏斗阶段判断 题目:销售漏斗模型中,通过广告、社交媒体等方式触达品牌信息(如浏览品 ...
2026-09-07在Python数据分析中,Pandas库的DataFrame是最核心、最常用的结构化数据表对象,类似于Excel的二维表格,具备规整的行列结构、字 ...
2026-09-07在数据分析、经营复盘、业绩预测与经济统计工作中,平均增速(平均增长率)是衡量数据长期变化趋势、业务发展快慢的核心指标。不 ...
2026-09-07 很多数据分析师精通Excel单元格操作,但当被问到“表结构数据的基本处理单位是什么”“字段和记录的本质区别”“为什么表结 ...
2026-09-07随着大数据技术的快速发展,商业竞争逐步从传统的经验式经营转变为数据驱动的精细化运营。海量的用户行为数据、交易数据、运营数 ...
2026-09-04