京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据应用 信用评分及模型原理解析
虽然人人都可以通过对借款方在Lending Club和Prosper上的历史借贷数据进行分析,但我相信,了解消费信贷行为、评分机制和贷款决策背后的工作原理可以帮助投资人更好的在市场中进行决策,获得收益。
消费信贷一直是推动世界领先国家经济转型的主要力量。在过去的50年里,消费开支也因此有所增加。根据纽约联邦储备银行家庭债务和信用季度报告,2014年8月,消费者负债总额为11.63万亿美元,其中74%为按揭和净值贷款,10%为学生贷款,8%为汽车贷款,以及6%为信用卡债务。消费信贷需求增长率极高,自动化风险评估系统势在必行。
信用评分最早始于上世纪50年代初。信用评分最初使用统计学方法来区分优秀和不良贷款。最初,信用评分的重点是是否要给贷方发放贷款,后来,这种行为转变成了申请人评分(applicant scoring)。信用评分借着申请人评分这一项成为了一项成功的评价系统。
在信用评分中,信贷价值假设会在未来的几年保持稳定,贷方会对申请人是否会在未来的12个月内出现90天以上的逾期支付进行评估。申请成功时申请人的最低评分是该分值边际良好和不良贷款几率相比而来,即会额外通过的优秀贷款与不良贷款的比例。申请者贷款1-2年以来的数据,加上相应的信用记录将帮助建立申请者未来2年左右的申请评分模型。
行为评分(Behavioral scoring),是申请人评分的一个补充,旨在评估申请人在过去一年中支付和购买行为的状况。 此数据用于预测未来12个月的违约风险情况,通常每个月更新一次数据。最近表现和当前信贷信息比最开始的申请信息更为重要。
比起违约风险,如今贷款方更加注重能满足他们盈利目标的贷款战略。他们可以选择贷款额、利率及其他条款,从而最大限度地提高盈利能力。基于盈利能力而做出决策的技术分析叫做利润评分(profit scoring)。
与可使用静态信用评分模式的申请人评分不同,行为评分和利润评分需要使用动态信用评分模式,即要将过去的信贷行为纳入考虑范围。 一般来说,信用评分模型会分别为每一笔借贷建模。但是,由于借款人贷款组合违约情况(信用风险)增高,所借款项的重要性便今非昔比了。目前为止没有广泛接受的用于评估贷款组合的信用风险模型。
您可以通过评估系统识别优秀及不良贷款的能力,预测概率的精确性以及分类预测的准确性这三点来评估一个信用评分模型。
贷款人的主要目标是在其投资组合中获得利润最大化。对于任何一笔贷款中,投资人都需要考虑贷款回报额。投资100美元,获利10美元显然不如投资25美元,获得3美元回报。
有些情况下,借款人无法偿还贷款,这就意味着贷款人甚至会面临重大损失。我们可以通过分析投资组合违约率及违约结果对风险进行量化。贷款人还可以将风险和回报设定在预期的范围内。
最终是否投资给借款人需要基于一系列决策:即哪些信息将有助于作出决策,在决策过程期间和之后贷款会有何发展以及最终可能出现的结果。
影响图网用可视化的图形帮助投资人了解主要决策、不确定性、相关信息以及最终成果是如何相互影响的。
影响图网可以确定决策的重要方面,有哪些数据与决策相关,以及在哪些方面有关。图网包括三种节点:决策(长方形节点),不确定事件(圆形节点),以及结果(菱形节点)。各节点由箭头相互连接。图1从市场中贷款人的角度进行绘制。
图1中,首先,贷款人获得借款人是否会有良好表现的贷款预测。预测是随机事件,因为贷款人不能决定预测的结果。它将影响投资与否(Loan or not)的决策,也会影响借款人的表现(Borrower good or bad)。接着,平台将决定是否发布贷款(Loan issued or not)。这对贷款人来说是随机事件。除非该贷款没有得到足够的贷款人支持,否则贷款人对是否发布贷款没有决定权或影响力。贷款一旦发布,贷款人就可以检验收入证明(Income verification)执行情况,查看FICO分数及还款记录(FICO score and payment history.)是否有变化,并更新贷款预测。根据更新后的贷款预测,贷款人可以决定是否要在FILOfn二级交易平台上卖出贷款。类似的,其他贷款人也可以在二级交易平台上很据更新的贷款预测决定是否买入贷款。这一系列事件会最终影响贷款人的收益。
决策树确定贷款中有哪些最优决策,并按照决策过程中信息的了解顺序来解析决策的各个步骤。
那么决策树模型又是如何根据可视化影响图网中的结构逐渐形成的呢?决策树与影像图网的结构类似。其结果由以数字代表的回报事件表示。每个机会节点(不确定事件)都被赋予一定比重,比重代表事件结果发生的可能性。
从结果点开始往回推,经过所有决策及不确定事件的节点后,可以计算出每个结果的预期货币值(EMV)。
图2是一个简单的贷款决策的决策树。贷款人对是否进行投资做出了一份初期判断。如果贷款人不愿投资,则回报是0。如果贷款人投资,则有两种可能:投资回报良好,或不好(即违约)。
假设,借款人回报良好时,贷款人获益10,借款人违约时,贷款人则损失100。如果违约可能性是5%,并且贷款人愿意投资,则贷款人可能从借款人处获益:
0.95 x 10 + 0.05 x (-100) = 4.5
如果贷款人不愿投资,则获益为0。因此,决策树显示贷款人应该进行投资。如果违约的可能性增加到10%,则贷款人可能从借款人处获益:
0.90 x 10 + 0.10 x (-100) = -1
因此,决策树显示贷款人不应该进行投资。
综上所示,如果g代表贷款人收益,l代表因借款人违约导致的贷款人损失,p代表投资回报良好的可能性,那么根据预期货币值(EMV)的标准,只有 pg – (1-p)l > 0时,贷款人应该进行投资。
p/(1-p)即投资回报良好的可能性与违约可能性的比值,也称为良莠比(good:bad odds)。
能够涵盖所有贷款决策的决策树很难实现,也不方便。但是,决策树可以协助贷款人进行决策。
CDA学员免费下载查看报告全文:2026全球数智化人才指数报告【CDA数据科学研究院】.pdf
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在大数据技术飞速迭代、数字营销竞争日趋激烈的今天,“精准触达、高效转化、成本可控”已成为企业营销的核心诉求。传统广告投放 ...
2026-04-24在游戏行业竞争白热化的当下,用户流失已成为制约游戏生命周期、影响营收增长的核心痛点。据行业报告显示,2024年移动游戏平均次 ...
2026-04-24 很多业务负责人开会常说“我们要数据驱动”,最后却变成“看哪张报表数据多就用哪个”,往往因为缺乏一套结构性的方法去搭建 ...
2026-04-24在Power BI数据可视化分析中,切片器是连接用户与数据的核心交互工具,其核心价值在于帮助使用者快速筛选目标数据、聚焦分析重点 ...
2026-04-23以数为据,以析促优——数据分析结果指导临床技术改进的实践路径 临床技术是医疗服务的核心载体,其水平直接决定患者诊疗效果、 ...
2026-04-23很多数据分析师每天盯着GMV、DAU、转化率,但当被问到“哪些指标是所有企业都需要的”“哪些指标是因行业而异的”“北极星指标和 ...
2026-04-23近日,由 CDA 数据科学研究院重磅发布的《2026 全球数智化人才指数报告》,被中国教育科学研究院官方账号正式收录, ...
2026-04-22在数字化时代,客户每一次点击、浏览、下单、咨询等行为,都在传递其潜在需求与决策倾向——这些按时间顺序串联的行为轨迹,构成 ...
2026-04-22数据是数据分析、建模与业务决策的核心基石,而“数据清洗”作为数据预处理的核心环节,是打通数据从“原始杂乱”到“干净可用” ...
2026-04-22 很多数据分析师每天盯着GMV、转化率、DAU等数字看,但当被问到“什么是指标”“指标和维度有什么区别”“如何搭建一套完整的 ...
2026-04-22在数据分析与业务决策中,数据并非静止不变的数值,而是始终处于动态波动之中——股市收盘价的每日涨跌、企业月度销售额的起伏、 ...
2026-04-21在数据分析领域,当研究涉及多个自变量与多个因变量之间的复杂关联时,多变量一般线性分析(Multivariate General Linear Analys ...
2026-04-21很多数据分析师精通描述性统计,能熟练计算均值、中位数、标准差,但当被问到“用500个样本如何推断10万用户的真实满意度”“这 ...
2026-04-21在数据处理与分析的全流程中,日期数据是贯穿业务场景的核心维度之一——无论是业务报表统计、用户行为追踪,还是风控规则落地、 ...
2026-04-20在机器学习建模全流程中,特征工程是连接原始数据与模型效果的关键环节,而特征重要性分析则是特征工程的“灵魂”——它不仅能帮 ...
2026-04-20很多数据分析师沉迷于复杂的机器学习算法,却忽略了数据分析最基础也最核心的能力——描述性统计。事实上,80%的商业分析问题, ...
2026-04-20在数字化时代,数据已成为企业决策的核心驱动力,数据分析与数据挖掘作为解锁数据价值的关键手段,广泛应用于互联网、金融、医疗 ...
2026-04-17在数据处理、后端开发、报表生成与自动化脚本中,将 SQL 查询结果转换为字符串是一项高频且实用的操作。无论是拼接多行数据为逗 ...
2026-04-17面对一份上万行的销售明细表,要快速回答“哪个地区卖得最好”“哪款产品增长最快”“不同客户类型的购买力如何”——这些看似复 ...
2026-04-17数据分析师一天的工作,80% 的时间围绕表格结构数据展开。从一张销售明细表到一份完整的分析报告,表格结构数据贯穿始终。但你真 ...
2026-04-16