京公网安备 11010802034615号
经营许可证编号:京B2-20210330
理论物理学家和研究科学家Mehmet Suzen曾表示,二分类任务是机器学习的基础。但是,其性能的标准统计信息是一种数学工具,ROC-AUC很难解释。在这里,引入了一种性能度量,该度量仅考虑进行正确的二进制分类的可能性。
机器学习模型的核心应用是二分类任务。从用于诊断测试的医学领域到为消费者提供信用风险决策的领域,有很多领域。建立分类器的技术多种多样,从简单的决策树到逻辑回归,再到最近利用多层神经网络的超酷深度学习模型。但是,它们在构造和训练方法上在数学上有所不同,就其评估而言,事情变得棘手。在本文中,我们为实践中的二元分类器提出了一种简单且可解释的性能指标。
为什么ROC-AUC无法解释?
因为不同的阈值会产生不同的混淆矩阵。
报告分类器性能的实际标准是使用接收机工作特性(ROC)-曲线下面积(AUC)''度量。它起源于1940年代美国海军研发雷达时,用于测量探测性能。 ROC-AUC的含义至少有5种不同的定义,即使您拥有博士学位也是如此。在机器学习中,人们很难解释AUC作为绩效指标的含义。由于AUC功能几乎在所有图书馆中都可用,并且它几乎像一种宗教仪式一样,在机器学习论文中作为分类表现进行报告。但是,除了荒谬的比较问题之外,其解释并不容易,请参阅hmeasure。 AUC会根据从不同阈值的混淆矩阵中提取的假正率(FPR)来衡量真正率(TPR)曲线下的面积。
f(x)= y
∫10 f(x)dx = AUC
其中,y是TPR,x是FPR。除了多种解释且容易混淆之外,将积分放在FPR之上没有明确的目的。显然,我们希望通过将FPR设置为零来实现完美的分类,但是该区域在数学上并不清晰,这意味着它作为一个数学对象是不清楚的。
正确分类的概率(PCC)
对于二分类问题的分类器而言,一种简单且可解释的性能指标对于技术含量高的数据科学家和非技术利益相关者都非常有用。这个方向的基本租户是,分类器技术的目的是区分两个类别的能力。这归结为一个概率值,正确分类的概率(PCC)。一个明显的选择是所谓的平衡精度(BA)。通常建议将其用于不平衡问题,即使是SAS也是如此;尽管他们使用了概率相乘。由于统计上的依赖性,在这里我们将BA称为PCC并使用加法代替:
PCC =(TPR + TNR)/ 2
TPR = TP /(条件正例)= TP /(TP + FN)
TNR = TN /(条件负例)= TN /(TN + FP)。
PCC告诉我们分类器在检测任何一个分类中有多好,它是一个概率值[0,1]。请注意,即使我们的数据在生产中是均衡的,在肯定和否定情况下使用总精度也会产生误导,即使我们衡量绩效的批次可能不均衡,所以仅凭准确性并不是一个好方法。
生产问题
迫在眉睫的问题是如何在生成混淆矩阵时选择阈值?一种选择是选择一个阈值,以使PCC在测试集上的生产最大化。为了改善PCC的估计,可以对测试集进行重采样以获得良好的不确定性。
结论
我们尝试通过引入PCC或平衡精度作为二进制分类器的一种简单且可解释的性能指标来规避报告AUC。这很容易向非技术人员解释。可以引入一种改进的PCC,它考虑到更好的估计属性,但是主要解释仍然与正确分类的可能性相同。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数字化商业环境中,数据已成为企业优化运营、抢占市场、规避风险的核心资产。但商业数据分析绝非“堆砌数据、生成报表”的简单 ...
2026-01-20定量报告的核心价值是传递数据洞察,但密密麻麻的表格、复杂的计算公式、晦涩的数值罗列,往往让读者望而却步,导致核心信息被淹 ...
2026-01-20在CDA(Certified Data Analyst)数据分析师的工作场景中,“精准分类与回归预测”是高频核心需求——比如预测用户是否流失、判 ...
2026-01-20在建筑工程造价工作中,清单汇总分类是核心环节之一,尤其是针对楼梯、楼梯间这类包含多个分项工程(如混凝土浇筑、钢筋制作、扶 ...
2026-01-19数据清洗是数据分析的“前置必修课”,其核心目标是剔除无效信息、修正错误数据,让原始数据具备准确性、一致性与可用性。在实际 ...
2026-01-19在CDA(Certified Data Analyst)数据分析师的日常工作中,常面临“无标签高维数据难以归类、群体规律模糊”的痛点——比如海量 ...
2026-01-19在数据仓库与数据分析体系中,维度表与事实表是构建结构化数据模型的核心组件,二者如同“骨架”与“血肉”,协同支撑起各类业务 ...
2026-01-16在游戏行业“存量竞争”的当下,玩家留存率直接决定游戏的生命周期与商业价值。一款游戏即便拥有出色的画面与玩法,若无法精准识 ...
2026-01-16为配合CDA考试中心的 2025 版 CDA Level III 认证新大纲落地,CDA 网校正式推出新大纲更新后的第一套官方模拟题。该模拟题严格遵 ...
2026-01-16在数据驱动决策的时代,数据分析已成为企业运营、产品优化、业务增长的核心工具。但实际工作中,很多数据分析项目看似流程完整, ...
2026-01-15在CDA(Certified Data Analyst)数据分析师的日常工作中,“高维数据处理”是高频痛点——比如用户画像包含“浏览次数、停留时 ...
2026-01-15在教育测量与评价领域,百分制考试成绩的分布规律是评估教学效果、优化命题设计的核心依据,而正态分布则是其中最具代表性的分布 ...
2026-01-15在用户从“接触产品”到“完成核心目标”的全链路中,流失是必然存在的——电商用户可能“浏览商品却未下单”,APP新用户可能“ ...
2026-01-14在产品增长的核心指标体系中,次日留存率是当之无愧的“入门级关键指标”——它直接反映用户对产品的首次体验反馈,是判断产品是 ...
2026-01-14在CDA(Certified Data Analyst)数据分析师的业务实操中,“分类预测”是高频核心需求——比如“预测用户是否会购买商品”“判 ...
2026-01-14在数字化时代,用户的每一次操作——无论是电商平台的“浏览-加购-下单”、APP的“登录-点击-留存”,还是金融产品的“注册-实名 ...
2026-01-13在数据驱动决策的时代,“数据质量决定分析价值”已成为行业共识。数据库、日志系统、第三方平台等渠道采集的原始数据,往往存在 ...
2026-01-13在CDA(Certified Data Analyst)数据分析师的核心能力体系中,“通过数据建立模型、实现预测与归因”是进阶关键——比如“预测 ...
2026-01-13在企业数字化转型过程中,业务模型与数据模型是两大核心支撑体系:业务模型承载“业务应该如何运转”的逻辑,数据模型解决“数据 ...
2026-01-12当前手游市场进入存量竞争时代,“拉新难、留存更难”成为行业普遍痛点。对于手游产品而言,用户留存率不仅直接决定产品的生命周 ...
2026-01-12