问答文章1 问答文章501 问答文章1001 问答文章1501 问答文章2001 问答文章2501 问答文章3001 问答文章3501 问答文章4001 问答文章4501 问答文章5001 问答文章5501 问答文章6001 问答文章6501 问答文章7001 问答文章7501 问答文章8001 问答文章8501 问答文章9001 问答文章9501

如何理解Type I/II Error,敏感性与特异性以及ROC,AUC

发布网友 发布时间:2022-09-17 20:06

我来回答

1个回答

热心网友 时间:2023-10-17 17:06

(2019-12-16)

首先,Type I/II Error 在维基百科的解释为:

Type I error is the rejection of a true null hypothesis (also known as a "false positive" finding),
I类错误是拒绝了本为真的 Null Hypothesis

Type II error is failing to reject a false null hypothesis (also known as a "false negative" finding). 1-power。
II类错误是未能拒绝一个本为假的 Null Hypothesis

用一个例子来讲:

Type I Error:
(见图上H0): 阴性
假设 成立,实际上也确实成立,但是我们检测到的样本正好有Bias,导致 落于置信区间外,造成了False Positive Error(本来没病,却检查出有病)

Type II Error:
(见图上H1): 阴性
假设 成立,实际上不成立,应该是 。但是我们检测到的样本正好有Bias,导致 落于置信区间内,造成了False Negative Error(本来有病,却检查出没病)

再追加一个例子,如果我们要检验:
: 中国人平均身高 ≤ 170cm
: 中国人平均身高 > 170cm
Type I Error 就是平均身高实际是170cm,但是取到的样本平均身高到了180cm,导致错误地拒绝了H0
Type II Error 就是平均身高实际是180cm,但是取到样本平均身高却是172cm,导致错误地未能拒绝H0

α 的选择越小,蓝线右移,P(Type I Error) 越小,P(Type II Error) 越大;
α 的选择越大,蓝线左移,P(Type I Error) 越大,P(Type II Error) 越小。

其中,定义检验的势 Power = 1 - P(Type II Error)

敏感性(Sensitivity)意味着有病的人的检测正确率,特异性(Specificity)意味着没病的人的检测正确率。

具体来讲,
如果拿出机器学习中的混淆矩阵:

敏感性的计算公式为:,它与FNR是互补关系(和为1)
高敏感性意味着低 FNR(False Nagetive Rate,图中的β,漏诊率),有病的都能被检测出来,机器学习中意味着高召回率( ),可以看到公式是一样的。另外它和假设检验中的 power(势) 也是一致的。

特异性的计算公式为:,它与FPR是互补关系(和为1)
高特异性意味着低 FPR(False Positive Rate,图中的α,误诊率),没病的都不会被勿诊为有病,但注意,高特异性并不意味着机器学习中的高精确度( ),因为即便高特异性意味着低FP,但可能模型本身很差,根本无法找出TP,从而导致精确度很低。

将模型检测结果的 TPR (Sensitivity) 作为横坐标,FPR (1 - Specificity) 作为纵坐标,画到笛卡尔坐标系中,即可得到类似与如下的曲线:

直观上理解,其实就是当下图中的蓝线(阈值)从紫色面积的最右边逐渐移到红色部分的最左边时,产生的曲线:

其中的道理是,通过阈值的选择可以让模型对正例的判别变得严格,这样就会有更多的真实正样本被分为正例,TPR( )增加,但同时也会有更多的真实负样本被分为正例,所以同时提高了FPR( ):

极端情况下,

而AUC就是所谓的Area under Curve,代表ROC曲线下面的面积,值域为[0, 1],正常情况下为[0.5, 1]。

AUC的实际意义是:当随机挑选一个正样本以及一个负样本,当前的分类算法根据计算得到的分数将这个正样本排在负样本前面的概率就是AUC值。所以,AUC的值越大,当前的分类算法越有可能将正样本排在负样本值前面,既能够更好的分类。

假设一个*会根据一系列经验去抓小偷,但是不能100%保证准确率,那么当*提高他的严苛度(阈值)时,必然会有更多的小偷被抓到,漏判率降低,但是随之误判率会升高,会有良民被抓。

因此,阈值的设定关系到了我们想要这个模型产出的效果,如果希望抓出更多的Positive样本,就提高阈值,随之Sensitivity增加,FPR增加;如果希望Negative样本不要误判,就降低阈值,Sensitivity降低,FPR降低。

例如在金融领域,欺诈用户如果不能更好地被检测出来,会给企业带来巨大损失,同样如果病人被误判为健康的,那么他的生命就会受到威胁,这两种情况则都需要模型具有较高的敏感度。关于这种情况的优化,可以参考1999年的一篇论文: MetaCost: A General Method for Making Classifiers Cost-Sensitive 。其采用了Bagging的思想对使分类器变得代价敏感。

方法有多种,其中包括:找到离(0,1)最近的点,Youden index等[2]

一个模型只能产生一个结果,那么如何绘制曲线呢?
具体方法是在得到 生成概率/预测概率/后验概率 后,先不急着算出预测类别,而是先对生成概率进行从大到小的排序,例如:

然后我们就可以通过画线分割的方式来选择不同的阈值,同时计算相应的TPR和FPR了,比如先选择阈值0.99:

, ,ROC上添加点 (0, 0.2)

当阈值选为0.9时:

, ,ROC上添加点 (0, 0.4)

以此类推我们可以继续得到点:
(0.2, 0.6)
(0.2, 0.8)
(0.2, 1.0)
(0.4, 1.0)
(0.6, 1.0)
(0.8, 1.0)
(1.0, 1.0)

将图像画出即为:

毫无疑问,统计学习是包含在统计学中的,是统计学中的一个上层建筑。
其中的I/II类错误,还有power都是假设检验中的概念,但通过上面的分析也发现了不同统计概念中的一致性(例如Sensitivity, Power, Recall都是一致的)。

实际上在现实世界的统计规律中,如果不给定或者给定极少的(例如1个)特征,那么分类问题就如同盲人摸象,不同类别的分布会重叠在一起。而统计机器学习的目的,就是通过一定的手段,把这两个分布尽可能地拉开,拉的越开,那么分类的效果就越好

而这个手段,就是 数据(特征)+ 模型+ 算法(最优化)。如何更好地利用这些手段,并解决现实生活中的实际问题,就是统计机器学习的研究目标。

References:
[1] Youtube - Sensitivity, Specificity, and ROC Curves
[2] 全面了解ROC曲线
[3] ROC及AUC计算方法及原理

声明声明:本网页内容为用户发布,旨在传播知识,不代表本网认同其观点,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。E-MAIL:11247931@qq.com
想你花就开了是什么意思 ...轻弹簧下端固定在水平面上.一个小球从弹簧正上方某一高度处由静止... ...弹簧下端固定在水平地面上,质量为m的小球从轻弹簧的正上方某一高处... ...一竖直弹簧下端固定于水平地面上,小球从弹簧的正上方高为h的地方自... ...结婚证,孩子户口也在女方家,男方可以要求拿抚养权吗? 小男孩适合戴哪些翡翠小男孩适合戴什么翡翠 产后尿道口痛是什么原因 产后尿道口疼怎么回事 ...同种点电荷连线上和中垂线上电势的变化规律 办理北京银行需要什么手续 微软账号在登陆visual studio2019的时候为什么显示无法刷新此账户的凭据?怎么解决? 请问华为充电到100是充满了吗 清华大学用英语怎么说? 我是清华大学毕业的,但是我大学四年是在北京大学读的…这句话怎么翻译? 用英语怎么说她毕业于清华大学 2014年7月毕业于清华大学用英语翻译 今年26岁,毕业于清华大学,我成绩优越,英语流利,能熟练应用计算机,英语怎么翻译 翻译一下:(在面面试官对话的时候)我毕业于清华大学,主修英语专业。 oppo手机尺寸一般是多少? 女生学工程管理还是信息管理与信息系统好啊 信息管理与信息系统、工程管理哪个未来前景更好? 荣耀X1安装下载的的安装包的候提示打开的方式 1应用市场2打包安装程序 请问这两种打开方式有什么区别吗? 安卓手机里打包安装程序是什么意思?禁止连网会怎么样?有大神知道吗? 卡车的4X2 6X2 6X4分别代表什么意思 "4x2,6x4"代表什么 卡车驱动形式小科普 卡车的驱动形式"4x2、6x4..."表示什么意思? 6x4是什么意思 重装Windows系统的主要步骤 重新安装Windows系统的方法 建筑智能化系统集成资质是哪个部门颁发的,在建设部网站上查不到这个资质,样子是怎样的,最好有图片说明 烟头代表什么生肖和数字 城南污水处理厂属于城投还是环投 type of clothes什么意思 the first types of clothes为什么type用复数? 万能公式能不能计算圆的面积 【求助+挑战】根据回答的语境,将中文的问题翻译成英文。 陕西旅游出版社五年级下册讲与练阅读短文的翻译怎么写 急求!英语作文 我是工程管理专业(学位证是管理学学士),不知道可以报考注册设备工程师或是电气工程师吗? 真我gt怎么显示电量百分比 真我GT2新机,设计环保,续航强吗? 杨梅团宝是什么 请问打包程序可以删除么? 杨美琪的简介 杨兴义的人物事迹 C语言的枚举类型知识 x20原装电池多少钱 本人承诺以上信息真实有效愿承担下面选是还是选否 自愿参加承诺书 个人免责协议书