Python机器学习利用鸢尾花数据绘制ROC和AUC曲线_F11

分享到

Python机器学习利用鸢尾花数据绘制ROC和AUC曲线

python 来源：互联网作者：佚名发布时间：2023-02-09 21:53:23 人浏览

摘要

一、ROC与AUC 很多学习器是为了测试样本产生的一个实值或概率预测，然后将这个预测值与一个分类阈值（threshold）进行比较，若大于阈值则分为正类，否则为反类。主要看需要建立的模

一、ROC与AUC

很多学习器是为了测试样本产生的一个实值或概率预测，然后将这个预测值与一个分类阈值（threshold）进行比较，若大于阈值则分为正类，否则为反类。主要看需要建立的模型侧重于想用在测试数据的泛华性能的好坏。排序本身的质量好坏体系了综合考虑学习去在不同任务下的“期望泛化性能”的好坏。ROC曲线则是从这个角度出发来研究学习器泛化性能。

1.ROC

ROC的全称是“受试者工作特征”曲线，与P-R曲线相似。与P-R曲线使用查准率、查全率为纵、横坐标不同，ROC曲线的纵轴是“真正例率”{简称TPR），横轴是“假正例率”（简称FPR）二者分别定义为：

ROC曲线图以真正例率为Y轴，假正例率为X轴。

2.AUC

进行检验判定ROC曲线性能的合理判据是比较ROC曲线下的面积，即AUC。从定义知AUC可通过对ROC曲线下各部分的面积求和而得，AUC可估算为：

从形式化看，AUC考虑的是样本预测的排序质量，因此它与排序误差有紧密联系。因此存在排序损失。

二、代码实现

形式基本和P-R曲线差不多，只是几个数值要改一下。

代码如下（示例）：

from sklearn import svm, datasets

from sklearn.model_selection import train_test_split

from sklearn.metrics import roc_curve, auc

from itertools import cycle

from sklearn.preprocessing import label_binarize #标签二值化LabelBinarizer，可以把yes和no转化为0和1，或是把incident和normal转化为0和1。

import numpy as np

from sklearn.multiclass import OneVsRestClassifier

iris = datasets.load_iris()

# 鸢尾花数据导入

X = iris.data

#每一列代表了萼片或花瓣的长宽，一共4列，每一列代表某个被测量的鸢尾植物，iris.shape=(150,4)

y = iris.target

#target是一个数组，存储了data中每条记录属于哪一类鸢尾植物，所以数组的长度是150,所有不同值只有三个

random_state = np.random.RandomState(0)

#给定状态为0的随机数组

y = label_binarize(y, classes=[0, 1, 2])

n_classes = y.shape[1]

n_samples, n_features = X.shape

X = np.c_[X, random_state.randn(n_samples, 200 * n_features)]

#添加合并生成特征测试数据集

X_train, X_test, y_train, y_test = train_test_split(X, y,

test_size=0.25,

random_state=0)

#根据此模型训练简单数据分类器

classifier = OneVsRestClassifier(svm.SVC(kernel='linear', probability=True,

random_state=random_state))#线性分类支持向量机

y_score = classifier.fit(X_train, y_train).decision_function(X_test)

#用一个分类器对应一个类别，每个分类器都把其他全部的类别作为相反类别看待。

fpr = dict()

tpr = dict()

roc_auc = dict()

for i in range(n_classes):

fpr[i], tpr[i], _ = roc_curve(y_test[:, i], y_score[:, i])

#计算ROC曲线面积

roc_auc[i] = auc(fpr[i], tpr[i])

fpr["micro"], tpr["micro"], _ = roc_curve(y_test.ravel(), y_score.ravel())

roc_auc["micro"] = auc(fpr["micro"], tpr["micro"])

import matplotlib.pyplot as plt

plt.figure()

lw = 2

plt.plot(fpr[2], tpr[2], color='darkorange',

lw=lw, label='ROC curve (area = %0.2f)' % roc_auc[2])

plt.plot([0, 1], [0, 1], color='navy', lw=lw, linestyle='--')

plt.xlabel('FPR')

plt.ylabel('TPR')

plt.ylim([0.0, 1.0])

plt.xlim([0.0, 1.0])

plt.legend(loc="lower right")

plt.title("Precision-Recall")

plt.show()

效果

您可能感兴趣的文章 :

原文链接 : https://juejin.cn/post/7196975187992068133

Tag : python(792)

Flask接口签名sign原理与实例代码

作用防止有人不停的刷接口，对接口作限制比如说，登录接口，按道理说，应该只有app会请求这个接口但是，如果有人抓取app的请求，就
Python机器学习利用鸢尾花数据绘制ROC和AUC曲线

一、ROC与AUC 很多学习器是为了测试样本产生的一个实值或概率预测，然后将这个预测值与一个分类阈值（threshold）进行比较，若大于阈值则
python字符串大小写转换的三种方法

python中，为了方便字符串的大小写转换，为我们提供了三种方法: title() lower() upper() python title()方法 title()方法用于将字符串中的每个单词的
C# DataGridView行列转换的具体实现

初始表格需要进行行列转置转换后的效果实现代码如下 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 33 34 35 36 37 voi
Pycharm更换安装源与添加第三方库方法介绍

今天继续给大家介绍Python相关知识，本文主要内容是Pycharm更换安装源和添加第三方库详解。一、Pycharm更换安装源在下载安装好Pycharm后，一
Python利用D3Blocks绘制可动态交互的图表

今天小编给大家来介绍一款十分好用的可视化模块，D3Blocks，不仅可以用来绘制可动态交互的图表，并且导出的图表可以是HTML格式，方便在
Python经典案例之图像漫水填充分割介绍

一.图像漫水填充图像漫水填充（FloodFill）是指用一种特定的颜色填充联通区域，通过设置可连通像素的上下限以及连通方式来达到不同的填
python在pygame中设置字体并显示中文的介绍

一、查看可用字体 1 2 import pygame print(pygame.font.get_fonts()) 二、设置字体 1.使用系统字体 1 2 self.font=pygame.font.SysFont(None,48)#None系统默认字体 s
pip安装python库时报Failed building wheel for xxx错误的解

一、问题描述如题，在使用pip install xxx的方法安装python库，或者是基于python的软件时，报错ERROR: Failed building wheel for xxx（某个库）这个报错
pygame.sprite的精灵碰撞的介绍

pygame中的精灵碰撞是可见游戏中用的最基础的东西，这里结合官方文档和小甲鱼的网站上的内容做个小总结，方便日后使用。 pygame.sprite.S