关于数据cutoff值确定多种方法(自备)

2024-03-24 13:44

本文主要是介绍关于数据cutoff值确定多种方法(自备),希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

目录

方法①survminer 包

方法②ROC曲线绘制的最佳cutoff

其他

方法①survminer 包

使用从“maxstat”R软件包中最大限度选择的等级统计数据,一次确定一个或多个连续变量的最佳分界点。这是一种以结果为导向的方法,提供了与结果(此处为存活率)关系最密切的分界点值。 surv_cutpoint():使用“maxstat”确定每个变量的最佳切割点。

surv _ categorize():根据surv_cutpoint()返回的切割点划分每个变量值。

示例数据分析

##采用包自带的示例数据##
rm(list = ls())
library(survival)
library(survminer)
data(myeloma)
head(myeloma)?surv_cutpoint#查看函数
res.cut <- surv_cutpoint(myeloma, time = "time", #生存时间event = "event", #生存结局variables = c("DEPDC1", "WHSC1", "CRIM1"))
summary(res.cut) #查看数据最佳截断点及统计量
#cutpoint statistic
#DEPDC1    279.8  4.275452
#WHSC1    3205.6  3.361330
#CRIM1      82.3  1.968317#数据分布
plot(res.cut, "DEPDC1", palette = "npg")

# 3. Categorize variables:这里根据cutoff值分为高低分组
res.cat <- surv_categorize(res.cut)
#head(res.cat)
#生存曲线绘制#
fit <- survfit(Surv(time, event) ~DEPDC1, data = res.cat)#拟合生存分析

#绘制生存曲线并显示P值
ggsurvplot(fit,data = res.cat,risk.table = TRUE,pval = T)

感谢木舟笔记:Q&A | R做生存分析如何取最佳cutoff(截断) - 知乎 (zhihu.com)


方法②ROC曲线绘制的最佳cutoff

根据某个数据的检验效能最佳截断值进行分组。

其可以在没有生存数据的时候进行使用,然后分析组间差异

连续性变量的组间差异分析_连续变量和连续变量差异性分析-CSDN博客

ROC及曲线面积汇总学习_roc csdn-CSDN博客

rm(list = ls())
library(pROC)
library(survival)
library(survminer)
#roc截断值确定属于是检验诊断效能
data(myeloma)##这里为了方便展示也是用这个数据进行测试dat <- myeloma[,c(4,8)]#[1] "event"  "DEPDC1"
roc1 <- roc(event ~ DEPDC1, data = dat)
#Setting levels: control = 0, case = 1
#Setting direction: controls < casesattributes(roc1)#查看结果包含内容
roc1$auc#
#Area under the curve: 0.6272
ci.auc(roc1)
#95% CI: 0.5491-0.7053 (DeLong)#求约登指数
roc.result <- data.frame(threshold = roc1$thresholds,sensitivity = roc1$sensitivities,specificity = roc1$specificities)
View(roc.result)
roc.result$youden <- roc.result$sensitivity + roc.result$specificity - 1
head(roc.result)
which.max(roc.result$youden)#找出约登指数最大的一行
roc.result[160,]##查看cutoff值
#threshold sensitivity specificity   youden
#160     281.9   0.5714286   0.7096774 0.281106
##计算出CI值和cutoff点,然后进行标注
table(dat$DEPDC1 > 281.9)#根据截断值划分分组#
myeloma$DEPDC11 <- ifelse(myeloma$DEPDC1 > 281.9,"high", "low")
##绘制生存曲线
fit <- survfit(Surv(time, event) ~DEPDC11, data = myeloma)#拟合生存分析
#绘制生存曲线并显示P值
ggsurvplot(fit,data = myeloma,risk.table = TRUE,pval = T)

结果是一致的。

surv_cutpoint()和ROC曲线都是用于确定最佳截断值的方法,它们之间存在一致性的原因如下:

  1. 目标相同:surv_cutpoint()和ROC曲线都旨在找到一个截断值,使得在该值之上或之下的预测结果能够最好地与实际观测结果相匹配。

  2. 基于模型性能:两种方法都是基于模型的性能来确定最佳截断值。surv_cutpoint()通过评估生存曲线的差异来选择最佳截断值,而ROC曲线通过计算真阳性率和假阳性率来评估分类模型的性能。

  3. 最大化敏感性和特异性:无论是surv_cutpoint()还是ROC曲线,都追求在预测中最大化敏感性和特异性。敏感性指的是正确识别阳性样本的能力,特异性指的是正确识别阴性样本的能力。

  4. 统计学原理:surv_cutpoint()和ROC曲线都基于统计学原理进行计算。surv_cutpoint()使用Kaplan-Meier估计和log-rank检验来评估生存曲线的差异,而ROC曲线使用真阳性率和假阳性率的比值来评估分类模型的性能。

综上所述,surv_cutpoint()确定的最佳截断值与ROC确定的最佳截断值是一致的,因为它们都追求在预测中最大化敏感性和特异性,并基于统计学原理来评估模型的性能。


其他

使用OptimalCutpoints包,cutpointr包

截断值确定全能-cutoff package - 知乎 (zhihu.com)

这篇关于关于数据cutoff值确定多种方法(自备)的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/841764

相关文章

Spring Security方法级安全控制@PreAuthorize注解的灵活运用小结

《SpringSecurity方法级安全控制@PreAuthorize注解的灵活运用小结》本文将带着大家讲解@PreAuthorize注解的核心原理、SpEL表达式机制,并通过的示例代码演示如... 目录1. 前言2. @PreAuthorize 注解简介3. @PreAuthorize 核心原理解析拦截与

一文详解JavaScript中的fetch方法

《一文详解JavaScript中的fetch方法》fetch函数是一个用于在JavaScript中执行HTTP请求的现代API,它提供了一种更简洁、更强大的方式来处理网络请求,:本文主要介绍Jav... 目录前言什么是 fetch 方法基本语法简单的 GET 请求示例代码解释发送 POST 请求示例代码解释

Feign Client超时时间设置不生效的解决方法

《FeignClient超时时间设置不生效的解决方法》这篇文章主要为大家详细介绍了FeignClient超时时间设置不生效的原因与解决方法,具有一定的的参考价值,希望对大家有一定的帮助... 在使用Feign Client时,可以通过两种方式来设置超时时间:1.针对整个Feign Client设置超时时间

C/C++错误信息处理的常见方法及函数

《C/C++错误信息处理的常见方法及函数》C/C++是两种广泛使用的编程语言,特别是在系统编程、嵌入式开发以及高性能计算领域,:本文主要介绍C/C++错误信息处理的常见方法及函数,文中通过代码介绍... 目录前言1. errno 和 perror()示例:2. strerror()示例:3. perror(

CSS去除a标签的下划线的几种方法

《CSS去除a标签的下划线的几种方法》本文给大家分享在CSS中,去除a标签(超链接)的下划线的几种方法,本文给大家介绍的非常详细,感兴趣的朋友一起看看吧... 在 css 中,去除a标签(超链接)的下划线主要有以下几种方法:使用text-decoration属性通用选择器设置:使用a标签选择器,将tex

C++变换迭代器使用方法小结

《C++变换迭代器使用方法小结》本文主要介绍了C++变换迭代器使用方法小结,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一起学习学习吧... 目录1、源码2、代码解析代码解析:transform_iterator1. transform_iterat

C++中std::distance使用方法示例

《C++中std::distance使用方法示例》std::distance是C++标准库中的一个函数,用于计算两个迭代器之间的距离,本文主要介绍了C++中std::distance使用方法示例,具... 目录语法使用方式解释示例输出:其他说明:总结std::distance&n编程bsp;是 C++ 标准

Python获取中国节假日数据记录入JSON文件

《Python获取中国节假日数据记录入JSON文件》项目系统内置的日历应用为了提升用户体验,特别设置了在调休日期显示“休”的UI图标功能,那么问题是这些调休数据从哪里来呢?我尝试一种更为智能的方法:P... 目录节假日数据获取存入jsON文件节假日数据读取封装完整代码项目系统内置的日历应用为了提升用户体验,

Linux换行符的使用方法详解

《Linux换行符的使用方法详解》本文介绍了Linux中常用的换行符LF及其在文件中的表示,展示了如何使用sed命令替换换行符,并列举了与换行符处理相关的Linux命令,通过代码讲解的非常详细,需要的... 目录简介检测文件中的换行符使用 cat -A 查看换行符使用 od -c 检查字符换行符格式转换将

SpringBoot实现数据库读写分离的3种方法小结

《SpringBoot实现数据库读写分离的3种方法小结》为了提高系统的读写性能和可用性,读写分离是一种经典的数据库架构模式,在SpringBoot应用中,有多种方式可以实现数据库读写分离,本文将介绍三... 目录一、数据库读写分离概述二、方案一:基于AbstractRoutingDataSource实现动态