《R语言与农业数据统计分析及建模》学习——logistic回归和poisson回归

本文主要是介绍《R语言与农业数据统计分析及建模》学习——logistic回归和poisson回归,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

        普通线性回归通常用来描述变量y与x之间的线性关系:

y=\beta_0+\beta_1x_1+\cdot \cdot \cdot +\beta_kx_k+\varepsilon

        普通线性模型的假设是:响应变量y是连续型变量而且,服从正态分布分布。但在很多现实情况y并不是正态分布,如:二值问题/多分类问题,计次问题等,这些问题都是广义线性回归的范畴。广义线性回归用于解决因变量不是正态分布的问题。不同的广义线性回归类型,使用不同的连接函数,如下:

一、Logistic回归

        Logistic回归通过使用其固有的logistic函数估计概率,来衡量因变量与一个或多个资变啊领之间的关系。

        R中使用glm()函数拟合Logistic模型。调用格式如下:

glm(formula,family=family.generator,data=data.frame)

        该函数与普通线性回归函数lm()的差异是,需要设置分布族参数(family),即连接函数。

# 导入数据集
# 某省份农田的产量、降水、温度数据集
df<-read.csv("Logistic.csv")
# 展示数据集
str(df)
# 建立广义线性回归模型
# 因变量转为因子型
df$yield<-as.factor(df$yield)
log_glm<-glm(yield~rain+temp,data=df,family="binomial")
summary(log_glm)

# 用建立的模型进行预测
df_new<-data.frame(temp=c(16.5,18.9),rain=c(210,246))
y_pred<-predict(object=log_glm,newdata=df_new,type="response")
y_pred

        结果:预测值返回的是概率值。1的产量为y的概率为0.0023,2的产量为y的概率是0.9998

二、Poisson回归

        Poisson回归是假设y服从泊松分布,使用连接函数为log(λ),来衡量因变量与自变量之间的关系。

        R中使用glm()函数拟合Poisson模型。

# 导入数据
# 诱导仙客来开花的试验数据
df<-read.csv("Poisson.csv")
# 数据展示
head(df)
# Variety(品种:哑元1~4)
# Regimem(温度方案:哑元1~4)
# Day(白天温度:摄氏度)
# Night(夜间温度:摄氏度)
# Fertilizer(施肥水平:哑元1~4)
# Flowers(花的数目)# 将变量转为因子型
df$Variety<-as.factor(df$Variety)
df$Regimem<-as.factor(df$Regimem)
df$Fertilizer<-as.factor(df$Fertilizer)# 建立Poisson回归模型
fit<-glm(Flowers~Variety+Regimem+Fertilizer,family=poisson(link="log"),data=df)
# 对拟合结果进行卡方检验
anova(fit,test="Chisq")

        结果显示,fertilizer对flowers的影响不显著,下面尝试逐步回归对模型进行精简。

# 尝试逐步回归
fit_new<-step(fit)
# 比较逐步回归前后两个模型的结果
anova(fit,fit_new,test="Chisq")

       逐步回归剔除了Fertilizer变量,而且两个回归模型对比分析,二者之间差异不显著,所以可以使用逐步回归后的模型。

这篇关于《R语言与农业数据统计分析及建模》学习——logistic回归和poisson回归的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/950924

相关文章

R语言中的正则表达式深度解析

《R语言中的正则表达式深度解析》正则表达式即使用一个字符串来描述、匹配一系列某个语法规则的字符串,通过特定的字母、数字及特殊符号的灵活组合即可完成对任意字符串的匹配,:本文主要介绍R语言中正则表达... 目录前言一、正则表达式的基本概念二、正则表达式的特殊符号三、R语言中正则表达式的应用实例实例一:查找匹配

Go语言结构体标签(Tag)的使用小结

《Go语言结构体标签(Tag)的使用小结》结构体标签Tag是Go语言中附加在结构体字段后的元数据字符串,用于提供额外的属性信息,这些信息可以通过反射在运行时读取和解析,下面就来详细的介绍一下Tag的使... 目录什么是结构体标签?基本语法常见的标签用途1.jsON 序列化/反序列化(最常用)2.数据库操作(

Python在二进制文件中进行数据搜索的实战指南

《Python在二进制文件中进行数据搜索的实战指南》在二进制文件中搜索特定数据是编程中常见的任务,尤其在日志分析、程序调试和二进制数据处理中尤为重要,下面我们就来看看如何使用Python实现这一功能吧... 目录简介1. 二进制文件搜索概述2. python二进制模式文件读取(rb)2.1 二进制模式与文本

C#实现将XML数据自动化地写入Excel文件

《C#实现将XML数据自动化地写入Excel文件》在现代企业级应用中,数据处理与报表生成是核心环节,本文将深入探讨如何利用C#和一款优秀的库,将XML数据自动化地写入Excel文件,有需要的小伙伴可以... 目录理解XML数据结构与Excel的对应关系引入高效工具:使用Spire.XLS for .NETC

MySQL数据目录迁移的完整过程

《MySQL数据目录迁移的完整过程》文章详细介绍了将MySQL数据目录迁移到新硬盘的整个过程,包括新硬盘挂载、创建新的数据目录、迁移数据(推荐使用两遍rsync方案)、修改MySQL配置文件和重启验证... 目录1,新硬盘挂载(如果有的话)2,创建新的 mysql 数据目录3,迁移 MySQL 数据(推荐两

Python数据验证神器Pydantic库的使用和实践中的避坑指南

《Python数据验证神器Pydantic库的使用和实践中的避坑指南》Pydantic是一个用于数据验证和设置的库,可以显著简化API接口开发,文章通过一个实际案例,展示了Pydantic如何在生产环... 目录1️⃣ 崩溃时刻:当你的API接口又双叒崩了!2️⃣ 神兵天降:3行代码解决验证难题3️⃣ 深度

MySQL快速复制一张表的四种核心方法(包括表结构和数据)

《MySQL快速复制一张表的四种核心方法(包括表结构和数据)》本文详细介绍了四种复制MySQL表(结构+数据)的方法,并对每种方法进行了对比分析,适用于不同场景和数据量的复制需求,特别是针对超大表(1... 目录一、mysql 复制表(结构+数据)的 4 种核心方法(面试结构化回答)方法 1:CREATE

详解C++ 存储二进制数据容器的几种方法

《详解C++存储二进制数据容器的几种方法》本文主要介绍了详解C++存储二进制数据容器,包括std::vector、std::array、std::string、std::bitset和std::ve... 目录1.std::vector<uint8_t>(最常用)特点:适用场景:示例:2.std::arra

C语言逗号运算符和逗号表达式的使用小结

《C语言逗号运算符和逗号表达式的使用小结》本文详细介绍了C语言中的逗号运算符和逗号表达式,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一起学习... 在C语言中逗号“,”也是一种运算符,称为逗号运算符。 其功能是把两个表达式连接其一般形式为:表达

Go语言实现桥接模式

《Go语言实现桥接模式》桥接模式是一种结构型设计模式,它将抽象部分与实现部分分离,使它们可以独立地变化,本文就来介绍一下了Go语言实现桥接模式,感兴趣的可以了解一下... 目录简介核心概念为什么使用桥接模式?应用场景案例分析步骤一:定义实现接口步骤二:创建具体实现类步骤三:定义抽象类步骤四:创建扩展抽象类步