《R语言与农业数据统计分析及建模》学习——logistic回归和poisson回归

本文主要是介绍《R语言与农业数据统计分析及建模》学习——logistic回归和poisson回归,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

        普通线性回归通常用来描述变量y与x之间的线性关系:

y=\beta_0+\beta_1x_1+\cdot \cdot \cdot +\beta_kx_k+\varepsilon

        普通线性模型的假设是:响应变量y是连续型变量而且,服从正态分布分布。但在很多现实情况y并不是正态分布,如:二值问题/多分类问题,计次问题等,这些问题都是广义线性回归的范畴。广义线性回归用于解决因变量不是正态分布的问题。不同的广义线性回归类型,使用不同的连接函数,如下:

一、Logistic回归

        Logistic回归通过使用其固有的logistic函数估计概率,来衡量因变量与一个或多个资变啊领之间的关系。

        R中使用glm()函数拟合Logistic模型。调用格式如下:

glm(formula,family=family.generator,data=data.frame)

        该函数与普通线性回归函数lm()的差异是,需要设置分布族参数(family),即连接函数。

# 导入数据集
# 某省份农田的产量、降水、温度数据集
df<-read.csv("Logistic.csv")
# 展示数据集
str(df)
# 建立广义线性回归模型
# 因变量转为因子型
df$yield<-as.factor(df$yield)
log_glm<-glm(yield~rain+temp,data=df,family="binomial")
summary(log_glm)

# 用建立的模型进行预测
df_new<-data.frame(temp=c(16.5,18.9),rain=c(210,246))
y_pred<-predict(object=log_glm,newdata=df_new,type="response")
y_pred

        结果:预测值返回的是概率值。1的产量为y的概率为0.0023,2的产量为y的概率是0.9998

二、Poisson回归

        Poisson回归是假设y服从泊松分布,使用连接函数为log(λ),来衡量因变量与自变量之间的关系。

        R中使用glm()函数拟合Poisson模型。

# 导入数据
# 诱导仙客来开花的试验数据
df<-read.csv("Poisson.csv")
# 数据展示
head(df)
# Variety(品种:哑元1~4)
# Regimem(温度方案:哑元1~4)
# Day(白天温度:摄氏度)
# Night(夜间温度:摄氏度)
# Fertilizer(施肥水平:哑元1~4)
# Flowers(花的数目)# 将变量转为因子型
df$Variety<-as.factor(df$Variety)
df$Regimem<-as.factor(df$Regimem)
df$Fertilizer<-as.factor(df$Fertilizer)# 建立Poisson回归模型
fit<-glm(Flowers~Variety+Regimem+Fertilizer,family=poisson(link="log"),data=df)
# 对拟合结果进行卡方检验
anova(fit,test="Chisq")

        结果显示,fertilizer对flowers的影响不显著,下面尝试逐步回归对模型进行精简。

# 尝试逐步回归
fit_new<-step(fit)
# 比较逐步回归前后两个模型的结果
anova(fit,fit_new,test="Chisq")

       逐步回归剔除了Fertilizer变量,而且两个回归模型对比分析,二者之间差异不显著,所以可以使用逐步回归后的模型。

这篇关于《R语言与农业数据统计分析及建模》学习——logistic回归和poisson回归的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/950924

相关文章

SpringBoot分段处理List集合多线程批量插入数据方式

《SpringBoot分段处理List集合多线程批量插入数据方式》文章介绍如何处理大数据量List批量插入数据库的优化方案:通过拆分List并分配独立线程处理,结合Spring线程池与异步方法提升效率... 目录项目场景解决方案1.实体类2.Mapper3.spring容器注入线程池bejsan对象4.创建

PHP轻松处理千万行数据的方法详解

《PHP轻松处理千万行数据的方法详解》说到处理大数据集,PHP通常不是第一个想到的语言,但如果你曾经需要处理数百万行数据而不让服务器崩溃或内存耗尽,你就会知道PHP用对了工具有多强大,下面小编就... 目录问题的本质php 中的数据流处理:为什么必不可少生成器:内存高效的迭代方式流量控制:避免系统过载一次性

C#实现千万数据秒级导入的代码

《C#实现千万数据秒级导入的代码》在实际开发中excel导入很常见,现代社会中很容易遇到大数据处理业务,所以本文我就给大家分享一下千万数据秒级导入怎么实现,文中有详细的代码示例供大家参考,需要的朋友可... 目录前言一、数据存储二、处理逻辑优化前代码处理逻辑优化后的代码总结前言在实际开发中excel导入很

MyBatis-plus处理存储json数据过程

《MyBatis-plus处理存储json数据过程》文章介绍MyBatis-Plus3.4.21处理对象与集合的差异:对象可用内置Handler配合autoResultMap,集合需自定义处理器继承F... 目录1、如果是对象2、如果需要转换的是List集合总结对象和集合分两种情况处理,目前我用的MP的版本

GSON框架下将百度天气JSON数据转JavaBean

《GSON框架下将百度天气JSON数据转JavaBean》这篇文章主要为大家详细介绍了如何在GSON框架下实现将百度天气JSON数据转JavaBean,文中的示例代码讲解详细,感兴趣的小伙伴可以了解下... 目录前言一、百度天气jsON1、请求参数2、返回参数3、属性映射二、GSON属性映射实战1、类对象映

C# LiteDB处理时间序列数据的高性能解决方案

《C#LiteDB处理时间序列数据的高性能解决方案》LiteDB作为.NET生态下的轻量级嵌入式NoSQL数据库,一直是时间序列处理的优选方案,本文将为大家大家简单介绍一下LiteDB处理时间序列数... 目录为什么选择LiteDB处理时间序列数据第一章:LiteDB时间序列数据模型设计1.1 核心设计原则

GO语言短变量声明的实现示例

《GO语言短变量声明的实现示例》在Go语言中,短变量声明是一种简洁的变量声明方式,使用:=运算符,可以自动推断变量类型,下面就来具体介绍一下如何使用,感兴趣的可以了解一下... 目录基本语法功能特点与var的区别适用场景注意事项基本语法variableName := value功能特点1、自动类型推

GO语言中函数命名返回值的使用

《GO语言中函数命名返回值的使用》在Go语言中,函数可以为其返回值指定名称,这被称为命名返回值或命名返回参数,这种特性可以使代码更清晰,特别是在返回多个值时,感兴趣的可以了解一下... 目录基本语法函数命名返回特点代码示例命名特点基本语法func functionName(parameters) (nam

Java+AI驱动实现PDF文件数据提取与解析

《Java+AI驱动实现PDF文件数据提取与解析》本文将和大家分享一套基于AI的体检报告智能评估方案,详细介绍从PDF上传、内容提取到AI分析、数据存储的全流程自动化实现方法,感兴趣的可以了解下... 目录一、核心流程:从上传到评估的完整链路二、第一步:解析 PDF,提取体检报告内容1. 引入依赖2. 封装

MySQL中查询和展示LONGBLOB类型数据的技巧总结

《MySQL中查询和展示LONGBLOB类型数据的技巧总结》在MySQL中LONGBLOB是一种二进制大对象(BLOB)数据类型,用于存储大量的二进制数据,:本文主要介绍MySQL中查询和展示LO... 目录前言1. 查询 LONGBLOB 数据的大小2. 查询并展示 LONGBLOB 数据2.1 转换为十