【数据分析】数据的离中趋势之二 - 方差和标准差、离散系数

2024-08-20 18:28

本文主要是介绍【数据分析】数据的离中趋势之二 - 方差和标准差、离散系数,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

四、方差和标准差

  • 方差是数据组中各数据值与其算术平均数离差平方的算术平均数。
  • 方差的平方根就是标准差
  • 标准差的本质与平均差基本相同,平均差取绝对值的方法消除离差正负号后用算数平均的方法求平均离差。标准差用平方的方法消除离差的正负号后用离差平方求平均数再开根号。
  • 标准差的性质:
    • 标准差度量了偏离平均数的大小
    • 标准差是一类平均偏差
    • 数列大多数项距离平均数少于1个标准差范围内,极少数项距离平均数 2个 或者 3个标准差以上。

两组工人日产量标准差计算如下:

甲   组乙   组
日产量离差离差平方日产量离差离差平方
xx - 平均数(x - 平均数) 的平方xx - 平均数(x - 平均数) 的平方
4-121447-981
7-98112-416
11-52514-24
14-2414-24
14-2415-11
16001711
17111711
248641939
2598120416
281214425981
合计---548合计---214
  • 甲组方差 = 甲组离差平方的平均值 = 548 / 10 = 54.8
  • 甲组标准差 = 7.40 (件)
  • 乙组方差 = 乙组离差平方的平均值 = 214 / 10 = 21.4
  • 乙组标准差 = 4.63(件)
  • 在甲乙两组工人平均日产量相等(都是16件)的情况下,甲组的标准差(7.40 件)大于乙组的标准差(4.63 件),因而其平均数的代表性比乙组小。

五、离散系数

  • 极差、平均差、标准差都是对数据的离中趋势进行绝对或平均差异的测定。
  • 在通常情况下,它们都带有计量单位,而月其离中趋势大小与变量平均水平的高低有关。
  • 因此,要比较数据平均水平不同的两组数据的离中程度的大小,就有必要计算它们的相对离中程度指标,即离散系数。
  • 常用的离散系数指标是标准差系数。

标准差系数是将一组数据的标准差与其算数平均数对比的结果,以测定其相对离中程度。

例:甲乙两班中,哪个班的平均成绩更具有代表性?

甲班的平均成绩为 70 分,标准差为 9.0 分,乙班的成绩分组如下:

成绩分组学生人数
60以下2
60 - 706
70 - 8025
80 - 9012
90 - 1005

以下分析乙班成绩:

按成绩分组

组中值(x)学生人数(f)xfx - 平均数(x - 平均数)的平方(x - 平均数)的平方 * 人数
60以下552110-22.4501.761003.52
60 - 70656390-12.4153.76922.56
70 - 8075251875-2.45.76144
80 - 90851210207.657.76693.12
90 - 10095547517.6309.761548.8
合计---503870------4312
  • 甲班的平均成绩为 70分,标准差为9.0分,标准差系数为 9.0 / 70 = 0.1286
  • 乙班的平均成绩为 3870 / 50 = 77.4 分
  • 乙班的标准差为 4312 / 50 的开根号 = 9.29 分

由于甲、乙两班成绩的平均值和标准差都不一样,无法使用标准差来比较哪个班的成绩波动大,因此必须使用离散系数来判断。从计算中可以看出:V乙<V甲,所以乙班的成绩波动小一些,则其班级的平均成绩更有代表性。

六、Python 计算 方差、标准差、离散系数

import dash
from dash import dcc, html
from dash.dependencies import Input, Output
import numpy as np# 创建 Dash 应用
app = dash.Dash(__name__)# 应用布局
app.layout = html.Div([html.H1('请输入数据'),dcc.Input(id='input-data', type='text', placeholder='输入数据,用逗号分隔'),html.Button('计算', id='compute-button', n_clicks=0),html.Div(id='output-container')
])# 回调函数,用于处理按钮点击事件
@app.callback(Output('output-container', 'children'),[Input('compute-button', 'n_clicks')],[dash.dependencies.State('input-data', 'value')]
)
def compute_var_std_mean(n_clicks, input_value):if n_clicks > 0:try:# 将输入字符串转换成数字列表data = list(map(float, input_value.split(',')))# 方差variance = np.var(data)# 标准差std_dev = np.std(data)# 均值mean = np.mean(data)# 离散系数coefficient_of_variation = std_dev / mean if mean != 0 else float('inf')# 显示结果output = [f'方差:{variance:.2f}'f'标准差:{std_dev:.2f}',f'离散系数:{coefficient_of_variation:.2f}']return '<br>'.join(output)except Exception as e:return str(e)if __name__ == '__main__':app.run_server(debug=True)

这篇关于【数据分析】数据的离中趋势之二 - 方差和标准差、离散系数的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1090841

相关文章

javaScript在表单提交时获取表单数据的示例代码

《javaScript在表单提交时获取表单数据的示例代码》本文介绍了五种在JavaScript中获取表单数据的方法:使用FormData对象、手动提取表单数据、使用querySelector获取单个字... 方法 1:使用 FormData 对象FormData 是一个方便的内置对象,用于获取表单中的键值

Rust中的BoxT之堆上的数据与递归类型详解

《Rust中的BoxT之堆上的数据与递归类型详解》本文介绍了Rust中的BoxT类型,包括其在堆与栈之间的内存分配,性能优势,以及如何利用BoxT来实现递归类型和处理大小未知类型,通过BoxT,Rus... 目录1. Box<T> 的基础知识1.1 堆与栈的分工1.2 性能优势2.1 递归类型的问题2.2

Python使用Pandas对比两列数据取最大值的五种方法

《Python使用Pandas对比两列数据取最大值的五种方法》本文主要介绍使用Pandas对比两列数据取最大值的五种方法,包括使用max方法、apply方法结合lambda函数、函数、clip方法、w... 目录引言一、使用max方法二、使用apply方法结合lambda函数三、使用np.maximum函数

Redis的数据过期策略和数据淘汰策略

《Redis的数据过期策略和数据淘汰策略》本文主要介绍了Redis的数据过期策略和数据淘汰策略,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一... 目录一、数据过期策略1、惰性删除2、定期删除二、数据淘汰策略1、数据淘汰策略概念2、8种数据淘汰策略

轻松上手MYSQL之JSON函数实现高效数据查询与操作

《轻松上手MYSQL之JSON函数实现高效数据查询与操作》:本文主要介绍轻松上手MYSQL之JSON函数实现高效数据查询与操作的相关资料,MySQL提供了多个JSON函数,用于处理和查询JSON数... 目录一、jsON_EXTRACT 提取指定数据二、JSON_UNQUOTE 取消双引号三、JSON_KE

Python给Excel写入数据的四种方法小结

《Python给Excel写入数据的四种方法小结》本文主要介绍了Python给Excel写入数据的四种方法小结,包含openpyxl库、xlsxwriter库、pandas库和win32com库,具有... 目录1. 使用 openpyxl 库2. 使用 xlsxwriter 库3. 使用 pandas 库

SpringBoot定制JSON响应数据的实现

《SpringBoot定制JSON响应数据的实现》本文主要介绍了SpringBoot定制JSON响应数据的实现,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们... 目录前言一、如何使用@jsonView这个注解?二、应用场景三、实战案例注解方式编程方式总结 前言

使用Python在Excel中创建和取消数据分组

《使用Python在Excel中创建和取消数据分组》Excel中的分组是一种通过添加层级结构将相邻行或列组织在一起的功能,当分组完成后,用户可以通过折叠或展开数据组来简化数据视图,这篇博客将介绍如何使... 目录引言使用工具python在Excel中创建行和列分组Python在Excel中创建嵌套分组Pyt

在Rust中要用Struct和Enum组织数据的原因解析

《在Rust中要用Struct和Enum组织数据的原因解析》在Rust中,Struct和Enum是组织数据的核心工具,Struct用于将相关字段封装为单一实体,便于管理和扩展,Enum用于明确定义所有... 目录为什么在Rust中要用Struct和Enum组织数据?一、使用struct组织数据:将相关字段绑

在Mysql环境下对数据进行增删改查的操作方法

《在Mysql环境下对数据进行增删改查的操作方法》本文介绍了在MySQL环境下对数据进行增删改查的基本操作,包括插入数据、修改数据、删除数据、数据查询(基本查询、连接查询、聚合函数查询、子查询)等,并... 目录一、插入数据:二、修改数据:三、删除数据:1、delete from 表名;2、truncate