《Excel数据可视化:一样的数据不一样的图表》——2.2 表示数据稳定性的标准差和变异系数

简介: 本节书摘来自华章计算机《Excel数据可视化:一样的数据不一样的图表》一书中的第2章,第2.2节,作者 恒盛杰资讯,更多章节内容可以访问云栖社区“华章计算机”公众号查看。 2.2 表示数据稳定性的标准差和变异系数 在统计学领域中,概率论是统计学的一个分支,而随机变量是概率论的一个方面。

本节书摘来自华章计算机《Excel数据可视化:一样的数据不一样的图表》一书中的第2章,第2.2节,作者 恒盛杰资讯,更多章节内容可以访问云栖社区“华章计算机”公众号查看。

2.2 表示数据稳定性的标准差和变异系数

screenshot

在统计学领域中,概率论是统计学的一个分支,而随机变量是概率论的一个方面。随机变量的分布描述了随机现象的统计规律,然而对于许多实际问题,随机变量的分布并不容易求得;另外,有一些实际问题往往并不直接对分布感兴趣,而只感兴趣分布的少数几个特征指标,称之为随机变量的数字特征。其中最主要的就是期望值、方差和标准差。如果要表示数据稳定性的统计量,则一般会用标准差和变异系数。

screenshot

其实在统计学中,表示数据离散程度的统计量除了本节要详细介绍的标准差和变异系数外,还有常用的极差(最大值减去最小值)、方差、离均差平方和。它们都是依靠平均值得来的,而彼此之间又有着千丝万缕的关系。

极差:是指一组测量值内最大值与最小值之差,又称范围误差或全距。极差没有充分利用数据的信息,但计算十分简单,仅适用样本容量较小(n<10)的情况。

screenshot

方差:方差是各个数据分别与其和的平均数之差的平方的和的平均数,用字母D表示,其公式可表示为:D(X)=E(x2)-[E(x2)],也就是平方的平均减去平均的平方。在概率论和数理统计中,方差(英文Variance)用来度量随机变量和其数学期望(即均值)之间的偏离程度。

screenshot

离均差平方和:是计算每个观察值与平均数的差,然后将其平方后相加,是统计离散趋势的重要指标之一,其公式表示为:SS=∑(X-N)2

screenshot

变异系数:当需要比较两组数据离散程度大小的时候,如果两组数据的测量尺度相差太大,或者数据量纲不同,直接使用标准差来进行比较是不合适的,此时应当消除测量尺度和量纲的影响,使用变异系数就可以达到这一效果。它是标准差与其平均数的比。变异系数越大说明数据间的差异越大,即数据不稳定。

screenshot

实例 2 根据标准差/变异系数分析两个养猪场的体重差异

有A、B两养猪场地,分别从两场地中随机抽取5个样本猪,称其体重并记录下来,根据测得的样本体重判断哪个养猪场的体重差距更大。

screenshot

screenshot

数据分析

通过步骤 02、步骤 03的操作,计算出两组数据的均值、标准差和变异系数后,可以根据结果作出分析。如果用极值来判断两组数据的离散程度,则A场地中极值为30,B场地极值为5,该统计结果说明B场地猪的体重更集中;如果用标准差来判断,则A场地中的12.1943大于B场地中的2.91548,由于标准差越大,说明数据间的差异也越大,即B场地猪的体重差异更小;如果用变异系数来判断,则A场地中的0.061963大于B场地中的0.014651,由于均值和标准差两两不相等,所以求得的变异系数越大说明变异程度也越大,即B场地猪的体重越稳定。

目录
打赏
0
0
0
0
1408
分享
相关文章
利用Python自动化处理Excel数据:从基础到进阶####
本文旨在为读者提供一个全面的指南,通过Python编程语言实现Excel数据的自动化处理。无论你是初学者还是有经验的开发者,本文都将帮助你掌握Pandas和openpyxl这两个强大的库,从而提升数据处理的效率和准确性。我们将从环境设置开始,逐步深入到数据读取、清洗、分析和可视化等各个环节,最终实现一个实际的自动化项目案例。 ####
599 10
Probly:开源 AI Excel表格工具,交互式生成数据分析结果与可视化图表
Probly 是一款结合电子表格功能与 Python 数据分析能力的 AI 工具,支持在浏览器中运行 Python 代码,提供交互式电子表格、数据可视化和智能分析建议,适合需要强大数据分析功能又希望操作简便的用户。
325 2
自动化数据处理:使用Selenium与Excel打造的数据爬取管道
本文介绍了一种使用Selenium和Excel结合代理IP技术从WIPO品牌数据库(branddb.wipo.int)自动化爬取专利信息的方法。通过Selenium模拟用户操作,处理JavaScript动态加载页面,利用代理IP避免IP封禁,确保数据爬取稳定性和隐私性。爬取的数据将存储在Excel中,便于后续分析。此外,文章还详细介绍了Selenium的基本设置、代理IP配置及使用技巧,并探讨了未来可能采用的更多防反爬策略,以提升爬虫效率和稳定性。
381 4
从Excel到Hadoop:数据规模的进化之路
从Excel到Hadoop:数据规模的进化之路
56 10
招行面试:100万级别数据的Excel,如何秒级导入到数据库?
本文由40岁老架构师尼恩撰写,分享了应对招商银行Java后端面试绝命12题的经验。文章详细介绍了如何通过系统化准备,在面试中展示强大的技术实力。针对百万级数据的Excel导入难题,尼恩推荐使用阿里巴巴开源的EasyExcel框架,并结合高性能分片读取、Disruptor队列缓冲和高并发批量写入的架构方案,实现高效的数据处理。此外,文章还提供了完整的代码示例和配置说明,帮助读者快速掌握相关技能。建议读者参考《尼恩Java面试宝典PDF》进行系统化刷题,提升面试竞争力。关注公众号【技术自由圈】可获取更多技术资源和指导。
不通过navicat工具怎么把查询数据导出到excel表中
不通过navicat工具怎么把查询数据导出到excel表中
84 0
使用OpenPyXL在Excel中创建折线图:数据可视化入门
本文介绍了如何使用Python的`openpyxl`库在Excel中创建折线图,包括安装库、加载Excel文件、定义数据范围、设置图表属性(如标题、轴标签)及保存文件等步骤,适合数据可视化初学者。
154 15
Python实用记录(十):获取excel数据并通过列表的形式保存为txt文档、xlsx文档、csv文档
这篇文章介绍了如何使用Python读取Excel文件中的数据,处理后将其保存为txt、xlsx和csv格式的文件。
343 3
Python实用记录(十):获取excel数据并通过列表的形式保存为txt文档、xlsx文档、csv文档
SpringBoot中大量数据导出方案:使用EasyExcel并行导出多个excel文件并压缩zip后下载
在SpringBoot环境中,为了优化大量数据的Excel导出体验,可采用异步方式处理。具体做法是将数据拆分后利用`CompletableFuture`与`ThreadPoolTaskExecutor`并行导出,并使用EasyExcel生成多个Excel文件,最终将其压缩成ZIP文件供下载。此方案提升了导出效率,改善了用户体验。代码示例展示了如何实现这一过程,包括多线程处理、模板导出及资源清理等关键步骤。
使用Python读取Excel数据
本文介绍了如何使用Python的`pandas`库读取和操作Excel文件。首先,需要安装`pandas`和`openpyxl`库。接着,通过`read_excel`函数读取Excel数据,并展示了读取特定工作表、查看数据以及计算平均值等操作。此外,还介绍了选择特定列、筛选数据和数据清洗等常用操作。`pandas`是一个强大且易用的工具,适用于日常数据处理工作。

热门文章

最新文章

AI助理

你好,我是AI助理

可以解答问题、推荐解决方案等