由于网易不能使用LaTex插件,所以这里均没有写数学公式,如果想找数学公式请Google。
书到用时方恨少,不仅文科是这样,理科更是这样。
想想大学时候,我们学习数学的目的也就是为了考试,从来没有想过它们能解决什么实际问题。但是现在想想,我们真是错了。数学其实就是来自生活。
话题一转,如果是搞科研不懂得一些数学知识,你还怎么混?现在由于自己在Metric Space空间下,需要去研究自己的一些科研问题,有时候还会用打到PCA,k-means···等一些算法。其实这些算法大多有着强大的数学支持。
最近一直围绕着方差,协方差,协方差矩阵在思考问题,索性就参考一些博文加上自己的理解去思考一些问题吧。
统计学的基本概念
期望
离散型随机变量的一切可能的取值xi与对应的概率Pi(=xi)之积的和称为该离散型随机变量的数学期望(设级数绝对收敛),记为 E(x)。随机变量最基本的数学特征之一。它反映随机变量平均取值的大小。又称期望或均值。
方差
方差是各个数据与平均数之差的平方的平均数。在概率论和数理统计中,方差(英文Variance)用来度量随机变量和其数学期望(即均值)之间的偏离程度。在许多实际问题中,研究随机变量和均值之间的偏离程度有着很重要的意义。
方差刻画了随机变量的取值对于其数学期望的离散程度。
方差深入:
很显然,均值描述的是样本集合的中间点,它告诉我们的信息是很有限的,而标准差给我们描述的则是样本集合的各个样本点到均值的距离之平均。以这两个集合为例,[0,8,12,20]和[8,9,11,12],两个集合的均值都是10,但显然两个集合差别是很大的,计算两者的标准差,前者是8.3,后者是1.8,显然后者较为集中,故其标准差小一些,标准差描述的就是这种“散布度”。之所以除以n-1而不是除以n,是因为这样能使我们以较小的样本集更好的逼近总体的标准差,即统计上所谓的“无偏估计”。而方差则仅仅是标准差的平方。
标准差
标准差(Standard Deviation) ,也称均方差(mean square error),是各数据偏离平均数的距离的平均数,它是离均差平方和平均后的方根,用σ表示。标准差是方差的算术平方根。标准差能反映一个数据集的离散程度。平均数相同的,标准差未必相同。
协方差
协方差分析是建立在方差分析和回归分析基础之上的一种统计分析方法。 方差分析是从质量因子的角度探讨因素不同水平对实验指标影响的差异。一般说来,质量因子是可以人为控制的。 回归分析是从数量因子的角度出发,通过建立回归方程来研究实验指标与一个(或几个)因子之间的数量关系。但大多数情况下,数量因子是不可以人为加以控制的。
在概率论和统计学中,协方差用于衡量两个变量的总体误差。而方差是协方差的一种特殊情况,即当两个变量是相同的情况。
上面几个统计量看似已经描述的差不多了,但我们应该注意到,标准差和方差一般是用来描述一维数据的,但现实生活我们常常遇到含有多维数据的数据集,最简单的大家上学时免不了要统计多个学科的考试成绩。面对这样的数据集,我们当然可以按照每一维独立的计算其方差,但是通常我们还想了解更多,比如,一个男孩子的猥琐程度跟他受女孩子欢迎程度是否存在一些联系啊,嘿嘿~协方差就是这样一种用来度量两个随机变量关系的统计量。
协方差的结果有什么意义呢?如果结果为正值,则说明两者是正相关的(从协方差可以引出“相关系数”的定义),也就是说一个人越猥琐就越受女孩子欢迎,嘿嘿,那必须的~结果为负值就说明负相关的,越猥琐女孩子越讨厌,可能吗?如果为0,也是就是统计上说的“相互独立”。
总结
必须要明确一点,协方差矩阵计算的是不同维度之间的协方差,而不是不同样本之间的。
理解协方差矩阵的关键就在于牢记它计算的是不同维度之间的协方差,而不是不同样本之间,拿到一个样本矩阵,我们最先要明确的就是一行是一个样本还是一个维度,心中明确这个整个计算过程就会顺流而下,这么一来就不会迷茫了~
分享到:
相关推荐
总结来说,方差协方差矩阵是量化分析中不可或缺的一部分,它提供了关于数据波动性和变量间关系的全面信息,对投资决策和风险控制具有重要的指导作用。在处理多变量问题时,理解并熟练运用方差和协方差的概念及计算...
【方差协方差矩阵】是统计学和金融分析中常用的一种工具,它用于衡量多个变量之间的变异性和相互关系。在投资领域,方差代表一个资产收益率的波动程度,而协方差则度量两个资产收益率之间的关联性。在本PPT学习教案...
本文的目的是通过模糊性和模糊性厌恶的概念将不确定方差-协方差纳入均值方差投资组合模型。 本研究中开发的方法在数值上比较了收益歧义性和方差歧义性的影响。 尤其是,应通过股指数据重新检查不确定的方差-协方差...
4. 可视化协方差:可以使用`imagesc`或`heatmap`函数绘制协方差矩阵的图像,帮助直观理解变量间的相关性。 例如,如果我们有数据矩阵`Data`,可以这样操作: ```matlab % 加载数据 load('协方差分析.mat'); % ...
在C#编程环境中,协方差矩阵、相关系数矩阵以及它们的特征值是统计学和数据分析中的重要概念,尤其在处理多元数据集时。本文将详细介绍这些概念,并提供C#实现这些计算的方法。 首先,我们要理解协方差矩阵。协方差...
对于 \(p\) 个变量的数据集,其协方差矩阵是一个 \(p \times p\) 的对称矩阵,其中对角线元素是各变量的方差,非对角线元素是相应变量之间的协方差。协方差矩阵的计算公式如下: \[ \Sigma = \begin{bmatrix} Var(X...
协方差矩阵是统计学和线性代数中一个重要的概念,它被用来描述多变量数据集的统计特性,特别是各变量之间的相关性。在本文中,我们将探讨协方差矩阵的几何解释,以及它与数据形状、线性变换和特征分解的关系。 首先...
协方差矩阵是概率论和统计学中重要的概念,它是描述随机变量之间相关性的一个重要工具。在这个PPT学习教案中,我们将详细介绍协方差矩阵的定义、性质和应用。 一、协方差矩阵的定义 协方差矩阵是描述随机变量之间...
对于二维或多维数据,协方差矩阵的对角线元素表示每个特征的方差,非对角线元素表示特征间的协方差。在GMM中,每个高斯分量都有自己的协方差矩阵,用于捕捉该聚类内数据点的分布形态和方向。 **协方差矩阵求解** 在...
文章目录一、 协方差1、为什么需要协方差2、协方差的定义二、协方差矩阵1、协方差矩阵的定义2、协方差矩阵公式推导参考博客 一、 协方差 1、为什么需要协方差 定义:假如有N个样本的集合{X1,X2,…XNX_1,X_2,…X_NX1...
协方差矩阵是一种统计学工具,用于衡量两个变量之间的关联程度和方向。在信号处理、机器学习和图像处理等领域,协方差矩阵有着广泛的...如果你正在处理类似的任务,了解汇编语言和协方差矩阵的基本概念是非常重要的。
协方差矩阵的对角线元素表示各特征自身的方差,即该特征的分散程度;非对角线元素表示特征之间的协方差,揭示它们之间的相互关系。 例如,图2所示的二维数据,我们可以通过计算x方向和y方向上的方差来理解数据的...
2. 计算协方差矩阵:协方差矩阵用于度量不同特征之间的线性关系。矩阵的对角线元素表示各个特征自身的方差,非对角线元素表示特征之间的协方差。协方差矩阵的大小为n×n,其中n是特征的数量。 3. 计算特征值和特征...
1. **标准化**:由于不同变量可能具有不同的尺度,因此在计算协方差矩阵之前,通常会先对数据进行中心化,即将各变量减去其均值,然后除以标准差,使得所有变量具有相同的单位。 2. **计算协方差矩阵**:应用到标准...
基础数据处理部分详细描述了如何根据历史收益率数据计算股票的平均收益率、不同股票之间的协方差以及协方差矩阵。协方差矩阵反映了投资组合中所有资产之间的相关性结构,是优化模型中不可或缺的一部分。 模型建立中...
在高维数据处理中,协方差矩阵的估计往往面临样本量不足的问题,这可能导致估计的不稳定性和过大的方差。为了解决这个问题,研究者们提出了各种收缩算法,以改善协方差矩阵的估计质量。本篇文章将详细讨论...
概率统计矩与协方差矩阵是统计学中的基本概念,尤其在处理多元随机变量时具有重要意义。矩是描述随机变量分布形状的量,而协方差矩阵则是衡量多个随机变量之间关联性的工具。 一、矩的概念 矩分为原点矩和中心矩。...