96SEO 2026-02-19 21:32 23
我们首先要知道这个皮尔逊相关系数里面的两个概念我们的系数的计算要使用到这两个概念一个就是总体的均值就是求和之后求解平均值xy各是一组数据我们使用这个x里面的数据减去第一组的均值乘上第二组的数值减去均值然后做乘法求和除以on就是这个两组数据的协方差

皮尔逊相关系数就是在协方差的基础上面除以各自对应的标准差这个除以标准差的过程实际上就是进行的这个标准化的过程这个标准化之后的协方差就是我们的皮尔逊相关系数
我们的总体的皮尔逊相关系数是除以这个数组的个数n,但是这个样本的皮尔逊相关系数是除以这个n-1,这个就是两者在计算上面的区别
上面的这个无论是总体的皮尔逊相关系数还是样本的皮尔逊相关系数都是为了让我们了解这个背后的计算方法在实际的数学建模里面我们是使用的相关的数学软件里面的函数直接进行这个计算的并不会用到上面的理论知识但是只有了解这些理论知识当我们的结果计算出来的时候我们才可以让这个结果结合理论对于我们的题目进行描述性说明达到我们的建模的效果
通过上面的这个图形我们也可以看出来同样是0.816的系数我们的散点图的绘制效果完全不同这个就是因为我们的这个皮尔逊相关系数使用是有自己的条件的如果我们无论是什么模型都去计算这个皮尔逊相关系数其实是没有他的真实含义的
实际上只有两个变量之间是线性相关这个相关系数的求解计算才会有实际意义因此这个就要求我们首先要进行这个可视化做出来这个散点图根据这个散点图去判断我们的这个两个变量之间是否满足线性相关只有满足的情况下我们再去计算这个皮尔逊相关系数
对于上面的这四张图片我们进行下面的解释就是这个皮尔逊相关系数即使是一样的但是这个实际情况却截然不同第一个图像上面的数据点显然不是线性相关的但是这个皮尔逊相关系数的计算结果显示这个数据集具有很强的相关性离散的点对于这个皮尔逊系数的影响也很大最后一张图的那个根本就没有相关关系但是这个计算结果却很大实际上这个计算结果是没有实际意义的
因此我们进行总结当两个变量之间满足线性相关的时候结果大就说明两个变量的相关性强小就是两个变量的相关性弱但是如果这两个变量就没有相关性这个时候即使计算结果很大也不能说明两个变量之间具有较强的相关性
下面这个就是多组向量我们可以先进行可视化的工作然后根据这个可视化的结果去判断这个是否满足线性相关满足的话我们就是用这个corr函数进行皮尔逊相关系数的计算
但是对于这样的数据类赛题我们拿到这个数据之后最好是进行一下这个数据的描述性分析就是计算这个数据的平均值方差之类的获得这个数据的数字特征利于我们后续的分析
我们使用下面的这个基本的计算方差均值标准差之类的函数对于这个数据的数字特征进行计算和说明这个是我们的准备工作然后我们就可以去调用这个corrcoef函数你进行这个相关系数的计算这个计算结果就是一个6*6的矩阵表示这6个变量之间一一对应的相关系数因为这个1和22和1的这个相关系数应该是一样的因此使用这个函数输出的这个矩阵也是一个对称矩阵只需要看一半就可以知道任意两组数据之间的相关关系
在这个数学建模的时候很多的情况下我们都需要导入数据这个时候我们就需要去学习导入数据的方法以及使用数据的代码
选择我们想要导入的数据不要复制这个表头例如这个x,y之类的我们只需要复制这个数据因为这个就算我们把这个x,y复制过去这个也是被视为0的因为这个xy不是数值型数据
首先就是右键点击新建然后新建一个变量把我们的这个数据粘贴进去即可这个时候的变量就导入进去了我们可以创建一个x一个y进行演示
我们再右键工作区保存两个数据xy,这个时候命名这个数据集合是data.mat,这个后缀是我们的系统自动加上的我们只需要进行这个名字的修改即可
这个时候如果我们在这个编程的过程中需要使用到上面的数据这个时候我们的代码里面就可以使用load文件的名字这个时候我们需要的数据就导入了进来这个就是导入数据的方法
假设性检验的前提就是我们需要有原假设下面的这个例子就是一个班级上面的30名同学。
我们假设这个班级的平均成绩在80分左右这个就是一个原假设
显著性水平α表示我们的原来的假设不成立的概率这个概率一般都会比较小
我们假设这个符合正态分布那么这个70,90就是两个临界值如果我们取出一个同学的成绩在这个区间里面那么这个就可以说明我们的原假设成立如果不在这个区间里面就说明我们的原假设不成立这个不成立的时候就是第一类错误因为这个不成立的概率很小我们却遇到了
首先就是有一个原假设这个里面涉及到了这个概率密度函数和累积密度函数统计量等诸多的数学概念我们如果没学过就只需要知道这个具体的比较至于这个相关的函数以及具体的计算我就不在赘述了
就是我们的这个标准化后的检验值是不是在这个接受域里面如果是我们就接受原假设否则就拒绝原假设这个接受域的计算和我们的置信水平有关置信水平越高我们接受原假设的概率越大大概就是这个样子的
为什么会有这个p值判断法就是这个皮尔逊相关系数的检验方法太复杂我们使用这个p值来简化这个流程且这个运用我们的累计密度函数
下面的一个验证正态分布的方法就是基于p值进行的就是通过打印这个p值来判断是否满足我们的正态分布
想要对于这个皮尔逊相关系数进行假设性检验首先这个数据需要满足我们的正态分布小样本数据我们可以使用威克尔检验查看这个数据之间是否在满足正态分布大样本的数据需要使用JB检验查看是否满足正态分布
使用这个JB检验需要调用这个jbtest函数这个函数的第一个参数就是需要进行检验的向量第二个参数就是我们的自由度下面这个实例里面的自由度就是2
我们这个输出结果里面实际上是有0有1的这个时候输出结果是0的表示的就是这个对应的行和列代表的变量之间拒绝原假设
同时使用两个相关系数进行分析出现的这个右上角的型号表示的是这个相关性的显著程度
因为这个皮尔逊相关系数基本上进行假设检验的时候是很难满足我们的正态分布的因此我们大部分情况下使用的都是这个斯皮尔曼相关系数来进行这个求解问题
作为专业的SEO优化服务提供商,我们致力于通过科学、系统的搜索引擎优化策略,帮助企业在百度、Google等搜索引擎中获得更高的排名和流量。我们的服务涵盖网站结构优化、内容优化、技术SEO和链接建设等多个维度。
| 服务项目 | 基础套餐 | 标准套餐 | 高级定制 |
|---|---|---|---|
| 关键词优化数量 | 10-20个核心词 | 30-50个核心词+长尾词 | 80-150个全方位覆盖 |
| 内容优化 | 基础页面优化 | 全站内容优化+每月5篇原创 | 个性化内容策略+每月15篇原创 |
| 技术SEO | 基本技术检查 | 全面技术优化+移动适配 | 深度技术重构+性能优化 |
| 外链建设 | 每月5-10条 | 每月20-30条高质量外链 | 每月50+条多渠道外链 |
| 数据报告 | 月度基础报告 | 双周详细报告+分析 | 每周深度报告+策略调整 |
| 效果保障 | 3-6个月见效 | 2-4个月见效 | 1-3个月快速见效 |
我们的SEO优化服务遵循科学严谨的流程,确保每一步都基于数据分析和行业最佳实践:
全面检测网站技术问题、内容质量、竞争对手情况,制定个性化优化方案。
基于用户搜索意图和商业目标,制定全面的关键词矩阵和布局策略。
解决网站技术问题,优化网站结构,提升页面速度和移动端体验。
创作高质量原创内容,优化现有页面,建立内容更新机制。
获取高质量外部链接,建立品牌在线影响力,提升网站权威度。
持续监控排名、流量和转化数据,根据效果调整优化策略。
基于我们服务的客户数据统计,平均优化效果如下:
我们坚信,真正的SEO优化不仅仅是追求排名,而是通过提供优质内容、优化用户体验、建立网站权威,最终实现可持续的业务增长。我们的目标是与客户建立长期合作关系,共同成长。
Demand feedback