Advertisement

Python的数据清洗统计(气象)

阅读量:

需求

数据格式如下:

在这里插入图片描述

我们采用的1至7号大气模式指标分别对应站点多年观测数据的相关性计算。通过显著性检验分析得出其中显著性水平设定的临界相关系数阈值为0.231。在此基础上我们需要做的是:第一阶段找出小于临界值的相关系数指标并置零;第二阶段将非零的相关系数指标按照从大到小排序并按降序排列后赋予相应权重确保各权重之和等于单位一;第三阶段完成上述处理后所得的数据集要求其模式编号与对应的站点编号保持不变以保证后续分析的有效性和一致性。

代码实现

导入包,获得数据

复制代码
    import pandas as pd
    import numpy as np
    data = pd.read_excel("ttt.xlsx",sheet_name="权重")

将index变量赋值为站点名称,并对所有数据执行绝对值运算以避免排序过程中出现负数影响相关系数计算(因为我们在计算相关系数时通常关注其绝对值)

复制代码
    data.index = data["站点"]
    data = data.drop(["站点"],axis=

全部评论 (0)

还没有任何评论哟~