数据统计异常值分析方法
发布时间
阅读量:
阅读量
阅读之前看这里 👉:博主是一名正在学习数据分析的人员,博客内容记录了学习过程中的部分总结,也期待与大家共同进步。在撰写过程中,可能存在诸多疏漏与不足之处,如有疑问,欢迎私信博主进行指正。
博客地址:天阑之蓝的博客,在学习的过程中难免会遇到困难与困惑,希望大家能够在这一过程中不断肯定自我、突破自我,并最终实现自我价值。
在构建机器学习模型或运用统计方法时,错误数据或异常值往往构成一个较为突出的问题,这类数据通常是由于测量偏差或系统运行中的特殊状况所导致的,并无法反映实际系统的本质特征。事实上,在开展后续分析工作前,应当优先完成对异常值的识别与处理。在特定情境下,这些异常数据也可能揭示出系统中某些区域存在的非典型现象;因此,对异常值的识别具有重要意义,因为这一过程能够为数据集提供额外的信息支持。当前已有多种技术手段可用于异常值检测,并可根据实际情况自主决定是否将其从原始数据中剔除。
文章目录
- 1.基础统计分析
- 2.3\sigma判定准则
- 3. 箱线图分析法
- 4.异常值识别技术
- 4.1 模型驱动的异常检测方式
- 4.2 基于邻近关系的异常点识别方法
- 4.3 密度分布导向的异常点检测策略
- 4.4 利用聚类算法进行异常点识别的技术路径
常用的技术手段包括
全部评论 (0)
还没有任何评论哟~
