导语:
本文主要介绍了关于python缺失值的解决方法的相关知识,包括python用均值填充缺失值,以及python含有缺失值的均值这些编程知识,希望对大家有参考作用。
解决方法
1、忽视元组。
这通常在缺少类标签时进行(假设挖掘任务与分类相关)并且效果较差,除非元组具有多个属性的缺失值。当每个属性的缺失值百分比变化很大时,它的性能特别差。
2、人工填写缺失值。
一般来说,这种方法耗时较长,在数据集较大且缺失值较多的情况下可能无法实现。
3、使用全局常量填充缺失值。
用相同的常数(如未知或负数)替换缺失的属性值。如果将缺失值替换为未知,挖掘程序可能会认为形成了一个有趣的概念。因为有相同的值未知。因此,这种方法简单但不可靠。
4. 使用与给定元组相同类型的所有样本的属性均值。
5、使用最可能的值填充缺失值。
它可以通过回归、使用贝叶斯形式化的基于推理的工具和决策树的总结来决定。
实例
import numpy as np
from sklearn.preprocessing import Imputer
imp = Imputer(missing_values='NaN', strategy='mean', axis=0)
import numpy as np
from sklearn.preprocessing import Imputer
###1.使用均值填充缺失值
imp = Imputer(missing_values='NaN', strategy='mean', axis=0)
imp.fit([[1, 2], [np.nan, 3], [7, 6]])
X = [[np.nan, 2], [6, np.nan], [7, 6]]
print(imp.transform(X))
[[4. 2. ]
[6. 3.66666667]
[7. 6. ]]
本文教程操作环境:windows7系统、Python 3.9.1,DELL G3电脑。
本文为原创文章,版权归知行编程网所有,欢迎分享本文,转载请保留出处!
你可能也喜欢
- ♥ python如何对列表进行排序09/03
- ♥ C 或 python 用于文本处理01/06
- ♥ python如何输出换行符08/17
- ♥ 如何在python中使用@contextmanage?01/10
- ♥ python如何引入第三方库08/28
- ♥ python数据结构堆简介11/07
内容反馈