python數據預處理之缺失值簡單處理：https://blog.csdn.net/Amy_mm/article/details/79799629

該博客總結比較詳細，感謝博主。

我們在進行模型訓練時，不可避免的會遇到某些特征出現空值的情況，下面整理了幾種填充空值的方法

1. 用固定值填充

對於特征值缺失的一種常見的方法就是可以用固定值來填充，例如0，9999， -9999, 例如下面對灰度分這個特征缺失值全部填充為-99

data['灰度分'] = data['灰度分'].fillna('-99')

對於數值型的特征，其缺失值也可以用未缺失數據的均值填充，下面對灰度分這個特征缺失值進行均值填充

data['灰度分'] = data['灰度分'].fillna(data['灰度分'].mean()))

與均值類似，可以用未缺失數據的眾數來填充缺失值

data['灰度分'] = data['灰度分'].fillna(data['灰度分'].mode()))

用前一個數據進行填充

data['灰度分'] = data['灰度分'].fillna(method='pad')

用后一個數據進行填充

data['灰度分'] = data['灰度分'].fillna(method='bfill')

data['灰度分'] = data['灰度分'].interpolate()

from fancyimpute import BiScaler, KNN, NuclearNormMinimization, SoftImpute dataset = KNN(k=3).complete(dataset)

本站轉載的文章為個人學習借鑒使用，本站對版權不負任何法律責任。如果侵犯了您的隱私權益，請聯系本站郵箱yoyou2525@163.com刪除。

猜您在找 缺失值的常見填充方法 spss缺失值填充步驟 pandas缺失值填充時遇到的問題使用Python預測缺失值數據預處理：標稱型特征的編碼和缺失值處理 Python—關於Pandas缺失值問題(國內唯一) Python與矩陣論——特征值與特征向量 Python與矩陣論——特征值與特征向量 Python學習筆記：pd.dropna刪除缺失值 python字典dict處理缺失值的若干方法