数据分析方法 1.缺失值填充
缺失值:缺失值是指粗糙数据中由于缺少信息而造成的数据的聚类、分组、删失或截断。它指的是现有数据集中某个或某些属性的值是不完全的。(百度词条)
1.1 缺失的类型
1.1.1完全随机缺失(missing completely at random,MCAR):数据缺失是完全随机的,不依赖于任何不完全变量或完全变量。不影响样本的无偏性。如:家庭地址缺失。
1.1.2随机缺失(missing at random,MAR):数据的缺失不是完全随机的,该数据的缺失依赖于其它完全