R中VIM::knn()插补Pima Indian Dataset时,使用全属性还是部分属性行?
VIM::knn() 插补的行使用规则
VIM::knn()做K近邻插补时,不会只局限于所有属性都无缺失的行,而是会利用所有有部分非NA属性的行参与计算。- 计算样本间距离时,函数会自动跳过两个样本中存在缺失值的属性,仅基于双方都有有效值的属性来计算相似度。也就是说,只要两个样本存在共同的非缺失属性,就能参与近邻的筛选和插补值的推导。
- 举个实际场景:样本X有5个属性里的3个非NA,样本Y有5个属性里的4个非NA,其中2个属性是双方都有有效值的,那函数就用这2个属性计算两者的距离,X和Y都能成为彼此的候选近邻。
内容的提问来源于stack exchange,提问作者Antonio
相关产品推荐
相关产品推荐

