为何使用knn()函数时prob返回的比例异常?
基于鸢尾花数据集的KNN物种分类实践
最近我在捣鼓用KNN(k近邻)算法对经典的鸢尾花(iris)数据集做3类物种的预测,先给大家瞅瞅这个数据集的前6行记录:
head(iris)
输出结果:
Sepal.Length Sepal.Width Petal.Length Petal.Width Species 1 5.1 3.5 1.4 0.2 setosa 2 4.9 3.0 1.4 0.2 setosa 3 4.7 3.2 1.3 0.2 setosa 4 4.6 3.1 1.5 0.2 setosa 5 5.0 3.6 1.4 0.2 setosa 6 5.4 3.9 1.7 0.4 setosa
我已经提前创建了数值向量tr和nw,用来把iris数据集拆分成训练数据和待预测的新数据,之后运行了k值为5的KNN模型,同时设置返回分类概率:
knn5 <- knn(iris[tr, -5], iris[nw, -5], iris$Species[nw], k = 5, prob = TRUE)
内容的提问来源于stack exchange,提问作者Ovi
相关产品推荐
相关产品推荐

