在R语言中使用Knn函数时为何出现“train”与“class”长度不同的报错?
乳腺癌数据集项目划分情况说明
我之前留意到这个问题已经有人提过了,翻了好几个平台都没找到能解决问题的正确答案。最近我在做一个学校的项目,得靠着医疗记录和示例手册来推进,目前已经把用到的乳腺癌数据集完成了训练集和测试集的划分,具体情况整理如下:
- 原始数据集总计:569条记录,涵盖 31个变量
- 训练集
wbcd_train:包含469个样本对象,31个变量 - 测试集
wbcd_test:包含100个样本对象,31个变量 - 训练集标签集
wbcd_train_lables:包含469个样本对象,仅1个标签变量
样本数据示例
wbcd_train 单条样本示例:
Radius 17.99, Texture 10.38, Perimeter 122.8, Area 1001, Smoothness 0.1184, Compactness 0.2776, Concavity 0.3001, Concave points 0.1471, Symmetry 0.2419, Fractal dimension 0.07871...(剩余变量内容省略)
内容的提问来源于stack exchange,提问作者Pranav Khanna
相关产品推荐
相关产品推荐

