随机森林文本分类模型能否通过参数设置指定输出类别数量
解答
不能通过给RandomForestClassifier添加初始化参数的方式,直接指定模型输出的类别数量。
随机森林分类器的输出类别完全由训练阶段传入的标签数据决定,没有专门的初始化参数用来人为设定输出类别数:
- 如果你需要模型最终预测只输出2个类别,不需要修改当前的模型初始化代码,只要在数据预处理环节把训练集标签处理成仅包含2个目标类别即可:既可以直接过滤掉不属于这两个类别的样本,也可以按照业务规则把原有多类标签映射合并为2类,再用处理好的标签训练模型。
- 要是你传入训练的标签本身包含超过2个类别,不管怎么调整初始化参数,模型最终都会按训练数据里实际存在的所有类别输出预测结果,没法靠参数强行限制成2类。
你当前写的随机森林初始化代码本身是合法可用的,只要喂给模型的训练标签是2个类别,训练完成后的预测结果自然就只会输出这两个类别。
内容的提问来源于stack exchange,提问作者o akka
相关产品推荐
相关产品推荐

