使用bibliometrix的conceptualStructure时遇CW未找到错误求助
关于
conceptualStructure函数报错object 'CW' not found的原因解析 1. CW是什么?
CW不是你输入的文献数据集M中的字段,而是conceptualStructure函数内部生成的临时变量(大概率是“Cleaned Words”的缩写),用于存储清洗、处理后的词汇矩阵。官方文档不会提及它,因为这是函数内部的中间处理对象,不属于用户需要关注的输入/输出字段。
2. 报错的核心逻辑
你两次调用的参数差异是field="AU"(作者字段)+stemming=TRUE,对比field="DE"(叙词字段)+stemming=FALSE,错误触发的关键在于:
- 作者姓名是专有名词,完全不适合词干提取:词干提取算法会把姓名拆成无意义的片段(比如把“Johnson”处理成“johnson”甚至“johnsoni”),破坏了姓名的完整性,导致处理后没有符合
minDegree=4(至少出现在4篇文献中)的有效词汇。 - 当内部处理后没有满足条件的词汇时,函数本该生成的
CW矩阵就无法被创建,但后续代码依然尝试调用colnames(CW),于是抛出“object 'CW' not found”的错误。
3. 验证与修复建议
- 快速验证:提取
M$AU字段,用bibliometrix的词干提取工具处理后,统计词汇出现频率——你会发现几乎没有词汇能达到minDegree=4的阈值,因为词干提取破坏了姓名的唯一性和重复度。 - 修复方案:
- 处理作者字段时关闭词干提取:
CS <- conceptualStructure(M,field="AU", method="CA", minDegree=4, clust=5, stemming=FALSE, labelsize=10) - 或者降低
minDegree阈值(比如设为2),让函数能生成有效的词汇矩阵。
- 处理作者字段时关闭词干提取:
内容的提问来源于stack exchange,提问作者David Beales
相关产品推荐
相关产品推荐

