如何在stm()函数中无缝纳入Quanteda DFM自带的Year文档变量
解决方案:在STM中纳入Quanteda DFM的Year文档变量
提取Year变量:从你的quanteda DFM中直接提取文档变量
Year,用quanteda内置的docvars()函数:year_covariate <- docvars(your_dfm, "Year")若
Year是分类变量,建议转为因子类型:year_covariate <- as.factor(docvars(your_dfm, "Year"))传入STM模型:利用
stm()函数的covariates和prevalence参数实现无缝纳入:- 基础用法:仅将
Year作为协变量传入(后续可用于主题分析的其他环节):stm_model <- stm(documents = your_dfm, covariates = data.frame(Year = year_covariate), K = 你的主题数量) - 进阶用法:让
Year影响主题的流行度(即每个文档的主题分布概率),通过prevalence参数指定公式:stm_model <- stm(documents = your_dfm, covariates = data.frame(Year = year_covariate), prevalence = ~ Year, K = 你的主题数量)
- 基础用法:仅将
注意事项:quanteda生成的DFM在传入
stm()时会自动转换为STM所需的格式,但文档变量会被保留,因此直接用docvars()提取不会有问题。
内容的提问来源于stack exchange,提问作者Connor
相关产品推荐
相关产品推荐

