基于R语言的含特定关键词/话题标签推文emoji使用分析实现
R语言实现Twitter指定内容推文emoji情感分析实操指南
适配R生态的实现方案
你可以基于rtweet包完成全流程开发,你提供的初始代码存在几处拼写、语法错误,修正后的可用完整代码如下,可实现推文采集、emoji提取、高频emoji统计功能,在此基础上可进一步扩展情感分析能力:
# 安装并加载依赖包 install.packages("rtweet") library(rtweet) install.packages("tidyverse") library(tidyverse) install.packages("tidytext") library(tidytext) install.packages("httpuv") library(httpuv) install.packages("emo") library(emo) # 替换为你在Twitter开发者平台申请的对应密钥 api_key <- '你的api key' api_secret <- '你的api secret' access_token <- '你的access token' access_token_secret <- '你的access token secret' # 完成API身份认证 token <- create_token( app = "你的应用名称", consumer_key = api_key, consumer_secret = api_secret, access_token = access_token, access_secret = access_token_secret) # 按指定话题标签采集推文,示例采集#CleanDishwasher相关非转发、非回复英文推文 tweets <- search_tweets(q ="#CleanDishwasher", n = 18000, include_rts = FALSE, `-filter` = "replies", lang = "en") # 导出采集到的推文到本地csv write_as_csv(tweets, "tweets.csv") # 示例:采集悉尼地区的公开推文 sydney <- lookup_coords("sydney", "country:AU") sydney_tweets <- search_tweets(geocode = sydney) # 提取推文里的emoji并统计出现频次最高的10个emoji sydney_tweets %>% mutate(emoji = ji_extract_all(text)) %>% unnest(cols = c(emoji)) %>% count(emoji, sort = TRUE) %>% top_n(10)
核心流程说明
- 依赖配置:rtweet包负责对接Twitter API采集数据,tidyverse系列包完成数据清洗处理,emo包专门用于文本中emoji的识别和提取,tidytext可支持后续情感分析计算
- 身份认证:你需要先申请Twitter开发者权限,创建应用后获取对应的4组密钥,替换代码中的占位内容即可完成认证
- 数据采集:支持按关键词、话题标签、地理位置等多维度筛选采集你需要的推文内容
- emoji情感扩展:如果要实现emoji情感分析能力,可引入公开的emoji情感标注词典,为每个提取到的emoji匹配对应的情感分值,再按单条推文、所属话题等维度聚合,即可得到对应维度的情感倾向结果
内容的提问来源于stack exchange,提问作者SarahR
相关产品推荐
相关产品推荐

