You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何合并DataFrame中同名作者频次?str_replace_all无效果求助

解决R中作者姓名合并与频次求和问题

一、排查替换失效的常见原因

  • 未加载stringr包:str_replace_all是stringr专属函数,未加载包的话无法正常执行,需先运行library(stringr)。
  • 字符串匹配失败:姓名可能存在隐藏空格(前后空格、中间多空格),导致精确匹配"Rodriguez A"找不到对应项。
  • 对象重名干扰:确认authortable是你要操作的目标DataFrame,没有同名对象覆盖。

二、完整解决流程

假设你的频次列名为freq,按以下步骤操作:

  1. 加载依赖包并清理字符串
library(stringr)
library(dplyr)

# 清理姓名列的前后空格,消除匹配干扰
authortable$AU <- trimws(authortable$AU)
  1. 精准替换姓名
    如果直接精确匹配无效,用正则匹配处理可能的空格差异:
# 匹配所有"Rodriguez A"(支持中间任意数量空格)并替换为"Rodriguez AR"
authortable$AU <- str_replace_all(authortable$AU, "^Rodriguez\\s+A$", "Rodriguez AR")
  1. 按作者姓名合并频次求和
# 分组求和,得到合并后的结果
merged_auth <- authortable %>%
  group_by(AU) %>%
  summarise(total_freq = sum(freq, na.rm = TRUE))

将代码中的freq替换为你实际的频次列名称即可。

三、备选灵活匹配方案

如果存在更多姓名变体(比如缩写不一致),可以用case_when批量匹配:

authortable$AU <- case_when(
  str_detect(authortable$AU, "^Rodriguez\\s*A(?!R)") ~ "Rodriguez AR", # 匹配Rodriguez A且后面没有R的情况
  TRUE ~ authortable$AU
)

内容的提问来源于stack exchange,提问作者Antonio Rodriguez Andres

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.05 14:02:21