You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

迭代循环结果存入Dataframe时出现行数不匹配问题求助

解决rscopus获取参考文献时合并DataFrame的行数不匹配问题

你遇到的这个“Arguments imply differing number of rows”错误,主要是因为代码里的几个潜在问题:一是用eval(parse())的方式提取标题容易遇到空值(比如有的参考文献没有标题字段),导致生成的临时数据框行数不一致;二是循环里反复用rbind合并初始为NULL的数据框,很容易触发结构不兼容的问题。

下面是修改后的代码,既能解决错误,又能更高效安全地收集所有参考文献标题:

library(rscopus)
library(dplyr)
library(purrr)  # 需要用到这个包的map_dfr和%||%

# 设置API密钥
auth_token_header("d2f02ad55dcfc907212f0e6b216bf847")
akey <- "d2f02ad55dcfc907212f0e6b216bf847"
set_api_key(akey)

# 初始DOI数据框
df <- data.frame(doi = c("10.1109/TPAMI.2018.2798607", "10.1109/CNS.2017.8228696"))

# 定义专门的函数处理单个DOI的参考文献提取
get_ref_titles <- function(target_doi) {
  # 获取文献详情
  paper_data <- abstract_retrieval(target_doi, identifier = "doi")
  
  # 提取参考文献列表,如果该文献没有参考文献就返回空数据框
  refs <- paper_data$content$`abstracts-retrieval-response`$`item`$bibrecord$tail$`bibliography`$reference
  if (is.null(refs)) {
    return(tibble(initial_paper = target_doi, ref_title = character(0)))
  }
  
  # 遍历每个参考文献,安全提取标题(空值用NA替代)
  map_dfr(refs, function(ref_entry) {
    title <- ref_entry$`ref-info`$`ref-title` %||% NA_character_
    tibble(initial_paper = target_doi, ref_title = title)
  })
}

# 批量处理所有DOI,合并结果
df_references <- map_df(df$doi, get_ref_titles)

# 查看最终结果
head(df_references)

关键改进点说明:

  • 替换eval(parse()):直接用列表索引提取标题,避免了动态字符串解析带来的不稳定,也更容易调试。
  • 处理空值和无参考文献的情况:用is.null(refs)判断是否有参考文献,用%||%运算符把空的标题字段替换成NA,确保每一行都有合法值,不会出现行数不匹配。
  • 用map_dfr替代循环rbind:purrr::map_dfr会自动把每个DOI的结果合并成一个统一的DataFrame,比循环里反复rbind效率更高,也更不容易出错。
  • 用tibble替代基础data.frame:tibble对数据结构的兼容性更好,减少了类型转换带来的问题。

如果你还没装purrr包,先运行install.packages("purrr")安装即可。

内容的提问来源于stack exchange,提问作者Elr Mant

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.05.11 08:47:03