You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

R语言如何按id和year匹配合并不同长度dataframe并补全NA

你之前的merge仅指定了by = "ID"作为唯一匹配键,导致同ID下的所有年份会做笛卡尔积匹配,无法对应到同年份的记录,只要调整匹配逻辑即可实现需求,以下是两种常用实现方案:

基础R实现(无需额外安装包)

# 直接判断A中的ID+年份组合是否在B中存在,生成year.y列
A$year.y <- ifelse(paste(A$ID, A$year) %in% paste(B$ID, B$year), A$year, NA)
# 重命名A的year列为year.x,和预期格式对齐
colnames(A)[colnames(A) == "year"] <- "year.x"
D <- A

如果偏好merge写法也可以用以下写法,效果完全一致:

# 先重命名B的year列避免合并时被去重
colnames(B)[colnames(B) == "year"] <- "year.y"
# 双匹配键左连接,保留A的所有行
D <- merge(A, B, by.x = c("ID", "year"), by.y = c("ID", "year.y"), all.x = TRUE)
# 重命名A的year列为year.x,和预期格式对齐
colnames(D)[colnames(D) == "year"] <- "year.x"

dplyr实现(tidyverse生态常用写法)

library(dplyr)
D <- A %>%
  rename(year.x = year) %>%
  mutate(year.y = if_else(paste(ID, year.x) %in% paste(B$ID, B$year), year.x, NA_integer_))

两种方案得到的结果都和你给出的预期结构完全一致,可直接运行验证。

内容的提问来源于stack exchange,提问作者CHIA

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.24 04:06:03