如何用purrr::map_dfr()处理长度不一/含缺失值的日期列表?
如何用purrr::map_dfr()处理长度不一、含缺失值的日期列表
可以用purrr::map_dfr()实现需求,之前报错的原因是**map_dfr()要求每个迭代返回的数据是数据框或命名原子向量**,而直接调用max()返回的是无命名的单个值,导致dplyr::bind_rows()无法识别结构;同时你误用了.id参数——该参数是用来生成标记原列表元素序号的列,不是结果列的名称。
正确实现方式
以下两种方法都能通过map_dfr()得到你需要的结果:
方法1:让迭代函数返回tibble
library(tidyverse) date_list <- list(as.Date('2020-01-01'), c(as.Date('2021-01-01'), as.Date('2021-06-01')), NA_Date_, c(as.Date('2022-01-01'), as.Date('2022-08-01')), as.Date('2023-01-01')) map_dfr(date_list, ~ tibble(latest = max(.x)), .id = "id") |> select(latest) #> # A tibble: 5 × 1 #> latest #> <date> #> 1 2020-01-01 #> 2 2021-06-01 #> 3 NA #> 4 2022-08-01 #> 5 2023-01-01
方法2:让迭代函数返回命名原子向量
map_dfr(date_list, ~ set_names(max(.x), "latest"), .id = "id") |> select(latest) #> # A tibble: 5 × 1 #> latest #> <date> #> 1 2020-01-01 #> 2 2021-06-01 #> 3 NA #> 4 2022-08-01 #> 5 2023-01-01
说明
两种方法的核心都是保证每个列表元素经过max()处理后,输出带有明确列名的结构(tibble或命名向量),这样map_dfr()底层的bind_rows()就能正确拼接结果。如果你不需要原列表元素的序号列,可以省略.id参数。
内容的提问来源于stack exchange,提问作者hvgupta
相关产品推荐
相关产品推荐

