如何获取2010年边界下美国2010普查应答率及tidycensus实现
答复
2010年行政边界口径2010年普查应答率获取路径
你此前调用的2010年普查应答率API端点本身就可以返回2010年边界口径的目标数据,不存在额外的特殊获取门槛:
- 你参考的官方指引文档针对的是2020年十年普查应答率数据集,该数据集默认绑定2020年普查行政边界,和你调用的2010年端点不属于同一数据集。
- 2010年decennial responserate API端点原生配套2010年普查地理编码体系,你构造的俄亥俄州tract级数据调用逻辑返回的
GEO_ID字段,和2010年普查官方发布的tract边界文件ID完全一一对应,不存在边界口径错配问题。 - 如果需要获取全美范围同口径数据,只需将调用参数中的州筛选条件删除,设置普查层级为全美团区即可全量拉取。
tidycensus实现方式
该需求可以通过tidycensus直接实现,无需额外做跨边界匹配处理:
- 首先可调用
load_variables(2010, "responserate", cache = TRUE)查看该数据集下的全量字段,确认FSRR2010为目标2010年普查自应答率字段。 - 拉数时明确指定年份为2010、数据集为responserate即可,若需要同步获取匹配2010年边界的空间要素,开启geometry参数即可,参考代码如下:
library(tidycensus) # 首次使用需配置你申请的Census API密钥 # census_api_key("你的个人API密钥", install = TRUE) oh_tract_2010_response <- get_decennial( geography = "tract", state = "OH", variables = "FSRR2010", year = 2010, dataset = "responserate", geometry = TRUE # 需返回空间要素时添加该参数,自动匹配2010年普查区边界 )
- 注意不要将
year参数误设为2020,否则返回的将是绑定2020年行政边界的2020年普查应答率数据集,和你参考的指引文档输出口径一致。
拿到返回结果后,可将数据中的GEOID字段与2010年官方TIGER普查区边界文件的GEOID10字段做匹配校验,二者完全一一对应,不需要做跨期边界权重转换。
内容的提问来源于stack exchange,提问作者SushiChef
相关产品推荐
相关产品推荐

