如何下载点击后在网页直接打开的pipe delimited格式txt文件
可行的文件下载方法
浏览器手动下载
- 打开展示txt内容的页面后,直接按快捷键
Ctrl+S(Windows系统)/Cmd+S(Mac系统),在弹出的保存窗口里选择本地存储路径,确认后即可把txt文件完整保存到本地。 - 也可以在页面空白位置点击鼠标右键,选择「另存为」选项,后续操作和快捷键一致,保存时保持文件后缀为
.txt即可。
R语言直接下载/读取(适配数据处理需求)
作为R语言初学者,可以直接通过代码完成文件下载、读取全流程,不需要手动操作浏览器,后续做数据清洗分析也更顺畅:
运行代码前确认网络可以正常访问目标文件地址即可
代码1:把文件下载到本地指定路径
# 定义目标文件的在线地址 file_url <- "https://apps.deadiversion.usdoj.gov/pubdisp/pub_disposal_sites.txt" # 定义本地保存路径,存到当前R工作目录下直接写文件名即可 local_path <- "pub_disposal_sites.txt" # 执行下载操作 download.file(url = file_url, destfile = local_path, method = "auto")
代码2:直接读取文件到R数据框(无需提前手动下载)
因为文件是|(pipe)分隔格式,直接指定分隔符就能读成结构化数据:
# 直接读取在线文件为数据框 disposal_locations <- read.delim( file = file_url, sep = "|", header = TRUE, stringsAsFactors = FALSE ) # 运行以下命令查看前6行数据,确认读取成功 head(disposal_locations)
内容的提问来源于stack exchange,提问作者user17073706
相关产品推荐
相关产品推荐

