如何用R语言拆分PDF为单页?pdftools报错解决方案
拆分PDF为单页独立文件的R解决方案
你之前的错误根源在于:pdf_text()读取的是PDF的文本内容(返回字符向量),但pdf_subset()要求直接传入原始PDF文件的路径,而非文本内容,所以触发了input should contain exactly one file错误。
以下是正确的实现代码,可自动将多页PDF拆分为单独的单页文件:
library(pdftools) # 替换为你的原始PDF文件路径 pdf_path <- "~/Desktop/personal-website/Blog_Files/big_pdf.pdf" # 获取PDF总页数 total_pages <- pdf_info(pdf_path)$pages # 循环拆分每页 for (page_num in 1:total_pages) { # 定义输出文件名,格式为page_1.pdf、page_2.pdf... output_file <- paste0("page_", page_num, ".pdf") # 拆分并保存单页PDF pdf_subset(input = pdf_path, pages = page_num, output = output_file) }
关键说明
pdf_info()用于获取PDF的元数据,其中$pages提取出总页数,确保循环覆盖所有页面- 循环过程中自动生成规范命名的输出文件,无需手动指定每个页码
- 输出文件默认保存在当前R工作目录,若需指定路径,可在
output_file中写入完整路径(比如paste0("~/Desktop/split_pages/page_", page_num, ".pdf"))
内容的提问来源于stack exchange,提问作者stats_noob
相关产品推荐
相关产品推荐

