You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

使用pdf2image转换PDF为JPEG失败,生成PPM文件如何解决?

解决PDF转JPEG却生成PPM的问题

问题出在你使用了output_folder参数却未指定输出格式——poppler默认会把转换后的图片以PPM格式保存到该文件夹,你后续的save操作其实是额外生成JPEG(可能因路径问题没被你注意到)。以下是两种直接解决的方案:

方案一:移除output_folder,手动保存JPEG

让convert_from_path直接返回PIL Image对象,再通过save方法生成JPEG,不会产生PPM文件:

from pdf2image import convert_from_path
pages = convert_from_path(path_to_pdf, poppler_path=poppler_path)
for i, page in enumerate(pages):
    page.save(f'page{i}.jpg', 'JPEG')

方案二:保留output_folder,指定输出格式为JPEG

如果需要用output_folder管理输出路径,直接给convert_from_path添加fmt='jpeg'参数,让poppler直接生成JPEG到目标文件夹,无需后续手动保存:

from pdf2image import convert_from_path
pages = convert_from_path(
    path_to_pdf, 
    output_folder=path_to_output, 
    fmt='jpeg',
    poppler_path=poppler_path
)
# 不需要处理图片对象的话,上面一行就足够,下方循环可删除
for i, page in enumerate(pages):
    print(type(page))

原理说明:PPM是poppler转换PDF时的默认输出格式,当你指定output_folder但不声明fmt时,就会生成PPM文件。如果同时使用output_folder和手动save,会同时生成PPM和JPEG两个文件,这显然不是预期结果。

内容的提问来源于stack exchange,提问作者ClawX69

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.14 02:19:58