You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

AWS Python Lambda返回大PDF失败,如何代码实现Gzip压缩输出?

问题解答

可以通过代码对AWS Lambda的输出进行Gzip压缩,你当前遇到的无效PDF问题,核心是客户端未正确处理压缩响应或压缩逻辑的细节疏漏,以下是具体解决方案:

问题根源

你返回的是Gzip压缩后的字节流,且已正确设置Content-Encoding: gzip,但如果客户端(如Insomnia)未开启自动解压缩,会直接把压缩后的二进制内容当作PDF解析,自然无法识别为有效文件。

修正后的代码实现

确保压缩逻辑正确,并添加必要的响应头提示客户端处理压缩内容:

import base64
import gzip

def lambda_handler(event, context):
    # 此处替换为你的Pyppeteer生成PDF逻辑,pdf为字节流对象
    pdf = generate_pdf_content()
    
    # 用最高压缩级别压缩PDF字节流
    compressed_pdf = gzip.compress(pdf, compresslevel=9)
    
    return {
        'headers': {
            "Content-Type": "application/pdf",
            "Content-Encoding": "gzip",
            # 可选:添加压缩后的内容长度,帮助客户端判断
            "Content-Length": str(len(compressed_pdf))
        },
        'statusCode': 200,
        'body': base64.b64encode(compressed_pdf).decode('utf-8'),
        'isBase64Encoded': True
    }

客户端验证步骤

  1. Insomnia设置检查:打开请求的「Settings」面板,找到「Compression」选项,确保「Auto Decompress Responses」和「Accept Gzip Encoding」处于开启状态;
  2. 命令行测试:用curl手动验证压缩和解压缩流程:
    curl -H "Accept-Encoding: gzip" https://your-lambda-endpoint-url | gzip -d > test.pdf
    
    打开生成的test.pdf,如果能正常显示,说明压缩逻辑没问题。

额外注意事项

  • 禁止同时使用Serverless的compression插件和自定义代码压缩,否则会导致双重压缩,直接损坏文件;
  • Lambda的返回payload上限为6MB(base64编码后),Gzip压缩能缓解这个问题,但如果压缩后的base64内容仍超过阈值,建议改用S3中转方案:
    1. 将生成的PDF上传到S3桶;
    2. 生成S3预签名URL返回给客户端,让客户端直接从S3下载大文件。

内容的提问来源于stack exchange,提问作者Tom

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.18 20:25:28