AWS Python Lambda返回大PDF失败,如何代码实现Gzip压缩输出?
问题解答
可以通过代码对AWS Lambda的输出进行Gzip压缩,你当前遇到的无效PDF问题,核心是客户端未正确处理压缩响应或压缩逻辑的细节疏漏,以下是具体解决方案:
问题根源
你返回的是Gzip压缩后的字节流,且已正确设置Content-Encoding: gzip,但如果客户端(如Insomnia)未开启自动解压缩,会直接把压缩后的二进制内容当作PDF解析,自然无法识别为有效文件。
修正后的代码实现
确保压缩逻辑正确,并添加必要的响应头提示客户端处理压缩内容:
import base64 import gzip def lambda_handler(event, context): # 此处替换为你的Pyppeteer生成PDF逻辑,pdf为字节流对象 pdf = generate_pdf_content() # 用最高压缩级别压缩PDF字节流 compressed_pdf = gzip.compress(pdf, compresslevel=9) return { 'headers': { "Content-Type": "application/pdf", "Content-Encoding": "gzip", # 可选:添加压缩后的内容长度,帮助客户端判断 "Content-Length": str(len(compressed_pdf)) }, 'statusCode': 200, 'body': base64.b64encode(compressed_pdf).decode('utf-8'), 'isBase64Encoded': True }
客户端验证步骤
- Insomnia设置检查:打开请求的「Settings」面板,找到「Compression」选项,确保「Auto Decompress Responses」和「Accept Gzip Encoding」处于开启状态;
- 命令行测试:用curl手动验证压缩和解压缩流程:
打开生成的curl -H "Accept-Encoding: gzip" https://your-lambda-endpoint-url | gzip -d > test.pdftest.pdf,如果能正常显示,说明压缩逻辑没问题。
额外注意事项
- 禁止同时使用Serverless的compression插件和自定义代码压缩,否则会导致双重压缩,直接损坏文件;
- Lambda的返回payload上限为6MB(base64编码后),Gzip压缩能缓解这个问题,但如果压缩后的base64内容仍超过阈值,建议改用S3中转方案:
- 将生成的PDF上传到S3桶;
- 生成S3预签名URL返回给客户端,让客户端直接从S3下载大文件。
内容的提问来源于stack exchange,提问作者Tom
相关产品推荐
相关产品推荐

