通过API传递CSV文件,Lambda端接收后无法解析的问题咨询
问题描述
尝试通过API传递CSV文件,具体情况如下:
CSV内容
field_1, field_2, field_3 1, 3, 7
推送代码
with open("sample_csv.csv") as f: data = {"file": f} print(data) headers = { "Content-Type": "text/csv", "File-Type": "POS", "File-Key": "somekey", } r = requests.post(endpoint, data=data, headers=headers)
Lambda端接收情况
Lambda中读取到的内容为:
b'file=field_1%2C+field_2%2C+field_3%0A&file=1%2C+3%2C+7'
Lambda函数代码
def main(event: dict, context) -> dict: body = base64.b64decode(event["body"]) print(body)
需要将上述URL编码的内容转换为正常CSV格式。
问题原因
手动设置了Content-Type: text/csv,但使用requests.post(data=data)传递字典时,requests会自动将数据编码为application/x-www-form-urlencoded格式的表单数据,覆盖了手动设置的Content-Type。CSV文件的每一行被拆分为单独的file参数值,并且所有内容都做了URL编码,导致Lambda收到的是键值对形式的编码字符串。
解决方案
方案1:修正发送端代码(推荐)
使用files参数上传文件,让requests自动处理正确的请求格式:
with open("sample_csv.csv", "rb") as f: # 定义文件参数:(文件名, 文件对象, 内容类型) files = {"file": ("sample_csv.csv", f, "text/csv")} headers = { "File-Type": "POS", "File-Key": "somekey", } # 无需手动设置Content-Type,requests会自动设置为multipart/form-data r = requests.post(endpoint, files=files, headers=headers)
或者直接将CSV内容作为请求体发送(适用于无需表单字段的场景):
with open("sample_csv.csv", "rb") as f: csv_content = f.read() headers = { "Content-Type": "text/csv", "File-Type": "POS", "File-Key": "somekey", } r = requests.post(endpoint, data=csv_content, headers=headers)
方案2:在Lambda端解析现有编码内容
如果无法修改发送端代码,可以在Lambda中解析URL编码的表单数据:
import urllib.parse def main(event: dict, context) -> dict: # 解码base64并转成字符串 body_str = base64.b64decode(event["body"]).decode("ascii") # 解析表单数据 parsed_data = urllib.parse.parse_qs(body_str) # 对每一行内容做URL解码,再拼接成完整CSV csv_lines = [urllib.parse.unquote(line) for line in parsed_data["file"]] csv_content = "\n".join(csv_lines) print(csv_content) # 后续可使用csv模块处理csv_content,例如: # import csv # from io import StringIO # reader = csv.reader(StringIO(csv_content)) # for row in reader: # print(row) return {"statusCode": 200, "body": "CSV parsed successfully"}
内容的提问来源于stack exchange,提问作者OctaveParango
相关产品推荐
相关产品推荐

