Python FPDF使用cell/multi_cell写入PDF时出现多余换行问题
fpdf multi_cell 意外多余换行问题排查修复
问题根因
异常换行和FPDF的cell/multi_cell参数配置无关,是代码里的文本读取逻辑存在两个隐性问题:
- 读取文件行时未清理末尾换行符:Python的
readline()方法会保留每行末尾的原生换行符(Windows下为\r\n、Unix下为\n),你直接将读取到的行拼接为长字符串传入multi_cell时,这些隐性换行符会被FPDF识别为强制换行指令,生成非预期断行。 - 文件读取循环逻辑冗余:现有循环先读取第一行,进入循环后立刻再次执行
readline(),当读到文件末尾返回空字符串时,仍会将空值追加到内容列表,额外生成空行。 - 额外逻辑bug:判断格式参数的条件
"[" in line and "SQL" or ";" not in line存在运算符优先级问题,实际执行逻辑和预期不符,会错误识别大量非参数字段。
修复步骤
1. 修正文件读取逻辑,清理换行符
修改读取目标cfformat文件的代码块,读行时主动剥离末尾换行符,跳过无效空行:
with open(item,'r', encoding='utf-8') as fp: line = fp.readline().strip('\r\n') # 给判断条件加括号明确优先级,避免逻辑错误 if ("[" in line and "SQL" in line) or (";" not in line): formatArgs = line ruleFlag = 0 cnt = 1 while line: line = fp.readline().strip('\r\n') line = line.replace("–", "-") # 不需要空行就保留这行,需要保留空行就注释掉 if not line: continue contentsList.append(line) if "@" in line: callingList.append(line) cnt += 1
2. 同步修正caller列表的读取逻辑
读取调用方列表的代码同样存在未清理换行符的问题,一并修改:
with open(item2,'r', encoding='utf-8') as fp2: line2 = fp2.readline().strip('\r\n') while line2: line2 = fp2.readline().strip('\r\n') if cnt == 0 : if os.path.basename(formatName) in line2 and os.path.basename(formatName) != os.path.basename(formatName2) : callerList.append(os.path.basename(formatName2)) cnt += 1
3. (可选)优化字符串拼接逻辑
拼接长文本时可以在每行之间加单个空格,避免上一行末尾和下一行开头的单词连在一起:
codeStr = "" i = 0 while i != len (obj.contentsList): codeStr = codeStr + " " + obj.contentsList[i] i += 1
callerStr和callingStr的拼接逻辑也可以按同样方式调整。
其他优化建议
- 现有代码中硬编码的
mypath路径会覆盖命令行传入的参数,建议将硬编码路径改为无传入参数时的默认 fallback 值。 - 打开文件时显式指定文件编码(如
encoding='utf-8'),避免不同操作系统默认编码不一致导致的乱码、读取异常。 - 重复遍历文件树的逻辑可以优化:现有代码在循环处理每个文件时都会重新调用一次
get_filepaths(mypath)遍历全目录,文件量大时性能很差,可以提前把全量文件路径、文件内容缓存后再做关联匹配。
内容的提问来源于stack exchange,提问作者NBessmer
相关产品推荐
相关产品推荐

