You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Python函数功能异常:误保留序言与许可证而非书籍正文求助

问题分析与修复方案

你的代码核心问题是判断条件写反了——当前逻辑是把*** START OF ***之前和*** END OF ***之后的内容写入新文件,正好和你想要的“仅保留书籍正文”完全相反。

另外代码还有可以优化的地方:既然已经用readlines()把所有行读到了列表里,没必要再调用seek(0)重新读一遍文件,直接对列表切片操作更高效。

修复后的完整代码如下:

import os

def remove_preamble_and_license(file_name):
    new_file_name = file_name[:-4] + "-new.txt"
    
    with open(file_name, "r") as old_file, open(new_file_name, "w") as new_file:
        lines = old_file.readlines()
        
        start_line = -1
        end_line = -1
        for i, line in enumerate(lines):
            if "*** START OF" in line:
                start_line = i
            elif "*** END OF" in line:
                end_line = i
                break
        
        # 确保找到有效标记且顺序正确,再写入正文
        if start_line != -1 and end_line != -1 and start_line < end_line:
            # 跳过START标记行,到END标记行之前结束,只保留中间正文
            new_file.writelines(lines[start_line+1:end_line])

关键修复点说明:

  • 修正内容筛选逻辑:只保留start_line之后、end_line之前的行,并且跳过标记行本身
  • 增加有效性校验:避免文件中没有找到START/END标记时出现异常
  • 简化写入操作:用writelines()直接写入切片后的行列表,比逐行循环更高效

内容的提问来源于stack exchange,提问作者Jumper_Child64

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.06 02:50:52