You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Python实现按固定行数分组拆分txt原始数据为多个txt文件

Python实现txt数据按固定行数切分导出

实现逻辑

先读取原始文件内容,自动过滤无效空行避免切分错位,再按每3行连续数据为一组切片,每组单独写入独立txt文件,输出格式和预期效果完全匹配。

完整可运行代码

# 按需修改以下配置参数
input_file_path = "raw_data.txt"  # 替换为你的原始txt文件实际路径
group_line_count = 3  # 每组的行数,当前按需求设为3
output_file_prefix = "split_group_"  # 拆分后文件的名称前缀

# 读取原始数据,过滤空行
with open(input_file_path, "r", encoding="utf-8") as f:
    valid_data_lines = [line.strip() for line in f if line.strip()]

# 逐组切分并写入文件
for i in range(0, len(valid_data_lines), group_line_count):
    group_content = valid_data_lines[i : i + group_line_count]
    # 输出文件从1开始编号,比如split_group_1.txt、split_group_2.txt
    output_filename = f"{output_file_prefix}{i//group_line_count + 1}.txt"
    with open(output_filename, "w", encoding="utf-8") as out_f:
        # 行之间保留空行,和原数据格式一致
        out_f.write("\n\n".join(group_content) + "\n")

使用注意事项

  • 运行前先把input_file_path的值改成你自己存放原始数据的txt文件路径
  • 如果后续需要调整每组的行数,直接修改group_line_count的数值即可
  • 脚本自动兼容原始文件里行之间存在空行的情况,不会出现切分错位
  • 如果原始数据总行数不是3的整数倍,最后不足3行的剩余数据会自动单独保存为最后一个文件,不会丢失数据

内容的提问来源于stack exchange,提问作者EL-san

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.30 04:30:52