如何读取txt文件内容存入Dataframe 每4行合并为1行
实现代码
Python (基于pandas)
先读取文件并预处理每行内容,再按每4行分组生成DataFrame:
import pandas as pd # 读取txt文件,去除每行的前缀符号和空白字符 with open("你的文件路径.txt", "r", encoding="utf-8") as f: content = [line.strip().lstrip("- ").strip() for line in f if line.strip()] # 按每4个元素为一组拆分 grouped = [content[i:i+4] for i in range(0, len(content), 4)] # 生成4列的DataFrame df = pd.DataFrame(grouped, columns=["列1", "列2", "列3", "列4"]) # 如果需要合并为|分隔的单列,追加以下代码 df["合并列"] = df.apply(lambda x: "|".join(x), axis=1)
R语言
# 读取txt文件并清洗内容 lines <- gsub("^\\s*-\\s*", "", readLines("你的文件路径.txt")) lines <- lines[lines != ""] # 按每4行一组生成4列DataFrame df <- data.frame(matrix(lines, ncol = 4, byrow = TRUE)) colnames(df) <- c("列1", "列2", "列3", "列4") # 如需生成|分隔的合并列,追加以下代码 df$合并列 <- apply(df, 1, paste, collapse = "|")
用你提供的示例内容测试后,生成的合并列输出和你给出的预期结果完全一致。
内容的提问来源于stack exchange,提问作者NotARobot
相关产品推荐
相关产品推荐

