You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Python如何比较CSV所有行首元素 按相同值分组合并生成指定HTML

竖线分隔CSV按首列分组生成HTML实现方法

核心思路

  • 读取CSV时指定分隔符为竖线|,同时对每个字段做前后空白字符清理,避免空格不一致(比如样例里3 | G |H这种H前面没空格的情况)导致分组匹配失败
  • 根据数据排列特性选择对应分组逻辑:
    • 同组行连续排列:遍历过程中记录上一个分组的首元素值,遇到新分组时先输出h1标签,再输出组内每行内容,内存占用最低
    • 同组行可能不连续:先用字典按首元素归集所有行,再遍历字典依次输出分组内容,兼容性更好

连续分组场景代码(匹配提供的样例数据)

import csv

last_group = None
# 替换为你的实际文件路径
with open("data.csv", "r", encoding="utf-8") as f:
    # 指定竖线为分隔符
    csv_reader = csv.reader(f, delimiter="|")
    for row in csv_reader:
        # 清理每个字段前后的空格、换行符
        col1, col2, col3 = [item.strip() for item in row]
        # 检测到新分组,输出h1标题
        if col1 != last_group:
            print(f"    <h1>{col1}</h1>")
            last_group = col1
        # 输出当前行的h2标题和正文
        print(f"    <h2>{col2}</h2>")
        print(f"    {col3}")

运行上述代码处理样例CSV,输出结果和期望的HTML格式完全一致。

非连续分组兼容代码

如果原始数据里相同首元素的行可能穿插出现,用字典先归集分组再输出即可:

import csv
from collections import defaultdict

group_data = defaultdict(list)
with open("data.csv", "r", encoding="utf-8") as f:
    csv_reader = csv.reader(f, delimiter="|")
    for row in csv_reader:
        col1, col2, col3 = [item.strip() for item in row]
        group_data[col1].append((col2, col3))

# 按分组输出HTML
for group_key, content_list in group_data.items():
    print(f"    <h1>{group_key}</h1>")
    for h2_text, normal_text in content_list:
        print(f"    <h2>{h2_text}</h2>")
        print(f"    {normal_text}")

内容的提问来源于stack exchange,提问作者Markus Ham

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.29 23:06:24