You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何用Python去除文本文件单行重复元素并统计唯一颜色

解决文本行内重复颜色的统计问题

你的代码当前会把每行里重复的颜色多次计数(比如Red Red Blue会给Red累加2次),但你需要的是每行内的重复颜色只算一次。用set去重确实是最直接的方案,修改起来很简单:

关键修改点

对每行拆分后的颜色列表转成set,自动剔除行内重复项,再遍历这个去重后的集合更新计数。另外用with语句处理文件会更安全,不用手动调用close()。

修改后的完整代码

"""Counts color names in the slot machine file without duplicates."""

def main():
    data_directory_name = 'data'
    infile_name = input('Please enter the input filename: ')
    infile_path_and_name = f'{data_directory_name}/{infile_name}'
    color_count = {}

    # 用with语句自动管理文件关闭,避免遗漏或异常导致文件未关闭
    with open(infile_path_and_name, 'r') as infile:
        for line in infile:
            slot_values = line.split()
            # 转成集合自动去除行内重复的颜色
            unique_colors = set(slot_values)
            for color in unique_colors:
                color_count[color] = color_count.get(color, 0) + 1

    # 直接对颜色名称排序,写法更简洁
    sorted_colors = sorted(color_count.keys())

    print()
    print(f'{"COLOR":<10}{"COUNT":>7}')
    for color in sorted_colors:
        print(f'{color:<10}{color_count[color]:>7,}')

main()

核心逻辑说明

  • set(slot_values):把每行的颜色列表转换成集合,集合会自动剔除重复元素,比如['Red', 'Red', 'Blue']会变成{'Red', 'Blue'},这样每行里的同一种颜色只会被统计一次。
  • with open(...) as infile:Python的上下文管理器,代码块结束后会自动关闭文件,比手动调用close()更可靠。
  • sorted(color_count.keys()):直接对字典的键进行排序,替代先转列表再排序的写法,更简洁高效。

内容的提问来源于stack exchange,提问作者user20139344

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.17 01:30:47