You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何用itertools.groupby对元组列表按标签分组?

用itertools.groupby正确分组元组列表的方法

你遇到的问题其实是itertools.groupby的一个常见坑——它只会对连续的相同键进行分组,而你的原始my_tuples里的标签(A/B/C)并不是连续出现的(比如先是C,接着A,又回到C),所以直接用groupby会把同标签的非连续项拆成多个组,最后转成字典时还会覆盖之前的结果,自然得不到正确输出。

要解决这个问题,只需要先对列表按标签排序,让相同标签的元组连续排列,再用groupby分组就行,而且可以用字典推导式写出你想要的简洁形式:

from itertools import groupby

# 先按标签排序,确保同标签元组连续
sorted_tuples = sorted(my_tuples, key=lambda x: x[0])

# 用字典推导式生成分组结果
result = {key: [num for _, num in group] for key, group in groupby(sorted_tuples, key=lambda x: x[0])}

运行这段代码后,result就是你期望的格式:

{'A': [74, 23, 2], 'B': [52], 'C': [74, 87, 99, 21, 1, 87]}

为什么你的原代码不行?

原代码直接对未排序的my_tuples使用groupby,比如原始列表中第一个C组是('C',74),之后遇到A就会切换分组,再遇到C时又会创建新的C组。当你用dict()转换groupby结果时,后面的C组会覆盖前面的,最终得到的C对应的数值只有最后几个,完全不符合预期。

如果你不想排序(比如需要保留原始顺序的分组?不过你的需求里没提这个),其实可以用collections.defaultdict来实现,但既然你优先想用groupby,那排序+groupby就是最符合要求的方案。

内容的提问来源于stack exchange,提问作者Stefan Falk

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.05.29 08:42:16