Python列表去重:保留首元素重复项中键值最高的子列表
解决方案
没问题,我来教你搞定这个需求——从嵌套列表里保留每个元素对应最高键值(子列表末尾的数值)的条目,用字典跟踪就能高效解决:
核心思路
遍历原列表时,用字典的键存储子列表的第一个元素(比如123、456),值存储对应的完整子列表。每次遇到同一个元素的子列表时,只保留键值更大的那个;如果是第一次遇到该元素,直接存入字典即可。最后把字典的值转换成列表,就是我们要的结果。
代码实现(Python)
all_lists = [[123, 1],[456, 1],[789, 1],[123,2],[456, 2],[789,1]] # 初始化字典跟踪每个元素的最高键值条目 version_tracker = {} for item in all_lists: element = item[0] current_key = item[1] # 元素未被记录,或当前键值更高时更新字典 if element not in version_tracker or current_key > version_tracker[element][1]: version_tracker[element] = item # 转换为列表得到最终结果 final_result = list(version_tracker.values()) print(final_result) # 输出: [[123, 2], [456, 2], [789, 1]]
额外说明:保持元素出现顺序
如果需要结果列表的元素顺序和原列表中第一次出现的顺序一致:
- Python 3.7及以上版本:普通字典默认保持插入顺序,上面的代码直接满足需求。
- Python 3.6及更早版本:可以用
collections.OrderedDict实现,代码调整如下:
from collections import OrderedDict all_lists = [[123, 1],[456, 1],[789, 1],[123,2],[456, 2],[789,1]] version_tracker = OrderedDict() for item in all_lists: element = item[0] current_key = item[1] if element not in version_tracker or current_key > version_tracker[element][1]: version_tracker[element] = item final_result = list(version_tracker.values()) print(final_result)
这个方法时间复杂度是O(n),只需要遍历一次原列表,效率拉满,不管列表规模多大都能快速处理。
内容的提问来源于stack exchange,提问作者Andrew Dunlop
相关产品推荐
相关产品推荐

