如何用集合操作实现列表列的四类过滤逻辑?
基于集合操作实现列表列的四类过滤
假设我们有一列存储列表类型的数据,内容如下:
row People -------------------- 1 ['Veli'] 2 ['David'] 3 ['David', 'Veli'] 4 ['George'] 5 ['David', 'George']
当筛选条件为{'Veli', 'David'}时,我们可以用集合操作实现以下四类过滤逻辑:
1. 列表包含条件中的任意值 → 返回行1、2、3、5
核心判断行集合与条件集合是否存在交集:
rows = (set(['Veli']), set(['David']), set(['Veli', 'David']), set(['George']), set(['George', 'David'])) criteria = {'David', 'Veli'} result = filter(lambda row: row & criteria, rows) # 结果:(set(['Veli']), set(['David']), set(['Veli', 'David']), set(['George', 'David']))
2. 列表不包含条件中的任何值 → 返回行4
核心判断行集合与条件集合无交集,两种实现方式:
# 方式1:用isdisjoint方法直接判断无交集 result = filter(lambda row: row.isdisjoint(criteria), rows) # 方式2:判断交集为空集合 result = filter(lambda row: not (row & criteria), rows) # 结果:(set(['George']))
3. 列表包含条件中的所有值 → 返回行3
核心判断条件集合是否是行集合的子集(即行集合完全覆盖条件元素):
result = filter(lambda row: criteria.issubset(row), rows) # 结果:(set(['Veli', 'David']))
4. 列表仅包含条件中的值 → 返回行1、2、3
核心判断行集合是否是条件集合的子集(即行内所有元素都在条件范围内):
result = filter(lambda row: row.issubset(criteria), rows) # 结果:(set(['Veli']), set(['David']), set(['Veli', 'David']))
内容的提问来源于stack exchange,提问作者David542
相关产品推荐
相关产品推荐

