Python中按字符串条件提取列表嵌套字典内的指定字段
正确提取嵌套数据中firstname的方案
嘿,我明白你卡在哪了——你的数据结构是列表套字典,字典里又嵌套了列表和子字典,之前的列表推导式完全没匹配上这个层级结构,所以执行失败啦。咱一步步来解决:
先拆解你的数据结构
你的mydataset是一个列表,每个元素是一个独立的字典:
- 每个字典里的
data字段是另一个列表,这个列表里装着包含firstname的子字典 - 你要的是所有
data列表里子字典的firstname值
正确的列表推导式实现
直接用嵌套的列表推导式就能搞定,完全匹配你的数据层级:
mydataset = [{'thing1': 'pink', 'thing2': 'apple', 'thing3': 'car', 'data': [{'firstname': 'jenny', 'lastname': 'jones', }]}, {'thing1': 'blue', 'thing2': 'banana', 'thing3': 'bicycle', 'data': [{'firstname': 'david', 'lastname': 'walls', }]}] # 提取所有firstname myextract = [person['firstname'] for item in mydataset for person in item['data']] print(myextract) # 输出: ['jenny', 'david']
为啥你的原代码不行?
你写的[x in x if mydataset['data']]有两个核心问题:
mydataset是列表,不能直接用mydataset['data']取字段——得先遍历列表里的每个字典元素- 列表推导式的语法是
[要提取的表达式 for 变量 in 可迭代对象 可选条件],你的写法完全不符合这个结构
更易读的分步循环版本(适合新手理解)
如果觉得推导式太紧凑,用普通循环也能实现同样效果,逻辑更直观:
myextract = [] # 第一步:遍历mydataset里的每个字典项 for item in mydataset: # 第二步:取出当前字典里的data列表 data_list = item['data'] # 第三步:遍历data列表里的每个子字典 for person in data_list: # 第四步:提取firstname并加入结果列表 myextract.append(person['firstname'])
进阶:容错处理(避免KeyError)
如果你的数据里可能存在缺少data字段或者firstname字段的情况,可以用get()方法做容错,避免程序崩溃:
myextract = [person.get('firstname', '未知姓名') for item in mydataset for person in item.get('data', [])]
内容的提问来源于stack exchange,提问作者mark
相关产品推荐
相关产品推荐

