You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Python从JSON筛选指定属性生成新字典的优化方法

精简实现方案

原方案的核心问题是对全量广告数据做了多次重复遍历,每提取一个字段就要循环一遍所有广告和属性,代码冗余且执行效率低。你可以通过预定义目标属性集合、单次遍历完成提取,后续增减要保留的字段只需要修改属性集合即可,不需要调整核心逻辑。

基础版本(无默认值)

# 在这里配置所有你需要保留的属性名,新增/删除提取字段只需要修改这个集合
KEEP_ATTRIBUTES = {"HEADING", "LOCATION", "PRICE", "STATE", "description"}
small_dict = {}

# 仅需遍历一次全量广告列表
for advert_pos, advert in enumerate(data['props']['pageProps']['searchResult']['advertSummaryList']['advertSummary']):
    small_dict[advert_pos] = {}
    # 遍历单条广告的所有属性,匹配到目标字段直接写入
    for attr in advert['attributes']['attribute']:
        attr_name = attr['name']
        if attr_name in KEEP_ATTRIBUTES:
            small_dict[advert_pos][attr_name] = attr['values']

注意:你原代码中if attr['name'] in 'HEADING'是错误写法,该语法是判断attr['name']是否为字符串"HEADING"的子串,会出现"HEAD"、"ADING"这类值误命中的问题,做精确匹配请使用==判断或集合成员判断,上述代码用集合做匹配,执行效率比逐次相等判断更高。

带默认值版本

如果需要避免某条广告缺失目标属性时出现KeyError,可以在初始化条目时先给所有目标属性设置默认值:

KEEP_ATTRIBUTES = {"HEADING", "LOCATION", "PRICE", "STATE", "description"}
DEFAULT_VAL = None  # 缺失字段的填充值
small_dict = {}

for advert_pos, advert in enumerate(data['props']['pageProps']['searchResult']['advertSummaryList']['advertSummary']):
    # 初始化时预填所有目标字段的默认值
    small_dict[advert_pos] = {attr: DEFAULT_VAL for attr in KEEP_ATTRIBUTES}
    for attr in advert['attributes']['attribute']:
        attr_name = attr['name']
        if attr_name in KEEP_ATTRIBUTES:
            small_dict[advert_pos][attr_name] = attr['values']

内容的提问来源于stack exchange,提问作者Paul Muster

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.02 21:03:40