如何按指定字符拆分DataFrame中的字段并生成新行?
解决列表中带斜杠条目的拆分问题
嘿,这事儿好办!我给你写个Python的实现方案,刚好能满足你的需求——把包含/的水果条目拆分成独立的事件行,同时保留对应月份和人名不变。
思路说明
核心逻辑就是遍历原列表的每一项:
- 如果第三个元素(水果)里包含
/,就把它按/分割成多个子项,然后为每个子项生成一条新的记录,月份和人名沿用原来的; - 如果不包含
/,直接保留原记录即可。
代码实现
original_data = [["October", "Steve", "Apples"], ["November", "Joe", "Oranges"], ["December", "James", "Apples/Oranges"]] result = [] for item in original_data: month, name, fruits = item # 检查水果字符串是否有斜杠,有就拆分 if "/" in fruits: for fruit in fruits.split("/"): result.append([month, name, fruit]) else: result.append(item) print(result)
运行结果
执行这段代码后,输出正好是你想要的:
[["October", "Steve", "Apples"], ["November", "Joe", "Oranges"], ["December", "James", "Apples"], ["December", "James", "Oranges"]]
如果你喜欢更简洁的写法,也可以用列表推导式一行搞定:
result = [ [month, name, fruit] for month, name, fruits in original_data for fruit in (fruits.split("/") if "/" in fruits else [fruits]) ]
这个写法和上面的循环逻辑完全一致,只是更紧凑而已。
内容的提问来源于stack exchange,提问作者Zak
相关产品推荐
相关产品推荐

