基于多列匹配条件的DataFrame行转换与过滤需求
DataFrame数据处理需求
输入数据
| source_element | source_text | source_entity | target_element | target_text | target_entity | |---------------|-------------------|----------------|---------------|-------------|----------------| | vvvvvv | ['body'] | name | aaaaa | ceo | code | | vvvvvv | ['body'] | name | bbbbb | cap | code | | vvvvvv | ['body', 'fat'] | name | ccccc | fat | name | | hhhhhh | ['man', 'hat'] | name | kkkkk | hat | name | | kkkkk | ['hat'] | name | lllll | 700 | price | | kkkkk | ['hat'] | name | fffff | mud | code | | eeeee | ['strong'] | name | zzzzz | 300 | price | | ssssss | ['head'] | name | ddddd | zip | code | | ssssss | ['head', 'strong']| name | eeeee | strong | name | | ssssss | ['head', 'part'] | name | uuuuu | part | name | | uuuuu | ['part'] | name | xxxxx | 190 | price |
处理条件
- 若某行的
source_entity与target_entity均为"name",且该行的source_element或target_element与DataFrame中任意行的source_element匹配,则将该行的target_text和target_entity替换为匹配行的对应值,并删除所有source_entity与target_entity均为"name"的行; - 保留未受上述条件影响的其他行。
期望输出数据
| source_text | source_entity | target_text | target_entity | |-----------------|----------------|----------------|-------------------| | ['body', 'fat']| name | 'ceo' | code | | ['body', 'fat']| name | 'cap' | code | | ['man', 'hat'] | name | '700' | price | | ['man', 'hat'] | name | 'mud' | code | | ['head', 'strong'] | name | 'zip' | code | | ['head', 'strong'] | name | '300' | price | | ['head', 'part'] | name | 'zip' | code | | ['head', 'part'] | name | '190' | price |
内容的提问来源于stack exchange,提问作者Anonymous
相关产品推荐
相关产品推荐

