Python中针对脏字符串生成字典的更简洁清洗方案咨询
问题:从杂乱样本字符串生成字典
尝试从杂乱的样本字符串生成字典,但当前处理逻辑存在问题。
现有Python代码片段
dict(item.split(':', 1) for item in re.sub(' ', '', re.sub('"', '', ','.join( list(filter(None, re.sub('\r', '', text_subsection.split('text')[1]).split('\n')))))).split(',') )
text_subsection示例内容
\r\n; Count of Something: 3\r\ntext\r\n"Key1: 9999999, Key2: mnkhkljh213, Key3: 593, Key4: 66666"\r\n"Key5 something: sample, Desc: , Date: 4/28/2025, Time: 4:15 PM"\r\n"ANOTHERKEY: 622523, KEY1: 9999999, KEY6: 160305, KEY7: 0, KEY8: 10, KEY11: 1, DATE: 4/28/2025, TIME: 16:15:50"\r\n
注意事项
- key1存在
Key1和KEY1两种形式 - date存在
Date和DATE两种形式 - time存在
Time、TIME形式且包含多个冒号 - key5的键名包含空格
- 后续逻辑可接受字典中的键重复
内容的提问来源于stack exchange,提问作者Andrew Alsberge
相关产品推荐
相关产品推荐

