如何移除Pandas DataFrame每行字符串中的指定部分?
解决Pandas DataFrame中批量移除timestamp+数字前缀的问题
你的问题在于原代码仅针对固定的timestamp1678081731027字符串进行替换,但每行的timestamp后数字都不一样,所以需要用正则表达式匹配所有符合timestamp+数字格式的前缀,一次性替换掉。
直接使用以下代码即可:
log_df['message'] = log_df['message'].str.replace(r'timestamp\d+', '', regex=True)
代码说明:
r'timestamp\d+'是正则模式:timestamp匹配固定前缀文本\d+匹配一个或多个数字(对应每行不同的时间戳数字)
regex=True明确告知Pandas使用正则匹配(Pandas 2.0+后该参数默认是False,必须显式指定)
执行后,所有行开头的timestampXXXXXXX部分都会被移除,剩下的就是后续的有效内容。
内容的提问来源于stack exchange,提问作者Jai
相关产品推荐
相关产品推荐

