如何用Python将Pandas中字符串类型的数组对象转换为可用列表
首先你当前df['text']列存储的是字符串格式的序列化列表,而非原生Python列表,所以需要先做类型转换,再拆分为单行即可,完整实现代码如下:
步骤1:导入依赖库
import ast import html import pandas as pd
步骤2:将字符串列表转为原生列表
# 去除字符串首尾多余空白,用ast.literal_eval安全转换为真实列表 df['text'] = df['text'].apply(lambda x: ast.literal_eval(x.strip()))
步骤3:拆分列表元素为单独行
# explode方法会将每个列表元素拆分为独立行,ignore_index重置连续索引 df_result = df.explode('text', ignore_index=True)
步骤4(可选):处理HTML转义字符
如果你需要把文本里的"这类HTML转义符还原为正常字符,加这一步:
df_result['text'] = df_result['text'].apply(html.unescape)
步骤5(可选):自定义行号
如果你需要示例里的连续自定义起始行号,比如从20523203开始,直接修改索引即可:
start_num = 20523203 df_result.index = range(start_num, start_num + len(df_result))
处理完成后直接打印df_result就能得到你期望的输出效果。
内容的提问来源于stack exchange,提问作者LearningCode
相关产品推荐
相关产品推荐

