如何移除DataFrame列表列中字符串前导空格并解决迭代错误?
问题解决方法
错误原因
你的df['Countries']列中存在空值(NaN),NaN的类型是float,当循环到这类行时,for country in eachRow会触发TypeError: 'float' object is not iterable——因为浮点数无法被遍历。
简洁解决方法
方法1:直接修正DataFrame中的Countries列
用apply结合lambda表达式,同时处理空值和字符串去空格:
df['Countries'] = df['Countries'].apply( lambda lst: [country.lstrip() for country in lst] if isinstance(lst, list) else lst )
这段代码会遍历每一行:如果该行是列表,就对每个国家字符串执行lstrip()移除前导空格;如果是空值(或非列表类型),则保持原内容不变。
方法2:提取所有处理后的国家到单独列表y
如果你的需求是把所有处理后的国家收集到列表y中,同时规避空值:
y = [] for eachRow in df['Countries']: if isinstance(eachRow, list): y.extend([country.lstrip() for country in eachRow])
用isinstance(eachRow, list)先判断行类型,只处理列表行,跳过空值,避免报错。
方法3:用explode展开处理后再聚合(适合批量操作)
如果需要批量处理且保留原DataFrame的行结构,可以用explode先把列表拆成单行,处理空格后再重新聚合:
df['Countries'] = df['Countries'].explode()\ .str.lstrip()\ .groupby(level=0)\ .agg(list)
内容的提问来源于stack exchange,提问作者Michael Kessler
相关产品推荐
相关产品推荐

