解决DataFrame迭代中使用str.join()时出现TypeError: sequence item 0: expected str instance, float found错误的方案
解决TypeError: sequence item 0: expected str instance, float found的问题
这个错误的核心原因很明确:你在使用str.join()拼接row[0:4]里的元素时,其中包含了**非字符串类型(比如float)**的数据,而join()要求所有拼接对象必须是字符串。看你的DataFrame,house列里的977大概率被Pandas识别成了数值类型(int/float),而不是字符串,这就触发了类型错误。
快速修复方案
直接在拼接时把每个元素转成字符串,同时注意计算长度时也要用字符串类型的值:
out = [] for _, row in df.iterrows(): # 把row的每个元素先转成字符串再拼接 name = " ".join(str(x) for x in row[0:4]) entities = [] i = 0 for n in row.index[0:4]: val_str = str(row[n]) entities.append([i, i + len(val_str), n]) i += len(val_str) + 1 out.append([name, {"entities": entities}])
更高效的提前处理方案
如果你的数据量比较大,每次循环都转字符串会有点低效,可以提前把DataFrame的目标列全部转成字符串类型:
# 先把需要处理的列统一转成字符串 df[['house', 'road', 'sub_area']] = df[['house', 'road', 'sub_area']].astype(str) # 之后再运行原代码就不会报错了 out = [] for _, row in df.iterrows(): name = " ".join(row[0:4]) entities = [] i = 0 for n in row.index[0:4]: entities.append([i, i + len(row[n]), n]) i += len(row[n]) + 1 out.append([name, {"entities": entities}])
额外优化建议
你的DataFrame只有3列,row[0:4]其实就是取全部3列,写成row.iloc[:3]或者直接row.values会更清晰,避免后续列数变化时出现意外的索引问题。
内容的提问来源于stack exchange,提问作者bellatrix
相关产品推荐
相关产品推荐

