Python从DataFrame提取坐标生成列表带索引、重复迭代问题求解
问题原因分析
- 原代码逻辑错误:遍历
new['DBA Name']的单个值时,每次匹配成功都追加了整个new['Location']列(即带索引的Series对象),而非当前匹配行对应的坐标值,因此会出现大量重复内容、附带行索引的问题。 - 变量名大小写错误:最后调用的是大写开头的
Location,和定义的小写location列表不一致,在大小写敏感的运行环境中会直接报错。
正确实现方案
推荐写法(Pandas向量化操作,性能更高)
直接用isin()方法筛选符合条件的行,再提取坐标转列表即可,无需手动写循环:
# 筛选DBA Name属于greater_three的行,提取Location列转嵌套列表 location = new[new['DBA Name'].isin(greater_three)]['Location'].tolist()
如果你的Location列是字符串格式而非原生列表,可以直接从经纬度字段生成符合格式的坐标列表:
location = new[new['DBA Name'].isin(greater_three)][['Latitude', 'Longitude']].values.tolist()
原循环写法的修正方案
如果要保留循环写法,需要同时遍历行索引和名称,仅追加当前匹配行的坐标:
location = [] for idx, name in enumerate(new['DBA Name']): if name in greater_three: location.append(new.loc[idx, 'Location']) # 注意调用的是小写的location变量 print(location)
内容的提问来源于stack exchange,提问作者Gazoo
相关产品推荐
相关产品推荐

