You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Pandas基于多列条件合并DataFrame实现坐标点匹配线段端点ID

实现方案

核心思路是通过两次merge操作,分别匹配线段的起点、终点对应的点位ID:

  • 第一步:构造示例测试数据(可直接替换为真实业务数据)
import pandas as pd

# 构造点位表df1
df1 = pd.DataFrame([
    ['P01', 3, 48],
    ['P02', 9, 44]
], columns=['point', 'lon', 'lat'])

# 构造线段表df2
df2 = pd.DataFrame([
    ['L01', 3, 48, 3, 49]
], columns=['line', 'lon.start', 'lat.start', 'lon.end', 'lat.end'])
  • 第二步:匹配起点对应的点位ID,生成point.start列
# 临时修改df1列名和df2起点字段对齐,方便合并
df1_start = df1.rename(columns={'lon': 'lon.start', 'lat': 'lat.start', 'point': 'point.start'})
res = pd.merge(df2, df1_start, on=['lon.start', 'lat.start'], how='left')
  • 第三步:匹配终点对应的点位ID,生成point.end列
# 临时修改df1列名和df2终点字段对齐,方便合并
df1_end = df1.rename(columns={'lon': 'lon.end', 'lat': 'lat.end', 'point': 'point.end'})
res = pd.merge(res, df1_end, on=['lon.end', 'lat.end'], how='left')
  • 第四步:删除不需要的line字段,得到最终结果
res = res.drop(columns=['line'])

注意:上述代码使用左连接how='left',如果某线段的起点/终点经纬度在df1中没有匹配的点位,对应的point.start/point.end会返回NaN,可根据业务需求调整连接方式,或后续对NaN值做填充、删除处理。

内容的提问来源于stack exchange,提问作者lizard

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.10.02 14:30:04