如何快速合并重复记录:整合投票地点的Precinct ID
重复投票地点记录合并方案
针对合并重复投票地点记录、将对应Precinct ID整合到单个单元格的需求,以下是几种常用工具的实现方法:
Excel(适用于可视化操作场景)
方法1:数据透视表+自定义聚合
- 选中全部数据区域,插入「数据透视表」
- 将
Location Name拖入行区域,Precinct ID拖入值区域 - 点击值区域的
Precinct ID字段,选择「值字段设置」→「自定义」,输入公式:=CONCATENATEX(VALUES(表[Precinct ID]), 表[Precinct ID], ", ")
(替换「表」为你的实际数据表格名称)
方法2:函数组合(Excel 365/2021及以上版本支持)
- 用
UNIQUE函数提取唯一地点名称:
在空白单元格(如D2)输入=UNIQUE(A:A),下拉得到所有不重复的投票地点 - 用
TEXTJOIN+FILTER合并对应Precinct ID:
在E2单元格输入=TEXTJOIN(", ", TRUE, FILTER(B:B, A:A=D2)),下拉自动填充所有结果
Python Pandas(适用于批量处理大量数据)
使用groupby分组后结合自定义聚合函数实现:
import pandas as pd # 读取数据(根据实际文件格式选择read_excel或read_csv) df = pd.read_excel("voting_data.xlsx") # 按投票地点分组,合并Precinct ID为逗号分隔的字符串 merged_df = df.groupby("Location Name")["Precinct ID"].agg( lambda x: ", ".join(x.astype(str)) ).reset_index() # 输出或保存结果 print(merged_df) merged_df.to_excel("merged_voting_data.xlsx", index=False)
SQL(适用于数据库存储的数据)
根据使用的数据库类型选择对应函数:
MySQL 8.0+
SELECT `Location Name`, GROUP_CONCAT(`Precinct ID` SEPARATOR ', ') AS `Precinct ID` FROM voting_locations GROUP BY `Location Name`;
SQL Server 2017+
SELECT [Location Name], STRING_AGG([Precinct ID], ', ') AS [Precinct ID] FROM voting_locations GROUP BY [Location Name];
内容的提问来源于stack exchange,提问作者Fred Ditzian
相关产品推荐
相关产品推荐

