如何用SQL移除Cust_id与User_id重复组,保留Sequence最大值记录
保留Cust_id+User_id分组下Sequence最大值的记录
针对你的需求——从表TCD中移除Cust_id和User_id组合重复的记录,仅保留每组内Sequence数值最大的条目,以下是两种实用的SQL实现方案:
方案1:窗口函数法(适合MySQL 8+、PostgreSQL、SQL Server等)
利用ROW_NUMBER()窗口函数对每个分组的记录按Sequence降序排序,取排序后第一条记录:
WITH ranked_records AS ( SELECT DateTime, Cust_id, User_id, Sequence, ROW_NUMBER() OVER (PARTITION BY Cust_id, User_id ORDER BY Sequence DESC) AS rn FROM TCD ) SELECT DateTime, Cust_id, User_id, Sequence FROM ranked_records WHERE rn = 1;
如果同一分组内存在多条Sequence同为最大值的记录,想全部保留的话,把ROW_NUMBER()替换为RANK()即可。
方案2:子查询关联法(兼容所有SQL方言)
先通过子查询找出每个Cust_id+User_id组合的最大Sequence值,再关联原表筛选对应记录:
SELECT t1.* FROM TCD t1 INNER JOIN ( SELECT Cust_id, User_id, MAX(Sequence) AS max_seq FROM TCD GROUP BY Cust_id, User_id ) t2 ON t1.Cust_id = t2.Cust_id AND t1.User_id = t2.User_id AND t1.Sequence = t2.max_seq;
该方案会返回同一分组内所有Sequence等于最大值的记录,若需仅保留一条,可结合DISTINCT或额外排序条件调整。
内容的提问来源于stack exchange,提问作者Himanshu
相关产品推荐
相关产品推荐

