如何选取Outcome1字段MIN decimal值实现重复ID数据去重
可行解决方案
方案1:窗口函数法(推荐,适配MySQL 8.0+/PostgreSQL/SQL Server/Oracle等所有支持窗口函数的主流数据库)
通过分组排序直接定位每组最小Outcome1对应的行:
SELECT ID, Outcome1, Outcome2 FROM ( SELECT *, -- 按ID分组,组内按Outcome1升序排序,生成序号 ROW_NUMBER() OVER(PARTITION BY ID ORDER BY Outcome1 ASC) AS rank_num FROM 你的表名 ) AS temp_table WHERE rank_num = 1;
如果同一个ID下存在多行Outcome1同为最小值且需要全部保留,将ROW_NUMBER()替换为RANK()即可。
方案2:子查询关联法(适配MySQL 5.x等不支持窗口函数的低版本数据库)
先统计每组ID的最小Outcome1,再关联原表匹配完整行:
SELECT t1.* FROM 你的表名 AS t1 INNER JOIN ( -- 先查询每个ID对应的最小Outcome1值 SELECT ID, MIN(Outcome1) AS min_oc1 FROM 你的表名 GROUP BY ID ) AS t2 ON t1.ID = t2.ID AND t1.Outcome1 = t2.min_oc1;
该方案默认会返回同一ID下所有Outcome1为最小值的行,符合绝大多数去重场景需求。
两种方案代入你提供的示例数据,均会返回预期输出结果。
内容的提问来源于stack exchange,提问作者sqlenthusiast
相关产品推荐
相关产品推荐

