如何用SQL按分组筛选出每组中日期最早的所有行
问题解答
你尝试的第一条SQL的问题
你写的这条语句:
SELECT * FROM table GROUP BY ID ORDER BY Event_Date ASC LIMIT 1;
首先,GROUP BY ID搭配SELECT *的写法不符合标准SQL规范,仅部分数据库(如关闭ONLY_FULL_GROUP_BY的MySQL)允许,但返回的非聚合列(Gender、Event_Date)是随机取值的,并非分组内的最早日期行。其次,LIMIT 1是从整个查询结果集中只返回1行,完全不会处理每个ID分组的多行数据,更不可能保留同一ID下所有日期最早的行——它只会返回全局排序后的第一行,完全不符合需求。
你尝试的第二条SQL的问题
这条语句:
SELECT * FROM table WHERE Event_Date IS Min(Event_Date)
存在两处错误:
Min()是聚合函数,只能用于分组聚合场景(如SELECT ID, Min(Event_Date) FROM table GROUP BY ID),无法直接放在WHERE子句中过滤行——WHERE仅用于单条行的条件判断,不能引用聚合后的结果。- 判断相等应该用
=,而非IS(IS通常用于判断NULL)。
正确实现方案
要保留每个ID分组下日期最早的所有行,推荐两种实用方法:
方法1:窗口函数(推荐,适用于MySQL 8+、PostgreSQL、SQL Server等支持窗口函数的数据库)
利用RANK()窗口函数,给每个ID分组内的行按Event_Date排序,标记出最早日期的行:
SELECT ID, Gender, Event_Date FROM ( SELECT *, RANK() OVER (PARTITION BY ID ORDER BY Event_Date ASC) AS rnk FROM table ) t WHERE rnk = 1;
RANK()会给同一ID下日期相同的行分配相同排名(比如ID=2的三个最早日期行排名都是1),筛选rnk=1即可保留所有并列最早的行。
方法2:子查询+关联(兼容低版本数据库)
先通过子查询获取每个ID的最小Event_Date,再关联原表筛选匹配的行:
SELECT t1.* FROM table t1 JOIN ( SELECT ID, MIN(Event_Date) AS min_date FROM table GROUP BY ID ) t2 ON t1.ID = t2.ID AND t1.Event_Date = t2.min_date;
该方法先提取每个ID的最早日期,再匹配原表中ID和日期均符合的行,同样能保留所有同一ID下日期最早的行。
内容的提问来源于stack exchange,提问作者alex
相关产品推荐
相关产品推荐

