技术问询:如何为每个cust_id提取各mis_dt对应的最后一行(如图黄高亮行)
提取每个cust_id对应每个mis_dt的最后一行记录
针对需求——获取每个cust_id下,每个mis_dt对应的最后一行记录,下面是几种主流数据库的实现方案:
MySQL 实现
利用窗口函数ROW_NUMBER()分组排序后筛选:
SELECT cust_id, mis_dt, col1, col2, ... -- 替换为你的实际字段 FROM ( SELECT *, -- 按cust_id和mis_dt分组,按排序字段倒序编号(这里用id示例,可替换为时间字段) ROW_NUMBER() OVER (PARTITION BY cust_id, mis_dt ORDER BY id DESC) AS rn FROM your_table -- 替换为你的表名 ) t WHERE rn = 1;
如果没有明确的排序字段,不建议依赖物理存储顺序取最后一行,结果不稳定。
PostgreSQL 实现
除了窗口函数,还可以用DISTINCT ON语法简化写法:
SELECT DISTINCT ON (cust_id, mis_dt) cust_id, mis_dt, col1, col2, ... FROM your_table -- 先按分组字段排序,再按目标字段倒序,确保取到最后一行 ORDER BY cust_id, mis_dt, id DESC;
DISTINCT ON会保留每个分组内排序后的第一行,倒序排序就能拿到逻辑上的最后一条记录。
SQL Server 实现
用窗口函数的写法和MySQL一致:
SELECT cust_id, mis_dt, col1, col2, ... FROM ( SELECT *, ROW_NUMBER() OVER (PARTITION BY cust_id, mis_dt ORDER BY id DESC) AS rn FROM your_table ) t WHERE rn = 1;
新版本SQL Server也可以用TOP 1 WITH TIES简化:
SELECT TOP 1 WITH TIES cust_id, mis_dt, col1, col2, ... FROM your_table ORDER BY ROW_NUMBER() OVER (PARTITION BY cust_id, mis_dt ORDER BY id DESC);
关键提示
- 务必将
id DESC替换为实际的排序依据(比如业务上的更新时间update_time DESC),这样“最后一行”的逻辑才符合业务需求 - 如果同一分组内有多个记录的排序字段值相同,
ROW_NUMBER()会随机选一条;若要保留所有等值记录,可改用RANK()或DENSE_RANK()替换ROW_NUMBER()
内容的提问来源于stack exchange,提问作者sank
相关产品推荐
相关产品推荐

