AWS Redshift中合并重复行(仅value列单值非空)的实现方法
AWS Redshift中合并重复行(仅value列单值非空)的实现方法
嗨,这个场景我太熟啦!你遇到的是典型的同组行合并需求——相同id和key的行里,value1/value2/value3每次只有一列带有效值,剩下的都是NULL,要把这些零散的行合并成一行,把所有非空值都保留下来对吧?
其实用Redshift的聚合函数就能轻松搞定,核心思路就是按id和key分组,对每个value列取最大值(或最小值)——因为聚合函数会自动忽略NULL值,而同一组里每个value列最多只有一个非空值,所以取MAX/MIN就能精准拿到那个有效数据。
给你贴个完整的正确SQL:
SELECT id, key, MAX(value1) AS value1, MAX(value2) AS value2, MAX(value3) AS value3 FROM your_table_name -- 记得替换成你的实际表名 GROUP BY id, key ORDER BY id;
顺便给你拆解下逻辑:
GROUP BY id, key会把所有id和key完全相同的行归为同一组- 对每个value列用
MAX():同一组里每个value列只有一个非空值,MAX会直接抓取这个值,其余NULL会被自动忽略,完美契合你“有值就用、没值留NULL”的要求
另外提一句,你之前尝试的SQL里有个小笔误——把MAX(value2)的别名写成了value1,一定要修正过来,不然结果会出现列值错位的问题哦~
备注:内容来源于stack exchange,提问作者x89
相关产品推荐
相关产品推荐

