You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何在BigQuery的GROUP BY分组中选取任意完整行?

分组选取任意一行完整数据的SQL语法

PostgreSQL 实现方式

PostgreSQL 支持 DISTINCT ON 语法,可直接获取每个a分组下的任意一行完整数据:

SELECT DISTINCT ON (a) a, b, c, d, e, f
FROM foo
ORDER BY a;

如果需要指定分组内选取某类行(比如b值最大的行),可在ORDER BY后追加排序字段:

SELECT DISTINCT ON (a) a, b, c, d, e, f
FROM foo
ORDER BY a, b DESC;

BigQuery 实现方式

BigQuery 不支持DISTINCT ON,可通过以下两种方式实现:

方法1:窗口函数ROW_NUMBER()

给每个a分组的行分配随机序号,选取序号为1的行:

SELECT a, b, c, d, e, f
FROM (
  SELECT *,
         ROW_NUMBER() OVER (PARTITION BY a ORDER BY RAND()) AS rn
  FROM foo
)
WHERE rn = 1;

若不需要随机选取,可省略ORDER BY RAND(),此时窗口函数会按存储顺序分配序号,同样能得到分组内任意一行。

方法2:ARRAY_AGG 打包取首行

将每个a分组的行打包为数组,取数组第一个元素的所有字段:

SELECT 
  a,
  ARRAY_AGG(STRUCT(b, c, d, e, f))[OFFSET(0)].*
FROM foo
GROUP BY a;

内容的提问来源于stack exchange,提问作者y.selivonchyk

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.21 11:29:58