You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

子查询分组后为何未作用于主查询?两段SQL为何不等价?

关于SQL分组的两个问题解答

问题1:为什么在子查询中使用GROUP BY进行分组后,分组未作用于主查询?

对应SQL代码示例:

select sum(age),customer_id 
from (select * from customers group by first_name)

子查询里的GROUP BY first_name只会对子查询内部的数据集生效:它会按first_name分组,返回每组的一行数据(在未开启严格分组模式的SQL环境中,比如关闭了MySQL的ONLY_FULL_GROUP_BY,非分组列会随机取组内某行的值)。

而主查询是基于子查询返回的这个结果集来执行的,主查询本身没有GROUP BY子句,所以sum(age)是对整个子查询结果集的所有age值求和,customer_id则是从子查询结果里随机取一行的id——相当于主查询完全忽略了子查询的分组逻辑,只是把它当成一个普通的数据源来做全局聚合和随机取值,自然分组效果不会传递到主查询。

问题2:以下两段SQL代码为何不相等价?

代码1:

select sum(age),customer_id 
from (select * from customers group by first_name)

代码2:

select sum(age),customer_id 
from customers 
group by first_name

两者的执行逻辑完全不同:

  1. 代码1的执行流程:

    • 先执行子查询,按first_name分组得到一个中间结果集(每组一行);
    • 主查询对这个中间结果集做全局聚合:sum(age)是把中间结果里所有组的age加起来的总和,customer_id随机取中间结果里某一行的id。最终只会返回一行数据。
  2. 代码2的执行流程:

    • 直接对customers表按first_name分组;
    • 每个分组内计算sum(age)(即每个first_name对应的年龄总和),同时customer_id取该分组内某一行的id。最终会返回多行数据,每行对应一个first_name分组的结果。

这就导致两段代码的输出结果、行数都完全不同,自然不等价。

内容的提问来源于stack exchange,提问作者anant

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.06.25 05:10:02