SQL统计需求与语句修正:按月分组统计符合条件的UHID数量
正确SQL实现需求方案
你的原始SQL存在两个核心问题:
- 统计的是符合条件的记录条数,而非去重后的
uhid数量(同一个用户在同一月份可能有多条符合条件的记录,但应只计数一次) - 条件逻辑与需求完全不符(你使用了
response_val='5'和response_key范围81-87,而需求是95-98区间且response_val=4)
方案一:直接筛选+去重计数
这是最简洁的写法,先筛选出符合要求的记录,再按月份统计去重的uhid数量:
SELECT month, COUNT(DISTINCT uhid) AS count FROM audit WHERE response_key BETWEEN 95 AND 98 AND response_val = '4' GROUP BY month;
逻辑说明:
WHERE子句先过滤出response_key在95-98之间且response_val=4的所有记录COUNT(DISTINCT uhid)确保同一个uhid在同一月份内无论有多少条符合记录,都只被计数一次- 最后按
month分组,得到每个月符合条件的用户数
对应你的样本数据,这个语句会返回:
| count | month |
|---|---|
| 1 | 2019-09 |
完全匹配预期结果。
方案二:分组筛选后统计(更严谨的多条件场景)
如果需要更灵活的判断(比如用户在95-98区间内至少有一条response_val=4),可以先按uhid和month分组,筛选出符合条件的用户,再统计:
SELECT month, COUNT(*) AS count FROM ( SELECT uhid, month FROM audit WHERE response_key BETWEEN 95 AND 98 GROUP BY uhid, month HAVING SUM(CASE WHEN response_val = '4' THEN 1 ELSE 0 END) > 0 ) AS qualified_users GROUP BY month;
逻辑说明:
- 子查询先按
uhid和month分组,通过HAVING子句判断该用户在当月的95-98记录中是否存在response_val=4的条目 - 外层查询对筛选后的用户-月份组合按
month计数,得到最终结果
内容的提问来源于stack exchange,提问作者Rina Xavier
相关产品推荐
相关产品推荐

