You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何通过SQL查询同表内2019年缺失的CountyName记录

查询2019年缺失县名的实现方案

核心逻辑是直接在SQL层做集合比对:找出所有2020年收录、但2019年未收录的CountyName,全程不需要导出数据人工核对,以下是不同场景下的可用写法:

方法1:NOT EXISTS 反连接(通用推荐,性能最优)

所有主流关系型数据库都支持该语法,数据库优化器对其适配度最高,字段建索引后查询效率极高:

SELECT DISTINCT a2020.CountyName
FROM 表A a2020
WHERE a2020.Year = 2020
  AND NOT EXISTS (
      SELECT 1
      FROM 表A a2019
      WHERE a2019.Year = 2019
        AND a2019.CountyName = a2020.CountyName
  );

语句中加DISTINCT是为了过滤同一年单县多条关联业务记录导致的重复结果,如果你确认单年单县在表中唯一,可以去掉该关键字。

方法2:LEFT JOIN 反连接

逻辑和NOT EXISTS完全一致,适合习惯写连接查询的场景:

SELECT DISTINCT a2020.CountyName
FROM 表A a2020
LEFT JOIN 表A a2019
  ON a2020.CountyName = a2019.CountyName
  AND a2019.Year = 2019
WHERE a2020.Year = 2020
  AND a2019.CountyName IS NULL;

注意:过滤2019年的条件必须写在ON子句中,不能放到WHERE子句里,否则左连接会被强制转为内连接,无法查出缺失的县名。

方法3:EXCEPT 集合差(写法最简洁)

如果你用的是PostgreSQL、SQL Server、BigQuery等支持EXCEPT语法的数据库,可以直接取两个县名集合的差集,EXCEPT自带去重逻辑,不需要额外加DISTINCT:

SELECT CountyName FROM 表A WHERE Year = 2020
EXCEPT
SELECT CountyName FROM 表A WHERE Year = 2019;

注意:MySQL 8.0以下版本不支持EXCEPT语法,这类环境优先选择前两种写法。


避坑提示

  • 不推荐使用NOT IN写法:如果2019年的CountyName字段存在NULL值,NOT IN会直接返回空结果,极易引发逻辑错误。
  • 性能优化建议:给表建(Year, CountyName)的联合索引,能把这类跨年比对查询的速度提升数倍。

内容的提问来源于stack exchange,提问作者Vishal Borgaonkar

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.30 02:18:20