You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Aurora MySQL关联查询计数结果异常,是Bug还是操作问题?

问题分析与结论

这不是Aurora MySQL的Bug,是你对关联查询的计数逻辑理解有误。

核心原因:ID列存在重复值

当使用JOIN按ID关联两张表时,COUNT(*)统计的是所有匹配成功的记录行数,而非唯一ID的数量。如果某ID在table1中出现m次,在table2中出现n次,这个ID会生成m×n条匹配记录。最终的总计数就是所有共同ID的m×n之和。

你的两张表总记录数分别是155万和129万,两者乘积约201亿,你得到的151亿在这个合理范围内,完全符合关联逻辑的预期。

验证步骤

你可以执行以下SQL确认ID重复情况:

  1. 查看table1中重复次数最多的ID:
SELECT ID, COUNT(*) AS repeat_count 
FROM table1 
GROUP BY ID 
HAVING repeat_count > 1 
ORDER BY repeat_count DESC 
LIMIT 10;
  1. 查看table2中重复次数最多的ID:
SELECT ID, COUNT(*) AS repeat_count 
FROM table2 
GROUP BY ID 
HAVING repeat_count > 1 
ORDER BY repeat_count DESC 
LIMIT 10;
  1. 计算理论匹配总条数(和你之前的COUNT(*)结果对比):
SELECT SUM(t1.cnt * t2.cnt) AS total_matches
FROM (SELECT ID, COUNT(*) AS cnt FROM table1 GROUP BY ID) t1
JOIN (SELECT ID, COUNT(*) AS cnt FROM table2 GROUP BY ID) t2 ON t1.ID = t2.ID;

这个结果会和你之前得到的15172673205一致。

如果你需要统计共同唯一ID的数量

如果你的真实需求是统计两张表中都存在的唯一ID的个数,应该用以下语句:

SELECT COUNT(DISTINCT t1.ID) 
FROM table1 t1 
JOIN table2 t2 ON t1.ID = t2.ID;

或者更高效的写法:

SELECT COUNT(*) 
FROM (SELECT ID FROM table1 INTERSECT SELECT ID FROM table2) AS tmp;

内容的提问来源于stack exchange,提问作者Bobby

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.18 08:02:53