Aurora MySQL关联查询计数结果异常,是Bug还是操作问题?
问题分析与结论
这不是Aurora MySQL的Bug,是你对关联查询的计数逻辑理解有误。
核心原因:ID列存在重复值
当使用JOIN按ID关联两张表时,COUNT(*)统计的是所有匹配成功的记录行数,而非唯一ID的数量。如果某ID在table1中出现m次,在table2中出现n次,这个ID会生成m×n条匹配记录。最终的总计数就是所有共同ID的m×n之和。
你的两张表总记录数分别是155万和129万,两者乘积约201亿,你得到的151亿在这个合理范围内,完全符合关联逻辑的预期。
验证步骤
你可以执行以下SQL确认ID重复情况:
- 查看
table1中重复次数最多的ID:
SELECT ID, COUNT(*) AS repeat_count FROM table1 GROUP BY ID HAVING repeat_count > 1 ORDER BY repeat_count DESC LIMIT 10;
- 查看
table2中重复次数最多的ID:
SELECT ID, COUNT(*) AS repeat_count FROM table2 GROUP BY ID HAVING repeat_count > 1 ORDER BY repeat_count DESC LIMIT 10;
- 计算理论匹配总条数(和你之前的
COUNT(*)结果对比):
SELECT SUM(t1.cnt * t2.cnt) AS total_matches FROM (SELECT ID, COUNT(*) AS cnt FROM table1 GROUP BY ID) t1 JOIN (SELECT ID, COUNT(*) AS cnt FROM table2 GROUP BY ID) t2 ON t1.ID = t2.ID;
这个结果会和你之前得到的15172673205一致。
如果你需要统计共同唯一ID的数量
如果你的真实需求是统计两张表中都存在的唯一ID的个数,应该用以下语句:
SELECT COUNT(DISTINCT t1.ID) FROM table1 t1 JOIN table2 t2 ON t1.ID = t2.ID;
或者更高效的写法:
SELECT COUNT(*) FROM (SELECT ID FROM table1 INTERSECT SELECT ID FROM table2) AS tmp;
内容的提问来源于stack exchange,提问作者Bobby
相关产品推荐
相关产品推荐

