SQLite同结果不同查询语句执行时间差异原因求教
SQLite查询执行时间差异原因分析
我有一个存储电影信息的SQLite数据库,需要提取所有出演2004年上映电影的人员姓名,并按出生日期排序。我写了两个逻辑完全相同的查询语句,但第一个执行时间长达12-13秒,是第二个(1-2秒)的10倍多,在DB Browser for SQLite和SQLite CLI中都存在这个现象,想搞清楚差异产生的原因。
第一个慢查询(执行时间约12-13秒)
SELECT DISTINCT people.name FROM people JOIN stars ON people.id = stars.person_id JOIN movies ON movies.id = stars.movie_id WHERE movies.year = 2004 ORDER BY people.birth
第二个快查询(执行时间约1-2秒)
SELECT DISTINCT people.name FROM movies JOIN stars ON movies.id = stars.movie_id JOIN people ON stars.person_id = people.id WHERE movies.year = 2004 ORDER BY people.birth
差异核心原因
两者的关键区别在于表的连接顺序与过滤条件的执行时机:
- 第一个查询从
people表(人员总数量远大于2004年电影数量)开始,先遍历所有人员记录,再关联stars表找到他们参演的所有电影,最后才过滤出2004年的电影。这个过程会先产生一个包含所有人员参演电影的超大中间数据集,再逐步筛选,消耗大量内存和IO资源,自然速度慢。 - 第二个查询从
movies表开始,第一步就通过WHERE movies.year = 2004过滤出2004年的电影,直接把数据集缩小到一个很小的范围,再关联stars表找到这些电影的参演人员,最后关联people表取姓名和出生日期。后续所有连接操作都基于小数据集,执行效率自然大幅提升。
SQLite的查询优化器虽然会尝试选择最优执行路径,但当表数据量差异悬殊时,手动指定从过滤后数据量更小的表启动连接,能让优化器更高效地完成查询——这里2004年的电影数量远小于总人员数,所以先处理movies表的过滤是性能提升的关键。
内容的提问来源于stack exchange,提问作者Kanexxy
相关产品推荐
相关产品推荐

