查询优化--小表驱动大表（In，Exists区别）

Mysql 系列文章主页

===============

本文将以真实例子来讲解小表驱动大表（In，Exists区别）

1 准备数据

1.1 创建表、函数、存储过程

参照这篇（调用函数和存储过程批量插入数据）文章中的第 1-7 步，注意，不要执行第8步

1.2 插入数据

现在来执行第8步。

1.2.1 向 Department 表中插入 100 条记录

CALL insert_dept(1000, 100)

1.2.2 向 Employee 表中插入 100000 条记录

CALL insert_employee(100000000, 100000);

2 测试

2.1 查询所有 Employee 信息，要求是：Employee 的 dept_id 存在于 Department 表中

Case#1：用 IN

SELECT * FROM employee WHERE dept_id IN (SELECT id FROM department);

结果：在我本机测试了数十次，耗时大概是 120--130 ms

Case#2：用 EXISTS

SELECT * FROM employee e WHERE EXISTS (SELECT 1 FROM department d WHERE e.dept_id = d.id);

结果：在我本机测试了数十次，耗时大概是 350--370 ms

2.2 查询所有 Department 信息，要求是：至少有一条 Employee 记录的 dept_id 对应 Department（或者说：此部门下至少有一条员工记录）

Case#3：用 EXISTS

SELECT * FROM department d WHERE EXISTS (SELECT 1 FROM employee e WHERE d.id = e.dept_id);

结果：在我本机测试了数十次，耗时大概是 4--6 ms

Case#4：用 IN

SELECT * FROM department WHERE id IN (SELECT dept_id FROM employee);

结果：在我本机测试了数十次，耗时大概是 50--55 ms

2.3 分析并总结

在 Case#1，#2 中，Employee 是大表，Department 是小表，用 IN(Department) 的效果较好（大概是用 EXISTS 时间的三分之一）====> IN 后面跟小表~

在 Case#3，#4 中，Employee 是大表，Department 是小表，用 EXISTS(Employee) 的效果较好（大概是用 IN 时间的十分之一）====> EXISTS 后面跟大表~

记忆：IN 后面跟小表~EXISTS 后面跟大表~~~因为 IN 这个单词比 EXISTS 单词更短（更小），EXISTS 这个单词比 IN 更长（更大）

2.4 进一步分析

至于为什么 Case#1 优于 Case#2，Case#3 优于 Case#4，还没搞清楚到底是为什么，，，，，TODO

一篇文章可供参考：https://www.cnblogs.com/beijingstruggle/p/5885137.html

3 结论

小表驱动大表

IN 小 EXISTS 大

查询优化--小表驱动大表（In，Exists区别）的更多相关文章

6.2 小表驱动大表（exists的应用）
1. 优化原则:小表驱动大表,即小数据集驱动大数据集. select * from A where id in (select id from B) 等价于: for select id from B ...
Mysql优化原则_小表驱动大表IN和EXISTS的合理利用
//假设一个for循环 ; $i < ; $i++) { ; $i < ; $j++) { } } ; $i < ; $i++) { ; $i < ; $j++) { } } ...
MySQL高级知识（十六）——小表驱动大表
前言:本来小表驱动大表的知识应该在前面就讲解的,但是由于之前并没有学习数据批量插入,因此将其放在这里.在查询的优化中永远小表驱动大表. 1.为什么要小表驱动大表呢类似循环嵌套 for(int i=5 ...
MySql 小表驱动大表
在了解之前要先了解对应语法 in 与 exist. IN: select * from A where A.id in (select B.id from B) in后的括号的表达式结果要求之输出一列 ...
了解MySQL联表查询中的驱动表，优化查询，以小表驱动大表
一.为什么要用小表驱动大表 1.驱动表的定义当进行多表连接查询时, [驱动表] 的定义为: 1)指定了联接条件时,满足查询条件的记录行数少的表为[驱动表] 2)未指定联接条件时,行数少的表为[驱动表 ...
3.mysql小表驱动大表的4种表连接算法
小表驱动大表 1.概念驱动表的概念是指多表关联查询时,第一个被处理的表,使用此表的记录去关联其他表.驱动表的确定很关键,会直接影响多表连接的关联顺序,也决定了后续关联时的查询性能. 2.原则驱动表 ...
小表驱动大表, 兼论exists和in
给出两个表,A和B,A和B表的数据量, 当A小于B时,用exists select * from A where exists (select * from B where A.id=B.id) ex ...
【Spark调优】小表join大表数据倾斜解决方案
[使用场景] 对RDD使用join类操作,或者是在Spark SQL中使用join语句时,而且join操作中的一个RDD或表的数据量比较小(例如几百MB或者1~2GB),比较适用此方案. [解决方案] ...
hive join 优化 --小表join大表
1.小.大表 join 在小表和大表进行join时,将小表放在前边,效率会高.hive会将小表进行缓存. 2.mapjoin 使用mapjoin将小表放入内存,在map端和大表逐一匹配.从而省去red ...

随机推荐

Andrew Ng机器学习第一章——单变量线性回归
监督学习算法工作流程 h代表假设函数,h是一个引导x得到y的函数如何表示h函数是监督学习的关键问题线性回归:h函数是一个线性函数代价函数在线性回归问题中,常常需要解决最小化问题.代价函数常用平 ...
QT5.5与MYSQL5.6数据库连接的具体方法与实现
由于毕设需要用到QT读取数据库中的数据,并将数据保存至数据库中.花了一天的时间,总算实现了从QT中读取数据库中的数据.网上相关资料很多,但是写得不是很全,中间出现了一些问题,解决起来比较麻烦.所以本文 ...
Struts(二十三)：使用声名式验证
Struts2工程中的验证分为两种: 1.基于XWork Validation Framework的声明式验证:Struts2提供了一些基于XWork Validation Framework的内建验 ...
vuex commit保存数据技巧
vuex 单向数据流,推荐的commit 改变state数据,写起来非常繁琐,因为改数据可能要写很多commit函数. 依据我的理解,单向数据流主要是为了避免数据混乱,便于调试. 说白了,就是一个数据 ...
hue集成hive访问报database is locked
这个问题这应该是hue默认的SQLite数据库出现错误,你可以使用mysql postgresql等来替换 hue默认使用sqlite作为元数据库,不推荐在生产环境中使用.会经常出现database ...
jquery ajax 发送邮件例子
<div class="form"> <dl> <dt>您的称呼<small>(必填)</small></dt&g ...
[LeetCode] 4 Keys Keyboard 四键的键盘
Imagine you have a special keyboard with the following keys: Key 1: (A): Print one 'A' on screen. Ke ...
php文件包含漏洞（input与filter）
php://input php://input可以读取没有处理过的POST数据.相较于$HTTP_RAW_POST_DATA而言,它给内存带来的压力较小,并且不需要特殊的php.ini设置.php:/ ...
[HNOI 2016]大数
Description 题库链接给你一个长度为 $n$ ,可含前导零的大数,以及一个质数 $p$ . $m$ 次询问,每次询问你一个大数的子区间 $[l,r]$ ,求出子区间中有多少 ...
[Codeforces 933B]A Determined Cleanup
Description 题库链接给你两个正整数 $p,k$ ,询问是否能够构造多项式 $f(x)=\sum\limits_{i=0}^{d-1}a_ix^i$ ,使得存在多项式 \(q(x) ...

查询优化--小表驱动大表（In，Exists区别）

查询优化--小表驱动大表（In，Exists区别）的更多相关文章

随机推荐

热门专题