MySQL 5.7 优化SQL提升100倍执行效率的深度思考(GO)
系统环境:微软云Linux DS12系列、Centos6.5 、MySQL 5.7.10、生产环境,step1,step2是案例,精彩的剖析部分在step3,step4.
1、慢sql语句大概需要13秒
原来的sql语句要13秒,sql如下:
SELECT (SELECT COUNT(*) FROM TB_BIS_POS_DEVICE t1, TB_BIS_MERCHANT t2 WHERE t1.`PROJECT_ID` = '1024' AND t1.MERCHANT_ID = t2.ID AND t2.SPACE_ID = 'DE907E67FB9B487FA762E6E9B795072A') AS '安装', (SELECT COUNT(*) FROM TB_BIS_POS_DEVICE t1, TB_BIS_POS_HEARTBEAT t2, TB_BIS_MERCHANT t3 WHERE t1.`PROJECT_ID` = '1024' AND t1.MERCHANT_ID = t3.ID AND t3.SPACE_ID = 'DE907E67FB9B487FA762E6E9B795072A' AND t1.`ID` = t2.`DEVICE_ID` AND t2.ENABLED = 1) AS '在线', (SELECT COUNT(DISTINCT (t1.`SN`)) FROM TB_BIS_POS_DEVICE t1, TB_BIS_POS_ORDER t2, TB_BIS_MERCHANT t3 WHERE t1.`PROJECT_ID` = '1024' AND t1.MERCHANT_ID = t3.ID AND t3.SPACE_ID = 'DE907E67FB9B487FA762E6E9B795072A' AND t1.ID = t2.`DEVICE_ID`) AS '连通', (SELECT COUNT(*) FROM TB_BIS_POS_DEVICE t1, TB_BIS_MERCHANT t2 WHERE t1.`PROJECT_ID` = '1024' AND t1.MERCHANT_ID = t2.ID AND t2.SPACE_ID = 'DE907E67FB9B487FA762E6E9B795072A' AND exists( select 1 ) AND t1.ID IN (SELECT t2.`DEVICE_ID` FROM TB_BIS_POS_ORDER t2 WHERE t2.`CREATE_DATE` >= DATE_FORMAT(NOW(), '%Y-%m-%d')) AND t1.ID NOT IN (SELECT t2.`DEVICE_ID` FROM TB_BIS_POS_ORDER t2 WHERE t2.`CREATE_DATE` <= DATE_FORMAT(NOW(), '%Y-%m-%d')) ) AS '今日连通', (SELECT COUNT(DISTINCT (t1.`SN`)) FROM TB_BIS_POS_DEVICE t1, TB_BIS_POS_ORDER t2, TB_BIS_MERCHANT t3 WHERE t1.`PROJECT_ID` = '1024' AND t1.MERCHANT_ID = t3.ID AND t3.SPACE_ID = 'DE907E67FB9B487FA762E6E9B795072A' AND t1.ID = t2.`DEVICE_ID` AND UNIX_TIMESTAMP(t2.CREATE_DATE) >= UNIX_TIMESTAMP(NOW()) - 60 * 60 * 2) AS '正常交易', (SELECT COUNT(*) FROM TB_BIS_POS_DEVICE t1, TB_BIS_POS_ORDER t2, TB_BIS_MERCHANT t3 WHERE t1.`PROJECT_ID` = '1024' AND t1.MERCHANT_ID = t3.ID AND t3.SPACE_ID = 'DE907E67FB9B487FA762E6E9B795072A' AND t1.ID = t2.`DEVICE_ID`) AS '交易共计', (SELECT COUNT(*) FROM TB_BIS_POS_DEVICE t1, TB_BIS_POS_ORDER t2, TB_BIS_MERCHANT t3 WHERE t1.`PROJECT_ID` = '1024' AND t1.MERCHANT_ID = t3.ID AND t3.SPACE_ID = 'DE907E67FB9B487FA762E6E9B795072A' AND t1.ID = t2.`DEVICE_ID` AND t2.`CREATE_DATE` >= DATE_FORMAT(NOW(), '%Y-%m-%d')) AS '今日产生' FROM DUAL ; |
2、优化后提升100倍,只要0.09秒
和开发人员熟悉了业务之后,优化成如下,从13秒到0.09秒,效率提升了100多倍。
采用如下3种策略提升百倍效率,如下
/*(1)内连接+distinct效率低下,换成exists高效*/
/*(2)IN不走索引,优化成EXISTS如下*/
/*(3)字段不能做函数处理,不然不走索引,优化成如下*/
SELECT sql_no_cache ( SELECT COUNT(*) FROM TB_BIS_POS_DEVICE t1, TB_BIS_MERCHANT t2 WHERE t1.`PROJECT_ID` = '1024' AND t1.MERCHANT_ID = t2.ID AND t2.SPACE_ID = 'DE907E67FB9B487FA762E6E9B795072A' ) AS '安装', ( SELECT COUNT(*) FROM TB_BIS_POS_DEVICE t1, TB_BIS_POS_HEARTBEAT t2, TB_BIS_MERCHANT t3 WHERE t1.`PROJECT_ID` = '1024' AND t1.MERCHANT_ID = t3.ID AND t3.SPACE_ID = 'DE907E67FB9B487FA762E6E9B795072A' AND t1.`ID` = t2.`DEVICE_ID` AND t2.ENABLED = 1 ) AS '在线', ( /* SELECT COUNT(DISTINCT (t1.`SN`)) FROM TB_BIS_POS_DEVICE t1, TB_BIS_POS_ORDER t2, TB_BIS_MERCHANT t3 WHERE t1.`PROJECT_ID` = '1024' AND t1.MERCHANT_ID = t3.ID AND t3.SPACE_ID = 'DE907E67FB9B487FA762E6E9B795072A' AND t1.ID = t2.`DEVICE_ID`*/ /*(1)内连接+distinct效率低下,换成exists高效*/ SELECT COUNT(t1.`SN`) FROM TB_BIS_POS_DEVICE t1 WHERE t1.`PROJECT_ID` = '1024' AND EXISTS(SELECT 1 FROM TB_BIS_POS_ORDER t2 WHERE t1.ID = t2.`DEVICE_ID`) AND EXISTS(SELECT 1 FROM TB_BIS_MERCHANT t3 WHERE t1.MERCHANT_ID = t3.ID AND t3.SPACE_ID = 'DE907E67FB9B487FA762E6E9B795072A') ) AS '连通', ( /* SELECT COUNT(*) FROM TB_BIS_POS_DEVICE t1, TB_BIS_MERCHANT t2 WHERE t1.`PROJECT_ID` = '1024' AND t1.MERCHANT_ID = t2.ID AND t2.SPACE_ID = 'DE907E67FB9B487FA762E6E9B795072A' AND exists( select 1 ) AND t1.ID IN (SELECT t2.`DEVICE_ID` FROM TB_BIS_POS_ORDER t2 WHERE t2.`CREATE_DATE` >= DATE_FORMAT(NOW(), '%Y-%m-%d')) AND t1.ID NOT IN (SELECT t2.`DEVICE_ID` FROM TB_BIS_POS_ORDER t2 WHERE t2.`CREATE_DATE` <= DATE_FORMAT(NOW(), '%Y-%m-%d')) */ /*(2)IN不走索引,优化成EXISTS如下*/ SELECT COUNT(*) FROM TB_BIS_POS_DEVICE t1, TB_BIS_MERCHANT t2 WHERE t1.`PROJECT_ID` = '1024' AND t1.MERCHANT_ID = t2.ID AND t2.SPACE_ID = 'DE907E67FB9B487FA762E6E9B795072A' AND EXISTS( SELECT 1 FROM TB_BIS_POS_ORDER t3 WHERE t3.`CREATE_DATE` >= DATE_FORMAT(NOW(), '%Y-%m-%d') AND t3.`DEVICE_ID`=t1.`ID`) ) AS '今日连通', ( SELECT COUNT(DISTINCT (t1.`SN`)) FROM TB_BIS_POS_DEVICE t1, TB_BIS_POS_ORDER t2, TB_BIS_MERCHANT t3 WHERE t1.`PROJECT_ID` = '1024' AND t1.MERCHANT_ID = t3.ID AND t3.SPACE_ID = 'DE907E67FB9B487FA762E6E9B795072A' AND t1.ID = t2.`DEVICE_ID` /*AND UNIX_TIMESTAMP(t2.CREATE_DATE) >= UNIX_TIMESTAMP(NOW()) - 60 * 60 * 2*/ /*(3)字段不能做函数处理,不然不走索引,优化成如下*/ AND t2.CREATE_DATE >= DATE_ADD(NOW(),INTERVAL 2 HOUR) ) AS '正常交易', ( SELECT COUNT(*) FROM TB_BIS_POS_DEVICE t1, TB_BIS_POS_ORDER t2, TB_BIS_MERCHANT t3 WHERE t1.`PROJECT_ID` = '1024' AND t1.MERCHANT_ID = t3.ID AND t3.SPACE_ID = 'DE907E67FB9B487FA762E6E9B795072A' AND t1.ID = t2.`DEVICE_ID` ) AS '交易共计', ( SELECT COUNT(*) FROM TB_BIS_POS_DEVICE t1, TB_BIS_POS_ORDER t2, TB_BIS_MERCHANT t3 WHERE t1.`PROJECT_ID` = '1024' AND t1.MERCHANT_ID = t3.ID AND t3.SPACE_ID = 'DE907E67FB9B487FA762E6E9B795072A' AND t1.ID = t2.`DEVICE_ID` AND t2.`CREATE_DATE` >= DATE_FORMAT(NOW(), '%Y-%m-%d') ) AS '今日产生' FROM DUAL ; |
3、SQL优化准则:小结果集驱动大结果集
大家遇到相似的,可以借鉴下,当然还有其它的情况,也需要注意,接下来说下在机械磁盘的时代浪潮里面,优化必须要遵守的一大准则à用小结果集驱动大结果集
永远用小的结果集驱动大的结果集
很多看过数据库开发指南或者听过某某大师网络课程的开发人缘,喜欢在优化 SQL 的时候使用小表驱动大表,在在很多时候有效,但是并不是100%有效,必须看实际场景,主要是因为大表经过 WHERE 条件过滤之后返回的结果集并不一定就比小表所返回的大,也许更小。在这种情况下如果仍然采用小表驱动大表,就会得到相反的性能效果。
bty:他们说的用小表驱动大表只是为了让开发人员方便记忆方便理解,但是开发人员不能死抱这个不放,需要理解深层次的原因。
因为在MySQL中,只有 Nested Loop 一种 Join 方式,也就是说MySQL的 Join 都是通过嵌套循环来实现的。驱动结果集越大,所需要循环就越多,那么被驱动表的访问次数自然也就越多,而每次访问被驱动表,即使需要的逻辑 IO 很少,循环次数多了,总量也不可能小,而且每次循环都不能避免消耗CPU,所以 CPU 运算量也会跟着增加。如果仅仅以表的大小来作为驱动表的判断依据,假若小表过滤后所剩下的结果集比大表多很多,结果就会在嵌套循环中带来更多的循环次数,这种情况小勇大表驱动小表就是低效率了(因为根据在机械磁盘的时代里面,IO是最大瓶颈,减少IO量就是提升sql效率,增加IO就意味增加cpu消耗,就意味着效率低下),反之,所需要的循环次数就会更少,总体 IO 量和 CPU 运算量也会更少。
而在非 Nested Loop 的 Join 算法中,比如 Oracle 中的 Hash Join,就不是以表大小来决定,而是以结果集来决定,所以以小结果集驱动大的结果集同样是最优的选择。
所以,在优化数据库Join Query 的时候,不管是MySQL还是Oracle等,最基本的原则就是“用小结果集驱动大结果集”,通过这个原则来减少嵌套循环中的循环次数,以减少 IO总量及CPU运算的次数,如下SQL模板所示:
SELECT t1.c1,t2.c2 FROM 小结果集 AS t1 LEFT JOIN 大结果集 AS t2 ON t1.id=t2.cid WHERE t1.created_time > ‘2016-10-13’ AND t1.is_del=’0’ AND t2.project_id=’XJ160603’ and ……; |
4、深度思考 IN ---- EXISTS
MySQL 5.7 优化SQL提升100倍执行效率的深度思考(GO)的更多相关文章
- 阿里云maven仓库地址,速度提升100倍
参照:https://www.cnblogs.com/xxt19970908/p/6685777.html maven仓库用过的人都知道,国内有多么的悲催.还好有比较好用的镜像可以使用,尽快记录下来. ...
- 分布式协同AI基准测试项目Ianvs:工业场景提升5倍研发效率
摘要:全场景可扩展的分布式协同AI基准测试项目 Ianvs(雅努斯),能为算法及服务开发者提供全面开发套件支持,以研发.衡量和优化分布式协同AI系统. 本文分享自华为云社区<KubeEdge|分 ...
- mysql第四篇--SQL逻辑查询语句执行顺序
mysql第四篇--SQL逻辑查询语句执行顺序 一.SQL语句定义顺序 SELECT DISTINCT <select_list> FROM <left_table> < ...
- 提升 Hive Query 执行效率 - Hive LLAP
从 Hive 刚推出到现在,得益于社区对它的不断贡献,使得 Hive执行 query 效率显著提升.其中比较有代表性的功能如 Tez (将多个 job整合为一个DAG job)以及 CBO(Cost- ...
- 优化临时表使用,SQL语句性能提升100倍
[问题现象] 线上mysql数据库爆出一个慢查询,DBA观察发现,查询时服务器IO飙升,IO占用率达到100%, 执行时间长达7s左右.SQL语句如下:SELECT DISTINCT g.*, cp. ...
- 转--优化临时表使用,SQL语句性能提升100倍
转自:http://www.51testing.com/html/01/n-867201-2.html [问题现象] 线上mysql数据库爆出一个慢查询,DBA观察发现,查询时服务器IO飙升,IO占用 ...
- sql 字段先计算后再拿比对的字段进行比对 效率提升100倍
关于日期索引的使用,不要计算后再对比,否则使用不了索引例如:以下执行不了索引,耗时很大 dywl=# explain analyze SELECT car_bill.billno,car_bill.b ...
- 使用Apache Spark 对 mysql 调优 查询速度提升10倍以上
在这篇文章中我们将讨论如何利用 Apache Spark 来提升 MySQL 的查询性能. 介绍 在我的前一篇文章Apache Spark with MySQL 中介绍了如何利用 Apache Spa ...
- mysql五补充部分:SQL逻辑查询语句执行顺序
一 SELECT语句关键字的定义顺序 SELECT DISTINCT <select_list> FROM <left_table> <join_type> JOI ...
随机推荐
- c++ 类图
https://baijiahao.baidu.com/s?id=1609647985519542865&wfr=spider&for=pc
- Ubuntu 12.04不能在華碩F81se系列電腦上安裝解决辦法
本人華碩F81se系列的電腦,剛開始是裝的ubuntu 10.04的系統,周末閑的無聊,就想把系統換成ubuntu 12.04的,從ubuntu官網上下載了12.04的安裝包,下了個usb insta ...
- 数据库开启对sys用户的审计
需求:客户想对数据库开启sys用户的审计功能,关闭其它用户的审计功能. 1)再一次巡检报告中,我们发现数据库版本11.2.0.4,开启审计功能,提供的建议如下,关闭审计alter system set ...
- python中的list按照某一列进行排序的方法
如题,python中的list着实很好用,我有如下一个list 可以看出list中的每一个元素是由字符串,两个新的list,以及一个float组成,现在想根据这最后一个float对这个list进行排序 ...
- 用jq修改css
$(".tag_add").css("background","#ffffff"); $(".tag_add").css ...
- inner join 与一般笛卡尔积的区别
inner join 与一般笛卡尔积的区别:inner join是笛卡尔积的特殊形式.如果有表a和表b,表a有m条记录,表b有n条记录,则一般笛卡尔积后得到的记录条数是m*n条,记录之间的组合是随意的 ...
- 环境变量、cp、mv、cat 等命令
1.环境变量: PATH 个人理解 环境变量,即是所有命令文件所存放的目录,或是人为的定义的目录,(命令文件所存放的目录,当输入一个命令的时候,系统会自动找到且不报错,并不需要输入绝对路径,来运行相关 ...
- java-BigInteger类
1.BigInteger类的概述和方法使用 * A:BigInteger的概述 * 可以让超过Integer范围内的数据进行运算 * B:构造方法 * public BigInteger(String ...
- Linux使用sshfs挂载远程目录到本地
1安装sshfs [root@iZwz9hy7gff0kpg1swp1d3Z ~]# yum install sshfs 2创建本地目录 [root@iZwz9hy7gff0kpg1swp1d3Z ~ ...
- L1-059 敲笨钟 (20 分)
微博上有个自称“大笨钟V”的家伙,每天敲钟催促码农们爱惜身体早点睡觉.为了增加敲钟的趣味性,还会糟改几句古诗词.其糟改的方法为:去网上搜寻压“ong”韵的古诗词,把句尾的三个字换成“敲笨钟”.例如唐代 ...