Mysql 索引问题集锦

一、Mysql 中的索引

索引：顾名思义用来检索、查找数据的key (字段)
几种Mysql 中的常见索引分类：普通索引（联合索引）、唯一索引、主键索引、全文索引
优点：使得查询数据变快
缺点：更新数据时，也需要更新索引。所以更新速度变慢，占据磁盘空间
注意：myisam中可以延迟更新索引

1.1 Mysql中都有那些索引

MySQL有哪些索引类型，这是个半开放式命题；

从数据结构角度分：
B+树索引、哈希索引、以及不常用的FULLTEXT索引（现在MyISAM和InnoDB引擎都支持了）和R-Tree索引（用于对GIS数据类型创建SPATIAL索引）；
从物理存储角度分：
聚集索引（clustered index）、非聚集索引（non-clustered index）；
从逻辑角度分：
主键索引、普通索引，或者单列索引、多列索引、唯一索引、非唯一索引等等。需要掌握这些不同概念之间的区别，例如主键索引和唯一索引的区别是什么。

为什么InnoDB表最好要有自增列做主键；
为什么需要设置双1才能保证主从数据的一致性；
有几种binlog格式*，及其区别是什么；
如何确认MySQL replication真正的复制延迟是多少；

1.1.0 主键索引和唯一索引的区别

主键是一种约束，唯一索引是一种索引，两者在本质上是不同的。
主键创建后一定包含一个唯一性索引，唯一性索引并不一定就是主键。
唯一性索引列允许空值，而主键列不允许为空值。
主键列在创建时，已经默认为空值 + 唯一索引了。
主键可以被其他表引用为外键，而唯一索引不能。
一个表最多只能创建一个主键，但可以创建多个唯一索引。
主键更适合那些不容易更改的唯一标识，如自动递增列、身份证号等。
在 RBO 模式下，主键的执行计划优先级要高于唯一索引。两者可以提高查询的速度。

1.1.0.1 为什么innodb优先使用自增列做主键

B+ 树的特点:

（1）所有关键字都出现在叶子结点的链表中(稠密索引)，且链表中的关键字恰好是有序的;

（2）不可能在非叶子结点命中;

（3）非叶子结点相当于是叶子结点的索引(稀疏索引)，叶子结点相当于是存储(关键字)数据的数据层;

如果我们定义了主键(PRIMARY KEY)，那么InnoDB会选择主键作为聚集索引、如果没有显式定义主键，则InnoDB会选择第一个不包含有NULL值的唯一索引作为主键索引、如果也没有这样的唯一索引，则InnoDB会选择内置6字节长的ROWID作为隐含的聚集索引(ROWID随着行记录的写入而主键递增，这个ROWID不像ORACLE的ROWID那样可引用，是隐含的)。(关于内置三个字段中的ROWID：全称- DB_ROW_ID，默认自增）点击此处了解
数据记录本身被存于主索引（一颗B+Tree）的叶子节点上。这就要求同一个叶子节点内（大小为一个内存页或磁盘页）的各条数据记录按主键顺序存放，因此每当有一条新的记录插入时，MySQL会根据其主键将其插入适当的节点和位置，如果页面达到装载因子（InnoDB默认为15/16），则开辟一个新的页（节点）
如果表使用自增主键，那么每次插入新的记录，记录就会顺序添加到当前索引节点的后续位置，当一页写满，就会自动开辟一个新的页
如果使用非自增主键（如果身份证号或学号等），由于每次插入主键的值近似于随机，因此每次新纪录都要被插到现有索引页得中间某个位置，此时MySQL不得不为了将新记录插到合适位置而移动数据，甚至目标页面可能已经被回写到磁盘上而从缓存中清掉，此时又要从磁盘上读回来，这增加了很多开销，同时频繁的移动、分页操作造成了大量的碎片，得到了不够紧凑的索引结构，后续不得不通过OPTIMIZE TABLE来重建表并优化填充页面。

综上总结，如果InnoDB表的数据写入顺序能和B+树索引的叶子节点顺序一致的话，这时候存取效率是最高的，也就是下面这几种情况的存取效率最高：

使用自增列(INT/BIGINT类型)做主键，这时候写入顺序是自增的，和B+数叶子节点分裂顺序一致；
该表不指定自增列做主键，同时也没有可以被选为主键的唯一索引(上面的条件)，这时候InnoDB会选择内置的ROWID作为主键，写入顺序和ROWID增长顺序一致；
除此以外，如果一个InnoDB表又没有显示主键，又有可以被选择为主键的唯一索引，但该唯一索引可能不是递增关系时(例如字符串、UUID、多字段联合唯一索引的情况)，该表的存取效率就会比较差。

1.1.1 Myisam 下的非聚集索引

关于B+Tree 内容
 Myisam 和 innodb 内容

myisam 为mysql 5.5 版本前的默认数据库引擎：
myisam 使用B+Tree 结构存储数据。只有（只支持）主键索引、表锁，不支持外键，不支持事务，B+Tree 所有的非叶子节点都只存储 key
myisam 在叶子节点 data 域存储的是数据的地址，不是数据，当myisam引擎进行查找时，先根据索引在索引表中找到位置，去对应的data域拿到数据所在地址
然后去该地址提取出数据

1.1.2 innodb 下的聚集索引

innodb 为mysql 5.5 版本后的默认数据库引擎.

innodb 也使用 B+Tree 结构存储数据，与myisam不同的有：支持外键、行锁、事务，B+Tree 的所有非叶子节点一样只存储 key

innodb 在叶子节点 data 域存储的是数据，叶子节点数据类型[key, data]，当 innodb引擎进行查找时，根据索引找到 data 位置，直接将data 中的数据取出

innodb 辅助索引（非主键索引外）进行查找时，根据辅助索引查找到主键索引，再拿着主键索引到主键索引表中查找到 data 取出data。注意辅助索引并不存数据，

二、什么时候使用索引

经常使用在 where、group by 、order by 的后面查询的字段，可设置索引
减少使用子查询
多使用limit 这样数据量被限制较小，能提高查询速度
适度增加冗余字段，减少跨表查询，常用数据和不常用数据分表one2one保存
尽量不使用 * 查询数据，需要什么字段就查什么字段
别再数据库里面使用函数计算
尽量根据索引来检索数据
核心业务中别使用 like 语句模糊查询
将区分度字段写在where前面

三、添加索引

创建表时添加索引：
create table tb_name(
--> id int not null auto_increment primary key,
--> name char(32) not null,
--> identify_num bigint not null,
--> unique key(identify_num),
--> index name_index (name(32))
--> );
更新表结构时添加：alter table tb_name add
alter table tb_name add index name_index(name(32));

create unique index identify_index on tb_name(identify_num)

四、索引失效

like会导致索引失效

like "%name" //失效的

like "name%" //不失效
字段使用函数来修饰

例:select * from u1 where md5(name) = 'j'
联合索引中字段，将区分度较大的字段放大前面

Mysql 索引问题集锦的更多相关文章

mysql索引的面试题
相信很多人对于MySQL的索引都不陌生,索引(Index)是帮助MySQL高效获取数据的数据结构. 因为索引是MySQL中比较重点的知识,相信很多人都有一定的了解,尤其是在面试中出现的频率特别高.楼主 ...
深入MySQL索引
MySQL索引作为数据库优化的常用手段之一在项目优化中经常会被用到, 但是如何建立高效索引,有效的使用索引以及索引优化的背后到底是什么原理?这次我们深入数据库索引,从索引的数据结构开始说起. 索引原理 ...
MySQL 索引
MySQL索引的建立对于MySQL的高效运行是很重要的,索引可以大大提高MySQL的检索速度. 打个比方,如果合理的设计且使用索引的MySQL是一辆兰博基尼的话,那么没有设计和使用索引的MySQL就是 ...
MYSQL索引结构原理、性能分析与优化
[转]MYSQL索引结构原理.性能分析与优化第一部分:基础知识索引官方介绍索引是帮助MySQL高效获取数据的数据结构.笔者理解索引相当于一本书的目录,通过目录就知道要的资料在哪里, 不用一页一页 ...
MySQL索引原理及慢查询优化
原文:http://tech.meituan.com/mysql-index.html 一个慢查询引发的思考 select count(*) from task where status=2 and ...
【转】MySQL索引背后的数据结构及算法原理
摘要本文以MySQL数据库为研究对象,讨论与数据库索引相关的一些话题.特别需要说明的是,MySQL支持诸多存储引擎,而各种存储引擎对索引的支持也各不相同,因此MySQL数据库支持多种索引类型,如BT ...
[转]MySQL索引背后的数据结构及算法原理
摘要本文以MySQL数据库为研究对象,讨论与数据库索引相关的一些话题.特别需要说明的是,MySQL支持诸多存储引擎,而各种存储引擎对索引的支持也各不相同,因此MySQL数据库支持多种索引类型,如BT ...
MySQL索引类型总结和使用技巧以及注意事项
索引是快速搜索的关键.MySQL索引的建立对于MySQL的高效运行是很重要的.下面介绍几种常见的MySQL索引类型在数据库表中,对字段建立索引可以大大提高查询速度.假如我们创建了一个 mytable ...
MySQL索引背后的数据结构及算法原理【转】
本文来自:张洋的MySQL索引背后的数据结构及算法原理摘要本文以MySQL数据库为研究对象,讨论与数据库索引相关的一些话题.特别需要说明的是,MySQL支持诸多存储引擎,而各种存储引擎对索引的支持 ...

随机推荐

c复杂函数指针
函数指针,函数的返回值是数组 int *(*(*fun)(int* a, int* b))[]; 上面的代码是声明一个函数指针,这个函数有2个int指针参数,返回值是指针,指向的是数组,数组里放的是i ...
PE 添加系统管理员账号（域控可加）转
使用U盘制作一个PE系统,这里推荐老毛桃或者大白菜:开机进入Bios,选择U盘启动:进入U盘启动画面后,选择一个PE系统:进入PE系统后,我们去本机系统盘,将 C:/Windows/System32/ ...
Linux下键盘值对应input_evnet的code值。
最近做了一个linux下面的模拟鼠标和键盘的app,但不是很清楚字符对应的键值:查找内核源码,在kernel/include/uapi/linux/input.h文件中找到: 下面给出普通键盘上面对应 ...
February 27th, 2018 Week 9th Tuesday
Great minds think alike. 英雄所见略同. If great minds really did think alike, then we would live in an unr ...
MATLAB常微分方程数值解——欧拉法、改进的欧拉法与四阶龙格库塔方法
MATLAB常微分方程数值解作者:凯鲁嘎吉 - 博客园 http://www.cnblogs.com/kailugaji/ 1.一阶常微分方程初值问题 2.欧拉法 3.改进的欧拉法 4.四阶龙格库塔 ...
微服务---Eureka注册中心(服务治理)
在上一篇的初识SpringCloud微服务中,我们简单讲解到服务的提供者与消费者,当服务多了之后,会存在依赖与管理之间混乱的问题,以及需要对外暴露自己的地址,为了解决此等问题,我们学习Eureka注册 ...
C#のsocket通信
博主要做一个手机和电脑端(C#)通讯的程序,便览了网络上关乎socket的东西.但是接收文件的时候卡住了,怎么也接收不全.后来做了分片处理,如果分片,发送的时候就会有不同的socket(客户端开发不是 ...
maven项目引入依赖之后,jar包没有自动导入报错
解决这个问题可run maven-intall 一下 ,需要在联网的情况下去下载jar包. 我这样做了一下就可以了.
机器学习算法总结(五)——聚类算法（K-means，密度聚类，层次聚类）
本文介绍无监督学习算法,无监督学习是在样本的标签未知的情况下,根据样本的内在规律对样本进行分类,常见的无监督学习就是聚类算法. 在监督学习中我们常根据模型的误差来衡量模型的好坏,通过优化损失函数来改善 ...
【angularJs】阻止默认事件
$scope.click = function($event){ $event.stopPropagation();//在函数体内加上这句代码就好} 作者:smile.轉角 QQ:493177502 ...

Mysql 索引问题集锦

Mysql 索引问题集锦的更多相关文章

随机推荐

热门专题