主题
面试速答(先看这里)
**一句话结论:**下面是一次explain返回的一条SQL语句的执行计划的内容:
60秒标准回答:
下面是一次explain返回的一条SQL语句的执行计划的内容
一个执行计划中,共有12个字段,每个字段都挺重要的,先来介绍下这12个字段
假如我们有如下一张表(MySQL Innodb 5.7)
**答题顺序:**结论 → 原理/机制 → 关键流程 → 场景与取舍 → 易错点
回答主线:
- **要点1:**一个执行计划中,共有12个字段,每个字段都挺重要的,先来介绍下这12个字段
- **要点2:**假如我们有如下一张表(MySQL Innodb 5.7):
- **要点3:**挑其中比较重要的几个字段分别介绍下他们的不同值都有哪些区别:
- **要点4:**首先说 type ,他有以下几个取值内容,并给出了具体的SQL(PS:以下SQL是我实际测试过的,但是具体的表内容不一样可能最终优化器优化后的效果可能也不一样。
- **要点5:**需要注意的是,这里的index表示的是做了索引树扫描,效率并不高。
**记忆锚点:**where → explain → select → from → Using → MySQL
关键取舍:
- explain select * from t1 join t2 on t1.id = t2.id where t1.f1 = 's'; 当在连接操作中使用了唯一索引或主键索引,并且连接条件是基于这些索引的等值条件时,MySQL通常会选择 eq_ref 连接类型,以提高查询性能。
易错提醒:
- explain select * from t2 where d = "ni"; 使用非索引字段查询 需要注意的是,这里的index表示的是做了索引树扫描,效率并不高。
加分表达:
- possible_keys:表示可能被查询优化器选择使用的索引。
- key:表示查询优化器选择使用的索引。
- 假如我们有如下一张表(MySQL Innodb 5.7): 挑其中比较重要的几个字段分别介绍下他们的不同值都有哪些区别: 首先说 type ,他有以下几个取值内容,并给出了具体的SQL(PS:以下SQL是我实际测试过的,但是具体的表内容不一样可能最终优化器优化后的效果可能也不一样。
追问准备:
- 围绕「where」:底层原理是什么?使用时有哪些边界和常见坑?
- 围绕「explain」:底层原理是什么?使用时有哪些边界和常见坑?
- 围绕「select」:底层原理是什么?使用时有哪些边界和常见坑?
- 如果线上出现异常,你会如何定位、验证并规避?
典型回答
下面是一次explain返回的一条SQL语句的执行计划的内容:
plain
+----+-------------+-------+------------+-------+---------------+----------+---------+------+------+----------+--------------------------+
| id | select_type | table | partitions | type | possible_keys | key | key_len | ref | rows | filtered | Extra |
+----+-------------+-------+------------+-------+---------------+----------+---------+------+------+----------+--------------------------+
| 1 | SIMPLE | t2 | NULL | index | NULL | idx_abc | 198 | NULL | 5 | 20.00 | Using where; Using index |
+----+-------------+-------+------------+-------+---------------+----------+---------+------+------+----------+--------------------------+一个执行计划中,共有12个字段,每个字段都挺重要的,先来介绍下这12个字段
- id:执行计划中每个操作的唯一标识符。对于一条查询语句,每个操作都有一个唯一的id。但是在多表join的时候,一次explain中的多条记录的id是相同的。
- select_type:操作的类型。常见的类型包括SIMPLE、PRIMARY、SUBQUERY、UNION等。不同类型的操作会影响查询的执行效率。
- table:当前操作所涉及的表。
- partitions:当前操作所涉及的分区。
- type:表示查询时所使用的索引类型,包括ALL、index、range、ref、eq_ref、const、system等。
- possible_keys:表示可能被查询优化器选择使用的索引。
- key:表示查询优化器选择使用的索引。
- key_len:表示索引的长度。索引的长度越短,查询时的效率越高。
- ref:用来表示哪些列或常量被用来与key列中命名的索引进行比较。
- rows:表示此操作需要扫描的行数,即扫描表中多少行才能得到结果。
- filtered:表示此操作过滤中保留的的行数占扫描行数的百分比。
- Extra:表示其他额外的信息,包括Using index、Using filesort、Using temporary等。
假如我们有如下一张表(MySQL Innodb 5.7):
plain
CREATE TABLE `t2` (
`id` INT(11),
`a` varchar(64) NOT NULL,
`b` varchar(64) NOT NULL,
`c` varchar(64) NOT NULL,
`d` varchar(64) NOT NULL,
`f` varchar(64) DEFAULT NULL,
PRIMARY KEY(id),
UNIQUE KEY `f` (`f`),
KEY `idx_abc` (`a`,`b`,`c`)
) ENGINE=InnoDB DEFAULT CHARSET=latin1挑其中比较重要的几个字段分别介绍下他们的不同值都有哪些区别:
首先说type,他有以下几个取值内容,并给出了具体的SQL(PS:以下SQL是我实际测试过的,但是具体的表内容不一样可能最终优化器优化后的效果可能也不一样。)
system:系统表,少量数据,往往不需要进行磁盘IO
const:使用常数索引,MySQL 只会在查询时使用常数值进行匹配。
explain select * from t2 where f='Hollis';使用唯一性索引做唯一查询
eq_ref:唯一索引扫描,只会扫描索引树中的一个匹配行。
explain select * from t1 join t2 on t1.id = t2.id where t1.f1 = 's';当在连接操作中使用了唯一索引或主键索引,并且连接条件是基于这些索引的等值条件时,MySQL通常会选择 eq_ref 连接类型,以提高查询性能。
ref:非唯一索引扫描, 只会扫描索引树中的一部分来查找匹配的行。
explain select * from t2 where a = 'Hollis';使用非唯一索引进行查询
range:范围扫描, 只会扫描索引树中的一个范围来查找匹配的行。
explain select * from t2 where a > 'a' and a < 'c';使用索引进行性范围查询
index:全索引扫描, 会遍历索引树来查找匹配的行
explain select c from t2 where b = 's';不符合最左前缀匹配的查询
ALL:全表扫描, 将遍历全表来找到匹配的行。
explain select * from t2 where d = "ni";使用非索引字段查询
需要注意的是,这里的index表示的是做了索引树扫描,效率并不高。以上类型由快到慢:
system> const > eq_ref >ref>range> index >ALL
再来说说possible_keys 和 key,possible_keys 表示查询语句中可以使用的索引,而不一定实际使用了这些索引。这个字段列出了可能用于这个查询的所有索引,包括联合索引的组合。而 key 字段表示实际用于查询的索引。如果在查询中使用了索引,则该字段将显示使用的索引名称;
接着说一个很重要!的字段,但是经常被忽略的字段extra,这个字段描述了 MySQL 在执行查询时所做的一些附加操作。下面是 Extra 可能的取值及其含义:
Using where:表示 MySQL 将在存储引擎检索行后,再进行条件过滤(使用 WHERE 子句);查询的列未被索引覆盖,where筛选条件非索引的前导列或者where筛选条件非索引列。
explain select * from t2 where d = "ni";非索引字段查询explain select d from t2 where b = "ni";未索引覆盖,用联合索引的非前导列查询Using index:表示 MySQL 使用了覆盖索引(也称为索引覆盖)优化,只需要扫描索引,而无需回到数据表中检索行;
explain select b,c from t2 where a = "ni";索引覆盖Using index condition:表示查询在索引上执行了部分条件过滤。这通常和索引下推有关。
explain select d from t2 where a = "ni" and b like "s%";使用到索引下推。Using where; Using index:查询的列被索引覆盖,并且where筛选条件是索引列之一,但不是索引的前导列,或者where筛选条件是索引列前导列的一个范围
explain select a from t2 where b = "ni";索引覆盖,但是不符合最左前缀explain select b from t2 where a in ('a','d','sd');索引覆盖,但是前导列是个范围Using join buffer:表示 MySQL 使用了连接缓存;
explain select * from t1 join t2 on t1.id = t2.id where a = 's';Using temporary:表示 MySQL 创建了临时表来存储查询结果。这通常是在排序或分组时发生的;
explain select count(*),b from t2 group by b;Using filesort:表示 MySQL 将使用文件排序而不是索引排序,这通常发生在无法使用索引来进行排序时;
explain select count(*),b from t2 group by b;参考:https://www.yuque.com/laiyanhong-9tr5c/zwpzru/dcsy26p8fmm4bpv6 、 https://www.yuque.com/laiyanhong-9tr5c/zwpzru/btaea2mvl8ubveeoUsing index for group-by:表示 MySQL 在分组操作中使用了索引。这通常是在分组操作涉及到索引中的所有列时发生的;
Using filesort for group-by:表示 MySQL 在分组操作中使用了文件排序。这通常发生在无法使用索引进行分组操作时;
Range checked for each record:表示 MySQL 在使用索引范围查找时,需要检查每一条记录;
Using index for order by:表示 MySQL 在排序操作中使用了索引,这通常发生在排序涉及到索引中的所有列时;
Using filesort for order by:表示 MySQL 在排序操作中使用了文件排序,这通常发生在无法使用索引进行排序时;
Using index for group-by; Using index for order by:表示 MySQL 在分组和排序操作中都使用了索引。
扩展知识
如何判断一条SQL走没走索引
首先看key字段有没有值,有值表示用到了索引树,但是具体是怎么用的,还得看type和extra。
简单说以下几个情况:
情况一:
explain select b from t2 where a in ('a','d','sd');
plain
+----+-------+---------------+----------+--------------------------+
| id | type | possible_keys | key | Extra |
+----+-------+---------------+----------+--------------------------+
| 1 | index | NULL | idx_abc | Using where; Using index |
+----+-------+---------------+----------+--------------------------+type = index , key = idx_abc ,extra = Using where; Using index ,表示本次查询用到了idx_abc的联合索引,但是没有遵守最左前缀匹配,或者遵守了最左前缀,但是使用了a字段进行了范围查询。所以,最终其实还是扫描了索引树的。效率并不高
情况二:
explain select * from t2 where a = 'Hollis';
plain
+----+-------+---------------+----------+--------------------------+
| id | type | possible_keys | key | Extra |
+----+-------+---------------+----------+--------------------------+
| 1 | ref | idx_abc | idx_abc | NULL |
+----+-------+---------------+----------+--------------------------+表示用到了索引进行查询,并且用到的是idx_abc这个非唯一索引。
情况三:
explain select * from t2 where f = 'f';
plain
+----+-------+---------------+----------+--------------------------+
| id | type | possible_keys | key | Extra |
+----+-------+---------------+----------+--------------------------+
| 1 | const | f | f | NULL |
+----+-------+---------------+----------+--------------------------+表示用到了索引进行查询,并且用到的是f这个唯一索引。
情况四:
explain select b,c from t2 where a = 'Hollis';
plain
+----+-------+---------------+----------+--------------------------+
| id | type | possible_keys | key | Extra |
+----+-------+---------------+----------+--------------------------+
| 1 | ref | idx_abc | idx_abc | Using index |
+----+-------+---------------+----------+--------------------------+表示用到了索引进行查询,并且用到了idx_abc这个索引,而且查询用到了覆盖索引,不需要回表。
情况五:
explain select b,c from t2 where d = 'Hollis';
plain
+----+-------+---------------+----------+--------------------------+
| id | type | possible_keys | key | Extra |
+----+-------+---------------+----------+--------------------------+
| 1 | ALL | NULL | NULL | Using where |
+----+-------+---------------+----------+--------------------------+表示没有用到索引。