MySQL之ICP、MRR、BKA、BNL

栏目: 数据库 · Mysql · 发布时间: 7年前

内容简介：禁用ICP，存储引擎会通过遍历索引定位基表中的行，然后返回给MySQL Server层，再去为这些数据行进行WHERE后的条件的过滤。开启ICP，如果部分WHERE条件能使用索引中的字段，MySQL Server 会把这部分下推到存储引擎层，存储引擎通过索引过滤，把满足的行从表中读取出。ICP能减少引擎层访问基表的次数和MySQL Server 访问存储引擎的次数。

Index Condition Pushdown(ICP)

Index Condition Pushdown (ICP) 是 mysql 使用索引从表中检索行数据的一种优化方式。

ICP原理

禁用ICP，存储引擎会通过遍历索引定位基表中的行，然后返回给MySQL Server层，再去为这些数据行进行WHERE后的条件的过滤。

开启ICP，如果部分WHERE条件能使用索引中的字段，MySQL Server 会把这部分下推到存储引擎层，存储引擎通过索引过滤，把满足的行从表中读取出。ICP能减少引擎层访问基表的次数和MySQL Server 访问存储引擎的次数。

ICP的目标是减少从基表中全纪录读取操作的数量，从而降低IO操作

对于 InnoDB 表， ICP 只适用于辅助索引。

ICP标识

当使用ICP优化时，执行计划的 Extra 列显示 Using indexcondition 提示

适用场景

# 辅助索引 INDEX (zipcode, lastname, firstname) .

SELECT * FROM people WHERE zipcode='95054'AND lastname LIKE '%etrunia%'AND address LIKE '%Main Street%';

People表有个二级索引INDEX (zipcode, lastname, firstname),用户只知道某用户的zipcode,和大概的lastname、address,此时想查询相关信息。

若不使用ICP：则是通过二级索引中zipcode的值去基表取出所有zipcode=’95054’的数据，然后 server层 再对lastname LIKE ‘%etrunia%’AND address LIKE ‘%Main Street%’;进行过滤

若使用ICP：则lastname LIKE ‘%etrunia%’AND address LIKE ‘%Main Street%’的过滤操作在 二级索引 中完成，然后再去基表取相关数据

使用限制

l 只支持 select 语句

l 5.6 中只支持 MyISAM与InnoDB引擎

l 5.6 中不支持分区表的ICP; 从 MySQL 5.7.3开始支持分区表的ICP

l ICP的优化策略可用于range、ref、eq_ref、ref_or_null 类型的访问数据方法；

l 不支持主建索引的ICP（对于Innodb 的聚集索引，完整的记录已经被读取到Innodb Buffer，此时使用ICP并不能降低IO操作）

l 当 SQL 使用覆盖索引时但只检索部分数据时，ICP 无法使用

l ICP的加速效果取决于在存储引擎内通过ICP筛选掉的数据的比例。

Multi-Range Read (MRR)

MRR 的全称是 Multi-Range Read Optimization，是优化器将随机 IO 转化为顺序 IO 以降低查询过程中 IO 开销的一种手段。

MRR原理

select non_key_column from tb where ey_column=x;

在没有使用MRR特性时，MySQL执行查询的伪代码

第一步先根据where条件中的辅助索引获取辅助索引与主键的集合，结果集为rest。

select key_column, pk_column from tb where key_column=x order by key_column

第二步通过第一步获取的主键来获取对应的值。

for each pk_column value in rest do:

select non_key_column from tb where pk_column=val

使用MRR特性时，MySQL执行查询的伪代码

第一步先根据where条件中的辅助索引获取辅助索引与主键的集合，结果集为rest

select key_column, pk_column from tb where key_column = x order by key_column

第二步将结果集rest放在buffer里面(read_rnd_buffer_size 大小直到buffer满了)，然后对结果集rest按照pk_column排序，得到结果集是rest_sort

第三步利用已经排序过的结果集，访问表中的数据，此时是顺序IO.

select non_key_column fromtb where pk_column in (rest_sort)

综上

在不使用 MRR 时，优化器需要根据二级索引返回的记录来进行“回表”，这个过程一般会有较多的随机IO, 使用MRR时，SQL语句的执行过程是这样的：

1) 优化器将二级索引查询到的记录放到一块缓冲区中

2) 如果二级索引扫描到文件的末尾或者缓冲区已满，则使用快速排序对缓冲区中的内容按照主键进行排序

3) 用户线程调用MRR接口取cluster index，然后根据cluster index 取行数据

4) 当根据缓冲区中的 cluster index取完数据，则继续调用过程 2) 3)，直至扫描结束

通过上述过程，优化器将二级索引随机的 IO 进行排序，转化为主键的有序排列，从而实现了随机 IO 到顺序 IO 的转化，提升性能

此外MRR还可以将某些范围查询，拆分为键值对，来进行批量的数据查询，如下：

SELECT * FROM tWHERE key_part1 >= 1000 AND key_part1

2000AND

key_part2 = 10000;

表t上有二级索引(key_part1, key_part2)，索引根据key_part1,key_part2的顺序排序。

若不使用MRR：索引扫描会将key_part1在1000到2000的索引元组，而不管key_part2的值，这样对key_part2不等于10000的索引元组也做了额外的扫描。此时扫描的范围是：

[{1000, 10000}, {2000, MIN_INT}] 此间隔可能包含key_part2不等于10000的部分

若使用MRR：扫描则分为多个范围，对于每一个Key_part1(1000,1001…,1999)单个值的扫描只需要扫描索引中key_part2为10000的元组。如果索引中包含很多key_part2不为10000的元组，最终MRR的效果越好。MRR扫描的范围是多个单点间隔 [{1000, 10000}] ,

…,

[{1999, 10000}]

此间隔只包含key_part2=10000的部分。

MRR标识

当使用ICP优化时，执行计划的 Extra 列显示 Using MRR 提示

适用场景

# 辅助索引 key_part1 ，查询 key_part1 在 1000 到 2000 范围内的数据

SELECT * FROM t WHERE key_part1 >= 1000 AND key_part1 < 2000

不使用MRR：先通过二级索引的key_part1字段取出满足条件的key_part1,pk_col order by key_part1.然后通过pk_col去表中取出满足条件的数据，此时，因为取出的pk_col是乱序的，而表又是pk_col存放数据的，当去表中取数据时，则会产生大量的随机IO

使用MRR：先通过二级索引的key_part1字段取出满足条件的key_part1,pk_col order by key_part1.放到缓存中（read_rnd_buffer_size），当对应的缓冲满了以后，将这部分key值按照pk_col排序，最后再按照排序后的reset去取表中数据，此时pk_col1是顺序的，将随机IO转化为顺序IO，多页数据记录可一次性读入或根据此次的主键范围分次读入，以减少IO操作，提高查询效率

使用限制

MRR 适用于range、ref、eq_ref的查询

Batched Key Access (BKA)和Block Nested-Loop(BNL)

Batched Key Access (BKA)– 提高表join性能的算法。

当被join的表能够使用索引时，就先排好顺序，然后再去检索被join的表，听起来和MRR类似，实际上MRR也可以想象成二级索引和primary key的join

如果被Join的表上没有索引，则使用老版本的BNL策略(BLOCK Nested-loop)

BKA原理

对于多表join语句，当MySQL使用索引访问第二个join表的时候，使用一个join buffer来收集第一个操作对象生成的相关列值。BKA构建好key后，批量传给引擎层做索引查找。key是通过MRR接口提交给引擎的（mrr目的是较为顺序）.这样，MRR使得查询更有效率。

大致的过程如下:

1 BKA使用join buffer保存由join的第一个操作产生的符合条件的数据

2 然后BKA算法构建key来访问被连接的表，并批量使用MRR接口提交keys到数据库存储引擎去查找查找。

3 提交keys之后，MRR使用最佳的方式来获取行并反馈给BKA

BNL和BKA都是批量的提交一部分行给被join的表，从而减少访问的次数，那么它们有什么区别呢？

第一 BNL 比BKA出现的早，BKA直到5.6才出现，而NBL至少在5.1里面就存在。

第二 BNL 主要用于当被join的表上无索引

第三 BKA主要是指在被join表上有索引可以利用，那么就在行提交给被join的表之前，对这些行按照索引字段进行排序，因此减少了随机IO，排序这才是两者最大的区别，但是如果被join的表没用索引呢？那就使用NBL了。

BKA和BNL标识

Using join buffer (Batched Key Access) 和 Using join buffer (Block Nested Loop)

适用场景

支持 inner join, outer join, semi-join operations,including nested outer joins

BKA 主要适用于 join 的表上有索引可利用，无索引只能使用 BNL 了

简单总结

以下部分来源： http://www.cnblogs.com/zhoujinyi/p/4746483.html

ICP 优化（ Index
Condition Pushdown ）

Index Condition Pushdown (ICP) 是 MySQL 用索引去表里取数据的一种优化。 禁用 ICP (MySQL5.6 之前)，引擎层会利用索引在基表中寻找数据行，然后返回给MySQL

Server层，再去为这些数据行进行WHERE后的条件的过滤（回表）。 启用 ICP (MySQL5.6 之后)，如果部分WHERE条件能使用索引中的字段， MySQL会把这部分下推到引擎层。存储引擎通过使用索引把满足的行从表中读取出。ICP减少了引擎层访问基表的次数和MySQL

Server 访问存储引擎的次数。总之是 ICP的优化在引擎层就能够过滤掉大量的数据，减少io次数，提高查询语句性能

MRR 优化（ Multi-Range Read ）

Multi-Range Read 多范围读 (MRR) 它的作用是基于辅助 / 第二索引的查询，减少随机 IO ，并且将 随机 IO 转化为顺序 IO ，提高查询效率。 在没有 MRR 之前 (MySQL5.6 之前)，先根据where条件中的辅助索引获取辅助索引与主键的集合，再通过主键来获取对应的值。辅助索引获取的主键来访问表中的数据会导致随机的IO(辅助索引的存储顺序并非与主键的顺序一致)，不同主键不在同一个page里面时必然导致多次IO 和随机读。 使用 MRR 优化 (MySQL5.6 之后)，先根据where条件中的辅助索引获取辅助索引与主键的集合，再将结果集放在buffer里面(read_rnd_buffer_size 大小直到buffer满了)，然后对结果集按照pk_column排序，得到有序的结果集rest_sort。最后利用已经排序过的结果集，访问表中的数据，此时是顺序IO。即MySQL 将根据辅助索引获取的结果集根据主键进行排序，将无序化为有序，可以用主键顺序访问基表，将随机读转化为顺序读，多页数据记录可一次性读入或根据此次的主键范围分次读入，以减少IO操作，提高查询效率。

Nested Loop Join 算法：

将驱动表 / 外部表的结果集作为循环基础数据，然后循环该结果集，每次获取一条数据作为下一个表的过滤条件查询数据，然后合并结果，获取结果集返回给客户端。 Nested-Loop 一次只将一行传入内层循环 , 所以外层循环 ( 的结果集 ) 有多少行 , 内存循环便要执行多少次，效率非常差。

Block Nested-Loop Join 算法：

将外层循环的行 / 结果集存入 join buffer, 内层循环的每一行与整个 buffer 中的记录做比较，从而减少内层循环的次数。主要用于当被 join 的表上无索引。

Batched Key Access 算法：

当被 join 的表能够使用索引时，就先排好顺序，然后再去检索被 join 的表。对这些行按照索引字段进行排序，因此 减少了随机 IO 。如果被 Join 的表上没有索引，则使用老版本的 BNL 策略

(BLOCK

Nested-loop)

。

参考：

http://dev.mysql.com/doc/refman/5.7/en/select-optimization.html

http://blog.itpub.net/22664653

http://www.kancloud.cn/taobaomysql/monthly/117959

http://www.kancloud.cn/taobaomysql/monthly/67181

http://www.cnblogs.com/zhoujinyi/p/4746483.html

转： https://blog.csdn.net/caomiao2006/article/details/52205177

以上就是本文的全部内容，希望本文的内容对大家的学习或者工作能带来一定的帮助，也希望大家多多支持码农网

查看所有标签

猜你喜欢:

MySQL之ICP、MRR、BKA、BNL

本站部分资源来源于网络，本站转载出于传递更多信息之目的，版权归原作者或者来源机构所有，如转载稿涉及版权问题，请联系我们。

码农书籍

规划算法

拉瓦利 / 2011-1 / 99.00元

《规划算法》内容简介：规划是人类智慧的结晶，规划问题广泛地存在于人们的日常工作和生活中。现在，规划已涉及计算机科学、人工智能、力学、机械学、控制论、对策论、概率论、图论、拓扑学、微分几何、代数几何等许多现代科学领域。《规划算法》是作者多年来教学和科研工作的总结，系统地介绍了规划领域中的基础知识和最新成果。作者将三个相对独立的学科：机器人学、人工智能和控制论巧妙地结合在一起。《规划算法》给出了大量内......一起来看看《规划算法》这本书的介绍吧!

码农工具

MySQL之ICP、MRR、BKA、BNL

Index Condition Pushdown(ICP)

ICP原理

ICP标识

相关参数

适用场景

使用限制

Multi-Range Read (MRR)

MRR原理

在没有使用MRR特性时，MySQL执行查询的伪代码

使用MRR特性时，MySQL执行查询的伪代码

综上

此外MRR还可以将某些范围查询，拆分为键值对，来进行批量的数据查询，如下：

MRR标识

相关参数

适用场景

使用限制

Batched Key Access (BKA)和Block Nested-Loop(BNL)

BKA原理

BKA和BNL标识

相关参数

适用场景

简单总结

ICP 优化（ Index
Condition Pushdown ）

MRR 优化（ Multi-Range Read ）

规划算法

CSS 压缩/解压工具

Base64 编码/解码

SHA 加密

MySQL之ICP、MRR、BKA、BNL

Index Condition Pushdown(ICP)

ICP原理

ICP标识

相关参数

适用场景

使用限制

Multi-Range Read (MRR)

MRR原理

在没有使用MRR特性时，MySQL执行查询的伪代码

使用MRR特性时，MySQL执行查询的伪代码

综上

此外MRR还可以将某些范围查询，拆分为键值对，来进行批量的数据查询，如下：

MRR标识

相关参数

适用场景

使用限制

Batched Key Access (BKA)和Block Nested-Loop(BNL)

BKA原理

BKA和BNL标识

相关参数

适用场景

简单总结

ICP 优化 （ Index Condition Pushdown ）

MRR 优化 （ Multi-Range Read ）

规划算法

CSS 压缩/解压工具

Base64 编码/解码

SHA 加密

ICP 优化（ Index
Condition Pushdown ）

MRR 优化（ Multi-Range Read ）