文章末端有他著作的《深入理解 MySQL 主从事理 32 讲》,深入透彻理解 MySQL 主从,GTID 干系技能知识。
继上一篇文章:
MySQL:查询字段数量多少对查询效率的影响

我们连续来谈论一下 count()、count(字段)实现上的差异。把稳我们这里都利用 Innodb 做为存储引擎,不谈论其他引擎。由于了有了前面的谈论,更随意马虎看出它们的差异,这里我们有如下把稳点:
我们须要做到实行操持一样,这里以全表扫描为例。实际上 count 很可能利用到覆盖索引(Using index),本文紧张谈论它们实现的异同。count() 和 count(字段) 在结果上可能并不一致。比如 count(字段),但是某些行本字段为 NULL 的话那么将不会统计行数,下面将会解释这种 NULL 判断的位置。本文还是利用大略的全表扫描来进行比拟实现上的差异。首先我们要明确的是 count 利用的是一个 COUNT 计数器。一、利用示例在示例中我们也可以看到两个语句的结果实际上并不一致。
mysql> show create table baguai_f \G 1. row Table: baguai_fCreate Table: CREATE TABLE `baguai_f` ( `id` int(11) DEFAULT NULL, `a` varchar(20) DEFAULT NULL, `b` varchar(20) DEFAULT NULL, `c` varchar(20) DEFAULT NULL) ENGINE=InnoDB DEFAULT CHARSET=utf81 row in set (0.00 sec)mysql> select from baguai_f ;+------+------+------+------+| id | a | b | c |+------+------+------+------+| 1 | g | g | NULL || 1 | g1 | g1 | g1 || 3 | g2 | g2 | g2 || 4 | g | g | NULL || 5 | g | g | NULL || 6 | g3 | g3 | g3 |+------+------+------+------+6 rows in set (0.00 sec)mysql> desc select count() from baguai_f where b='g';+----+-------------+----------+------------+------+---------------+------+---------+------+------+----------+-------------+| id | select_type | table | partitions | type | possible_keys | key | key_len | ref | rows | filtered | Extra |+----+-------------+----------+------------+------+---------------+------+---------+------+------+----------+-------------+| 1 | SIMPLE | baguai_f | NULL | ALL | NULL | NULL | NULL | NULL | 6 | 16.67 | Using where |+----+-------------+----------+------------+------+---------------+------+---------+------+------+----------+-------------+1 row in set, 1 warning (0.00 sec)mysql> desc select count(c) from baguai_f where b='g';+----+-------------+----------+------------+------+---------------+------+---------+------+------+----------+-------------+| id | select_type | table | partitions | type | possible_keys | key | key_len | ref | rows | filtered | Extra |+----+-------------+----------+------------+------+---------------+------+---------+------+------+----------+-------------+| 1 | SIMPLE | baguai_f | NULL | ALL | NULL | NULL | NULL | NULL | 6 | 16.67 | Using where |+----+-------------+----------+------------+------+---------------+------+---------+------+------+----------+-------------+1 row in set, 1 warning (0.00 sec)mysql> select count() from baguai_f where b='g';+----------+| count() |+----------+| 3 |+----------+1 row in set (0.00 sec)mysql> select count(c) from baguai_f where b='g';+----------+| count(c) |+----------+| 0 |+----------+1 row in set (0.00 sec)
这种不一致来自于 b='g' 的 c 列中都是 NULL 值,因此 count(c) 返回为 0。
二、示例中 count() 获取数据流程简析
把稳在《MySQL:查询字段数量多少对查询效率的影响》一文中我们已经详细的描述了部分流程,这里不再赘述,如果须要更加详细的理解,自行参考。
1. MySQL 层 构建 read_set
这里构建的 read_set 实际上只会包含列b,即一个字段。
2. Innodb 层 构建模板
同理根据 read_set 构建的字段模板中只会包含列b。
LOOP:这里开始循环返回每一条数据
3. Innodb 层 根据模板返回数据
这里我们可以看看模板的数量和模板对应的详细列名
模板的数量断点:row_sel_store_mysql_rec查看模板数量:(gdb) p prebuilt->n_template$1 = 1
查看模板对应的字段
断点:row_sel_field_store_in_mysql_format_func查看模板对应的字段:(gdb) p field->name$3 = {m_name = 0x7ffe7c99cf85 "b"}
显然这里只是将 b 列的值返回给了 MySQL层,这里也很好理解,由于 b 列在 MySQL 层须要连续做过滤操作。
4. MySQL 层 过滤条件 b='g'
好了,当前返回给 MySQL 层的数据中只有 b 列的数据,然后施加 b='g' 这个条件进行过滤。
5. MySQL 层 过滤后做一个 COUNT 计数操作
对付普通的 select 语句过滤后的数据就可以返回了,但是对付 count 这种操作,这里做的是一个计数操作,个中行会对 count 字段的 NULL 值进行判断,当然这里是 count() 也就不存在 NULL 值判断了,下面是这段代码:
bool Item_sum_count::add(){ if (aggr->arg_is_null(false)) return 0; count++; return 0;}
END LOOP
终极我们只须要返回这个计数就可以了。下面是发送的数据,断点可以设置在 Query_result_send::send_data 中。
$22 = Item::SUM_FUNC_ITEM(gdb) p ((Item)(items)->first->info)->field_type()$23 = MYSQL_TYPE_LONGLONG(gdb) p ((Item)(items)->first->info)->val_int()$24 = 3(gdb) p (items)->first->info$26 = (void ) 0x7ffe7c006580(gdb) p ((Item_sum_count)$26)->count$28 = 3
我们可以发送的数据实际便是这个计数器,终极值为 3。
三、示例中 count(c) 获取数据流程的不同
实际上全体流程基本同等,但是差异在于:
构建的 read_set 不同,模板个数自然不同,由于须要 2 个字段,即 b、c 两个字段,个中 b 列用于 where 条件过滤,而 b 列用于统计是否有 NULL 值,因此模板数量为 2,如下:(gdb) p prebuilt->n_template$29 = 2
做 COUNT 计数器的时候会根据 c 列的 NULL 值做实际的过滤,操作只假如 NULL 则 count 计数不会增加 1,这个还是参考这段代码:
bool Item_sum_count::add(){ if (aggr->arg_is_null(false)) //过滤NULL值 return 0; count++; return 0;}
终极会调入函数 Field::is_null 进行 NULL 值判断,断点可以设置在这里。
四、不同点总结
示例中的语句 count(c) 返回为 0。现在我们很清楚了,这些数据什么时候过滤掉的,总结如下:
Innodb 层返回了全部的行数据。MySQL 层通过 where 条件过滤,剩下了 b='g' 的行。MySQL 层通过 NULL 判断,将剩下的 count(c) 中为 NULL 的行也打消在计数之外。而 count() 则没有第 3 步,这是一个不同。
然后的不同点便是在返回的字段上:
count(c) 很明显除了 where 条件以外,还须要返回 c 列给 MySQL 层count() 则不须要返回额外的字段给 MySQL 层,只须要 MySQL 层过滤须要的b列即可。通过上面的剖析,实际上效率没有太大的差别,我以为同样实行操持,同样返回数据结果的条件下,可能 count() 的效率要略微高一点。
五、备用栈帧(下图需点击放大查看)
NULL 值计数过滤栈帧
末了推抬高鹏的专栏《深入理解 MySQL 主从事理 32 讲》,想要透彻理解学习 MySQL 主从事理的朋友不容错过。