MySQL 实战：Server层和存储引擎

基础架构：一条 SQL 查询语句是如何执行的？

MySQL 的基本架构示意图：

MySQL 可以分为 Server 层和存储引擎层两部分。

Server 层包括连接器、查询缓存、分析器、优化器、执行器等，涵盖 MySQL 的大多数核心服务功能，以及所有的内置函数（如日期、时间、数学和加密函数等），所有跨存储引擎的功能都在这一层实现，比如存储过程、触发器、视图等。

存储引擎层负责数据的存储和提取。其架构模式是插件式的，支持 InnoDB、MyISAM、Memory 等多个存储引擎。现在最常用的存储引擎是 InnoDB，它从 MySQL 5.5.5 版本开始成为了默认存储引擎。

不同存储引擎的表数据存取方式不同，支持的功能也不同。不同的存储引擎共用一个Server 层，也就是从连接器到执行器的部分。

连接器

连接器负责跟客户端建立连接、获取权限、维持和管理连接。

查询缓存

MySQL 拿到一个查询请求后，会先到查询缓存看看，之前是不是执行过这条语句。之前执行过的语句及其结果可能会以 key-value 对的形式，被直接缓存在内存中。key 是查询的语句，value 是查询的结果。如果你的查询能够直接在这个缓存中找到 key，那么这个 value 就会被直接返回给客户端。

但是大多数情况下我会建议你不要使用查询缓存，为什么呢？因为查询缓存往往弊大于利。

查询缓存的失效非常频繁，只要有对一个表的更新，这个表上所有的查询缓存都会被清空。因此很可能你费劲地把结果存起来，还没使用呢，就被一个更新全清空了。对于更新压力大的数据库来说，查询缓存的命中率会非常低。除非你的业务就是有一张静态表，很长时间才会更新一次。比如，一个系统配置表，那这张表上的查询才适合使用查询缓存。

MySQL 8.0 版本直接将查询缓存的整块功能删掉了，也就是说 8.0 开始彻底没有这个功能了。

分析器

如果没有命中查询缓存，就要开始真正执行语句了。

分析器先会做“词法分析”。做完了这些识别以后，就要做“语法分析”。

优化器

优化器是在表里面有多个索引的时候，决定使用哪个索引；或者在一个语句有多表关联（join）的时候，决定各个表的连接顺序。

优化器阶段完成后，这个语句的执行方案就确定下来了，然后进入执行器阶段。

执行器

打开表的时候，执行器就会根据表的引擎定义，去使用这个引擎提供的接口。

你会在数据库的慢查询日志中看到一个 rows_examined 的字段，表示这个语句执行过程中扫描了多少行。这个值就是在执行器每次调用引擎获取数据行的时候累加的。

在有些场景下，执行器调用一次，在引擎内部则扫描了多行，因此引擎扫描行数跟 rows_examined 并不是完全相同的。

我给你留一个问题吧，如果表 T 中没有字段 k，而你执行了这个语句 select * from T where k=1, 那肯定是会报“不存在这个列”的错误： “Unknown column ‘k’ in ‘where clause’”。你觉得这个错误是在我们上面提到的哪个阶段报出来的呢？

答案是分析器。

日志系统：一条 SQL 更新语句是如何执行的？

与查询流程不一样的是，更新流程还涉及两个重要的日志模块，它们正是我们今天要讨论的主角：redo log（重做日志）和 binlog（归档日志）。

重要的日志模块：redo log

MySQL 里经常说到的 WAL 技术，WAL 的全称是 Write-Ahead Logging，它的关键点就是先写日志，再写磁盘。

具体来说，当有一条记录需要更新的时候，InnoDB 引擎就会先把记录写到 redo log（粉板）里面，并更新内存，这个时候更新就算完成了。同时，InnoDB 引擎会在适当的时候，将这个操作记录更新到磁盘里面，而这个更新往往是在系统比较空闲的时候做。

与此类似，InnoDB 的 redo log 是固定大小的，比如可以配置为一组 4 个文件，每个文件的大小是 1GB，那么这块“粉板”总共就可以记录 4GB 的操作。从头开始写，写到末尾就又回到开头循环写。

write pos 是当前记录的位置，一边写一边后移，写到第 3 号文件末尾后就回到 0 号文件开头。checkpoint 是当前要擦除的位置，也是往后推移并且循环的，擦除记录前要把记录更新到数据文件。

write pos 和 checkpoint 之间的是“粉板”上还空着的部分，可以用来记录新的操作。如果 write pos 追上 checkpoint，表示“粉板”满了，这时候不能再执行新的更新，得停下来先擦掉一些记录，把 checkpoint 推进一下。

有了 redo log，InnoDB 就可以保证即使数据库发生异常重启，之前提交的记录都不会丢失，这个能力称为crash-safe。

重要的日志模块：binlog

redo log 是 InnoDB 引擎特有的日志，而 Server 层也有自己的日志，称为 binlog（归档日志）。

为什么会有两份日志呢？

因为最开始 MySQL 里并没有 InnoDB 引擎。MySQL 自带的引擎是 MyISAM，但是 MyISAM 没有 crash-safe 的能力，binlog 日志只能用于归档。而 InnoDB 是另一个公司以插件形式引入 MySQL 的，既然只依靠 binlog 是没有 crash-safe 能力的，所以 InnoDB 使用另外一套日志系统——也就是 redo log 来实现 crash-safe 能力。

这两种日志有以下三点不同。

1 redo log 是 InnoDB 引擎特有的；binlog 是 MySQL 的 Server 层实现的，所有引擎都可以使用。
2 redo log 是物理日志，记录的是“在某个数据页上做了什么修改”；binlog 是逻辑日志，记录的是这个语句的原始逻辑，比如“给 ID=2 这一行的 c 字段加 1 ”。
3 redo log 是循环写的，空间固定会用完；binlog 是可以追加写入的。“追加写”是指 binlog 文件写到一定大小后会切换到下一个，并不会覆盖以前的日志。

有了对这两个日志的概念性理解，我们再来看执行器和 InnoDB 引擎在执行这个简单的 update 语句时的内部流程。

1 执行器先找引擎取 ID=2 这一行。ID 是主键，引擎直接用树搜索找到这一行。如果 ID=2 这一行所在的数据页本来就在内存中，就直接返回给执行器；否则，需要先从磁盘读入内存，然后再返回。
2 执行器拿到引擎给的行数据，把这个值加上 1，比如原来是 N，现在就是 N+1，得到新的一行数据，再调用引擎接口写入这行新数据。
3 引擎将这行新数据更新到内存中，同时将这个更新操作记录到 redo log 里面，此时 redo log 处于 prepare 状态。然后告知执行器执行完成了，随时可以提交事务。
4 执行器生成这个操作的 binlog，并把 binlog 写入磁盘。
5 执行器调用引擎的提交事务接口，引擎把刚刚写入的 redo log 改成提交（commit）状态，更新完成。

update 语句执行流程：

将 redo log 的写入拆成了两个步骤：prepare 和 commit，这就是"两阶段提交"。

两阶段提交

前面我们说过了，binlog 会记录所有的逻辑操作，并且是采用“追加写”的形式。

由于 redo log 和 binlog 是两个独立的逻辑如果不使用“两阶段提交”，那么数据库的状态就有可能和用它的日志恢复出来的库的状态不一致。

小结

redo log 用于保证 crash-safe 能力。innodb_flush_log_at_trx_commit 这个参数设置成 1 的时候，表示每次事务的 redo log 都直接持久化到磁盘。这个参数我建议你设置成 1，这样可以保证 MySQL 异常重启之后数据不丢失。

sync_binlog 这个参数设置成 1 的时候，表示每次事务的 binlog 都持久化到磁盘。这个参数我也建议你设置成 1，这样可以保证 MySQL 异常重启之后 binlog 不丢失。

事务隔离：为什么你改了我还看不见？

简单来说，事务就是要保证一组数据库操作，要么全部成功，要么全部失败。在 MySQL 中，事务支持是在引擎层实现的。你现在知道，MySQL 是一个支持多引擎的系统，但并不是所有的引擎都支持事务。比如 MySQL 原生的 MyISAM 引擎就不支持事务，这也是 MyISAM 被 InnoDB 取代的重要原因之一。

隔离性与隔离级别

在谈隔离级别之前，你首先要知道，你隔离得越严实，效率就会越低。SQL 标准的事务隔离级别包括：读未提交（read uncommitted）、读提交（read committed）、可重复读（repeatable read）和串行化（serializable ）。SQL 标准的事务隔离级别包括：

读未提交是指，一个事务还没提交时，它做的变更就能被别的事务看到。
读提交是指，一个事务提交之后，它做的变更才会被其他事务看到。
可重复读是指，一个事务执行过程中看到的数据，总是跟这个事务在启动时看到的数据是一致的。当然在可重复读隔离级别下，未提交变更对其他事务也是不可见的。
串行化，顾名思义是对于同一行记录，“写”会加“写锁”，“读”会加“读锁”。当出现读写锁冲突的时候，后访问的事务必须等前一个事务执行完成，才能继续执行。

若隔离级别是“读未提交”，则 V1 的值就是 2。这时候事务 B 虽然还没有提交，但是结果已经被 A 看到了。因此，V2、V3 也都是 2。
若隔离级别是“读提交”，则 V1 是 1，V2 的值是 2。事务 B 的更新在提交后才能被 A 看到。所以， V3 的值也是 2。
若隔离级别是“可重复读”，则 V1、V2 是 1，V3 是 2。之所以 V2 还是 1，遵循的就是这个要求：事务在执行期间看到的数据前后必须是一致的。
若隔离级别是“串行化”，则在事务 B 执行“将 1 改成 2”的时候，会被锁住。直到事务 A 提交后，事务 B 才可以继续执行。所以从 A 的角度看，V1、V2 值是 1，V3 的值是 2。

在实现上，数据库里面会创建一个视图，访问的时候以视图的逻辑结果为准。在“可重复读”隔离级别下，这个视图是在事务启动时创建的，整个事务存在期间都用这个视图。在“读提交”隔离级别下，这个视图是在每个 SQL 语句开始执行的时候创建的。这里需要注意的是，“读未提交”隔离级别下直接返回记录上的最新值，没有视图概念；而“串行化”隔离级别下直接用加锁的方式来避免并行访问。

Oracle 数据库的默认隔离级别其实就是“读提交”。

事务启动时的视图可以认为是静态的，不受其他事务更新的影响。

事务隔离的实现

在 MySQL 中，实际上每条记录在更新的时候都会同时记录一条回滚操作。记录上的最新值，通过回滚操作，都可以得到前一个状态的值。

同一条记录在系统中可以存在多个版本，就是数据库的多版本并发控制（MVCC）。

你一定会问，回滚日志总不能一直保留吧，什么时候删除呢？答案是，在不需要的时候才删除。也就是说，系统会判断，当没有事务再需要用到这些回滚日志时，回滚日志会被删除。

什么时候才不需要了呢？就是当系统里没有比这个回滚日志更早的 read-view 的时候。

长事务意味着系统里面会存在很老的事务视图。由于这些事务随时可能访问数据库里面的任何数据，所以这个事务提交之前，数据库里面它可能用到的回滚记录都必须保留，这就会导致大量占用存储空间。

在 MySQL 5.5 及以前的版本，回滚日志是跟数据字典一起放在 ibdata 文件里的，即使长事务最终提交，回滚段被清理，文件也不会变小。

除了对回滚段的影响，长事务还占用锁资源。

事务的启动方式

MySQL 的事务启动方式有以下几种：

1 显式启动事务语句， begin 或 start transaction。配套的提交语句是 commit，回滚语句是 rollback。
2 set autocommit=0，这个命令会将这个线程的自动提交关掉。

有些客户端连接框架会默认连接成功后先执行一个 set autocommit=0 的命令。这就导致接下来的查询都在事务中，如果是长连接，就导致了意外的长事务。

因此，我会建议你总是使用 set autocommit=1, 通过显式语句的方式来启动事务。

但是有的开发同学会纠结“多一次交互”的问题。对于一个需要频繁使用事务的业务，第二种方式每个事务在开始时都不需要主动执行一次 “begin”，减少了语句的交互次数。

深入浅出索引

索引的出现其实就是为了提高数据查询的效率，就像书的目录一样。

索引的常见模型

This chapter requires login to view full content. You are viewing a preview.

Course Curriculum

编程根基：数据结构、算法与系统基础

掌握常用数据结构与算法思想，理解操作系统进程/内存管理及网络 TCP/IP 模型，为后续性能分析、并发设计和系统调优提供底层认知支撑。

01 链 Link

02 栈 Stack

03 队列 Queue

04 树 Tree

05 堆 Heap

06 词典 Dictionary

07 散列 hasing

08 为什么计算机用补码存储数据

09 服务器并发处理能力 - 1

10 服务器并发处理能力 - 2

11 现代操作系统 - 存储设备

12 现代操作系统 - 进程与线程

13 现代操作系统 - 内存管理

Java 内核：JVM 与并发编程

深入 JVM 内存布局、垃圾回收机制与 Java 内存模型，熟练使用并发工具类与锁原语，写出线程安全、低延迟、可诊断的高性能 Java 代码。

14 为什么你看到的“传引用”其实是“传值

15 一个对象引用的思考

16 Java try-with-resource

17 Java 8 Convert List to Map

18 深入理解 ConcurrentHashMap

19 Java 自动装箱和自动拆箱

20 Java 内存模型与线程

21 浅谈 Java 内存模型

22 Java 应用 CPU 使用率为什么飚升？

23 内存栅栏和内存对齐

24 JVM 内存预警排查

25 JVM 体系结构

26 Linux与JVM的内存关系

27 浅谈 G1 垃圾收集器

28 详解 G1 垃圾收集器

29 GC 为何会导致线程数降低？

30 线程的状态和生命周期

31 深入浅出java线程池

32 一台Java服务器跑多少个线程

33 线程安全CopyOnWriteArrayList

34 静态方法、实例化方法与线程安全

35 利用Condition来实现阻塞队列

36 Java多线程Semaphore

37 ThreadPoolExecutor

38 ThreadPoolExecutor参数设置

39 SimpleDateFormat非线程安全

40 WeakReference和StrongReference

41 Threadlocal是否存在内存泄露

42 ArrayBlockingQueue

43 Java并发编程：线程安全性

44 Java并发编程：对象的共享

45 Java并发编程：内存模型

46 性感的 Guava

47 Guava Multimap putAll OOM?

48 RateLimiter 与 Semaphore

49 Google Guava Cache

50 Guava cache asynchronous reload

框架与 I/O：Spring、Netty 与 Web 容器

理解 Spring Boot 自动装配、AOP 与事务原理，掌握 Netty Reactor 模型及 Tomcat 连接处理机制，构建高内聚、易扩展的应用服务层。

51 Servlet3 异步原理与实践

52 理解Servlet的单实例多线程

53 Spring事务配置的五种方式

54 Spring的XML扩展特性

55 Singleton模式的线程安全

56 使用 Java SPI 简单示例

57 基于 Spring & SPI 实现动态服务配置实践

58 深入剖析Tomcat容器

59 深度解读Tomcat中的NIO模型

60 分析Tomcat内存溢出

61 Tomcat 6引发的定时Full GC问题

62 了解 Web 及网络基础

63 HTTP 中 GET 与 POST 的区别

64 Java NIO

65 NIO 堆外内存

66 解读 I/O 多路复用技术

67 Netty Overview

68 Netty 笔记整理

69 Netty 中的 Future & Promise

70 Netty 死锁异常

71 Netty IdleStateHandler心跳机制

72 高性能Server - Reactor模型

73 Netty I/O 多路复用

74 Netty Channel.isWritable 返回 false

75 SocketChannel & ServerSocketChannel

76 Netty 解决 TCP 粘包或半包问题

77 Netty 中的零拷贝机制

78 深入拆解Tomcat & Jetty：整体架构

79 深入拆解Tomcat & Jetty：Endpoint

80 深入拆解Tomcat & Jetty：Executor

81 深入拆解Tomcat & Jetty：Context 容器

82 深入拆解Tomcat & Jetty：性能优化

83 Netty in Action：异步和事件驱动

84 Netty in Action：Netty 的组件和设计

85 Netty in Action：传输

86 Netty in Action：ChannelHandler和ChannelPipeline

87 Netty in Action：EventLoop和线程模型

高性能中间件：消息、缓存与存储

熟练运用 MySQL 索引/事务、Redis 缓存策略、Kafka/RocketMQ 消息可靠性，以及 ZooKeeper 分布式协调，搭建稳定、解耦的分布式数据底座。

88 MySQL执行UPDATE语句错误

89 联合索引致SQL查询效率慢

90 MySQL datetime 精度

91 浅谈数据库连接池

92 配置MySQL数据库超时设置

93 MySQL InnoDB 存储引擎大观

94 浅谈 DDL 技术解密

95 Binlog 的三个业务应用场景

96 Binlog + Flink 实现多表数据同构

97 MySQL主从同步那点事儿

98 浅谈 MySQL binlog 主从同步

99 数据库读写分离与事务纠缠

100 MySQL 实战：Server层和存储引擎

101 MySQL 实战：日志和索引

102 MySQL 实战：锁和性能

103 “SELECT LAST_INSERT_ID 总是为1”

104 Redis 内存使用优化与存储

105 Redis 事务

106 Redis 管道、事务与Lua脚本

107 解析 reids dump.rdb

108 百万级消息推送 Redis 性能排查

109 浅谈分布式事务

110 浅谈分布式服务协调技术

111 Zookeeper中组成员的关系

112 RocketMQ 持久化

113 RocketMQ & Kafka 消息消费与消息重试

114 RocketMQ 技术内幕：路由中心

115 RocketMQ 技术内幕：消息发送

116 RocketMQ 技术内幕：消息存储

117 RocketMQ 技术内幕：消息消费

118 浅谈分布式消息技术 Kafka

119 KafkaProducer 技术内幕

120 Kafka 核心技术与实战：Kafka 入门

121 Kafka 核心技术与实战：客户端

122 Kafka 核心技术与实战：消费者

123 Kafka 核心技术与实战：深入内核

124 Kafka 核心技术与实战：Kafka 控制器

125 Kafka权威指南：初识 Kafka

126 Kafka权威指南：Kafka生产者

127 Kafka权威指南：Kafka消费者

128 Kafka权威指南：深入Kafka

129 Flink 原理与实现

130 Flink 基础教程

131 HBase 权威指南

架构能力：高可用、DDD 与系统设计

基于领域驱动设计划分限界上下文，结合限流、熔断、多活容灾等手段，设计可演进、可观测、故障自愈的大规模业务系统。

132 设计模式基础

133 设计模式中的类关系

134 小谈实践封装与多态

135 浅谈泛型对方法传参的扩展

136 Bridge设计模式

137 Composite 设计模式

138 Proxy / Delegate设计模式

139 重构实践之责任链模式

140 重构实践之桥接模式

141 策略模式实践

142 责任链模式实践

143 单例模式的常用写法

144 架构风格与协同之间设计考量

145 领域驱动设计下的服务高可用设计

146 Log4j 日志输出性能优化

147 监控告警三级治理策略

148 502 Bad Gateway 引起的反思

149 502 Bad Gateway 引起的反思2

150 RPC 框架异常引起的系统崩溃

151 一次网关事故的总结

152 记一次接口性能优化

153 RPC 调用 msgpack 序列化问题

154 从0开始学架构

155 亿级流量网站架构核心技术

156 高可用可伸缩微服务架构

157 架构整洁之道

158 高并发系统设计

159 凤凰架构

Java架构师核心突破指南

一本为Java工程师量身定制的实战突破手册，带你亲手将单体应用演进为分布式、云原生的企业级架构。

¥ 0.0 Free

No cost, unlimited access

Speaker

Songran Zhang

@Aliyun | Qwen Chat

Songran Zhang is senior systems architect at Aliyun, a speaker, and an author. Over the past 15 years, he's mastered architectures from cloud-native systems to AI-powered LLM platforms, building deep technical expertise across large-scale, high-availability systems.

Java架构师核心突破指南

Navigate to specific sections in the content

Loading table of contents...

MySQL 实战：Server层和存储引擎

基础架构：一条 SQL 查询语句是如何执行的？

日志系统：一条 SQL 更新语句是如何执行的？

事务隔离：为什么你改了我还看不见？

深入浅出索引

Course Curriculum

编程根基：数据结构、算法与系统基础

Java 内核：JVM 与并发编程

框架与 I/O：Spring、Netty 与 Web 容器

高性能中间件：消息、缓存与存储

架构能力：高可用、DDD 与系统设计

Java架构师核心突破指南

Speaker

Java架构师核心突破指南

Related Courses

敏捷开发实战 (2013-2019)

Java开发者速通Python核心

架构演进思维：驾驭复杂系统

Get in Touch

Hello there! 👋

Email

GitHub

Scan to Connect