Undo Log与Read View
undo log 和 Read View 是 MVCC 的两块拼图。undo 保存旧版本,Read View 定义可见性规则。读懂它们,才能解释为什么长事务会拖垮系统,也能解释可重复读的快照从哪里来。
# 1. 学习定位
| 维度 | 内容 |
|---|---|
| 难度层级 | 底层机制 |
| 核心目标 | 先会用,再理解机制,最后能做工程取舍和故障分析 |
| 学习方法 | 带着业务场景看命令、SQL、数据结构、日志和运行时指标 |
# 2. 核心地图
Undo Log与Read View
├─ 隐藏事务 ID
├─ 回滚指针
├─ Undo 链
├─ 活跃事务列表
├─ 低水位
├─ 高水位
└─ Purge
# 3. 小章节深度讲解
下面把核心地图中的每个点拆开讲。每个小节都同时面向开发和运维:开发侧关注怎么设计、怎么写代码、怎么避免错误;运维侧关注怎么监控、怎么定位、怎么恢复。
# 3.1. 隐藏事务 ID
# 是什么
隐藏事务 ID 关注的是事务版本可见性。InnoDB 通过事务 ID、undo 链和 Read View 判断某个历史版本对当前语句或事务是否可见。
# 开发人员怎么用
开发人员要区分快照读和当前读。只展示数据可以依赖快照读,读后要更新就要使用当前读、条件更新或唯一约束保护业务不变量。
# 运维人员怎么看
运维人员要观察长事务、undo 表空间、history list length 和 purge 速度。版本链积压会让查询变慢,也会推迟空间回收。
# 常见风险
常见风险是长时间打开事务做分页导出或人工审核,导致旧版本长期不能清理,最终拖累整个实例。
# 3.2. 回滚指针
# 是什么
回滚指针 关注的是事务版本可见性。InnoDB 通过事务 ID、undo 链和 Read View 判断某个历史版本对当前语句或事务是否可见。
# 开发人员怎么用
开发人员要区分快照读和当前读。只展示数据可以依赖快照读,读后要更新就要使用当前读、条件更新或唯一约束保护业务不变量。
# 运维人员怎么看
运维人员要观察长事务、undo 表空间、history list length 和 purge 速度。版本链积压会让查询变慢,也会推迟空间回收。
# 常见风险
常见风险是长时间打开事务做分页导出或人工审核,导致旧版本长期不能清理,最终拖累整个实例。
# 3.3. Undo 链
# 是什么
Undo 链 关注的是事务版本可见性。InnoDB 通过事务 ID、undo 链和 Read View 判断某个历史版本对当前语句或事务是否可见。
# 开发人员怎么用
开发人员要区分快照读和当前读。只展示数据可以依赖快照读,读后要更新就要使用当前读、条件更新或唯一约束保护业务不变量。
# 运维人员怎么看
运维人员要观察长事务、undo 表空间、history list length 和 purge 速度。版本链积压会让查询变慢,也会推迟空间回收。
# 常见风险
常见风险是长时间打开事务做分页导出或人工审核,导致旧版本长期不能清理,最终拖累整个实例。
# 3.4. 活跃事务列表
# 是什么
活跃事务列表 关注的是事务版本可见性。InnoDB 通过事务 ID、undo 链和 Read View 判断某个历史版本对当前语句或事务是否可见。
# 开发人员怎么用
开发人员要区分快照读和当前读。只展示数据可以依赖快照读,读后要更新就要使用当前读、条件更新或唯一约束保护业务不变量。
# 运维人员怎么看
运维人员要观察长事务、undo 表空间、history list length 和 purge 速度。版本链积压会让查询变慢,也会推迟空间回收。
# 常见风险
常见风险是长时间打开事务做分页导出或人工审核,导致旧版本长期不能清理,最终拖累整个实例。
# 3.5. 低水位
# 是什么
低水位 关注的是事务版本可见性。InnoDB 通过事务 ID、undo 链和 Read View 判断某个历史版本对当前语句或事务是否可见。
# 开发人员怎么用
开发人员要区分快照读和当前读。只展示数据可以依赖快照读,读后要更新就要使用当前读、条件更新或唯一约束保护业务不变量。
# 运维人员怎么看
运维人员要观察长事务、undo 表空间、history list length 和 purge 速度。版本链积压会让查询变慢,也会推迟空间回收。
# 常见风险
常见风险是长时间打开事务做分页导出或人工审核,导致旧版本长期不能清理,最终拖累整个实例。
# 3.6. 高水位
# 是什么
高水位 关注的是事务版本可见性。InnoDB 通过事务 ID、undo 链和 Read View 判断某个历史版本对当前语句或事务是否可见。
# 开发人员怎么用
开发人员要区分快照读和当前读。只展示数据可以依赖快照读,读后要更新就要使用当前读、条件更新或唯一约束保护业务不变量。
# 运维人员怎么看
运维人员要观察长事务、undo 表空间、history list length 和 purge 速度。版本链积压会让查询变慢,也会推迟空间回收。
# 常见风险
常见风险是长时间打开事务做分页导出或人工审核,导致旧版本长期不能清理,最终拖累整个实例。
# 3.7. Purge
# 是什么
Purge 关注的是事务版本可见性。InnoDB 通过事务 ID、undo 链和 Read View 判断某个历史版本对当前语句或事务是否可见。
# 开发人员怎么用
开发人员要区分快照读和当前读。只展示数据可以依赖快照读,读后要更新就要使用当前读、条件更新或唯一约束保护业务不变量。
# 运维人员怎么看
运维人员要观察长事务、undo 表空间、history list length 和 purge 速度。版本链积压会让查询变慢,也会推迟空间回收。
# 常见风险
常见风险是长时间打开事务做分页导出或人工审核,导致旧版本长期不能清理,最终拖累整个实例。
# 3.8. 本篇学习实验
建议准备一个至少百万行级别的测试表,分别观察正常查询、缺失索引、错误索引、长事务、锁等待和慢查询日志。每次实验都记录 SQL、执行计划、耗时、扫描行数和 MySQL 状态变量变化。
开发侧实验重点是理解 SQL 与事务边界,运维侧实验重点是理解指标如何变化。真正掌握本篇内容,应该能从现象反推 SQL、索引、锁、日志或存储引擎问题。
# 4. 核心机制
- InnoDB 行记录包含隐藏事务 ID 和回滚指针,回滚指针可以沿着 undo 链找到旧版本。
- Read View 记录创建时活跃事务列表、最小活跃事务 ID 和下一个待分配事务 ID,用于判断版本是否可见。
- 事务回滚需要 undo,快照读也需要 undo,因此 undo 不只是失败回滚日志。
- purge 线程负责清理不再被任何 Read View 需要的旧版本。
# 5. 工程实践
- 监控长事务和 history list length,避免 undo 积压。
- 分页导出、后台扫描和报表任务要控制事务边界,避免长时间持有快照。
- 大批量修改分批提交,减少 undo 体积和回滚成本。
- 发现磁盘增长异常时,把 undo、临时表、binlog 和大事务一起排查。
# 6. 常见坑
- 以为只读事务没有成本,长时间快照读同样会阻止旧版本清理。
- 大事务失败后回滚极慢,误以为数据库卡死。
- 只看表数据大小,不看 undo 表空间和历史版本。
- 把 Read View 理解成复制出来的数据快照,实际它是可见性判断规则。
# 7. 专家视角
- undo 链让数据库能在不阻塞写入的情况下服务旧版本读取。
- 专家分析 MVCC 问题会检查事务列表、undo 积压、purge 速度和业务长查询。
- Read View 是并发控制的抽象边界,决定“我能看见哪个历史版本”。
# 8. Tips 快问快答
Q:undo log 只用于回滚吗?
A:不是,还用于 MVCC 快照读。
Q:Read View 是数据副本吗?
A:不是,它是版本可见性规则。
Q:为什么长查询会影响写入后的空间回收?
A:因为旧版本仍可能被长查询的 Read View 看到,purge 不能清理。
# 9. 阶段小结
Undo Log与Read View 的学习重点不是记住零散概念,而是把它放回真实系统:数据如何进入、如何存储、如何被查询、如何在并发下保持正确、如何在故障后恢复。掌握这些连接关系,才能从“会用”走向“能设计、能优化、能排障”。