MySQL日志
MySQL 日志体系支撑崩溃恢复、事务回滚、复制、审计和性能分析。常见日志包括 redo log、undo log、binlog、relay log、slow log、error log 和 general log。
# 1. 学习定位
| 维度 | 内容 |
|---|---|
| 难度层级 | 可靠性核心 |
| 核心目标 | 先会用,再理解机制,最后能做工程取舍和故障分析 |
| 学习方法 | 带着业务场景看命令、SQL、数据结构、日志和运行时指标 |
# 2. 核心地图
MySQL日志
├─ redo log
├─ undo log
├─ binlog
├─ relay log
├─ slow log
├─ error log
├─ general log
└─ 两阶段提交
# 3. 小章节深度讲解
下面把核心地图中的每个点拆开讲。每个小节都同时面向开发和运维:开发侧关注怎么设计、怎么写代码、怎么避免错误;运维侧关注怎么监控、怎么定位、怎么恢复。
# 3.1. redo log
# 是什么
redo log 是 MySQL 可靠性和复制链路中的关键日志或日志阶段。不同日志服务不同目标:崩溃恢复、逻辑复制、慢 SQL 分析、错误诊断或审计。
# 开发人员怎么用
开发人员要控制事务大小和写入频率,避免一次提交产生过大日志。涉及消息、缓存和外部系统时,要理解提交成功和外部可见之间的边界。
# 运维人员怎么看
运维人员要监控日志刷盘、磁盘空间、binlog 保留、复制 relay log、慢日志体积和错误日志。日志策略必须服务恢复目标,而不是只看默认配置。
# 常见风险
常见风险是日志占满磁盘导致实例不可写,或者误删 binlog 后无法做时间点恢复。
# 3.2. undo log
# 是什么
undo log 关注的是事务版本可见性。InnoDB 通过事务 ID、undo 链和 Read View 判断某个历史版本对当前语句或事务是否可见。
# 开发人员怎么用
开发人员要区分快照读和当前读。只展示数据可以依赖快照读,读后要更新就要使用当前读、条件更新或唯一约束保护业务不变量。
# 运维人员怎么看
运维人员要观察长事务、undo 表空间、history list length 和 purge 速度。版本链积压会让查询变慢,也会推迟空间回收。
# 常见风险
常见风险是长时间打开事务做分页导出或人工审核,导致旧版本长期不能清理,最终拖累整个实例。
# 3.3. binlog
# 是什么
binlog 是 MySQL 可靠性和复制链路中的关键日志或日志阶段。不同日志服务不同目标:崩溃恢复、逻辑复制、慢 SQL 分析、错误诊断或审计。
# 开发人员怎么用
开发人员要控制事务大小和写入频率,避免一次提交产生过大日志。涉及消息、缓存和外部系统时,要理解提交成功和外部可见之间的边界。
# 运维人员怎么看
运维人员要监控日志刷盘、磁盘空间、binlog 保留、复制 relay log、慢日志体积和错误日志。日志策略必须服务恢复目标,而不是只看默认配置。
# 常见风险
常见风险是日志占满磁盘导致实例不可写,或者误删 binlog 后无法做时间点恢复。
# 3.4. relay log
# 是什么
relay log 是 MySQL 可靠性和复制链路中的关键日志或日志阶段。不同日志服务不同目标:崩溃恢复、逻辑复制、慢 SQL 分析、错误诊断或审计。
# 开发人员怎么用
开发人员要控制事务大小和写入频率,避免一次提交产生过大日志。涉及消息、缓存和外部系统时,要理解提交成功和外部可见之间的边界。
# 运维人员怎么看
运维人员要监控日志刷盘、磁盘空间、binlog 保留、复制 relay log、慢日志体积和错误日志。日志策略必须服务恢复目标,而不是只看默认配置。
# 常见风险
常见风险是日志占满磁盘导致实例不可写,或者误删 binlog 后无法做时间点恢复。
# 3.5. slow log
# 是什么
slow log 是 MySQL 可靠性和复制链路中的关键日志或日志阶段。不同日志服务不同目标:崩溃恢复、逻辑复制、慢 SQL 分析、错误诊断或审计。
# 开发人员怎么用
开发人员要控制事务大小和写入频率,避免一次提交产生过大日志。涉及消息、缓存和外部系统时,要理解提交成功和外部可见之间的边界。
# 运维人员怎么看
运维人员要监控日志刷盘、磁盘空间、binlog 保留、复制 relay log、慢日志体积和错误日志。日志策略必须服务恢复目标,而不是只看默认配置。
# 常见风险
常见风险是日志占满磁盘导致实例不可写,或者误删 binlog 后无法做时间点恢复。
# 3.6. error log
# 是什么
error log 是 MySQL 可靠性和复制链路中的关键日志或日志阶段。不同日志服务不同目标:崩溃恢复、逻辑复制、慢 SQL 分析、错误诊断或审计。
# 开发人员怎么用
开发人员要控制事务大小和写入频率,避免一次提交产生过大日志。涉及消息、缓存和外部系统时,要理解提交成功和外部可见之间的边界。
# 运维人员怎么看
运维人员要监控日志刷盘、磁盘空间、binlog 保留、复制 relay log、慢日志体积和错误日志。日志策略必须服务恢复目标,而不是只看默认配置。
# 常见风险
常见风险是日志占满磁盘导致实例不可写,或者误删 binlog 后无法做时间点恢复。
# 3.7. general log
# 是什么
general log 是 MySQL 可靠性和复制链路中的关键日志或日志阶段。不同日志服务不同目标:崩溃恢复、逻辑复制、慢 SQL 分析、错误诊断或审计。
# 开发人员怎么用
开发人员要控制事务大小和写入频率,避免一次提交产生过大日志。涉及消息、缓存和外部系统时,要理解提交成功和外部可见之间的边界。
# 运维人员怎么看
运维人员要监控日志刷盘、磁盘空间、binlog 保留、复制 relay log、慢日志体积和错误日志。日志策略必须服务恢复目标,而不是只看默认配置。
# 常见风险
常见风险是日志占满磁盘导致实例不可写,或者误删 binlog 后无法做时间点恢复。
# 3.8. 两阶段提交
# 是什么
两阶段提交 是 MySQL 可靠性和复制链路中的关键日志或日志阶段。不同日志服务不同目标:崩溃恢复、逻辑复制、慢 SQL 分析、错误诊断或审计。
# 开发人员怎么用
开发人员要控制事务大小和写入频率,避免一次提交产生过大日志。涉及消息、缓存和外部系统时,要理解提交成功和外部可见之间的边界。
# 运维人员怎么看
运维人员要监控日志刷盘、磁盘空间、binlog 保留、复制 relay log、慢日志体积和错误日志。日志策略必须服务恢复目标,而不是只看默认配置。
# 常见风险
常见风险是日志占满磁盘导致实例不可写,或者误删 binlog 后无法做时间点恢复。
# 3.9. 本篇学习实验
建议准备一个至少百万行级别的测试表,分别观察正常查询、缺失索引、错误索引、长事务、锁等待和慢查询日志。每次实验都记录 SQL、执行计划、耗时、扫描行数和 MySQL 状态变量变化。
开发侧实验重点是理解 SQL 与事务边界,运维侧实验重点是理解指标如何变化。真正掌握本篇内容,应该能从现象反推 SQL、索引、锁、日志或存储引擎问题。
# 4. 核心机制
- redo log 是 InnoDB 物理日志,用于崩溃恢复,保证已提交事务修改不丢。
- binlog 是 Server 层逻辑日志,用于复制、点位恢复和数据订阅。
- undo log 保存旧版本,用于回滚和 MVCC,一般不用于外部恢复。
- 事务提交需要协调 redo 和 binlog,常用两阶段提交保证崩溃恢复后一致。
# 5. 工程实践
- 生产必须开启 binlog,并设置合理保留周期和空间告警。
- 核心库开启慢查询日志,错误日志进入集中采集。
- 备份恢复要同时考虑全量备份、binlog 增量和恢复目标时间点。
- 排查复制问题时检查主库 binlog、从库 relay log 和复制线程状态。
# 6. 常见坑
- 磁盘被 binlog 或慢日志打满,数据库不可写。
- 只备份数据文件,不保留恢复所需 binlog。
- 误删 binlog 后才发现无法做时间点恢复。
- 把 general log 长期开在生产高峰,造成额外开销。
# 7. 专家视角
- 日志是数据库可靠性的证据链。没有日志,就没有可验证恢复。
- 专家会把日志策略和备份策略一起设计,而不是把日志只当排障文件。
- 理解两阶段提交是理解 MySQL 内部一致性的关键入口。
# 8. Tips 快问快答
Q:redo log 和 binlog 最大区别是什么?
A:redo 是 InnoDB 物理恢复日志,binlog 是 Server 层逻辑复制和恢复日志。
Q:binlog 可以关吗?
A:开发环境可以,生产核心库不建议关闭,否则复制和时间点恢复能力会受影响。
Q:慢日志会影响性能吗?
A:有一定开销,但合理阈值下收益通常远大于成本。
# 9. 阶段小结
MySQL日志 的学习重点不是记住零散概念,而是把它放回真实系统:数据如何进入、如何存储、如何被查询、如何在并发下保持正确、如何在故障后恢复。掌握这些连接关系,才能从“会用”走向“能设计、能优化、能排障”。