备份恢复与数据迁移
备份的价值不在于“有文件”,而在于能在目标时间内恢复到正确状态。数据迁移同样不是拷贝表,而是要保证一致性、校验、回滚和业务无感。
# 1. 学习定位
| 维度 | 内容 |
|---|---|
| 难度层级 | 运维核心 |
| 核心目标 | 先会用,再理解机制,最后能做工程取舍和故障分析 |
| 学习方法 | 带着业务场景看命令、SQL、数据结构、日志和运行时指标 |
# 2. 核心地图
备份恢复与数据迁移
├─ 逻辑备份
├─ 物理备份
├─ 全量备份
├─ 增量恢复
├─ PITR
├─ 校验
├─ 迁移
└─ 回滚
# 3. 小章节深度讲解
下面把核心地图中的每个点拆开讲。每个小节都同时面向开发和运维:开发侧关注怎么设计、怎么写代码、怎么避免错误;运维侧关注怎么监控、怎么定位、怎么恢复。
# 3.1. 逻辑备份
# 是什么
逻辑备份 服务于数据可恢复性。备份不是文件存在就成功,而是要能在目标时间内恢复到指定一致点。
# 开发人员怎么用
开发人员要让数据模型可校验、可重放、可补偿,例如保留业务流水号、更新时间和状态流转记录。
# 运维人员怎么看
运维人员要定期恢复演练,校验全量备份、binlog、权限、参数、表结构和业务样本。迁移还要验证增量追平和回滚入口。
# 常见风险
常见风险是只校验行数不校验内容,或备份和主库处在同一故障域,真正故障时一起丢失。
# 3.2. 物理备份
# 是什么
物理备份 服务于数据可恢复性。备份不是文件存在就成功,而是要能在目标时间内恢复到指定一致点。
# 开发人员怎么用
开发人员要让数据模型可校验、可重放、可补偿,例如保留业务流水号、更新时间和状态流转记录。
# 运维人员怎么看
运维人员要定期恢复演练,校验全量备份、binlog、权限、参数、表结构和业务样本。迁移还要验证增量追平和回滚入口。
# 常见风险
常见风险是只校验行数不校验内容,或备份和主库处在同一故障域,真正故障时一起丢失。
# 3.3. 全量备份
# 是什么
全量备份 服务于数据可恢复性。备份不是文件存在就成功,而是要能在目标时间内恢复到指定一致点。
# 开发人员怎么用
开发人员要让数据模型可校验、可重放、可补偿,例如保留业务流水号、更新时间和状态流转记录。
# 运维人员怎么看
运维人员要定期恢复演练,校验全量备份、binlog、权限、参数、表结构和业务样本。迁移还要验证增量追平和回滚入口。
# 常见风险
常见风险是只校验行数不校验内容,或备份和主库处在同一故障域,真正故障时一起丢失。
# 3.4. 增量恢复
# 是什么
增量恢复 服务于数据可恢复性。备份不是文件存在就成功,而是要能在目标时间内恢复到指定一致点。
# 开发人员怎么用
开发人员要让数据模型可校验、可重放、可补偿,例如保留业务流水号、更新时间和状态流转记录。
# 运维人员怎么看
运维人员要定期恢复演练,校验全量备份、binlog、权限、参数、表结构和业务样本。迁移还要验证增量追平和回滚入口。
# 常见风险
常见风险是只校验行数不校验内容,或备份和主库处在同一故障域,真正故障时一起丢失。
# 3.5. PITR
# 是什么
PITR 服务于数据可恢复性。备份不是文件存在就成功,而是要能在目标时间内恢复到指定一致点。
# 开发人员怎么用
开发人员要让数据模型可校验、可重放、可补偿,例如保留业务流水号、更新时间和状态流转记录。
# 运维人员怎么看
运维人员要定期恢复演练,校验全量备份、binlog、权限、参数、表结构和业务样本。迁移还要验证增量追平和回滚入口。
# 常见风险
常见风险是只校验行数不校验内容,或备份和主库处在同一故障域,真正故障时一起丢失。
# 3.6. 校验
# 是什么
校验 服务于数据可恢复性。备份不是文件存在就成功,而是要能在目标时间内恢复到指定一致点。
# 开发人员怎么用
开发人员要让数据模型可校验、可重放、可补偿,例如保留业务流水号、更新时间和状态流转记录。
# 运维人员怎么看
运维人员要定期恢复演练,校验全量备份、binlog、权限、参数、表结构和业务样本。迁移还要验证增量追平和回滚入口。
# 常见风险
常见风险是只校验行数不校验内容,或备份和主库处在同一故障域,真正故障时一起丢失。
# 3.7. 迁移
# 是什么
迁移 服务于数据可恢复性。备份不是文件存在就成功,而是要能在目标时间内恢复到指定一致点。
# 开发人员怎么用
开发人员要让数据模型可校验、可重放、可补偿,例如保留业务流水号、更新时间和状态流转记录。
# 运维人员怎么看
运维人员要定期恢复演练,校验全量备份、binlog、权限、参数、表结构和业务样本。迁移还要验证增量追平和回滚入口。
# 常见风险
常见风险是只校验行数不校验内容,或备份和主库处在同一故障域,真正故障时一起丢失。
# 3.8. 回滚
# 是什么
回滚 属于 MySQL 生命周期治理。它决定实例从下载安装到升级回滚的可控程度,也会影响字符集、目录布局、账号权限、配置来源和故障恢复方式。
# 开发人员怎么用
开发人员要关心版本兼容、驱动兼容、SQL 行为差异和本地环境一致性。不要在开发环境使用随意版本,在生产环境又依赖另一个版本的优化器或语法行为。
# 运维人员怎么看
运维人员要把 回滚 纳入基线:安装介质、配置文件、数据目录、systemd、账号初始化、升级检查、回滚包和变更窗口都要可审计。
# 常见风险
常见风险是安装时图省事,升级时无回滚。数据库一旦承载核心数据,任何版本和配置变化都必须能解释、能验证、能撤回。
# 3.9. 本篇学习实验
建议准备一个至少百万行级别的测试表,分别观察正常查询、缺失索引、错误索引、长事务、锁等待和慢查询日志。每次实验都记录 SQL、执行计划、耗时、扫描行数和 MySQL 状态变量变化。
开发侧实验重点是理解 SQL 与事务边界,运维侧实验重点是理解指标如何变化。真正掌握本篇内容,应该能从现象反推 SQL、索引、锁、日志或存储引擎问题。
# 4. 核心机制
- 逻辑备份导出 SQL 或逻辑数据,便于跨版本迁移,但恢复速度较慢。
- 物理备份复制数据文件和日志,适合大库快速恢复,但对版本和存储环境更敏感。
- 时间点恢复依赖全量备份加 binlog 增量重放。
- 在线迁移通常需要全量同步、增量追平、双写或校验、灰度切换和回滚方案。
# 5. 工程实践
- 备份必须定期恢复演练,不能只检查备份任务成功。
- 核心库保存多周期备份,并隔离存储,避免和主库同故障域。
- 迁移前冻结 DDL 或建立 DDL 同步规则。
- 迁移后做行数、校验和、抽样业务查询和关键账务校验。
# 6. 常见坑
- 备份文件损坏或缺少 binlog,故障时才发现无法恢复。
- 备份和数据库放同一块磁盘,磁盘坏了一起丢。
- 迁移只校验行数,不校验数据内容。
- 没有回滚入口,切换失败只能现场修数据。
# 7. 专家视角
- 备份体系要以恢复目标设计:恢复到什么时候、用多久、允许丢多少。
- 专家会把备份、binlog、权限、参数、账号和外部依赖一起纳入恢复剧本。
- 数据迁移本质是风险管理,校验和回滚比拷贝速度更重要。
# 8. Tips 快问快答
Q:备份成功就安全吗?
A:不安全。必须定期恢复演练,证明备份可用。
Q:逻辑备份和物理备份怎么选?
A:小库和跨版本迁移常用逻辑备份,大库快速恢复更偏物理备份。
Q:PITR 是什么?
A:Point-in-Time Recovery,利用全量备份和 binlog 恢复到指定时间点。
# 9. 阶段小结
备份恢复与数据迁移 的学习重点不是记住零散概念,而是把它放回真实系统:数据如何进入、如何存储、如何被查询、如何在并发下保持正确、如何在故障后恢复。掌握这些连接关系,才能从“会用”走向“能设计、能优化、能排障”。