SQL基础与执行顺序
SQL 是声明式语言,开发者描述“要什么结果”,数据库决定“如何拿到结果”。理解逻辑执行顺序和物理执行计划的差异,是从会写 SQL 走向会优化 SQL 的第一步。
# 1. 学习定位
| 维度 | 内容 |
|---|---|
| 难度层级 | SQL 入门 |
| 核心目标 | 先会用,再理解机制,最后能做工程取舍和故障分析 |
| 学习方法 | 带着业务场景看命令、SQL、数据结构、日志和运行时指标 |
# 2. 核心地图
SQL基础与执行顺序
├─ DDL
├─ DML
├─ DQL
├─ DCL
├─ FROM
├─ WHERE
├─ GROUP BY
├─ HAVING
├─ SELECT
├─ ORDER BY
└─ LIMIT
# 3. 小章节深度讲解
下面把核心地图中的每个点拆开讲。每个小节都同时面向开发和运维:开发侧关注怎么设计、怎么写代码、怎么避免错误;运维侧关注怎么监控、怎么定位、怎么恢复。
# 3.1. DDL
# 是什么
DDL 是 SQL 语言和优化器执行模型的一部分。SQL 是声明式语言,写法会影响优化器能否下推过滤、利用索引、减少排序和临时表。
# 开发人员怎么用
开发人员要写可优化的 SQL:字段类型匹配,避免在索引列上包函数,JOIN 条件完整,分页和排序有索引支撑。复杂 SQL 要先拆解数据流。
# 运维人员怎么看
运维人员要通过慢日志、执行计划、临时表指标、排序指标和 CPU/IO 观察 SQL 成本。报表查询应与在线交易隔离。
# 常见风险
常见风险是把所有计算塞进一条 SQL,测试数据没问题,生产数据一大就拖垮主库。
# 3.2. DML
# 是什么
DML 是 SQL 语言和优化器执行模型的一部分。SQL 是声明式语言,写法会影响优化器能否下推过滤、利用索引、减少排序和临时表。
# 开发人员怎么用
开发人员要写可优化的 SQL:字段类型匹配,避免在索引列上包函数,JOIN 条件完整,分页和排序有索引支撑。复杂 SQL 要先拆解数据流。
# 运维人员怎么看
运维人员要通过慢日志、执行计划、临时表指标、排序指标和 CPU/IO 观察 SQL 成本。报表查询应与在线交易隔离。
# 常见风险
常见风险是把所有计算塞进一条 SQL,测试数据没问题,生产数据一大就拖垮主库。
# 3.3. DQL
# 是什么
DQL 是 SQL 语言和优化器执行模型的一部分。SQL 是声明式语言,写法会影响优化器能否下推过滤、利用索引、减少排序和临时表。
# 开发人员怎么用
开发人员要写可优化的 SQL:字段类型匹配,避免在索引列上包函数,JOIN 条件完整,分页和排序有索引支撑。复杂 SQL 要先拆解数据流。
# 运维人员怎么看
运维人员要通过慢日志、执行计划、临时表指标、排序指标和 CPU/IO 观察 SQL 成本。报表查询应与在线交易隔离。
# 常见风险
常见风险是把所有计算塞进一条 SQL,测试数据没问题,生产数据一大就拖垮主库。
# 3.4. DCL
# 是什么
DCL 是 SQL 语言和优化器执行模型的一部分。SQL 是声明式语言,写法会影响优化器能否下推过滤、利用索引、减少排序和临时表。
# 开发人员怎么用
开发人员要写可优化的 SQL:字段类型匹配,避免在索引列上包函数,JOIN 条件完整,分页和排序有索引支撑。复杂 SQL 要先拆解数据流。
# 运维人员怎么看
运维人员要通过慢日志、执行计划、临时表指标、排序指标和 CPU/IO 观察 SQL 成本。报表查询应与在线交易隔离。
# 常见风险
常见风险是把所有计算塞进一条 SQL,测试数据没问题,生产数据一大就拖垮主库。
# 3.5. FROM
# 是什么
FROM 是 SQL 语言和优化器执行模型的一部分。SQL 是声明式语言,写法会影响优化器能否下推过滤、利用索引、减少排序和临时表。
# 开发人员怎么用
开发人员要写可优化的 SQL:字段类型匹配,避免在索引列上包函数,JOIN 条件完整,分页和排序有索引支撑。复杂 SQL 要先拆解数据流。
# 运维人员怎么看
运维人员要通过慢日志、执行计划、临时表指标、排序指标和 CPU/IO 观察 SQL 成本。报表查询应与在线交易隔离。
# 常见风险
常见风险是把所有计算塞进一条 SQL,测试数据没问题,生产数据一大就拖垮主库。
# 3.6. WHERE
# 是什么
WHERE 是 SQL 语言和优化器执行模型的一部分。SQL 是声明式语言,写法会影响优化器能否下推过滤、利用索引、减少排序和临时表。
# 开发人员怎么用
开发人员要写可优化的 SQL:字段类型匹配,避免在索引列上包函数,JOIN 条件完整,分页和排序有索引支撑。复杂 SQL 要先拆解数据流。
# 运维人员怎么看
运维人员要通过慢日志、执行计划、临时表指标、排序指标和 CPU/IO 观察 SQL 成本。报表查询应与在线交易隔离。
# 常见风险
常见风险是把所有计算塞进一条 SQL,测试数据没问题,生产数据一大就拖垮主库。
# 3.7. GROUP BY
# 是什么
GROUP BY 是 SQL 语言和优化器执行模型的一部分。SQL 是声明式语言,写法会影响优化器能否下推过滤、利用索引、减少排序和临时表。
# 开发人员怎么用
开发人员要写可优化的 SQL:字段类型匹配,避免在索引列上包函数,JOIN 条件完整,分页和排序有索引支撑。复杂 SQL 要先拆解数据流。
# 运维人员怎么看
运维人员要通过慢日志、执行计划、临时表指标、排序指标和 CPU/IO 观察 SQL 成本。报表查询应与在线交易隔离。
# 常见风险
常见风险是把所有计算塞进一条 SQL,测试数据没问题,生产数据一大就拖垮主库。
# 3.8. HAVING
# 是什么
HAVING 是 SQL 语言和优化器执行模型的一部分。SQL 是声明式语言,写法会影响优化器能否下推过滤、利用索引、减少排序和临时表。
# 开发人员怎么用
开发人员要写可优化的 SQL:字段类型匹配,避免在索引列上包函数,JOIN 条件完整,分页和排序有索引支撑。复杂 SQL 要先拆解数据流。
# 运维人员怎么看
运维人员要通过慢日志、执行计划、临时表指标、排序指标和 CPU/IO 观察 SQL 成本。报表查询应与在线交易隔离。
# 常见风险
常见风险是把所有计算塞进一条 SQL,测试数据没问题,生产数据一大就拖垮主库。
# 3.9. SELECT
# 是什么
SELECT 是 SQL 语言和优化器执行模型的一部分。SQL 是声明式语言,写法会影响优化器能否下推过滤、利用索引、减少排序和临时表。
# 开发人员怎么用
开发人员要写可优化的 SQL:字段类型匹配,避免在索引列上包函数,JOIN 条件完整,分页和排序有索引支撑。复杂 SQL 要先拆解数据流。
# 运维人员怎么看
运维人员要通过慢日志、执行计划、临时表指标、排序指标和 CPU/IO 观察 SQL 成本。报表查询应与在线交易隔离。
# 常见风险
常见风险是把所有计算塞进一条 SQL,测试数据没问题,生产数据一大就拖垮主库。
# 3.10. ORDER BY
# 是什么
ORDER BY 是 SQL 语言和优化器执行模型的一部分。SQL 是声明式语言,写法会影响优化器能否下推过滤、利用索引、减少排序和临时表。
# 开发人员怎么用
开发人员要写可优化的 SQL:字段类型匹配,避免在索引列上包函数,JOIN 条件完整,分页和排序有索引支撑。复杂 SQL 要先拆解数据流。
# 运维人员怎么看
运维人员要通过慢日志、执行计划、临时表指标、排序指标和 CPU/IO 观察 SQL 成本。报表查询应与在线交易隔离。
# 常见风险
常见风险是把所有计算塞进一条 SQL,测试数据没问题,生产数据一大就拖垮主库。
# 3.11. LIMIT
# 是什么
LIMIT 是 SQL 语言和优化器执行模型的一部分。SQL 是声明式语言,写法会影响优化器能否下推过滤、利用索引、减少排序和临时表。
# 开发人员怎么用
开发人员要写可优化的 SQL:字段类型匹配,避免在索引列上包函数,JOIN 条件完整,分页和排序有索引支撑。复杂 SQL 要先拆解数据流。
# 运维人员怎么看
运维人员要通过慢日志、执行计划、临时表指标、排序指标和 CPU/IO 观察 SQL 成本。报表查询应与在线交易隔离。
# 常见风险
常见风险是把所有计算塞进一条 SQL,测试数据没问题,生产数据一大就拖垮主库。
# 3.12. 本篇学习实验
建议准备一个至少百万行级别的测试表,分别观察正常查询、缺失索引、错误索引、长事务、锁等待和慢查询日志。每次实验都记录 SQL、执行计划、耗时、扫描行数和 MySQL 状态变量变化。
开发侧实验重点是理解 SQL 与事务边界,运维侧实验重点是理解指标如何变化。真正掌握本篇内容,应该能从现象反推 SQL、索引、锁、日志或存储引擎问题。
# 4. 核心机制
- SQL 逻辑执行顺序通常从
FROM/JOIN开始,再经过WHERE过滤、GROUP BY分组、HAVING过滤聚合结果、SELECT投影、ORDER BY排序和LIMIT截断。 - 物理执行顺序由优化器决定,可能通过索引下推、覆盖索引、半连接、派生表合并等方式改变真实访问路径。
- JOIN 本质是在多张表之间寻找匹配关系,错误的连接条件会造成结果膨胀或笛卡尔积。
- 聚合与排序通常需要额外内存或临时表,大数据量场景必须考虑索引顺序和结果集大小。
# 5. 工程实践
- 写查询前先明确结果粒度,是一行一个订单、一行一个用户,还是一行一个统计分组。
- 所有 JOIN 都写完整连接条件,避免隐式笛卡尔积。
- 分页查询避免深分页,优先使用基于游标或主键范围的翻页方式。
- 复杂 SQL 先拆出中间结果验证,再合并优化。
# 6. 常见坑
WHERE中对索引列做函数计算,导致索引失效。- 误以为
SELECT别名可以在同级WHERE里使用。 - 把业务排序完全丢给数据库,且没有合适索引支撑。
- 在大表上使用
SELECT *,放大网络、内存和回表成本。
# 7. 专家视角
- 专家写 SQL 会先画出数据流,再考虑索引路径,而不是先堆语法。
- 复杂报表 SQL 要区分在线交易查询和离线分析查询,不要让 OLAP 压垮 OLTP。
- 执行顺序只是理解模型,最终仍要以
EXPLAIN和运行时指标为准。
# 8. Tips 快问快答
Q:SQL 的逻辑顺序等于真实执行顺序吗?
A:不等于。逻辑顺序帮助理解结果,真实顺序由优化器和执行计划决定。
Q:为什么不推荐 SELECT *?
A:它会增加 IO、网络、回表和对象映射成本,也让字段变更更容易影响调用方。
Q:深分页为什么慢?
A:数据库需要跳过大量记录后再返回少量结果,扫描和排序成本会不断增加。
# 9. 阶段小结
SQL基础与执行顺序 的学习重点不是记住零散概念,而是把它放回真实系统:数据如何进入、如何存储、如何被查询、如何在并发下保持正确、如何在故障后恢复。掌握这些连接关系,才能从“会用”走向“能设计、能优化、能排障”。