来源书籍
数据库原理(微课版) (郭玉彬,宋歌,边山)
数据库/存储引擎类
类别清单覆盖
6/7
全书概览
数据库原理(微课版) (郭玉彬,宋歌,边山)
Skill 版本:v7
类别:数据库/存储引擎类
四象限结论:经典原理(高信息浓度 + 高稳定性)
理由:全书13章、4篇结构,主体内容围绕数据库系统长期稳定的核心原理展开,而非某个 具体产品的操作手册。抽样精读第2章、第9章、第11章后确认:第2章用域、笛卡儿积、关系、 码等形式化定义建立关系模型基础,给出严格的数学定义(如域的基数、笛卡儿积的集合论 定义);第9章讲B树/B+树的节点分裂规则、查询时间复杂度O(log_M N)的推导、哈希索引的 四种哈希函数设计方法,属于讲透”为什么这样设计能提升效率”的经典结构化知识,不随具体 数据库产品变化;第11章用银行转账的具体事务序列讲解基于日志的恢复技术(先写日志、 undo/redo操作的幂等性、检查点机制),并系统讲解冲突可串行化判定、锁粒度、MVCC等 并发控制方法,是关系数据库理论里最经得起时间检验的部分之一。第7章的函数依赖公理 体系、范式推导、无损分解算法同样是纯数学性质的经典理论。
稳定性方面,全书确实穿插了不少随产品版本变化的内容:第3章SQL语法、第5章MySQL用户 权限管理命令、第8章存储过程/触发器/JDBC语法、第12-13章大数据关键技术罗列和云数据库/ AI数据库等前沿技术趋势,这些内容的浓度或稳定性明显低于第1-2、4、6-7、9-11章的核心 原理部分。因此全书整体评为”经典原理”,但阶段三对操作性强的章节(尤其第3、5、8、12、 13章)会按浓度收紧卡片密度,只对其中真正展开论证的概念(如触发器原理、ODBC/JDBC 连接原理、NoSQL数据模型分类)生卡,过滤纯命令罗列和版本特定的操作步骤。
类别说明:本书以系统讲解关系数据库内部原理(存储引擎、索引结构、查询优化器、 事务与并发控制、恢复机制)为主要目标,并非围绕某个具体开源项目源码展开,明确命中 “数据库/存储引擎类”(判定标准:”以讲解数据库/存储系统内部原理为主要目标的书籍”)。 该类别的必答清单七个维度(存储结构与索引、事务与隔离级别、复制与分片、查询优化器、 故障恢复、并发控制、存储计算工程权衡)在本书中预期覆盖度会显著高于此前处理的《向量 数据库》一书——第9-11章正好是传统关系数据库在这些维度上的经典讲解,可以与向量数据库 那本书形成互补的跨书参照。
章节筛选
| 章节号 | 章节标题 | 精读/略读 | 状态 | 卡片数 |
|---|---|---|---|---|
| 01 | 绪论 | 精读:数据管理三阶段演进、三级模式与二级映像、数据模型分类,是理解数据库系统边界的基础概念 | done | 6 |
| 02 | 关系数据库 | 精读:关系模型形式化定义(域、笛卡儿积、关系、码)、关系完整性、关系代数运算,是全书理论底座 | done | 6 |
| 03 | 结构化查询语言 | 略读:主要是SQL数据定义、查询、更新、视图的语法罗列,操作性强,无实质原理论证 | done | 0 |
| 04 | 数据库完整性 | 精读:实体完整性、参照完整性、CHECK约束等语义约束机制,是数据库正确性的核心保证 | done | 4 |
| 05 | 数据库安全与保护 | 精读:基于角色的权限管理机制、故障分类(事务/系统/介质故障)、数据库转储与恢复策略是概念性内容,MySQL具体用户管理命令按浓度过滤 | done | 8 |
| 06 | 数据库设计 | 精读:设计方法分类、E-R模型与数据抽象(分类/聚集/概括)、逻辑与物理结构设计方法论 | done | 7 |
| 07 | 关系数据库规范化理论 | 精读:函数依赖、范式体系、阿姆斯特朗公理、无损分解算法,纯数学性质的经典理论 | done | 7 |
| 08 | 数据库编程 | 精读:触发器原理、嵌入式SQL/ODBC/JDBC连接原理是概念性内容,具体SQL控制语句语法和存储过程/触发器创建命令按浓度过滤 | done | 4 |
| 09 | 数据库存储与索引 | 精读:存储引擎模块划分、B树/B+树索引原理与复杂度、哈希索引与哈希函数设计、位图/R树/倒排索引,高浓度经典内容 | done | 8 |
| 10 | 查询处理与优化 | 精读:查询处理四阶段、选择与连接算法(嵌套循环/哈希连接/归并连接)、代数优化规则、基于代价的优化,高浓度经典内容 | done | 8 |
| 11 | 事务处理技术 | 精读:ACID特性、可串行化调度、并发控制(锁/时间戳/MVCC)、隔离级别、基于日志的恢复技术,核心经典理论 | done | 12 |
| 12 | 大数据管理技术 | 精读:大数据4V特征等有实质定义的概念需生卡,发展趋势罗列(区块链/AI/边缘计算标签)按浓度过滤 | done | 5 |
| 13 | 数据库前沿技术 | 精读:云原生数据库概念、NoSQL四种数据模型分类、AI原生数据库特性有一定概念性质,具体产品/趋势介绍按浓度过滤 | done | 5 |
实践卡进度
| 序号 | 实践标题 | 实践方式 | 状态 | 关联章节 | 产出 |
|---|---|---|---|---|---|
| 1 | cardbox的SQLite索引/触发器/约束设计对照教材理论 | 实现深读 | done | 第4、8、9章 | cardbox schema.sql对照笔记,发现无显式事务包装的潜在风险点 |
| 2 | SQLite的WAL模式验证教材”日志+检查点”理论 | 证据验证 | done | 第11章 | SQLite官方文档核验结论(WAL机制与教材理论一致,补充1000页自动检查点阈值等细节) |
| 3 | SQLite的B树实现验证教材B树结构理论 | 证据验证 | done | 第9章 | SQLite官方文档核验结论(表B树/索引B树区分对应教材”叶子存数据/存指针”两种情况) |
待关联术语
| 术语名 | 出现章节 | 一句话语境 |
|---|---|---|
| ARIES恢复算法 | 11 | IBM于1992年提出的基于后备副本和日志的恢复管理算法,书中仅提及其目标和背景,未展开具体机制 |
| 容灾备份同步技术 | 11 | 主站点与备份站点通过网络相连、备份同步技术实现两者数据一致,主站点故障时备份站点自动升级,书中未展开具体同步协议(同步/异步复制、冲突解决等) |
引用文献
| 标题 | 类型 | 出现章节 | 一句话语境 |
|---|
资金安全问题案例
| 问题标题 | 问题卡 | 解决方案卡(如有) | 出现章节 | 一句话说明 |
|---|---|---|---|---|
| 并发转账取款导致余额丢失修改 | 并发转账取款同时读旧值导致丢失修改 | (无,书中未给出针对此案例的专门解法) | 11 | 两个事务同时读到同一旧余额、各自独立写入,后写覆盖先写,导致账户实际转出金额与记录余额不符 |
类别清单核对(数据库/存储引擎类)
| 维度 | 覆盖状态 | 关联卡片标题或未覆盖理由 |
|---|---|---|
| 存储结构与索引原理 | 已覆盖 | 全书核心内容,第9章覆盖B树/B+树/哈希索引/位图索引/R树索引/倒排索引,第6章覆盖存取方法选型:[[B树索引的节点结构与查询效率]]、[[B+树相比B树的改进:叶子链表支持顺序扫描]]、[[哈希索引的冲突消解策略与负载因子权衡]]、[[位图索引/R树索引/倒排索引的适用场景对比]]、[[三种存取方法的选型依据:B+树/哈希索引与聚簇]] |
| 事务与隔离级别 | 已覆盖 | 第11章系统讲解:[[事务ACID四特性的分工:一致性由应用保证,其余三个由DBMS保证]]、[[事务隔离级别四级体系与四种异常现象]] |
| 复制与分片策略 | 未覆盖 | 全书未讨论数据分片(水平/垂直分区路由)或主从复制协议;仅在第11章故障恢复策略中简略提及”容灾备份”(主备站点通过网络同步),未展开同步协议、冲突解决等复制细节,已记入”待关联术语” |
| 查询优化器原理 | 已覆盖 | 第10章系统讲解查询处理四阶段、代数优化规则、基于规则/代价的物理优化、多表连接优化算法:[[查询处理四阶段流水线:解析/重写/优化/执行]]、[[代数优化五条实践原则]]、[[基于规则与基于代价优化的选择率决策逻辑]]、[[多表连接优化的组合爆炸与两种应对算法]] |
| 故障恢复机制 | 已覆盖 | 第11章系统讲解基于日志的恢复、检查点机制,第5章覆盖转储策略:[[基于日志的恢复:先写日志原则与undo/redo操作]]、[[检查点机制降低恢复扫描范围]]、[[转储范围与转储状态的两组独立权衡]] |
| 并发控制机制 | 已覆盖 | 第11章系统讲解锁机制、两阶段锁协议、锁粒度与意向锁、时间戳、MVCC、乐观并发控制:[[两阶段锁协议保证可串行化的机制]]、[[锁粒度的并发度开销权衡与意向锁机制]]、[[基于时间戳的并发控制规则与活锁风险]]、[[多版本并发控制(MVCC)的版本序列机制]]、[[基于验证的乐观并发控制:先执行后验证]] |
| 存储与计算的工程权衡 | 已覆盖 | 第9章覆盖存储引擎模块划分与聚簇索引维护代价权衡,第6章覆盖数据存放位置/系统配置权衡:[[存储引擎的四模块分工]]、[[聚簇索引与索引类型体系:为什么每张表最多一个聚簇索引]] |
核对说明:本书作为系统讲解关系数据库内部原理的教材,7个维度中6个都有实质性、系统性的讲解,仅”复制与分片策略”这一偏分布式系统的维度覆盖不足——这与本书聚焦单机关系数据库原理(存储引擎、索引、查询优化、事务并发控制)的定位一致,分布式复制/分片属于另一个专门方向(如分布式数据库原理),不在本书讨论范围内,是合理的覆盖缺口而非遗漏。这一覆盖情况恰好与此前处理的《向量数据库》一书形成互补:那本书在”存储结构”“事务/并发控制/故障恢复”等传统关系数据库维度上覆盖不足,本书则在这些维度上做了系统、深入的讲解,两本书合起来能提供更完整的数据库知识图谱。
章节与卡片
01 绪论
- 数据管理三阶段演进及各阶段暴露的具体问题 结构图卡
- 数据库三级模式结构与二级映像如何实现独立性 结构图卡
- 数据模型的三层抽象与结构化模型的表达能力权衡 普通读书笔记卡
- 数据库应用系统从二层到三层架构演进及C/S与B/S的区别 普通读书笔记卡
- 关系数据库与NoSQL三代技术演进各自要解决的问题 普通读书笔记卡
- XML/RDF/图模型三种半结构化数据模型的结构差异 普通读书笔记卡
02 关系数据库
- 域到关系的四层形式化定义链条 结构图卡
- 超码候选码主码的层层收窄逻辑 普通读书笔记卡
- 实体完整性/参照完整性/用户自定义完整性三层约束体系 结构图卡
- 集合运算与专门关系运算的分工 结构图卡
- 自然连接与三种外连接对悬浮元组的处理差异 普通读书笔记卡
- 关系代数/元组演算/域演算的等价性与SQL为何成为主流实现 普通读书笔记卡
04 数据库完整性
- 完整性约束的三种分类维度:对象/范围/状态 普通读书笔记卡
- 参照完整性违反时的五种处理策略及连锁影响 结构图卡
- UNIQUE约束与主码约束是候选码概念的两种落地方式 普通读书笔记卡
- 域约束通过集中定义换取约束修改的可维护性 普通读书笔记卡
05 数据库安全与保护
- 外部威胁与内部泄露的风险分类及应对手段 普通读书笔记卡
- 计算机信息系统安全保护五级递增体系 普通读书笔记卡
- RBAC的角色分类与权限继承的两条规则 普通读书笔记卡
- 分层权限检查:从全局到局部逐层匹配 结构图卡
- 加密层次与加密粒度的双重权衡 结构图卡
- 三类故障的性质差异及对应恢复策略指向 结构图卡
- 转储范围与转储状态的两组独立权衡 普通读书笔记卡
- 用户级审计与系统级审计的覆盖范围差异 普通读书笔记卡
06 数据库设计
- 数据库设计五阶段流程及与软件开发过程的同步关系 结构图卡
- 数据抽象的三种基本方法:分类/聚集/概括 普通读书笔记卡
- E-R模型的三要素与二元联系的三种基数类型 结构图卡
- E-R图集成时的三类冲突:属性/命名/结构冲突 普通读书笔记卡
- E-R模型向关系模型转换的映射规则 结构图卡
- 三种存取方法的选型依据:B+树/哈希索引与聚簇 结构图卡
- 数据库重组与重构的边界区别 普通读书笔记卡
07 关系数据库规范化理论
- 数据冗余引发的插入删除异常与更新不一致 普通读书笔记卡
- 函数依赖的三种子类型:部分/完全/传递函数依赖 普通读书笔记卡
- 范式体系1NF-BCNF的层层递进标准及各自消除的冗余类型 结构图卡
- 阿姆斯特朗公理体系与属性闭包算法:机械化验证函数依赖的两层工具 普通读书笔记卡
- 无损分解与保持函数依赖是分解质量的两个独立维度 结构图卡
- 多值依赖与4NF:函数依赖之外的第二种冗余来源 普通读书笔记卡
- 反规范化设计的四种手法及效率与维护成本的权衡 结构图卡
08 数据库编程
- 存储过程/存储函数相比应用层处理的四项优势 普通读书笔记卡
- 触发器的三要素结构与NEW/OLD表机制 结构图卡
- 嵌入式SQL需要解决的四类技术问题及预编译机制 普通读书笔记卡
- 数据库访问方式的三级抽象演进:嵌入式SQL到ODBC/JDBC到持久层框架 结构图卡
09 数据库存储与索引
- 表空间的多层逻辑存储结构解决逻辑无限与物理有限的映射问题 结构图卡
- 三种表组织方式的取舍:堆存储/顺序存储/索引存储 普通读书笔记卡
- 存储引擎的四模块分工 结构图卡
- 聚簇索引与索引类型体系:为什么每张表最多一个聚簇索引 普通读书笔记卡
- B树索引的节点结构与查询效率 结构图卡
- B+树相比B树的改进:叶子链表支持顺序扫描 普通读书笔记卡
- 哈希索引的冲突消解策略与负载因子权衡 结构图卡
- 位图索引/R树索引/倒排索引的适用场景对比 结构图卡
10 查询处理与优化
- 查询处理四阶段流水线:解析/重写/优化/执行 结构图卡
- 选择运算五种实现算法的代价梯度 结构图卡
- 连接运算三大类算法的适用条件 结构图卡
- 迭代模型的流水线拉取执行机制 普通读书笔记卡
- 代数优化的实证价值:操作顺序差十万倍代价 普通读书笔记卡
- 代数优化五条实践原则 结构图卡
- 基于规则与基于代价优化的选择率决策逻辑 普通读书笔记卡
- 多表连接优化的组合爆炸与两种应对算法 结构图卡
11 事务处理技术
- 事务ACID四特性的分工:一致性由应用保证,其余三个由DBMS保证 普通读书笔记卡
- 冲突可串行化的判定:前趋图有向无环 结构图卡
- 两阶段锁协议保证可串行化的机制 普通读书笔记卡
- 锁粒度的并发度开销权衡与意向锁机制 结构图卡
- 活锁与死锁的区别及应对策略 普通读书笔记卡
- 基于时间戳的并发控制规则与活锁风险 普通读书笔记卡
- 多版本并发控制(MVCC)的版本序列机制 普通读书笔记卡
- 基于验证的乐观并发控制:先执行后验证 普通读书笔记卡
- 事务隔离级别四级体系与四种异常现象 结构图卡
- 基于日志的恢复:先写日志原则与undo/redo操作 结构图卡
- 检查点机制降低恢复扫描范围 普通读书笔记卡
- 并发转账取款同时读旧值导致丢失修改 支付系统案例卡
12 大数据管理技术
- 大数据的4V特征及与传统数据的差异 结构图卡
- 数据预处理四步流程解决"脏数据无法直接挖掘"的问题 结构图卡
- NoSQL数据库的四种存储模型 普通读书笔记卡
- 数据挖掘与知识发现的层级关系 普通读书笔记卡
- 数据挖掘算法按任务类型的分类谱系 普通读书笔记卡
13 数据库前沿技术
- 云数据库与云原生数据库的概念区分 普通读书笔记卡
- CAP理论与NoSQL的一致性权衡逻辑 结构图卡
- 强一致性/弱一致性/最终一致性的层级及BASE原则 普通读书笔记卡
- NoSQL四种数据模型的复杂度递增谱系 结构图卡
- AI赋能数据库的共同逻辑:从经验规则到机器学习驱动 普通读书笔记卡
相关主题
暂无公开主题。