来源书籍

数据库原理(微课版) (郭玉彬,宋歌,边山)

数据库/存储引擎类

经典原理(高信息浓度 + 高稳定性)

全书13章、4篇结构,主体内容围绕数据库系统长期稳定的核心原理展开,而非某个 具体产品的操作手册。抽样精读第2章、第9章、第11章后确认:第2章用域、笛卡儿积、关系、 码等形式化定义建立关系模型基础,给出严格的数学定义(如域的基数、笛卡儿积的集合论 定义);第9章讲B树/B+树的节点分裂规则、查询时间复杂度O(log_M N)的推导、哈希索引的 四种哈希函数设计方法,属于讲透"为什么这样设计能提升效率"的经典结构化知识,不随具体 数据库产品变化;第11章用银行转账的具体事务序列讲解基于日志的恢复技术(先写日志、 undo/redo操作的幂等性、检查点机制),并系统讲解冲突可串行化判定、锁粒度、MVCC等 并发控制方法,是关系数据库理论里最经得起时间检验的部分之一。第7章的函数依赖公理 体系、范式推导、无损分解算法同样是纯数学性质的经典理论。 稳定性方面,全书确实穿插了不少随产品版本变化的内容:第3章SQL语法、第5章MySQL用户 权限管理命令、第8章存储过程/触发器/JDBC语法、第12-13章大数据关键技术罗列和云数据库/ AI数据库等前沿技术趋势,这些内容的浓度或稳定性明显低于第1-2、4、6-7、9-11章的核心 原理部分。因此全书整体评为"经典原理",但阶段三对操作性强的章节(尤其第3、5、8、12、 13章)会按浓度收紧卡片密度,只对其中真正展开论证的概念(如触发器原理、ODBC/JDBC 连接原理、NoSQL数据模型分类)生卡,过滤纯命令罗列和版本特定的操作步骤。 **类别说明**:本书以系统讲解关系数据库内部原理(存储引擎、索引结构、查询优化器、 事务与并发控制、恢复机制)为主要目标,并非围绕某个具体开源项目源码展开,明确命中 "数据库/存储引擎类"(判定标准:"以讲解数据库/存储系统内部原理为主要目标的书籍")。 该类别的必答清单七个维度(存储结构与索引、事务与隔离级别、复制与分片、查询优化器、 故障恢复、并发控制、存储计算工程权衡)在本书中预期覆盖度会显著高于此前处理的《向量 数据库》一书——第9-11章正好是传统关系数据库在这些维度上的经典讲解,可以与向量数据库 那本书形成互补的跨书参照。

类别清单覆盖

6/7

已覆盖 6 补充生成 0 未覆盖 1

全书概览

数据库原理(微课版) (郭玉彬,宋歌,边山)

Skill 版本:v7

类别:数据库/存储引擎类

四象限结论:经典原理(高信息浓度 + 高稳定性)

理由:全书13章、4篇结构,主体内容围绕数据库系统长期稳定的核心原理展开,而非某个 具体产品的操作手册。抽样精读第2章、第9章、第11章后确认:第2章用域、笛卡儿积、关系、 码等形式化定义建立关系模型基础,给出严格的数学定义(如域的基数、笛卡儿积的集合论 定义);第9章讲B树/B+树的节点分裂规则、查询时间复杂度O(log_M N)的推导、哈希索引的 四种哈希函数设计方法,属于讲透”为什么这样设计能提升效率”的经典结构化知识,不随具体 数据库产品变化;第11章用银行转账的具体事务序列讲解基于日志的恢复技术(先写日志、 undo/redo操作的幂等性、检查点机制),并系统讲解冲突可串行化判定、锁粒度、MVCC等 并发控制方法,是关系数据库理论里最经得起时间检验的部分之一。第7章的函数依赖公理 体系、范式推导、无损分解算法同样是纯数学性质的经典理论。

稳定性方面,全书确实穿插了不少随产品版本变化的内容:第3章SQL语法、第5章MySQL用户 权限管理命令、第8章存储过程/触发器/JDBC语法、第12-13章大数据关键技术罗列和云数据库/ AI数据库等前沿技术趋势,这些内容的浓度或稳定性明显低于第1-2、4、6-7、9-11章的核心 原理部分。因此全书整体评为”经典原理”,但阶段三对操作性强的章节(尤其第3、5、8、12、 13章)会按浓度收紧卡片密度,只对其中真正展开论证的概念(如触发器原理、ODBC/JDBC 连接原理、NoSQL数据模型分类)生卡,过滤纯命令罗列和版本特定的操作步骤。

类别说明:本书以系统讲解关系数据库内部原理(存储引擎、索引结构、查询优化器、 事务与并发控制、恢复机制)为主要目标,并非围绕某个具体开源项目源码展开,明确命中 “数据库/存储引擎类”(判定标准:”以讲解数据库/存储系统内部原理为主要目标的书籍”)。 该类别的必答清单七个维度(存储结构与索引、事务与隔离级别、复制与分片、查询优化器、 故障恢复、并发控制、存储计算工程权衡)在本书中预期覆盖度会显著高于此前处理的《向量 数据库》一书——第9-11章正好是传统关系数据库在这些维度上的经典讲解,可以与向量数据库 那本书形成互补的跨书参照。

章节筛选

章节号 章节标题 精读/略读 状态 卡片数
01 绪论 精读:数据管理三阶段演进、三级模式与二级映像、数据模型分类,是理解数据库系统边界的基础概念 done 6
02 关系数据库 精读:关系模型形式化定义(域、笛卡儿积、关系、码)、关系完整性、关系代数运算,是全书理论底座 done 6
03 结构化查询语言 略读:主要是SQL数据定义、查询、更新、视图的语法罗列,操作性强,无实质原理论证 done 0
04 数据库完整性 精读:实体完整性、参照完整性、CHECK约束等语义约束机制,是数据库正确性的核心保证 done 4
05 数据库安全与保护 精读:基于角色的权限管理机制、故障分类(事务/系统/介质故障)、数据库转储与恢复策略是概念性内容,MySQL具体用户管理命令按浓度过滤 done 8
06 数据库设计 精读:设计方法分类、E-R模型与数据抽象(分类/聚集/概括)、逻辑与物理结构设计方法论 done 7
07 关系数据库规范化理论 精读:函数依赖、范式体系、阿姆斯特朗公理、无损分解算法,纯数学性质的经典理论 done 7
08 数据库编程 精读:触发器原理、嵌入式SQL/ODBC/JDBC连接原理是概念性内容,具体SQL控制语句语法和存储过程/触发器创建命令按浓度过滤 done 4
09 数据库存储与索引 精读:存储引擎模块划分、B树/B+树索引原理与复杂度、哈希索引与哈希函数设计、位图/R树/倒排索引,高浓度经典内容 done 8
10 查询处理与优化 精读:查询处理四阶段、选择与连接算法(嵌套循环/哈希连接/归并连接)、代数优化规则、基于代价的优化,高浓度经典内容 done 8
11 事务处理技术 精读:ACID特性、可串行化调度、并发控制(锁/时间戳/MVCC)、隔离级别、基于日志的恢复技术,核心经典理论 done 12
12 大数据管理技术 精读:大数据4V特征等有实质定义的概念需生卡,发展趋势罗列(区块链/AI/边缘计算标签)按浓度过滤 done 5
13 数据库前沿技术 精读:云原生数据库概念、NoSQL四种数据模型分类、AI原生数据库特性有一定概念性质,具体产品/趋势介绍按浓度过滤 done 5

实践卡进度

序号 实践标题 实践方式 状态 关联章节 产出
1 cardbox的SQLite索引/触发器/约束设计对照教材理论 实现深读 done 第4、8、9章 cardbox schema.sql对照笔记,发现无显式事务包装的潜在风险点
2 SQLite的WAL模式验证教材”日志+检查点”理论 证据验证 done 第11章 SQLite官方文档核验结论(WAL机制与教材理论一致,补充1000页自动检查点阈值等细节)
3 SQLite的B树实现验证教材B树结构理论 证据验证 done 第9章 SQLite官方文档核验结论(表B树/索引B树区分对应教材”叶子存数据/存指针”两种情况)

待关联术语

术语名 出现章节 一句话语境
ARIES恢复算法 11 IBM于1992年提出的基于后备副本和日志的恢复管理算法,书中仅提及其目标和背景,未展开具体机制
容灾备份同步技术 11 主站点与备份站点通过网络相连、备份同步技术实现两者数据一致,主站点故障时备份站点自动升级,书中未展开具体同步协议(同步/异步复制、冲突解决等)

引用文献

标题 类型 出现章节 一句话语境

资金安全问题案例

问题标题 问题卡 解决方案卡(如有) 出现章节 一句话说明
并发转账取款导致余额丢失修改 并发转账取款同时读旧值导致丢失修改 (无,书中未给出针对此案例的专门解法) 11 两个事务同时读到同一旧余额、各自独立写入,后写覆盖先写,导致账户实际转出金额与记录余额不符

类别清单核对(数据库/存储引擎类)

维度 覆盖状态 关联卡片标题或未覆盖理由
存储结构与索引原理 已覆盖 全书核心内容,第9章覆盖B树/B+树/哈希索引/位图索引/R树索引/倒排索引,第6章覆盖存取方法选型:[[B树索引的节点结构与查询效率]]、[[B+树相比B树的改进:叶子链表支持顺序扫描]]、[[哈希索引的冲突消解策略与负载因子权衡]]、[[位图索引/R树索引/倒排索引的适用场景对比]]、[[三种存取方法的选型依据:B+树/哈希索引与聚簇]]
事务与隔离级别 已覆盖 第11章系统讲解:[[事务ACID四特性的分工:一致性由应用保证,其余三个由DBMS保证]]、[[事务隔离级别四级体系与四种异常现象]]
复制与分片策略 未覆盖 全书未讨论数据分片(水平/垂直分区路由)或主从复制协议;仅在第11章故障恢复策略中简略提及”容灾备份”(主备站点通过网络同步),未展开同步协议、冲突解决等复制细节,已记入”待关联术语”
查询优化器原理 已覆盖 第10章系统讲解查询处理四阶段、代数优化规则、基于规则/代价的物理优化、多表连接优化算法:[[查询处理四阶段流水线:解析/重写/优化/执行]]、[[代数优化五条实践原则]]、[[基于规则与基于代价优化的选择率决策逻辑]]、[[多表连接优化的组合爆炸与两种应对算法]]
故障恢复机制 已覆盖 第11章系统讲解基于日志的恢复、检查点机制,第5章覆盖转储策略:[[基于日志的恢复:先写日志原则与undo/redo操作]]、[[检查点机制降低恢复扫描范围]]、[[转储范围与转储状态的两组独立权衡]]
并发控制机制 已覆盖 第11章系统讲解锁机制、两阶段锁协议、锁粒度与意向锁、时间戳、MVCC、乐观并发控制:[[两阶段锁协议保证可串行化的机制]]、[[锁粒度的并发度开销权衡与意向锁机制]]、[[基于时间戳的并发控制规则与活锁风险]]、[[多版本并发控制(MVCC)的版本序列机制]]、[[基于验证的乐观并发控制:先执行后验证]]
存储与计算的工程权衡 已覆盖 第9章覆盖存储引擎模块划分与聚簇索引维护代价权衡,第6章覆盖数据存放位置/系统配置权衡:[[存储引擎的四模块分工]]、[[聚簇索引与索引类型体系:为什么每张表最多一个聚簇索引]]

核对说明:本书作为系统讲解关系数据库内部原理的教材,7个维度中6个都有实质性、系统性的讲解,仅”复制与分片策略”这一偏分布式系统的维度覆盖不足——这与本书聚焦单机关系数据库原理(存储引擎、索引、查询优化、事务并发控制)的定位一致,分布式复制/分片属于另一个专门方向(如分布式数据库原理),不在本书讨论范围内,是合理的覆盖缺口而非遗漏。这一覆盖情况恰好与此前处理的《向量数据库》一书形成互补:那本书在”存储结构”“事务/并发控制/故障恢复”等传统关系数据库维度上覆盖不足,本书则在这些维度上做了系统、深入的讲解,两本书合起来能提供更完整的数据库知识图谱。

章节与卡片

01 绪论

  1. 数据管理三阶段演进及各阶段暴露的具体问题 结构图卡
  2. 数据库三级模式结构与二级映像如何实现独立性 结构图卡
  3. 数据模型的三层抽象与结构化模型的表达能力权衡 普通读书笔记卡
  4. 数据库应用系统从二层到三层架构演进及C/S与B/S的区别 普通读书笔记卡
  5. 关系数据库与NoSQL三代技术演进各自要解决的问题 普通读书笔记卡
  6. XML/RDF/图模型三种半结构化数据模型的结构差异 普通读书笔记卡

02 关系数据库

  1. 域到关系的四层形式化定义链条 结构图卡
  2. 超码候选码主码的层层收窄逻辑 普通读书笔记卡
  3. 实体完整性/参照完整性/用户自定义完整性三层约束体系 结构图卡
  4. 集合运算与专门关系运算的分工 结构图卡
  5. 自然连接与三种外连接对悬浮元组的处理差异 普通读书笔记卡
  6. 关系代数/元组演算/域演算的等价性与SQL为何成为主流实现 普通读书笔记卡

04 数据库完整性

  1. 完整性约束的三种分类维度:对象/范围/状态 普通读书笔记卡
  2. 参照完整性违反时的五种处理策略及连锁影响 结构图卡
  3. UNIQUE约束与主码约束是候选码概念的两种落地方式 普通读书笔记卡
  4. 域约束通过集中定义换取约束修改的可维护性 普通读书笔记卡

05 数据库安全与保护

  1. 外部威胁与内部泄露的风险分类及应对手段 普通读书笔记卡
  2. 计算机信息系统安全保护五级递增体系 普通读书笔记卡
  3. RBAC的角色分类与权限继承的两条规则 普通读书笔记卡
  4. 分层权限检查:从全局到局部逐层匹配 结构图卡
  5. 加密层次与加密粒度的双重权衡 结构图卡
  6. 三类故障的性质差异及对应恢复策略指向 结构图卡
  7. 转储范围与转储状态的两组独立权衡 普通读书笔记卡
  8. 用户级审计与系统级审计的覆盖范围差异 普通读书笔记卡

06 数据库设计

  1. 数据库设计五阶段流程及与软件开发过程的同步关系 结构图卡
  2. 数据抽象的三种基本方法:分类/聚集/概括 普通读书笔记卡
  3. E-R模型的三要素与二元联系的三种基数类型 结构图卡
  4. E-R图集成时的三类冲突:属性/命名/结构冲突 普通读书笔记卡
  5. E-R模型向关系模型转换的映射规则 结构图卡
  6. 三种存取方法的选型依据:B+树/哈希索引与聚簇 结构图卡
  7. 数据库重组与重构的边界区别 普通读书笔记卡

07 关系数据库规范化理论

  1. 数据冗余引发的插入删除异常与更新不一致 普通读书笔记卡
  2. 函数依赖的三种子类型:部分/完全/传递函数依赖 普通读书笔记卡
  3. 范式体系1NF-BCNF的层层递进标准及各自消除的冗余类型 结构图卡
  4. 阿姆斯特朗公理体系与属性闭包算法:机械化验证函数依赖的两层工具 普通读书笔记卡
  5. 无损分解与保持函数依赖是分解质量的两个独立维度 结构图卡
  6. 多值依赖与4NF:函数依赖之外的第二种冗余来源 普通读书笔记卡
  7. 反规范化设计的四种手法及效率与维护成本的权衡 结构图卡

08 数据库编程

  1. 存储过程/存储函数相比应用层处理的四项优势 普通读书笔记卡
  2. 触发器的三要素结构与NEW/OLD表机制 结构图卡
  3. 嵌入式SQL需要解决的四类技术问题及预编译机制 普通读书笔记卡
  4. 数据库访问方式的三级抽象演进:嵌入式SQL到ODBC/JDBC到持久层框架 结构图卡

09 数据库存储与索引

  1. 表空间的多层逻辑存储结构解决逻辑无限与物理有限的映射问题 结构图卡
  2. 三种表组织方式的取舍:堆存储/顺序存储/索引存储 普通读书笔记卡
  3. 存储引擎的四模块分工 结构图卡
  4. 聚簇索引与索引类型体系:为什么每张表最多一个聚簇索引 普通读书笔记卡
  5. B树索引的节点结构与查询效率 结构图卡
  6. B+树相比B树的改进:叶子链表支持顺序扫描 普通读书笔记卡
  7. 哈希索引的冲突消解策略与负载因子权衡 结构图卡
  8. 位图索引/R树索引/倒排索引的适用场景对比 结构图卡

10 查询处理与优化

  1. 查询处理四阶段流水线:解析/重写/优化/执行 结构图卡
  2. 选择运算五种实现算法的代价梯度 结构图卡
  3. 连接运算三大类算法的适用条件 结构图卡
  4. 迭代模型的流水线拉取执行机制 普通读书笔记卡
  5. 代数优化的实证价值:操作顺序差十万倍代价 普通读书笔记卡
  6. 代数优化五条实践原则 结构图卡
  7. 基于规则与基于代价优化的选择率决策逻辑 普通读书笔记卡
  8. 多表连接优化的组合爆炸与两种应对算法 结构图卡

11 事务处理技术

  1. 事务ACID四特性的分工:一致性由应用保证,其余三个由DBMS保证 普通读书笔记卡
  2. 冲突可串行化的判定:前趋图有向无环 结构图卡
  3. 两阶段锁协议保证可串行化的机制 普通读书笔记卡
  4. 锁粒度的并发度开销权衡与意向锁机制 结构图卡
  5. 活锁与死锁的区别及应对策略 普通读书笔记卡
  6. 基于时间戳的并发控制规则与活锁风险 普通读书笔记卡
  7. 多版本并发控制(MVCC)的版本序列机制 普通读书笔记卡
  8. 基于验证的乐观并发控制:先执行后验证 普通读书笔记卡
  9. 事务隔离级别四级体系与四种异常现象 结构图卡
  10. 基于日志的恢复:先写日志原则与undo/redo操作 结构图卡
  11. 检查点机制降低恢复扫描范围 普通读书笔记卡
  12. 并发转账取款同时读旧值导致丢失修改 支付系统案例卡

12 大数据管理技术

  1. 大数据的4V特征及与传统数据的差异 结构图卡
  2. 数据预处理四步流程解决"脏数据无法直接挖掘"的问题 结构图卡
  3. NoSQL数据库的四种存储模型 普通读书笔记卡
  4. 数据挖掘与知识发现的层级关系 普通读书笔记卡
  5. 数据挖掘算法按任务类型的分类谱系 普通读书笔记卡

13 数据库前沿技术

  1. 云数据库与云原生数据库的概念区分 普通读书笔记卡
  2. CAP理论与NoSQL的一致性权衡逻辑 结构图卡
  3. 强一致性/弱一致性/最终一致性的层级及BASE原则 普通读书笔记卡
  4. NoSQL四种数据模型的复杂度递增谱系 结构图卡
  5. AI赋能数据库的共同逻辑:从经验规则到机器学习驱动 普通读书笔记卡

相关主题

暂无公开主题。