Keyboard shortcuts

Press ← or → to navigate between chapters

Press S or / to search in the book

Press ? to show this help

Press Esc to hide this help

Section E — Advanced Database Systems

This section covers cutting-edge database internals that go beyond what is covered in the core DBMS chapters. Topics range from modern query optimizer architectures (Cascades/Volcano/Columbia) to vectorized execution engines, learned indexes, serializable snapshot isolation, deterministic databases, vector databases for AI workloads, graph databases, temporal/streaming systems, and approximate query processing with privacy-preserving techniques.

Topic Map

mindmap
  root((Advanced DBMS))
    Query Optimizers
      Cascades / Volcano / Columbia
      Cost-Based & Cardinality Estimation
      Learned Cardinality
      Adaptive & Runtime Re-optimization
      Join Ordering (DP, bushy, WCO)
      AGM Bound & Leapfrog Triejoin
      Factorized Databases
    Execution Engines
      Vectorized & SIMD Execution
      JIT Compilation & Code Gen
      Morsel-Driven Parallelism
      Columnar Encodings (RLE, Dict, Bit-pack)
      Operator Fusion & Pipeline
    Advanced Indexing
      Learned Indexes (ALEX, FITing-Tree)
      Bw-Tree (Latch-Free B-Tree)
      Adaptive Radix Tree (ART)
      LSM-Based Indexes
    Advanced Concurrency
      SSI & Serializable Snapshot Isolation
      Deterministic Databases (Calvin)
      Distributed MVCC & Serializability
      Spanner / CockroachDB Transactions
    Distributed & NewSQL
      FoundationDB / TiDB / YugabyteDB
      Distributed SQL & HTAP
    Vector Databases
      HNSW / IVF / PQ / DiskANN
      Hybrid Search & RAG
    Graph Databases
      Cypher / SPARQL / Datalog
      Graph Joins & Analytics
    Temporal & Streaming
      Bitemporal / Time-Series
      Stream Processing
    Approximate & Privacy
      Sketches (HLL, CMS, t-digest)
      Differential Privacy & TEE
      Provenance & Lineage

Reading Order

OrderFilePrerequisitesCore Focus
1query-optimizers.md../query-processing/optimization.mdOptimizer architectures, join theory
2execution-engines.md../storage/column-stores.mdModern execution models
3index-advanced.md../indexing/b-tree.md, ../internals/lsm-trees.mdNext-gen index structures
4concurrency-advanced.md../transactions/mvcc.md, ../transactions/isolation-levels.mdDistributed concurrency & SSI
5distributed-databases.md../transactions/distributed.mdNewSQL & HTAP systems
6vector-databases.mdNoneVector search & AI-native DBs
7graph-databases.mdNoneGraph query languages & analytics
8temporal-streaming.mdNoneTemporal data & streaming
9approximate-privacy.mdNoneSketches, privacy, provenance

Foundations vs. Advanced

CategoryFoundations (existing files)This Section (advanced)
OptimizationRule-based, basic costCascades, learned cardinality, WCO, factorized
ExecutionVolcano iterator modelVectorized, JIT, morsel-driven
IndexingB-tree, hash, bitmapLearned, Bw-tree, ART, LSM indexes
Concurrency2PL, basic MVCC, locksSSI, deterministic DBs, distributed MVCC
Transactions2PC, basic serializabilitySpanner TrueTime, Calvin, CockroachDB

Cross-References to Existing Content