Skip to content

CORE CONCEPTS · 宽列数据库

Apache Cassandra 核心知识

Cassandra 要按查询反向设计表。分区键、聚簇顺序、一致性级别、压缩和 tombstone 是性能与可靠性的共同基础。

学完应该能做到

  • 能设计有界分区
  • 能计算一致性条件
  • 能治理 compaction 与 tombstone

三个必须建立的心智模型

01

查询驱动建模

每张表服务明确查询,分区键定位节点,聚簇列定义分区内排序。

  • 避免跨分区扫描
  • 限制分区大小
  • 为每个访问模式建表
02

一致性与修复

副本数 N、读写一致性 R/W 决定可用性与一致性;repair 修复副本差异。

  • 记录 consistency level
  • 规划增量 repair
  • 处理 hinted handoff 边界
03

LSM、压缩与 Tombstone

写入先到 memtable/WAL,再形成 SSTable;删除产生 tombstone,压缩负责合并。

  • 按工作负载选 UCS/STCS/LCS
  • 避免 tombstone storm
  • 监控 pending compaction

把知识落到工程决策

建模前

先写出访问模式、正确性边界、数据生命周期和故障预算,再决定表、键、索引或分区。

上线前

使用接近生产的数据分布与并发压测,记录查询计划、资源水位和恢复时间作为基线。

运行中

监控延迟分位数、容量增长、后台维护与复制健康;报警必须能映射到可执行处置步骤。

Released under the MIT License.