Availability
9 pages
-
Bulkhead Pattern
pattern
Resource partitioning, shuffle sharding, cellular architecture
-
CAP Theorem
concept
CAP theorem and PACELC extension; Kleppmann's critique ("best avoided"); timeliness vs integrity distinction
-
Chaos Engineering
concept
definition, prerequisites, experiment design, injection types (Chaos Monkey/Latency Monkey/FIT), targeting strategy, automation and moderation, disaster simulations; theoretical foundations (drift into failure, regulator paradox, antifragility); complex systems foundations (accidental vs essential complexity, emergent failures, composability of safety); Netflix origin story; Chaos Maturity Model
-
Control Plane / Data Plane
concept
data plane (on critical path, availability), control plane (off-path, consistency); static stability; scale imbalance solutions (file store buffer, push deltas, hybrid); control theory feedback loop
-
Cost vs Availability Decision Guide
comparison
Nines table with money attached; conversion via downtime cost; investment cost per nine; where each nine is earned; antipatterns (tyranny of the nines, MTBF without MTTR, redundancy without isolation); architectural choices that make availability cheap or expensive
-
DNS (Domain Name System)
concept
Hierarchical resolution process; TTL trade-offs; DNS as eventually consistent KV store; DNS as SPOF; static stability principle
-
Error Budgets
concept
error budget = 1 − SLO target; resolves dev/ops conflict by aligning incentives; budget exhaustion triggers release freeze; burn rate alerting; 100% is wrong target argument
-
Load Balancing
concept
DNS LB, L4 (transport), L7 (application), service discovery, health checks, power of two choices, sidecar as client-side LB; stateless services as prerequisite for scale-out
-
Site Reliability Engineering
source
*Site Reliability Engineering* — Beyer, Jones, Petoff, Murphy