Рано или поздно к любому, кто держит прод на одном сервере, приходит мысль «а что если он ляжет прямо сейчас». Дальше начинается разговор про бэкапы, резервный сервер, кластер — и почти всегда без цифр, на одних ощущениях. В итоге либо не делают ничего, либо строят кластер на три ноды для внутреннего блога на 200 читателей в день. Ниже — методика, которая переводит этот разговор в деньги: четыре уровня отказоустойчивости, что каждый из них стоит относительно базового варианта, какой у него RTO/RPO и для какого масштаба он оправдан.
Подробнее →