Архитектура, которая прекрасно работала внутри одного дата-центра — с десятками последовательных вызовов между сервисами и множественными обращениями к базе за один запрос, — может внезапно "развалиться" по времени отклика после того, как часть компонентов перенесли в другой регион ради отказоустойчивости. Дело не в баге и не в деградации железа: та же самая цепочка вызовов теперь физически стоит на два-три порядка дороже по времени, просто потому что каждый вызов стал ждать не доли миллисекунды, а десятки. Разбираем, почему это происходит и какой…
Подробнее →