— Подождите.
— Подождите.
— То есть прод сейчас живёт потому, что cron каждые пять минут проверяет контейнеры и поднимает упавшие?
— Да.
Тишина.
— И давно так?
— Полгода.
42–50 тысяч RPM на балансере.
404–500 тысяч уникальных пользователей в сутки.
Да, это прод.
Да, большой компании.
Да, решение странное.
Работало?
Работало.
Иногда инженерия — это выбор между:
«сделать правильно»
и
«сделать так, чтобы бизнес пережил понедельник»
Потом проходит полгода.
Кто-то осторожно спрашивает:
«а это временное решение?»
А потом рассказываю про это в кулуарах конференции.
И начинается самое интересное.
Обычно уточняют:
«Подождите. Вы точно про продукт B?»
Потом — длинная пауза.
И где-то в этот момент обычно всплывает:
«Подождите… то есть это была одна VM, docker-compose и один балансер?»
К этому моменту кофе обычно уже нужен всем.
Тишина.
А cron — жалко.