Катастрофоустойчивость ИТ: почему одной резервной площадки уже недостаточно

09.10.2026

В материале CNews Иван Рыбин, директор департамента развития программных продуктов «Гравитон», рассказал о современных подходах к построению катастрофоустойчивой ИТ-инфраструктуры и обеспечению непрерывной работы критичных сервисов.

Один из ключевых принципов — отказ от классической схемы с основной и пассивной резервной площадками в пользу геораспределенной архитектуры. В такой модели несколько ЦОД объединяются в единый кластер и одновременно участвуют в обработке операций. Это позволяет исключать единые точки отказа и сохранять работу сервисов даже при недоступности одной из площадок.

Практический пример такого подхода — проект для группы ПАО «НМТП». ПАК Helius на серверах «Гравитон» С2122И объединил два географически разнесенных ЦОД в единый кластер из 10 узлов. Первые критические ИТ-сервисы были переведены на новую платформу за два месяца, сегодня комплекс поддерживает работу технологических систем порта и более 1800 сотрудников.

Отдельное внимание в статье уделено производственной устойчивости. «Гравитон» использует фаблесс-модель: компания сосредоточена на инжиниринге, разработке материнских плат, микропрограммного обеспечения и интеграции ПО, а сборка оборудования распределена между независимыми контрактными производствами. Такой подход позволяет перераспределять выпуск между площадками и снижать риски срыва поставок при масштабировании инфраструктуры или аварийной замене оборудования.