557

После двух атак «Яндекс» вручную делит облачные мощности

Зона ru-central1-b остаётся недоступной, а восстановление двух повреждённых ЦОДов займёт неопределённое время.

На третий день после атаки на Сасово Yandex Cloud всё ещё работает без одной зоны доступности. После второго удара по ЦОДу в Калуге компания перешла к ручному распределению части облачных ресурсов.

Утром 10 октября у истории с дата-центрами «Яндекса» появился новый, уже не аварийный, а эксплуатационный этап. Зона доступности ru-central1-b по-прежнему недоступна. На выходные Yandex Cloud вводит полностью ручное управление квотами на вычислительные ресурсы и диски: новым мощностям дают лимиты, а приоритет обещают клиентам, чьи критичные системы до сих пор не восстановлены.

Это важное изменение. Оно означает, что проблема уже вышла за пределы одного повреждённого здания. Облаку приходится жить с уменьшенным запасом мощности и вручную распределять то, что осталось свободным, пока клиенты переносят виртуальные машины, базы данных и резервные копии на другие площадки.

Началось всё в ночь с 7 на 8 октября в Сасово Рязанской области. После атаки БПЛА и пожара дата-центр «Яндекса» там остановили полностью. Именно с этой площадкой связана зона ru-central1-b, которая остаётся недоступной третий день. Компания ещё 8 октября предупреждала, что быстро вернуть её в строй не получится.

Утром 9 октября удар пришёлся уже по другому дата-центру — в Калуге. «Яндекс» сообщил, что несколько модулей там полностью выведены из строя. Люди не пострадали, но сроки восстановления оборудования компания пока не называет. Поэтому сейчас речь идёт не о нескольких повреждённых ЦОДах в Калужской области, а о двух разных площадках: одной в Сасово и одной в Калуге.

Снаружи эта картина выглядит спокойнее, чем внутри инфраструктуры. Основные пользовательские сервисы продолжают работать, а часть нагрузки команда «Яндекса» переключила на другие зоны. Но запас прочности стал меньше. Yandex Cloud уже рекомендовал клиентам восстанавливать ресурсы из резервных копий и переносить их на альтернативные площадки; для ускорения такой миграции компания подключила Selectel, K2Cloud и VK Cloud.

ИЗНАНКА вчера писала о массовых сбоях в Рунете после остановки Сасово. Тогда в один временной промежуток наложились проблемы разных сервисов, и не все из них имели одну причину. Сейчас ситуация стала понятнее: сам инфраструктурный ущерб у «Яндекса» подтверждён и сохраняется, но нового сообщения о третьем пострадавшем дата-центре на 10 октября нет.

Поэтому нынешний этап — не новая волна отключений, а жизнь после потери части физической инфраструктуры. Для обычного пользователя она может почти не ощущаться, пока резервные площадки справляются. Для облачных клиентов цена этой устойчивости уже видна: переносы, лимиты, ручное распределение ресурсов и ожидание, когда удастся вернуть прежний уровень резервирования.

У дата-центра нет кнопки «перезапустить», если из строя вышло само здание и его инженерные системы. После двух атак устойчивость «Яндекса» теперь проверяется не тем, сколько сервисов упало сразу, а тем, как долго компания сможет держать привычную работу пользователей на сокращённой инфраструктуре.

Фото: редакция ИЗНАНКИ.