Серверы недоступны с ночи: на Хабре сообщают о простое клиентов Yandex Cloud

0

Пожар в дата-центре «Яндекса» в Сасово обернулся проблемами для клиентов облачной платформы: на Хабре появились сообщения о недоступной инфраструктуре. К вечеру 8 октября компания сообщила, что еще оценивает ущерб и пока не может подтвердить возможность восстановления оборудования площадки.

Для команды, которая держит рабочий проект на недоступных серверах, сообщение о сбое означает необходимость искать способ возобновить работу. В обсуждении на Хабре пользователи разбирают, помогут ли резервные копии, как перенести сервисы и почему облачная инфраструктура не всегда переключается на другую площадку автоматически.

«Все недоступно с ночи»

Пользователь Хабра под ником SYSTEM_FAILURE сообщил, что часть инфраструктуры его клиентов находилась в пострадавшем дата-центре «Яндекса». По его словам, она недоступна с ночи; он также пожаловался на отсутствие ответа поддержки и продолжающиеся начисления за сервисы.

«Собственно всё недоступно с ночи».

Пользователь SYSTEM_FAILURE, комментарий на Хабре

Это свидетельство участника обсуждения, а не подтвержденный компанией отчет о состоянии конкретных клиентских ресурсов. Независимого подтверждения его претензий к поддержке и начислениям редакция Digital Report пока не получила.

При этом сам инфраструктурный сбой подтвержден официально. В сообщении Yandex Cloud указана недоступность зоны ru-central1-b, затрагивающая вычислительные ресурсы, управляемые базы данных, Kubernetes и другие сервисы. Компания также предупреждала об ограничениях при создании новых ресурсов в облаке.

Вечером появилась новая причина для тревоги

В заявлении, которое в 18:24 мск опубликовал «Интерфакс», «Яндекс» сообщил, что масштаб ущерба еще оценивается. Возможность восстановления оборудования дата-центра на тот момент оставалась под вопросом.

«Масштаб ущерба для инфраструктуры еще оценивается. Пока мы не можем подтвердить возможность восстановления оборудования дата-центра в Сасове».

Пресс-служба «Яндекса», заявление от 8 октября

Компания говорит об оборудовании площадки, не объявляя в этом сообщении о безвозвратной потере всех клиентских данных. Редакция Digital Report пока не смогла получить официальное подтверждение, что пользователи облака массово лишились баз данных, исходного кода или резервных копий.

Почему второй сервер не обязательно спасает проект

В комментариях на Хабре обсуждают географическое резервирование и проверку восстановления из бэкапов. Пользователь mgis обращает внимание, что оплата ресурсов в двух зонах сама по себе не обеспечивает отказоустойчивость: требуется заранее подготовить переключение трафика, конфигурации и зависимые сервисы.

У этого обсуждения есть конкретная техническая основа. В документации Yandex Compute Cloud указано, что каждый диск автоматически реплицируется внутри своей зоны доступности. Таким образом, резервирование диска внутри зоны нельзя считать готовой копией всего проекта на другой площадке.

Для восстановления виртуальной машины в другой зоне Yandex Cloud предусматривает использование снимков дисков. Согласно инструкции, снимок содержит данные, записанные на момент его создания: изменения, появившиеся позднее, в него не попадут.

При этом разные облачные сервисы устроены по-разному. Например, в описании Object Storage говорится о репликации между зонами доступности. Поэтому состояние виртуальной машины, базы данных и объектного хранилища нужно проверять отдельно, а не делать общий вывод «все пропало» по недоступности одного сервера.

Та же зона уже останавливалась в 2025 году

Похожий по последствиям инцидент произошел 30 марта 2025 года. В официальном разборе Yandex Cloud указано, что сервисы зоны ru-central1-b были недоступны с 12:25 мск до полуночи из-за двойного отказа электропитания, связанного со сбоем на городской высоковольтной подстанции.

Тогда компания последовательно восстанавливала инфраструктуру, виртуальные машины, базы данных и балансировку трафика. Однако сроки того восстановления нельзя использовать как прогноз для нынешнего пожара: вечером 8 октября «Яндекс» еще оценивал состояние оборудования.

О пожаре в Сасово и первых предупреждениях облачной платформы мы уже писали. Сейчас для пострадавших команд ключевые вопросы вполне практические: какие ресурсы сохранились, доступны ли резервные копии и можно ли развернуть проект на другой площадке.

Следите за обновлениями о работе облачных сервисов в телеграм-канале Digital Report. Публикуем подтвержденные сообщения компаний и сведения о восстановлении инфраструктуры.

Digital Report
Share.

About Author

Digital-Report.ru — информационно-аналитический портал, который отслеживает изменения цифровой экономики. Мы описываем все технологические тренды, делаем обзоры устройств и технологических событий, которые влияют на жизнь людей.

Leave A Reply