Все системы работают исправно

Последние инциденты

16 января 2022

Без происшествий

15 января 2022

Без происшествий

14 января 2022

libra.lite-host.in Фиксируем недоступность части VDS серверов

По состоянию на 13:00 фиксируем недоступность части VDS серверов, проводим анализ проблемы.

Исходя из анализа, сервер LIBRA был выключен. В текущий момент сервер включен, ожидаем загрузки. В дата-центр отправлен запрос с уточнением причины произошедшего.

К сожалению, сервер не загружается с ошибкой fan failure, в дата-центр отправлен запрос на установку дисков в резервный сервер и запуск виртуальных машин на нем.

Дата-центр сообщил, что принял обращение в работу в 13:37.

К сожалению, по состоянию на 14:00 от дата-центра никакой информации нет.

Диски установили в 14:10 на резервный сервер, проводим запуск.

По состоянию на 14:25 все виртуальные машины запущены, дополнительно проверяем работоспособность каждой.

По состоянию на 14:30 фиксируем проблемы в работе сети части серверов, скорее всего это связано с лимитом на MAC адреса со стороны дата-центра, отправили заявку на расширение.

По состоянию на 14:55 лимит MAC адресов расширен со стороны дата-центра, повторно проверяем работу серверов.

По состоянию на 15:30 все работы завершены, все виртуальные машины работают в штатном режиме.

Мы продолжаем исследовать вопрос по выходу сервера LIBRA из строя, после его восстановления в ночное время переставим диски обратно в основной сервер, так как он более производительный. Об этом будет объявлено дополнительно.

13 января 2022

Без происшествий

12 января 2022

Без происшествий

11 января 2022

Без происшествий

10 января 2022

Без происшествий

9 января 2022

mars.lite-host.in Проблемы в работе сервера базы данных

По состоянию на 19:45 фиксируем проблемы в работе сервера базы данных, в текущий момент изучаем проблему.

Исходя из анализа произошло повреждение InnoDB таблиц, проводим анализ ситуации и оцениваем сроки восстановления.

Согласно рекомендациям разработчиков при получении ошибок InnoDB: Your database may be corrupt or you may have copied the InnoDB tablespace but not the InnoDB log files. требуется перевести сервер в режим только для чтения, сделать резервную копию баз данных (если это возможно), удалить существующие базы данных и выполнить восстановление данных из созданных резервных копий.

По состоянию на 20:20 мы перевели сервер базы данных в режим только для чтения и попробуем выполнить частичное восстановление баз данных исходя из результата выполнения mysqlcheck, ориентировочное время выполнения до 22:00. По мере появления новой информации мы сообщим об этом здесь.

По состоянию на 20:50 частичное восстановление данных не помогло, мы поставили создание резервных копий всех баз данных, после переустановим сервер базы данных и восстановим данные. На сервере около 700 баз данных, процедура может занять минимум несколько часов. О ходе выполнения работ будем продолжать сообщать здесь.

По состоянию на 21:05 создание резервной копии баз данных завершено, сервер базы данных полностью отключен, выполняем переустановку.

Восстановление баз данных начато в 21:25, по мере восстановления сайты будут восстанавливать свою работу.

По состоянию на 22:00 данные полностью восстановлены.

Исходя из анализа, в 19:42 одновременно ко многим сайтам пришли запросы к файлам xmlrpc.php и wp-login.php, это создало много процессов, которые привели к нехватки оперативной памяти, что в свою очередь привело к аварийному завершению процесса базы данных. Несмотря на то, что InnoDB считается надежным движком для таблиц, аварийное завершение привело к их повреждению, при этом без указания конкретных баз данных или таблиц. Сервер базы данных стал циклично перезагружаться. В данном случае единственное решение проблемы - это переустановка сервера базы данных и восстановление данных из резервных копий. Чтобы данные были актуальными, мы перевели сервер базы данных в режим только для чтения (параметр innodb_force_recovery), это позволило создать копию текущих данных, попутно контролируя статус выполнения команды mysqldump, чтобы исключить потерю каких-либо баз данных. Далее мы переустановили сервер базы данных и выполнили восстановление. Далее мы перезагрузили сервер для расширения оперативной памяти (это должно снизить шанс повторения подобной ситуации).

Общее время работ составило 2 часа 15 минут, так как большую часть времени база данных работала в режиме чтения, то мы получили только 2 обращения о проблемах. Приносим извинения за доставленные неудобства, если в работе сайтов наблюдаются до сих пор какие-то проблемы, либо сбой доставил неудобства - обратитесь в отдел поддержки с указанием проблемных сайтов.