Сервер перестал запускаться
Оборудование включается с ошибкой, операционная система не загружается или корпоративные сервисы полностью недоступны. Необходимо определить причину сбоя и возможный способ возврата систем в работу.
Восстанавливаем работу серверов, 1С, SQL, виртуальных машин, файловых ресурсов и других критичных систем после сбоев, повреждения данных, отказа оборудования или атак. Определяем причину аварии и возвращаем ключевые сервисы в работу в порядке их важности для бизнеса.
ВОССТАНОВИТЬ РАБОТУ СИСТЕМ
ЧТО МЫ ПРЕДЛАГАЕМ
При IT-аварии сотрудники обычно видят только последствия: не запускается 1С, недоступны общие папки, сервер не отвечает, повреждена база данных или перестала запускаться виртуальная машина. При этом настоящая причина может находиться в оборудовании, дисковой подсистеме, операционной системе, базе данных, виртуализации, сети или резервных копиях.
В такой ситуации важно не начинать восстановление случайными действиями. Неосторожные попытки быстро исправить проблему могут усложнить дальнейшее восстановление или привести к дополнительной потере данных.
Сначала фиксируем текущее состояние инфраструктуры, определяем масштаб аварии и проверяем доступные источники восстановления. Затем вместе с клиентом устанавливаем приоритет критичных для бизнеса систем и выбираем наиболее рациональный сценарий их возврата в работу.
Возможности восстановления зависят от характера повреждения и доступных данных. При физическом повреждении носителей может потребоваться специализированная лаборатория, а проблемы внутри конфигурации 1С могут потребовать подключения профильного специалиста.

КОГДА НУЖНА УСЛУГА
Оборудование включается с ошибкой, операционная система не загружается или корпоративные сервисы полностью недоступны. Необходимо определить причину сбоя и возможный способ возврата систем в работу.
Пользователи не могут подключиться к базе, сервер 1С или SQL недоступен либо повреждена база данных. Требуется проверить инфраструктурную часть и определить доступные варианты восстановления.
Файлы удалены, повреждены или стали недоступны после сбоя сервера или хранилища. Необходимо определить доступные версии данных и источники, из которых их можно вернуть.
Виртуальный сервер перестал работать после сбоя, обновления, повреждения хранилища или другой аварии. Требуется проверить виртуальную среду, данные и резервные копии.
Из строя вышел диск, контроллер, блок питания или другой критичный компонент. Нужно оценить состояние данных и возможность восстановления на текущем или резервном оборудовании.
Файлы и системы стали недоступны после атаки. Перед восстановлением необходимо определить масштаб инцидента, изолировать затронутые системы и проверить безопасность резервных данных.
До изменения конфигурации система работала, а после него перестала запускаться или потеряла часть сервисов. Нужно определить, безопаснее ли вернуть прежнее состояние или восстановиться из резервной копии.
Наличие копии ещё не означает, что сервис можно сразу вернуть в работу. Нужно проверить её целостность, подобрать точку восстановления, подготовить среду и корректно вернуть данные и пользовательский доступ.
ЧТО ВХОДИТ В УСЛУГУ
Определяем, какие системы перестали работать и какие компоненты инфраструктуры затронуты. Проверяем серверы, виртуальные машины, диски и хранилища, операционные системы, сети, 1С, SQL, файловые ресурсы, резервные копии и доступность ключевых сервисов.
До активных восстановительных действий стараемся сохранить доступную информацию о текущем состоянии системы. Это особенно важно при повреждении файловой системы или данных, когда неосторожные действия могут ухудшить ситуацию.
Совместно с клиентом определяем системы, которые необходимо вернуть в работу в первую очередь. Приоритет устанавливается по влиянию сервиса на деятельность компании, а не только по технической сложности восстановления.
Ищем доступные резервные данные в локальных и удалённых хранилищах, NAS, облачных копиях, резервных SQL-базах и копиях виртуальных машин. Проверяем дату, целостность и пригодность данных для восстановления.
В зависимости от характера аварии возвращаем систему на существующем оборудовании либо разворачиваем её на подходящей резервной инфраструктуре. Если основной сервер нельзя быстро вернуть в работу, критичные сервисы могут быть временно перенесены на другое оборудование или виртуальную среду.
Возвращаем виртуальные машины из доступных резервных копий либо создаём новую виртуальную среду и переносим в неё сохранившиеся данные. Возможный сценарий зависит от состояния исходной виртуальной машины и хранилища.
Восстанавливаем инфраструктурную часть: сервер, SQL, резервные базы, сетевой доступ и пользовательские подключения. Если проблема находится непосредственно внутри конфигурации 1С, для её устранения требуется профильный специалист.
Возвращаем корпоративные данные из доступных резервных источников. Если сервер работает, но пользователи не могут к нему подключиться, проверяем сеть, маршрутизацию, VPN, DNS и другие компоненты доступа.
После запуска проверяем пользовательский доступ, основные приложения, базы данных, права, сеть, резервное копирование и критичные рабочие сценарии. После стабилизации системы анализируем причину аварии и определяем, какие изменения помогут снизить риск её повторения.
ПРИМЕРЫ ЗАДАЧ
Сначала фиксируем текущее состояние и проверяем оборудование и доступность дисков. Затем анализируем резервные копии, готовим рабочую среду, восстанавливаем SQL и сервер 1С и проверяем пользовательские подключения. Если восстановление исходного сервера занимает слишком много времени, критичный сервис может быть временно развёрнут на другой подходящей инфраструктуре.
Останавливаем потенциально рискованные операции и определяем доступные точки восстановления. Выбираем подходящую копию, восстанавливаем базу, проверяем её запуск и целостность, после чего возвращаем пользовательский доступ.
Определяем примерное время удаления и проверяем доступные версии данных. После этого возвращаем необходимую папку или отдельные файлы из подходящего резервного источника.
Проверяем состояние системы после изменения и оцениваем возможность безопасного возврата к предыдущему состоянию. Если восстановление из резервной копии позволяет быстрее и надёжнее вернуть сервис, используем этот сценарий.
Проверяем гипервизор, конфигурацию виртуальной машины, состояние хранилища и резервные копии. Если исходный экземпляр повреждён, разворачиваем восстановленную копию либо переносим доступные данные в новую среду.
ЕСЛИ НЕТ РЕЗЕРВНОЙ КОПИИ
Отсутствие резервной копии значительно ограничивает возможности восстановления, но не всегда означает полную потерю данных.
Проверяем состояние дисков и файловой системы, доступность базы данных, временные и локальные копии, данные на других устройствах и существующие выгрузки.
После диагностики можно определить, какие варианты восстановления реально доступны.
При физическом повреждении носителей может потребоваться специализированная лаборатория по восстановлению данных. Аппаратное восстановление повреждённых накопителей не подменяется обычным системным администрированием.
ПОСЛЕ ВИРУСА-ШИФРОВАЛЬЩИКА
Восстановление после вируса-шифровальщика требует отдельного сценария.
Сначала изолируем затронутые устройства там, где это необходимо, и определяем масштаб инцидента. Затем проверяем резервные копии и выясняем, не были ли они доступны злоумышленнику вместе с основной инфраструктурой.
Критичные данные не возвращаются в заведомо скомпрометированную систему. Для восстановления подготавливается чистая среда, после чего сервисы возвращаются в порядке их важности для бизнеса.
Перед полноценным запуском устраняются очевидные причины и уязвимые точки, через которые мог произойти инцидент. После восстановления целесообразно отдельно провести аудит безопасности.
ПОДГОТОВКА К АВАРИИ
Резервное копирование помогает подготовиться к возможной аварии, а аварийное восстановление начинается после того, как сбой уже произошёл.
Даже при наличии резервной копии необходимо определить подходящую точку восстановления, подготовить сервер или виртуальную среду, восстановить данные, проверить их целостность, вернуть сервисы в сеть и восстановить пользовательский доступ.
Для систем, где простой критичен, можно заранее разработать план аварийного восстановления. В нём фиксируются критичные системы, последовательность их возврата в работу, ответственные, расположение резервных копий, необходимые доступы и оборудование, контакты профильных подрядчиков, а также показатели RPO и RTO.
RPO определяет допустимый объём потери данных, а RTO — допустимое время простоя системы. Эти показатели влияют на требования к резервному копированию, оборудованию и схеме восстановления.
КАК ПРОХОДИТ РАБОТА
Уточняем, что произошло, когда возникла проблема и какие системы сейчас недоступны.
Начинаем работу удалённо или с выездом в зависимости от характера аварии и доступности систем.
Определяем затронутые компоненты, масштаб аварии и вероятную причину сбоя.
До оценки данных стараемся не выполнять действия, которые могут дополнительно повредить систему или усложнить восстановление.
Находим доступные копии и определяем возможные точки восстановления.
Определяем последовательность возврата сервисов и согласовываем приоритеты с клиентом.
Возвращаем инфраструктуру в работу в порядке установленного бизнес-приоритета и с учётом технических возможностей.
Контролируем запуск баз данных и доступность необходимой информации после восстановления.
Проверяем подключения сотрудников и основные рабочие сценарии.
После стабилизации определяем причины инцидента и изменения, которые помогут снизить вероятность повторения ситуации.
ЧТО ПОЛУЧАЕТ КЛИЕНТ
Клиент получает результаты диагностики и понимание того, какие системы затронуты и какие варианты восстановления технически доступны.
Определяется последовательность возврата систем в работу с учётом их влияния на бизнес и состояния доступных данных.
В технически возможном объёме восстанавливаются серверы, виртуальные машины, инфраструктура 1С и SQL, корпоративные файлы и другие критичные сервисы.
После запуска проверяются пользовательский доступ, основные приложения, базы данных, права, сеть и критичные рабочие сценарии.
Клиент получает рекомендации по устранению причины инцидента, резервному копированию и дальнейшему сопровождению инфраструктуры.
Стоимость аварийного восстановления определяется после первичной диагностики.
На расчёт влияют тип аварии, количество серверов и затронутых сервисов, наличие и состояние резервных копий, наличие 1С и SQL, количество виртуальных машин, объём данных, состояние оборудования, необходимость резервного сервера или выезда, срочность, необходимость работы вне стандартного времени, сложность восстановления и привлечение сторонних специалистов.
До начала восстановительных работ согласовываются доступный сценарий, объём и порядок выполнения.
ПОЧЕМУ IT-WIZARDS

Системы возвращаются в работу не по принципу технической простоты, а исходя из их важности для деятельности компании.

Перед активным восстановлением фиксируется состояние инфраструктуры и оцениваются данные, чтобы не усугубить повреждение необдуманными действиями.

При аварии проверяются не только отдельный сервер или приложение, но и связанные компоненты: хранилища, виртуализация, базы данных, сеть, резервные копии и пользовательский доступ.

Если задача выходит за рамки инфраструктурного восстановления — например, требуется аппаратное восстановление физически повреждённого носителя или работа с конфигурацией 1С — подключаются профильные специалисты.
ЧАСТЫЕ ВОПРОСЫ
Сначала необходимо определить причину неисправности. Если данные на накопителях доступны, возможен перенос на другое оборудование или восстановление из резервной копии. При физическом повреждении носителей может потребоваться специализированная лаборатория.
Да, восстанавливаем инфраструктурную часть: сервер, SQL, резервную базу, сетевой и пользовательский доступ. Если повреждение связано непосредственно с конфигурацией 1С, может потребоваться профильный специалист.
Проводим диагностику и определяем, какие данные ещё доступны на дисках, в файловой системе, локальных копиях, выгрузках или других источниках. Возможность восстановления зависит от характера повреждения.
Да, если техническая архитектура и доступные данные это позволяют. Временное развёртывание на другом сервере или виртуальной машине может использоваться для возврата критичного сервиса.
Да, если имеется подходящая резервная копия или достаточно доступных данных для восстановления.
Сначала необходимо ограничить дальнейшее распространение атаки и проверить состояние резервных копий. Восстановление выполняется в безопасной среде, а не автоматически поверх заражённой системы.
Нет. Возможность восстановления зависит от характера повреждения, состояния инфраструктуры и наличия пригодных резервных копий.
Это зависит от типа аварии, объёма данных, состояния резервных копий и инфраструктуры. Более реалистичную оценку можно дать после диагностики.
Да. Для этого используются резервное копирование, мониторинг и при необходимости заранее разрабатывается план аварийного восстановления с определением критичных систем и порядка их возврата в работу.
Расскажите, что произошло и какие системы сейчас недоступны — после первичной диагностики определим возможные варианты и порядок восстановления.