Про сервер вспоминают в двух случаях: когда он упал и когда письма уходят в спам. Наша работа — чтобы оба случая не наступали, а если что-то происходит, чинилось до того, как заметит клиент.
Реальная последовательность: от первого предупреждения до записи в отчёте — без звонка от клиента.
monitor.vmtech.rs
Узел: web-01
LIVE
18 минут
Порог превышен
диск 85%
Уведомление дежурному
02:41
Причина найдена
журналы приложения
Устранено
диск 34%
Проверка сервисов
все сервисы в норме
Запись в отчёт
18 минут
ИНЦИДЕНТ
01Порог превышенМониторинг видит рост занятого места и предупреждает заранее, а не по факту остановки
02Уведомление дежурномуСообщение уходит инженеру с указанием узла, метрики и последних изменений
03Причина найденаЛоги показывают, что именно растёт: очередь почты, журналы приложения или временные файлы
04УстраненоМесто освобождено, ротация журналов исправлена, чтобы это не повторилось через месяц
05Проверка сервисовСайт, почта и обмен данными проверяются — не только «сервер отвечает»
06Запись в отчётВ месячном отчёте видно, что произошло, сколько заняло и что сделано, чтобы не повторилось
ЗНАКОМАЯ КАРТИНА
Как обычно выглядит «сервер работает»
Без обслуживания
О сбое узнают от клиента или из сообщения в мессенджере «у вас сайт не открывается»
Резервные копии вроде бы делаются, но никто ни разу не пробовал восстановиться
Письма с домена уходят в спам, и причина неизвестна
Обновления не ставят, потому что «работает — не трогай»
Доступы к серверу есть у бывшего подрядчика, и никто не помнит, у кого именно
На обслуживании
Мониторинг предупреждает до отказа: место, память, нагрузка, срок сертификата
Резервные копии проверяются восстановлением — известно, сколько времени займёт возврат
Почтовый домен настроен: SPF, DKIM и DMARC на месте, репутация отслеживается
Обновления безопасности ставятся по графику, с окном и возможностью отката
Список доступов известен и пересматривается — уволившийся подрядчик его теряет
ОБЪЁМ РАБОТ
Что входит в обслуживание
Аудит текущего состояния
Что запущено, какие версии, где хранятся копии, у кого есть доступ и что уже близко к отказу.
Настройка сервера
Веб-сервер, база, сертификаты, права доступа и разделение окружений для рабочей и тестовой версии.
Почтовый сервер
Домен, ящики, SPF, DKIM и DMARC, антиспам и контроль репутации, чтобы письма доходили.
Резервное копирование
Расписание, срок хранения, копия вне сервера и регулярная проверка восстановлением.
Мониторинг
Доступность, место, память, нагрузка, срок сертификатов и работа ключевых сервисов, а не только пинг.
Обновления и безопасность
Обновления системы и приложений по графику, ограничение доступа, защита от перебора паролей.
Регламент реагирования
Кто отвечает за инцидент, за какое время реагируем и что считается критичным именно для вас.
Отчётность
Что происходило за месяц, какие были инциденты, что сделано, чтобы они не повторились.
ТЕХНОЛОГИЧЕСКИЙ КОНТУР
С чем работаем
LinuxОсновная среда: веб-серверы, базы данных, очереди и фоновые задачиПочтовый контурSMTP, IMAP, антиспам, подписи DKIM и политика DMARC для доменаTLSСертификаты с автоматическим продлением и контролем срока действияКопии и хранилищеКопии базы и файлов с хранением вне основного сервераМониторинг и оповещенияПроверки сервисов, пороги предупреждений и уведомления дежурномуЖурналыСбор и ротация журналов, чтобы разбирать инциденты по фактам
Сервер, домен и хостинг остаются оформленными на вашу компанию. Мы получаем доступ для работ, и он отзывается по вашему решению в любой момент.
ВОПРОСЫ
Что обычно спрашивают
Почему письма с нашего домена попадают в спам?
Чаще всего причин три: домен не подписывает письма (нет DKIM), не объявлено, кто имеет право отправлять от его имени (нет SPF), или сервер попал в списки из-за прошлых рассылок. Мы проверяем все три, настраиваем подписи и политику, а затем смотрим репутацию домена в динамике — без этого разовая настройка не помогает.
Мы уже платим за хостинг. Зачем ещё обслуживание?
Хостинг отвечает за то, что железо включено и сеть работает. Всё, что выше — версии, настройки, копии, почта, обновления и реакция на инцидент — зона ответственности владельца сервера. Если этим никто не занимается, проблема обнаруживается в момент, когда уже мешает работе.
Как быстро вы реагируете ночью?
Это фиксируется в регламенте до начала работ: что считается критичным именно для вас и за какое время мы отвечаем. Мониторинг работает круглосуточно, и на критичные проверки уведомление уходит дежурному сразу — большинство инцидентов закрывается до того, как о них узнают ваши клиенты.
Что происходит, если сервер всё же упал?
Работает заранее описанный порядок: проверяем, что именно недоступно, поднимаем сервис или разворачиваем копию, сообщаем вам статус и время восстановления. Резервные копии проверены восстановлением заранее, поэтому срок возврата известен, а не выясняется в момент аварии.
Можно ли перенести сервер к другому провайдеру?
Да, и это обычная работа. Готовим новую площадку, переносим данные и настройки, проверяем работу параллельно, и только потом переключаем домен. Перенос планируется на время наименьшей нагрузки, а старая площадка остаётся доступной до подтверждения, что всё работает.