Мониторинг сайтов и инфраструктуры
Проверки каждую минуту из нескольких точек и уведомления о сбоях в реальном времени.
Что входит
Настраиваем мониторинг доступности и производительности: проверки из нескольких географических точек, оповещения через email, Яндекс 360 и Telegram.
Мониторинг заказывают после первого случая, когда о падении сайта сообщил клиент, а не система. Или когда выясняется, что оформление заказа не работало полдня из-за отвалившегося платёжного шлюза, при том что главная страница открывалась нормально и внешне всё было в порядке.
Настраиваем проверки доступности и времени ответа не только для главной, но и для ключевых сценариев: каталог, корзина, оформление заказа, программные интерфейсы, отвечающие за оплату и доставку. Проверки идут из нескольких географических точек, чтобы отличить реальное падение от сетевой проблемы у одного провайдера. Для каждой проверки задаются пороги срабатывания и канал оповещения: почта, Telegram или Яндекс 360. Отдельная работа — настроить пороги так, чтобы оповещения не превратились в шум, который перестают читать.
В результате о проблеме вы узнаёте в первые минуты и с конкретикой: какой сценарий сломался и с какого времени. Это сокращает простой и убирает самую дорогую его часть — период, когда сервис уже не работает, а никто об этом ещё не знает.
Этапы работы
- 01Определение ключевых проверок и метрик
- 02Настройка датчиков и порогов
- 03Каналы оповещений и дежурства
- 04Дашборды и отчётность
Частые вопросы
- Как проходит подключение мониторинга?
- Сначала вместе определяем, что критично для бизнеса: какие страницы, сценарии и программные интерфейсы должны работать всегда. Затем настраиваем проверки из выбранных точек, задаём пороги и подключаем каналы оповещений. После этого собираем дашборд, проводим пробный прогон с имитацией сбоя и передаём инструкцию ответственному сотруднику.
- Чем это отличается от бесплатных пингов доступности?
- Простая проверка отвечает на вопрос, открывается ли главная страница. Она промолчит, если каталог отдаёт пустоту, оплата не проходит, а обмен с 1С встал. Мы проверяем сценарии целиком и следим за временем ответа, поэтому видим и постепенную деградацию, которая обычно предшествует полному отказу.
- Можно ли следить за внутренними сервисами за периметром?
- Да, если есть способ до них достучаться: доступ через защищённый канал или агент внутри вашей сети. Внешние адреса проверяются напрямую без дополнительных условий. Если доступа внутрь нет вообще, честно ограничимся внешним контуром и скажем, какая часть инфраструктуры остаётся вне наблюдения.
- Что нужно от вас на старте?
- Список адресов и сценариев, которые нужно контролировать, и понимание, что для бизнеса считается сбоем: иногда медленный ответ хуже короткой недоступности. Также нужен ответственный сотрудник, который будет получать оповещения и вместе с нами настроит пороги, чтобы уведомления приходили по делу.
Другие услуги направления
Автоматизация развёртывания и CI/CD
Релизы по плану или по требованию с исключением человеческого фактора.
ПодробнееВнедрение ElasticSearch
Быстрый поиск и фильтрация по каталогам до миллионов позиций за доли секунды.
ПодробнееРазработка ETL и загрузка данных
Автоматический сбор данных из разнородных источников в единое хранилище.
ПодробнееОбсудим задачу
Расскажите о проекте — предложим решение и оценку
Посмотрим на задачу, процессы и бюджет и предложим, как её закрыть. Работаем по Fixprice или T&M.
- Телефон
- +7 (981) 894-98-79
- info@aimatik.ru
- Режим работы
- Пн–Пт, 9:00–19:00 МСК