Admin Portal

Единая консоль самообслуживания для администраторов распределенной системы мониторинга.

Проект автоматизирует рутинные операции по управлению конфигурациями, контролю состояния серверов и генерации технической отчетности.

Статус: В продуктивной эксплуатации

Было

Инженер → PuTTY → 20 серверов → 2 часа

Стало

Инженер → Admin Portal → 1 клик → 2 минуты

Контекст и проблема

Целью проекта стала разработка инструмента, который взял бы на себя всю «линейную» работу, позволив инженерам сосредоточиться на действительно критичных инцидентах и развитии системы. Объединить управление разрозненными компонентами мониторинга в едином интерфейсе.

В крупной ИТ-инфраструктуре инженеры групп эксплуатации ежедневно сталкиваются с большим потоком однотипных заявок:

  • постановка и снятие различных объектов мониторинга
  • контроль и проверка конфигурации
  • контроль по доступности метрик мониторинга
  • разбор причин недоступности агентов мониторинга
  • создание или изменение дашбордов
  • плановое обновление ПО
  • подготовка отчётов
  • и дт.

Выполнение таких задач вручную (через последовательные подключения к серверам) отнимало много времени и несло риски человеческой ошибки.

Роль

Автор идеи, Fullstack-разработчик.

Проект реализован с нуля как внутренний инструмент, без привлечения подрядчиков. В основе лежит понимание ежедневных болей администраторов мониторинга.

Стек

Python Flask Bootstrap 5 PostgreSQL Clickhouse Grafana API Prometheus Zabbix Elastic

Ключевой функционал и интерфейсные решения

Главный экран (Рабочее место администратора)

  • Поиск и фильтрация: Центральный элемент — строка поиска узлов сети с гибкими фильтрами, позволяющая быстро найти любой объект в системе.
  • Лента событий: Блок последних новостей группы и событий по серверам самой системы мониторинга для оперативного реагирования.
  • Раздел «Сводка»: Виджеты, отображающие критические отклонения ключевых метрик (CPU, RAM, DISK и тд.) по наиболее важным серверам.

Автоматизация рутинных операций

Главная «фишка» портала — выполнение пакетных операций. Инженеру больше не нужно заходить на каждый сервер вручную. Достаточно указать список хостов и выбрать действие. Система выполнит работу автоматически и сохранит результат в историю изменений.
Поддерживается массовое обновление конфигураций, перезапуск агентов, установка патчей.

Модуль инвентаризации

Автоматическое отслеживание изменений конфигураций серверов. Система фиксирует, кем, когда и на каком сервере были изменены CPU, RAM или диски, формируя полную историю конфигурационной единицы.

История изменений хранится неограниченно.

Аналитические отчеты

  • Тепловая карта: Отчет о серверах с нарушенной конфигурацией агентов мониторинга, сгруппированный по типу ошибки. Содержит инструкции по устранению.
  • Отчет покрытия: Контроль того, что все сервера находятся под мониторингом.
  • Capacity Management: Отчеты по управлению мощностями, помогающие планировать масштабирование системы.
  • Аудит действий: Детальная статистика по загрузке инженеров: кто какие задачи запускал, какие сервера ставил/снимал с мониторинга, какие удаленные команды выполнял.

Интеграция с Grafana (Self-Service BI)

Уникальный модуль, позволяющий инженеру создать готовый дашборд в Grafana за пару кликов. Выбор серверов и панелей метрик — и система возвращает готовую ссылку на дашборд.

Время создания дашборда: от 2 часов → до 30 секунд

Визуальный стиль

Интерфейс выполнен на базе Bootstrap 5 в светлой теме. Визуальный код намеренно минималистичен, так как приоритетом является функциональность и скорость работы. Цветовая индикация строго стандартизирована для мгновенного считывания статусов:

Зеленый — ОК / Работает
Желтый — Предупреждение
Красный — Ошибка
Синий — Информирование
Черный — Статика
Серый — Акцент

Ключевые результаты

~90%
рутинных операций автоматизировано
2 ч → 2 мин
среднее время выполнения заявки
100%
покрытие серверов мониторингом
0
ручных подключений к серверам