Мониторинг Swarm
Визуализируйте Docker Swarm cluster через service map и per-container metrics.
Когда Skitflow работает на нескольких servers как Docker Swarm cluster, Swarm Monitoring показывает, где запущены services и как ведут себя containers, без предварительной настройки внешнего monitoring stack.
Swarm overview
Overview показывает базовое здоровье cluster:
- Количество total, active и manager nodes.
- Роль manager или worker для каждого node.
- TLS readiness и scheduling availability.
- Engine version, CPU, memory и node IP.
- Быстрые переходы к node configuration и services.
С него стоит начинать, когда deployment идёт медленно, node пропал или service не достигает ожидаемого replica count.
Service map
Вкладка Service Map показывает связи между services, stacks и overlay networks. Она помогает ответить на вопросы:
- Какие services используют общий overlay network?
- Какому stack принадлежит service?
- Какие services подключены к Traefik и доступны из интернета?
- Failing service изолирован или находится на пути других workloads?
Map показывает topology, а не packet capture. Shared overlay network означает, что services потенциально могут достучаться друг до друга, а не то, что они прямо сейчас обмениваются traffic.
Container metrics
Вкладка Containers показывает per-container CPU, memory и network usage по nodes. Используйте её, чтобы находить перегруженные nodes, частые restarts и services, которые потребляют больше ресурсов, чем ожидалось.
Включение monitoring
Monitoring запускается как небольшой stack на manager node. При включении нужно выбрать:
- Manager server - Swarm manager, где будет развёрнут monitoring stack.
- Network - Docker network для доступа к services.
Вы можете проверить, активен ли monitoring, и отключить его в любой момент.
Для HTTP route metrics, logs и traces используйте Observability. Для node/container resource thresholds используйте Monitoring.
Related
- Cluster - настройка и масштабирование Docker Swarm cluster.
- Multi Server - управление remote servers.
- Observability - route metrics, logs, traces и ClickHouse retention.