Skitflow

Docker Swarm cluster

Управление multi-node Docker Swarm cluster в Skitflow.

Skitflow может запускать workloads на одном сервере или в Docker Swarm cluster. Кластер нужен, когда требуется больше capacity, изоляция nodes или устойчивость выше, чем может дать один host.

Skitflow Docker Swarm overview с manager и worker nodes

Когда масштабироваться горизонтально

Сначала используйте vertical scaling, если это возможно: добавить CPU, RAM и disk на тот же сервер проще в эксплуатации. Переходите к cluster, когда нужны:

  • Отдельные nodes для разных классов workloads.
  • Больше суммарных CPU/RAM, чем даёт один сервер.
  • Разделение managers и workers.
  • Запас для maintenance без остановки всех workloads.

Требования

  • Работающий Skitflow control-plane server.
  • Один или несколько дополнительных Linux servers, доступных по SSH.
  • Docker установлен или может быть установлен на каждом node.
  • Совместимая CPU architecture на nodes, которые будут запускать одни и те же images.
  • Registry credentials для images, которые должны pull worker nodes.
  • Network connectivity между nodes для Docker Swarm traffic.

Cluster не отменяет backups. Swarm может reschedule services, но не защищает application data, если потерян диск с данными.

Добавление nodes

Откройте Infrastructure -> Swarm и нажмите Manage Cluster. Setup flow поможет подключить servers по SSH, присоединить их как managers или workers и проверить, что они online.

Managers хранят cluster state и планируют services. Workers запускают workloads по правилам, заданным managers.

Проверка cluster health

После добавления nodes проверьте Swarm overview:

  • Total Nodes совпадает с ожидаемым количеством servers.
  • Active Nodes показывает, что все nodes online.
  • Manager Nodes показывает ожидаемое количество managers.
  • У каждого node есть TLS Status: Ready и Availability: Active.
  • Engine versions совместимы во всём cluster.

Деплой в cluster

Для production workloads:

  1. Опубликуйте application images в registry, доступный всем nodes.
  2. Настройте registry credentials в Skitflow.
  3. Разверните application или Compose stack.
  4. Используйте health checks и rollback settings для long-running services.
  5. Следите за placement и resource usage в Swarm Monitoring.

On this page