Docker Swarm cluster
Управление multi-node Docker Swarm cluster в Skitflow.
Skitflow может запускать workloads на одном сервере или в Docker Swarm cluster. Кластер нужен, когда требуется больше capacity, изоляция nodes или устойчивость выше, чем может дать один host.
Когда масштабироваться горизонтально
Сначала используйте vertical scaling, если это возможно: добавить CPU, RAM и disk на тот же сервер проще в эксплуатации. Переходите к cluster, когда нужны:
- Отдельные nodes для разных классов workloads.
- Больше суммарных CPU/RAM, чем даёт один сервер.
- Разделение managers и workers.
- Запас для maintenance без остановки всех workloads.
Требования
- Работающий Skitflow control-plane server.
- Один или несколько дополнительных Linux servers, доступных по SSH.
- Docker установлен или может быть установлен на каждом node.
- Совместимая CPU architecture на nodes, которые будут запускать одни и те же images.
- Registry credentials для images, которые должны pull worker nodes.
- Network connectivity между nodes для Docker Swarm traffic.
Cluster не отменяет backups. Swarm может reschedule services, но не защищает application data, если потерян диск с данными.
Добавление nodes
Откройте Infrastructure -> Swarm и нажмите Manage Cluster. Setup flow поможет подключить servers по SSH, присоединить их как managers или workers и проверить, что они online.
Managers хранят cluster state и планируют services. Workers запускают workloads по правилам, заданным managers.
Проверка cluster health
После добавления nodes проверьте Swarm overview:
- Total Nodes совпадает с ожидаемым количеством servers.
- Active Nodes показывает, что все nodes online.
- Manager Nodes показывает ожидаемое количество managers.
- У каждого node есть TLS Status: Ready и Availability: Active.
- Engine versions совместимы во всём cluster.
Деплой в cluster
Для production workloads:
- Опубликуйте application images в registry, доступный всем nodes.
- Настройте registry credentials в Skitflow.
- Разверните application или Compose stack.
- Используйте health checks и rollback settings для long-running services.
- Следите за placement и resource usage в Swarm Monitoring.
Related
- Multi Server для подключения remote servers.
- Registry для image pull credentials.
- Swarm Monitoring для service map и container metrics.
- Production checklist перед публикацией cluster workloads для пользователей.