Skitflow

Observability

Runtime logs, distributed traces и metrics для приложений, собираемые telemetry agents и хранимые в ClickHouse.

Observability сейчас в Beta. Logs, traces и route metrics реализованы и доступны в dashboard, но поведение setup зависит от deployment shape. Некоторым self-hosted installations может понадобиться ручная настройка agents. Metrics также доступны через Monitoring и Swarm Monitoring.

Observability собирает три telemetry signals - logs, traces и metrics - в одном месте, чтобы можно было понять "что только что произошло?" без внешнего сервиса и без вывода данных из Skitflow.

Skitflow Observability dashboard со статусом ClickHouse, retention, latency, error rate и throughput charts

Три сигнала

  • Runtime logs - structured logs из containers в реальном времени, с поиском и retention.
  • Distributed traces - путь request по services, чтобы увидеть, где тратится время и какой hop сломался.
  • Route metrics - latency percentiles, error rate и throughput для application routes.

Как это устроено

Pipeline состоит из трёх частей:

  1. Telemetry agents работают рядом с workloads и собирают logs, traces и metrics через OpenTelemetry.
  2. ClickHouse хранит signals в columnar database, рассчитанной на большие объёмы observability data.
  3. Consumers читают из этого хранилища: dashboard для людей и AI Assistant, который может использовать observability context для diagnostics и proposal-based operations.

Включение Observability

Откройте Observability в dashboard. Если entitlement и deployment shape это позволяют, Skitflow подготовит ClickHouse и telemetry pipeline.

Укажите retention в днях. Чем дольше retention, тем больше истории, но тем выше расход ClickHouse storage.

В некоторых self-hosted deployment shapes ingest token wiring может требовать ручной настройки. Если logs или traces не появляются после включения, проверьте agent connection и token в observability settings.

Связь с Monitoring

Observability дополняет monitoring stack, а не заменяет его:

  • Monitoring отслеживает server/container resource usage и alert thresholds.
  • Swarm Monitoring показывает cluster topology, node health и service placement.
  • Observability добавляет route metrics, logs, traces, retention и ClickHouse-backed querying.

Privacy

Agents работают рядом с workloads и пишут в ClickHouse. В self-hosted deployments telemetry остаётся на вашей инфраструктуре. В cloud deployments telemetry отправляется в Skitflow cloud control plane.

On this page