PLATFORM · v2.4

Полная картина вашей инфраструктуры в реальном времени.

Метрики, трейсы и логи собираются через единый OTLP-pipeline. Запросы выполняются по petabyte-класс хранилищу за миллисекунды. Корреляция между событиями — на уровне UI.

Что внутри

01 · TELEMETRY PIPELINE

Universal ingestion

Принимает данные из любого источника: OpenTelemetry (нативный OTLP gRPC и HTTP), Prometheus remote_write, StatsD, DogStatsD, InfluxDB line protocol, Fluent Bit, Vector, syslog. Батчинг, сжатие zstd, retry с экспоненциальной задержкой.

Throughput: до 10 миллионов событий/сек на один кластер ingestion. Horizontal scaling из коробки.

02 · STORAGE

Column-store на ClickHouse

Хранение в columnar-формате: метрики и трейсы в одном physical store. Pre-aggregated rollups для common queries (1m, 5m, 1h, 1d windows). Materialized views автоматически.

Retention policies на уровне tenant: от 7 дней (raw) до 5 лет (downsampled). Tiered storage: hot на NVMe, warm на SATA SSD, cold в S3-совместимом объектном хранилище.

03 · TRACING

Distributed tracing с tail-based sampling

Сквозная трассировка запросов через все сервисы. Tail-sampling на коллекторе: сохраняет 100% медленных и ошибочных трейсов, randomly samples остальные (configurable rate).

Service map автоматически строится из trace data. Зависимости между сервисами, latency-брейкдаун по span, error rate per endpoint.

04 · LOGGING

Structured log aggregation

Логи как first-class citizen, не appendage к метрикам. JSON-парсинг на лету, извлечение полей в колонки. Полнотекстовый поиск через inverted index.

Связь лог-записи с trace_id и metric label — клик по логу показывает всю цепочку запроса. Обфускация PII (emails, телефоны, номера карт) на ingestion.

05 · ALERTING

SLO-based alerting + anomaly detection

Алертинг поверх multi-window multi-burn-rate (Google SRE practices). Поддержка SLO, SLI, error budgets. Routing rules → PagerDuty, Opsgenie, Slack, Telegram, custom webhooks.

ML-модели детекции аномалий (Prophet + isolation forest) поверх seasonal паттернов. Гибкая suppression — никаких алертов во время planned maintenance.

06 · DASHBOARDS

Reusable dashboards

Grafana-совместимый dashboard engine. Templates, variables, alert panels, annotations. Импорт существующих Grafana JSON-dashboards одной командой.

Sharing: публичные ссылки, embed, export в PNG/PDF по расписанию. RBAC на уровне dashboard'а.

07 · SECURITY

Enterprise-grade security

SOC 2 Type II, ISO 27001 в процессе. RBAC с fine-grained permissions. SSO (SAML 2.0, OIDC), SCIM для автоматического user provisioning. Audit log всех действий.

Encryption at-rest (AES-256) и in-transit (TLS 1.3). PII detection и masking. Compliance с 152-ФЗ (данные РФ-резидентов хранятся в РФ-юрисдикции).

Архитектура

Поток данных от ваших сервисов до dashboard'а проходит пять уровней. Каждый уровень независимо масштабируется и отказоустойчив.

0 Your infrastructure external

Ваши сервисы — Kubernetes, Nomad, VM, edge. Ничего менять не нужно: агент Actaflow встаёт рядом как DaemonSet.

payments-api
billing-svc
search-api
worker-celery
… N services
OTLP gRPC/HTTP · Prometheus · StatsD · Fluent Bit
1 Actaflow Collector DaemonSet · edge

Daemon рядом с вашими сервисами. Принимает данные из всех источников, батчит, сжимает zstd, ретраит с экспоненциальной задержкой.

Deploy: Helm / DaemonSet Memory: ~80 MB / node Config: YAML / CRD
OTLP gRPC · TLS 1.3 · mTLS опция
2 Actaflow Ingest stateless · horizontally scalable

Stateless-сервис. Tail-sampling для трейсов, PII-маскинг для логов, schema validation. Throughput растёт линейно с числом реплик.

Throughput: 10M events/sec / cluster Features: tail-sampling · PII mask · schema check
batched INSERT · columnar · zstd
3 ClickHouse cluster sharded · replicated · tiered

Columnar storage. Pre-aggregated rollups для common queries (1m / 5m / 1h / 1d). Materialized views автоматически.

HOT
NVMe · 7 days
WARM
SSD · 90 days
COLD
S3 · up to 5 yrs
SQL / PromQL · streaming aggregates
4 Query engine + dashboard UI stateless · RBAC · audit log

API для выполнения запросов, GraphQL-эндпоинтов для dashboard'ов, alert evaluation. RBAC на всех уровнях, audit log всех действий.

Query engine

P95 < 80 ms по терабайтам. Кеш результатов в RAM. Streaming-ответы (SSE).

Dashboard UI

Real-time panels, SLO tracking, alerting, audit log, RBAC, SSO.

Производительность

Сравнение с основными альтернативами на идентичной workload: 1 млрд событий/день, 30-day retention, single-region. Замеры — Q4 2025, методика опубликована.

Query latency · P95
Типичный dashboard-запрос за 24-часовым окном, ниже — лучше
Actaflow
78 ms
Grafana Mimir
162 ms
Datadog
208 ms
New Relic
248 ms
Ingest cost
USD за 1M событий, ниже — лучше
Actaflow
$0.40
Grafana Cloud
$0.85
Datadog
$1.65
New Relic
$1.45
Trace retention
Дней при стандартном тарифе, больше — лучше
Actaflow
30 days
Datadog
15 days
New Relic
8 days
Grafana Cloud
10 days

Источники: публичные прайс-листы вендоров на 2025-12-01 + load-тестирование sysbench-observability v1.4 на identичной workload (1B events/day, 30-day retention, ru-1a). Полная методика и raw data — в техническом whitepaper.

Self-hosted vs Cloud

Параметр Actaflow Cloud Self-hosted Enterprise
Развертывание SaaS, multi-region On-premise / private cloud
Управление Полностью managed Контракт с support 24/7
Хранение данных РФ / EU регионы Ваш контур, air-gap опция
Обновления Continuous Long-term support releases
Compliance SOC 2, ISO 27001, 152-ФЗ Под вашу сертификацию
SLA 99.99% (Pro) / 99.999% (Enterprise) 99.99% + 4-hour support response