Полная картина вашей инфраструктуры в реальном времени.
Метрики, трейсы и логи собираются через единый OTLP-pipeline. Запросы выполняются по petabyte-класс хранилищу за миллисекунды. Корреляция между событиями — на уровне UI.
Что внутри
Universal ingestion
Принимает данные из любого источника: OpenTelemetry (нативный OTLP gRPC и HTTP), Prometheus remote_write, StatsD, DogStatsD, InfluxDB line protocol, Fluent Bit, Vector, syslog. Батчинг, сжатие zstd, retry с экспоненциальной задержкой.
Throughput: до 10 миллионов событий/сек на один кластер ingestion. Horizontal scaling из коробки.
Column-store на ClickHouse
Хранение в columnar-формате: метрики и трейсы в одном physical store. Pre-aggregated rollups для common queries (1m, 5m, 1h, 1d windows). Materialized views автоматически.
Retention policies на уровне tenant: от 7 дней (raw) до 5 лет (downsampled). Tiered storage: hot на NVMe, warm на SATA SSD, cold в S3-совместимом объектном хранилище.
Distributed tracing с tail-based sampling
Сквозная трассировка запросов через все сервисы. Tail-sampling на коллекторе: сохраняет 100% медленных и ошибочных трейсов, randomly samples остальные (configurable rate).
Service map автоматически строится из trace data. Зависимости между сервисами, latency-брейкдаун по span, error rate per endpoint.
Structured log aggregation
Логи как first-class citizen, не appendage к метрикам. JSON-парсинг на лету, извлечение полей в колонки. Полнотекстовый поиск через inverted index.
Связь лог-записи с trace_id и metric label — клик по логу показывает всю цепочку запроса. Обфускация PII (emails, телефоны, номера карт) на ingestion.
SLO-based alerting + anomaly detection
Алертинг поверх multi-window multi-burn-rate (Google SRE practices). Поддержка SLO, SLI, error budgets. Routing rules → PagerDuty, Opsgenie, Slack, Telegram, custom webhooks.
ML-модели детекции аномалий (Prophet + isolation forest) поверх seasonal паттернов. Гибкая suppression — никаких алертов во время planned maintenance.
Reusable dashboards
Grafana-совместимый dashboard engine. Templates, variables, alert panels, annotations. Импорт существующих Grafana JSON-dashboards одной командой.
Sharing: публичные ссылки, embed, export в PNG/PDF по расписанию. RBAC на уровне dashboard'а.
Enterprise-grade security
SOC 2 Type II, ISO 27001 в процессе. RBAC с fine-grained permissions. SSO (SAML 2.0, OIDC), SCIM для автоматического user provisioning. Audit log всех действий.
Encryption at-rest (AES-256) и in-transit (TLS 1.3). PII detection и masking. Compliance с 152-ФЗ (данные РФ-резидентов хранятся в РФ-юрисдикции).
Архитектура
Поток данных от ваших сервисов до dashboard'а проходит пять уровней. Каждый уровень независимо масштабируется и отказоустойчив.
Ваши сервисы — Kubernetes, Nomad, VM, edge. Ничего менять не нужно: агент Actaflow встаёт рядом как DaemonSet.
Daemon рядом с вашими сервисами. Принимает данные из всех источников, батчит, сжимает zstd, ретраит с экспоненциальной задержкой.
Stateless-сервис. Tail-sampling для трейсов, PII-маскинг для логов, schema validation. Throughput растёт линейно с числом реплик.
Columnar storage. Pre-aggregated rollups для common queries (1m / 5m / 1h / 1d). Materialized views автоматически.
API для выполнения запросов, GraphQL-эндпоинтов для dashboard'ов, alert evaluation. RBAC на всех уровнях, audit log всех действий.
Query engine
P95 < 80 ms по терабайтам. Кеш результатов в RAM. Streaming-ответы (SSE).
Dashboard UI
Real-time panels, SLO tracking, alerting, audit log, RBAC, SSO.
Производительность
Сравнение с основными альтернативами на идентичной workload: 1 млрд событий/день, 30-day retention, single-region. Замеры — Q4 2025, методика опубликована.
Источники: публичные прайс-листы вендоров на 2025-12-01 + load-тестирование sysbench-observability v1.4 на identичной workload (1B events/day, 30-day retention, ru-1a). Полная методика и raw data — в техническом whitepaper.
Self-hosted vs Cloud
| Параметр | Actaflow Cloud | Self-hosted Enterprise |
|---|---|---|
| Развертывание | SaaS, multi-region | On-premise / private cloud |
| Управление | Полностью managed | Контракт с support 24/7 |
| Хранение данных | РФ / EU регионы | Ваш контур, air-gap опция |
| Обновления | Continuous | Long-term support releases |
| Compliance | SOC 2, ISO 27001, 152-ФЗ | Под вашу сертификацию |
| SLA | 99.99% (Pro) / 99.999% (Enterprise) | 99.99% + 4-hour support response |