Xcellerate AIG передає ваш AI-трафік в інструменти моніторингу, якими ви вже користуєтеся: Prometheus і Grafana для метрик, будь-яке сховище OpenTelemetry для traces кожного запиту, JSON-журнали контейнерів для вашого log shipper і підписані webhooks для SIEM, SOAR чи ITSM. Сповіщення повідомляють потрібних людей через e-mail, Slack або webhook, коли вичерпано бюджет, ключ постачальника перестав працювати чи guardrail заблокував prompt.
TL;DR
- Prometheus збирає
/metrics, traces виходять через OTLP/HTTP, журнали — це JSON у stderr.- Підписані webhooks (HMAC-SHA256) живлять ваш SIEM, SOAR чи ITSM. Окремого SIEM-конектора немає.
- Сповіщення надходять через e-mail, Slack або webhook.
Перш ніж почати
- У вас є роль Admin в AIG. Metrics & tracing, Webhooks і Alerting — адміністративні екрани.
- Prometheus має доступ до
https://<your-gateway>/metricsу вашій внутрішній мережі. Цей endpoint не доступний через публічну точку входу. - Для traces: OTLP/HTTP endpoint (Tempo, Jaeger, OpenTelemetry Collector або хмарний APM), що зазвичай закінчується на
/v1/traces, плюс за потреби ingest header чи токен. - Для webhooks: HTTPS-приймач (можна внутрішній), що перевіряє HMAC-підписи. Для Slack: URL incoming webhook. Для сповіщень e-mail: вихідна пошта, налаштована в загальних налаштуваннях.
Підключення моніторингу
1. Метрики для Prometheus і Grafana
Відкрийте All screens → General settings → Metrics & tracing (Усі екрани → Загальні налаштування → Метрики та трасування) й увімкніть метрики. Збір можна обмежити IP-адресами чи діапазонами CIDR, basic auth або обома способами. Додайте в Prometheus scrape job для /metrics. Імпортуйте дашборд Grafana, що постачається з файлами розгортання, і вставте його адресу в Dashboard URL (URL дашборду).
2. Traces через OpenTelemetry
На тій самій сторінці увімкніть Export traces (експорт traces). Вставте OTLP/HTTP endpoint і за потреби ingest-токен у Extra request headers (додаткові заголовки запиту). Задайте Service name (назва сервісу) і Sample (%) (вибірка). Заповніть Trace link template (шаблон посилання на trace) з {trace_id}, щоб панель журналів вела просто до trace.
3. Webhooks для SIEM, SOAR чи ITSM
Відкрийте All screens → Webhooks і натисніть Add endpoint (додати endpoint). Вкажіть назву й URL та позначте потрібні події; типово підписок немає. Скопіюйте секрет підпису (показується один раз), натисніть Test (тест) і стежте за Recent deliveries (останні доставки).
4. Сповіщення через e-mail, Slack або webhook
Відкрийте All screens → Alerting (сповіщення) і натисніть Add a channel (додати канал): список адрес e-mail, Slack incoming webhook або URL. Натисніть Send a test (надіслати тест). Потім увімкніть одне з п'яти готових правил (усі типово вимкнені) або створіть своє: подія, необов'язкова умова, throttle у хвилинах і канали.
5. Перевірки стану для self-hosted AIG
Налаштуйте load balancer або моніторинг доступності на /up (liveness) і /up/ready (readiness).
Що відбувається після підключення
- Метрики: кількість запитів і помилок, гістограми затримки й першого токена, токени, витрати, повтори, ротації та стан ключів, запити в обробці, глибина черги, влучання в кеш, стан circuit, оцінки guardrails і виклики інструментів. Кількість значень міток обмежено.
- Traces: один span на запит (модель, постачальник, токени, вартість, ключ, команда) з дочірніми spans для кожної спроби до постачальника, виклику інструмента й рішення guardrail. Вхідний
traceparentпродовжується. - Журнали: один рядок JSON у stderr із вузлом та ID запиту.
X-Request-Idпов'язує того, хто викликав, ваші журнали й журнал запитів AIG. - Webhooks: JSON POST із
X-XC-Event,X-XC-Delivery,X-XC-TimestampіX-XC-Signature: sha256=…, тобто HMAC-SHA256 від<timestamp>.<body>. Невдалі доставки повторюються з дедалі більшими інтервалами, а потім позначаються як Given up; тоді їх можна надіслати повторно вручну. - Графіки в реальному часі — у Traffic → Observability (Трафік → Спостережуваність).
Варто знати
- Окремого конектора для Splunk, Microsoft Sentinel чи Elastic немає. Ваш SIEM приймає дані AIG через ці стандартні виходи.
- Канали сповіщень: e-mail, Slack і webhook; каналу для Microsoft Teams немає.
- Якщо сховище traces недоступне, AIG відкидає ці пакети й створює подію, на яку можна налаштувати сповіщення. Запити ніколи не сповільнюються.
- Ротація секрету webhook не має перехідного періоду: спершу оновіть приймач. Адреси loopback і cloud metadata завжди відхиляються як ціль.
- Правило з незрозумілою умовою ніколи не спрацьовує. Throttle 0 означає: щоразу.
Усунення несправностей
/metricsповертає 404 «metrics are disabled» (увімкніть метрики), 403 «forbidden» (IP не дозволено) або 401 «unauthorised» (перевірте basic auth).- Observability показує «Nothing sampled yet…»: перевірте, чи працює контейнер scheduler і чи ввімкнено метрики.
- Правило показує «No channels — nobody would be told»: додайте хоча б один канал.
- Webhook залишається в Retrying або Given up: перевірте приймач, потім скористайтеся Retry.
Дізнайтеся більше про спостережуваність, журнал аудиту і журнали запитів.
Хочете побачити AIG у власній Grafana та SIEM? Поговоріть з нами про AIG.
