Xcellerate AIG przekazuje ruch AI do narzędzi monitoringu, których już używasz: Prometheus i Grafana dla metryk, dowolny magazyn OpenTelemetry dla trace'ów każdego żądania, logi JSON z kontenerów dla Twojego log shippera i podpisane webhooki dla SIEM, SOAR lub ITSM. Alerty powiadamiają właściwe osoby e-mailem, na Slacku lub webhookiem, gdy skończy się budżet, klucz dostawcy przestanie działać albo guardrail zablokuje prompt.
TL;DR
- Prometheus zbiera
/metrics, trace'y wychodzą przez OTLP/HTTP, a logi to JSON na stderr.- Podpisane webhooki (HMAC-SHA256) zasilają Twój SIEM, SOAR lub ITSM. Osobnego konektora SIEM nie ma.
- Alerty wychodzą e-mailem, na Slacka lub webhookiem.
Zanim zaczniesz
- Masz rolę Admin w AIG. Metrics & tracing, Webhooks i Alerting to ekrany administracyjne.
- Prometheus ma dostęp do
https://<your-gateway>/metricsw sieci wewnętrznej. Ten endpoint nie jest dostępny przez publiczny punkt wejścia. - Dla trace'ów: endpoint OTLP/HTTP (Tempo, Jaeger, OpenTelemetry Collector lub hostowany APM), zwykle kończący się na
/v1/traces, plus ewentualny nagłówek lub token ingest. - Dla webhooków: odbiornik HTTPS (może być wewnętrzny), który weryfikuje podpisy HMAC. Dla Slacka: URL incoming webhook. Dla alertów e-mail: poczta wychodząca ustawiona w ustawieniach ogólnych.
Połącz monitoring
1. Metryki dla Prometheus i Grafana
Otwórz All screens → General settings → Metrics & tracing (Wszystkie ekrany → Ustawienia ogólne → Metryki i śledzenie) i włącz metryki. Zbieranie możesz ograniczyć do adresów IP lub zakresów CIDR, do basic auth albo obu. Dodaj w Prometheus scrape job dla /metrics. Zaimportuj dashboard Grafana dostarczany z plikami wdrożeniowymi i wklej jego adres w Dashboard URL (URL dashboardu).
2. Trace'y przez OpenTelemetry
Na tej samej stronie włącz Export traces (eksport trace'ów). Wklej OTLP/HTTP endpoint i w razie potrzeby token ingest w Extra request headers (dodatkowe nagłówki żądań). Ustaw Service name (nazwa usługi) i Sample (%) (próbkowanie). Uzupełnij Trace link template (szablon linku do trace'a) o {trace_id}, aby panel logów prowadził prosto do trace'a.
3. Webhooki dla SIEM, SOAR lub ITSM
Otwórz All screens → Webhooks i kliknij Add endpoint (dodaj endpoint). Podaj nazwę i URL oraz zaznacz potrzebne zdarzenia; domyślnie nic nie jest subskrybowane. Skopiuj sekret podpisu (pokazywany raz), kliknij Test i obserwuj Recent deliveries (ostatnie dostarczenia).
4. Alerty e-mailem, na Slacku lub webhookiem
Otwórz All screens → Alerting (alerty) i kliknij Add a channel (dodaj kanał): listę adresów e-mail, Slack incoming webhook lub URL. Kliknij Send a test (wyślij test). Potem włącz jedną z pięciu gotowych reguł (domyślnie wszystkie wyłączone) albo dodaj własną: zdarzenie, opcjonalny warunek, throttle w minutach i kanały.
5. Kontrole stanu dla self-hosted AIG
Skieruj load balancer lub monitoring dostępności na /up (liveness) i /up/ready (readiness).
Co się dzieje po połączeniu
- Metryki: liczba żądań i błędów, histogramy opóźnień i pierwszego tokena, tokeny, koszty, ponowienia, rotacje i stan kluczy, żądania w toku, głębokość kolejki, trafienia w cache, stan circuit, oceny guardrails i wywołania narzędzi. Liczba wartości etykiet jest ograniczona.
- Trace'y: jeden span na żądanie (model, dostawca, tokeny, koszt, klucz, zespół), ze spanami podrzędnymi dla każdej próby u dostawcy, wywołania narzędzia i werdyktu guardrail. Przychodzący
traceparentjest kontynuowany. - Logi: jedna linia JSON na stderr z węzłem i ID żądania.
X-Request-Idłączy wywołującego, Twoje logi i log żądań AIG. - Webhooki: JSON POST z
X-XC-Event,X-XC-Delivery,X-XC-TimestampiX-XC-Signature: sha256=…, czyli HMAC-SHA256 z<timestamp>.<body>. Nieudane dostarczenia są ponawiane w rosnących odstępach, a potem oznaczane jako Given up; wtedy możesz je ponowić samodzielnie. - Wykresy na żywo są w Traffic → Observability (Ruch → Obserwowalność).
Dobrze wiedzieć
- Nie ma osobnego konektora dla Splunk, Microsoft Sentinel ani Elastic. Twój SIEM przyjmuje dane AIG przez te standardowe wyjścia.
- Kanały alertów to e-mail, Slack i webhook; kanału Microsoft Teams nie ma.
- Gdy magazyn trace'ów nie działa, AIG porzuca te paczki i tworzy zdarzenie, na które można ustawić alert. Żądania nigdy nie zwalniają.
- Rotacja sekretu webhooka nie ma okresu przejściowego: najpierw zaktualizuj odbiornik. Adresy loopback i cloud metadata są zawsze odrzucane jako cel.
- Reguła z nieczytelnym warunkiem nigdy się nie uruchomi. Throttle 0 oznacza: przy każdym wystąpieniu.
Rozwiązywanie problemów
/metricszwraca 404 „metrics are disabled” (włącz metryki), 403 „forbidden” (IP niedozwolone) lub 401 „unauthorised” (sprawdź basic auth).- Observability pokazuje „Nothing sampled yet…”: sprawdź, czy działa kontener scheduler i czy metryki są włączone.
- Reguła pokazuje „No channels — nobody would be told”: dodaj co najmniej jeden kanał.
- Webhook zostaje w stanie Retrying lub Given up: sprawdź odbiornik, a potem użyj Retry.
Dowiedz się więcej o obserwowalności, logu audytu i logach żądań.
Chcesz zobaczyć AIG we własnej Grafanie i SIEM? Porozmawiaj z nami o AIG.
