AiHummer
Latviešu
PierakstītiesKonts
v1.0.x
{ }Swagger

Novērojamība

v1.0.x · atjaunināts 2026-07-07

AiHummer novērojamība ir divas virsmas: vārteja kalpo kā Promētejs GET /metrics galapunkts, ko varat izsūkt pamatiem, un tas var pēc izvēles nosūtīt telemetriju pār OTLP uz OpenTelemetry galapunktu, kuru jūs konfigurējat. Skrāpēt /metrics pamata uzraudzībai; lai iegūtu izsekojumus un bagātīgus metriku datus, norādiet AiHummer uz savu OTLP savācēju un vizualizējiet datus ar pievienotajām Grafana informācijas panelēm.

[!NOTE] pprof (/debug/pprof) ir ne atklāts.

Prometejs /metrics galapunkts

GET /metrics nodrošina Prometheus teksta formāta metriku bez papildu iestatīšanas. Ir pieejami tikai nesensitīvi mērītāji — būves informācija, procesa darba laiks un darbības laiks, DB savienojumu baseina stāvoklis un gatavības mērītājs; nav nomnieku datu, nav noslēpumu, nav katra pieprasījuma etiķešu. Lai iegūtu izsekojumus un bagātīgas metriku, izmantojiet OTLP push.

OTLP nospiediet

Iestatiet vienu mainīgo, lai ieslēgtu telemetriju:

# gateway.env — export telemetry to your OTLP collector
AIHUMMER_OTEL_ENDPOINT=http://otel-collector:4317

Ar AIHUMMER_OTEL_ENDPOINT komplekts, vārteja nosūta telemetriju uz šo vācēju. No turienes nosūti to uz savu backend (Tempo, metrikas krātuve, žurnāli) un uz Grafana.

Paniku un kļūdu apstrāde

Kļūdu ziņojumi nekad netiek sūtīti nekur uz āru: vārtejā nav ārēja kļūdu izsekotāja klienta un nav ārēja DSN — dati par jūsu kļūdām nekad neatstāj jūsu kontūru.

Noturība pret panikām tomēr ir pilnīga:

  • panika HTTP apstrādātājā pārvēršas par parastu kļūdas atbildi (500 ar AIH-… aploksni) — process nemirst un turpina apkalpot pārējos pieprasījumus;
  • panika fona gorutīnā arī tiek pārtverta un nenogāž vārteju.

Abi gadījumi nonāk strukturētajā žurnālā — skatiet tos lapā “Logs” (zemāk) vai caur journalctl.

Tiešraides žurnāli administratora saskarnē

Administratora lietotāja saskarnes “Logs” lapa ir vārtejas žurnāla tiešraides uzskaites daļa: jaunas rindas tiek automātiski pievienotas ik pēc dažām sekundēm, ar automātisko ritināšanu, kamēr jūs esat apakšā. Rīkjoslā ir līnijas meklēšana un a līmeņa filtrs (visi / kļūdas / brīdinājumi / informācija / atkļūdošana). Vairākas citas lapas (Informācijas panelis, Sesijas, Kanāli) arī tiek automātiski atsvaidzinātas, un garas saraksti (revīzija, izmaiņas, paziņojumi utt.) tiek ielādēti pa lapām ar pogu “Rādīt vairāk”.

Pilnie katra pakalpojuma žurnāli joprojām dzīvo systemd — aihummer logs [unit] vai journalctl -u aihummer-gateway.

Grafana informācijas paneļi

Gatavas Grafana informācijas paneļu tabulas tiek piegādātas ar laidienu. Importējiet tās savā Grafana instance, lai iegūtu darbības skatījumus, neveidojot paneļus no jauna.

Ko skatīties

Tās ir signalizācijas, kas norāda, ka sistēma ir veselīga un plūsmas notiek:

Signāls Kāpēc tas ir svarīgi
Gājiena kavēšanās Aģenta gājienu galapunktu reaģētspēja
Kļūdu līmenis Neizdošanās pagriezieni / pieprasījumi — pirmais problēmu signāls
Piegādes noteikumi Vai atbildes patiešām sasniedz kanālus
Gaidāmās piegādes Nepiegādāto atbilžu uzkrājums; ilgstoša izaugsme nozīmē, ka piegāde ir iestrēgusi

Ilgstoša pieaugšana gaidāmās vai atkārtoti neizdevušās piegādes ir visskaidrākais agrīnais brīdinājums, ka piegāde aizkavējas — vērojiet to izvēršanas un incidentu laikā.

Sistēmas galapunkti

Blakus OTLP, vārteja piedāvā nelielas HTTP galapunktus, kas noderīgi sondēm, pulksteņiem un klienta diagnostikai:

Metode Galapunkts Mērķis
GET /metrics Prometeja metrikas (būvēšana, izpildlaiks, DB pieslēgumu slānis, gatavība)
GET /healthz Dzīvotspēja + versija
GET /readyz Gatavība (pārbauda Postgres; 503, ja nav pieejams)
GET /v1/ping Viegls sasniedzamības pārbaudījums
GET /v1/time Servera laiks
POST /v1/client-log Ieplūdināt klienta puses žurnāla notikumus

Veselības un gatavības pārbaudes ir detalizēti apskatītas zem systemd un veselības pārbaudes.

Kur uz nākamo