Skip to Content
TestingObservability app

Observability app

Disponibilità

L’API observability è parzialmente implementata. Due sorgenti dati sono utili oggi:

  • timeline eventi append-only popolata manualmente; e
  • allocazione risorse VM corrente riportata da libvirt.

Quanto segue sono solo anteprime contratto:

  • analytics richieste restituisce elenco rollup vuoto perché ingest log accesso non gira;
  • configurazione uptime-probe persiste, ma nessuno scheduler esegue controlli HTTP;
  • sample risorse sono vuoti perché il sampler non gira; e
  • streaming log app non è implementato.

Non c’è dashboard observability completata. Configurazione probe memorizzata non è prova che un endpoint sia stato controllato.

Superficie REST attuale

Le route stanno sotto /api/app-gateway.

MetodoPathCosa prova oggi
GET/analytics/{slug}?days=7Il contratto è raggiungibile; rollups è atteso vuoto.
PUT/probes/{slug}Configurazione probe validata e memorizzata.
GET/probes/{slug}Configurazione memorizzata leggibile. Stato runtime resta unset.
DELETE/probes/{slug}Configurazione memorizzata rimossa.
POST/events/{slug}Evento fornito dal chiamante appendato.
GET/events/{slug}?limit=100Eventi memorizzati leggibili newest-first.
GET/metrics/{slug}?vm_name={name}Allocazione corrente può essere restituita; samples è vuoto.

Configurazione probe

PUT /api/app-gateway/probes/my-app Content-Type: application/json { "path": "/healthz", "interval_s": 60, "expected_status": 200, "timeout_s": 5, "enabled": true }

Una lettura attuale assomiglia a:

{ "config": { "path": "/healthz", "interval_s": 60, "expected_status": 200, "timeout_s": 5, "enabled": true }, "last_run_at": null, "last_status": null, "last_http_status": null, "consecutive_failures": 0 }

I campi runtime null sono il segnale importante: nessun controllo è girato. Usa monitor esterno per alerting disponibilità finché lo scheduler non è shipped.

Eventi

Gli eventi sono record duraturi scritti tramite API, non audit trail automaticamente completo. Hook deploy, checkpoint, dominio e walker sono ancora pending, quindi i chiamanti non devono assumere che quelle attività compaiano senza append esplicito.

Tratta metadati evento come dati forniti dal chiamante. Non mettere segreti.

Allocazione risorse

La route metrics può riportare vCPU, memoria e dischi assegnati quando una VM corrispondente è disponibile da libvirt. Non riporta ancora serie temporale o salute a livello applicazione. Allocazione è configurazione capacità, non evidenza che l’applicazione abbia usato o sopravvissuto a quella capacità.

Guida operativa

Finché ingest e loop worker non sono deployati:

  1. usa monitor HTTP esterno per uptime;
  2. raccogli log applicazione con meccanismo gestito operatore;
  3. usa libvirt o telemetria host per utilizzo reale; e
  4. allega timestamp ed evidenza sorgente ai record incidente invece di affidarti solo all’elenco eventi preview.

La feature può essere presentata pronta solo dopo che worker ingest, probe, sampling e log-stream restart-safe hanno superato test failure e recovery end-to-end.