Rakenduse jälgitavus
Saadavus
Jälgitavuse API on osaliselt implementeeritud. Täna on kasulikud kaks andmeallikat:
- ainult append-only, käsitsi täidetud sündmuste timeline; ja
- praegune VM ressursi jaotus, mida libvirt teatab.
Järgmine on ainult lepingu eelvaade:
- päringuanalüütika tagastab tühja rollup nimekirja, sest access-log ingestion ei tööta;
- uptime-probe konfiguratsioon püsib, kuid ükski scheduler ei tee HTTP kontrolle;
- resource samples on tühjad, sest sampler ei tööta; ja
- app log streaming pole implementeeritud.
Valmis jälgitavuse dashboard puudub. Salvestatud probe konfiguratsioon ei tõesta, et endpointit kontrolliti.
Praegune REST pind
Marsruudid asuvad all /api/app-gateway.
| Meetod | Tee | Mida see täna tõestab |
|---|---|---|
GET | /analytics/{slug}?days=7 | Leping on kättesaadav; rollups oodatakse tühjana. |
PUT | /probes/{slug} | Probe konfiguratsioon valideeriti ja salvestati. |
GET | /probes/{slug} | Salvestatud konfiguratsiooni saab lugeda. Runtime status jääb määramata. |
DELETE | /probes/{slug} | Salvestatud konfiguratsioon eemaldati. |
POST | /events/{slug} | Caller poolt antud sündmus lisati. |
GET | /events/{slug}?limit=100 | Salvestatud sündmusi saab lugeda uuemad enne. |
GET | /metrics/{slug}?vm_name={name} | Praegune jaotus võib tagasi tulla; samples on tühi. |
Probe konfiguratsioon
PUT /api/app-gateway/probes/my-app
Content-Type: application/json
{
"path": "/healthz",
"interval_s": 60,
"expected_status": 200,
"timeout_s": 5,
"enabled": true
}Lugemine näeb praegu välja nii:
{
"config": {
"path": "/healthz",
"interval_s": 60,
"expected_status": 200,
"timeout_s": 5,
"enabled": true
},
"last_run_at": null,
"last_status": null,
"last_http_status": null,
"consecutive_failures": 0
}Oluline märk on null runtime väljad: ühtegi kontrolli pole käivitatud. Kasutage availability hoiatusete jaoks välist monitorit, kuni scheduler on välja antud.
Sündmused
Sündmused on API kaudu kirjutatud püsivad kirjed, mitte automaatselt täielik audit trail. Deployment, checkpoint, domain ja walker hooks on endiselt ootel, seega caller ei tohi eeldada, et need tegevused ilmuvad ilma explicit appendita.
Käsitle sündmuse metaandmeid caller poolt antud andmetena. Ära pane sinna secrets.
Ressursi jaotus
Metrics marsruut võib teatada määratud vCPU-sid, mälu ja kettaid, kui libvirtist on saadaval sobiv VM. See ei teata veel time series ega application-level health. Jaotus on capacity konfiguratsioon, mitte tõend, et rakendus seda capacity kasutas või üle elas.
Operatiivsed juhised
Kuni ingestion ja worker loop pole paigaldatud:
- kasuta uptime jaoks välist HTTP monitorit;
- kogu application logs operator-managed mehhanismiga;
- kasuta tegeliku utilization jaoks libvirti või host telemeetriat; ja
- lisa incident records timestampid ja source evidence, ära toetu ainult eelvaate sündmuste nimekirjale.
Funktsiooni võib pidada valmis alles pärast seda, kui restart-safe ingest, probe, sampling ja log-stream worker on läbinud end-to-end failure ja recovery testid.