Alkalmazás-megfigyelhetőség
Elérhetőség
A megfigyelhetőségi API részlegesen implementált. Ma két adatforrás hasznos:
- append-only, kézzel feltöltött eseményidővonal; és
- a libvirt által jelentett aktuális VM-erőforrás-allokáció.
Az alábbiak csak szerződés-előnézetek:
- a request analytics üres rollup listát ad vissza, mert az access-log ingestion nem fut;
- az uptime-probe konfiguráció megmarad, de egyetlen scheduler sem végzi az HTTP ellenőrzéseket;
- az erőforrás-minták üresek, mert a sampler nem fut; és
- az alkalmazáslog-streaming nincs implementálva.
Nincs kész megfigyelhetőségi irányítópult. A tárolt probe-konfiguráció nem bizonyítja, hogy egy endpoint ellenőrizve lett.
Jelenlegi REST felület
Az útvonalak az /api/app-gateway alatt vannak.
| Method | Path | Mit igazol ma |
|---|---|---|
GET | /analytics/{slug}?days=7 | A szerződés elérhető; a rollups üresnek várható. |
PUT | /probes/{slug} | A probe-konfiguráció validálva és tárolva lett. |
GET | /probes/{slug} | A tárolt konfiguráció olvasható. A runtime status unset marad. |
DELETE | /probes/{slug} | A tárolt konfiguráció törölve lett. |
POST | /events/{slug} | A hívó által megadott esemény hozzá lett fűzve. |
GET | /events/{slug}?limit=100 | A tárolt események olvashatók a legújabbtól. |
GET | /metrics/{slug}?vm_name={name} | Visszaadható az aktuális allokáció; a samples üres. |
Probe-konfiguráció
PUT /api/app-gateway/probes/my-app
Content-Type: application/json
{
"path": "/healthz",
"interval_s": 60,
"expected_status": 200,
"timeout_s": 5,
"enabled": true
}Az olvasás jelenleg így néz ki:
{
"config": {
"path": "/healthz",
"interval_s": 60,
"expected_status": 200,
"timeout_s": 5,
"enabled": true
},
"last_run_at": null,
"last_status": null,
"last_http_status": null,
"consecutive_failures": 0
}A null runtime mezők a fontos jel: egyetlen ellenőrzés sem futott le. Elérhetőségi riasztásokhoz használj külső monitort, amíg a scheduler ki nem száll.
Események
Az események az API-n keresztül írt tartós rekordok, nem automatikusan teljes audit trail. A deployment, checkpoint, domain és walker hookok még pending állapotban vannak, ezért a hívók nem feltételezhetik, hogy ezek a tevékenységek explicit append nélkül megjelennek.
Az esemény metaadatokat hívó által megadott adatként kezeld. Ne tegyél bele secrets-et.
Erőforrás-allokáció
A metrics útvonal jelentheti a hozzárendelt vCPU-kat, memóriát és lemezeket, ha a libvirt elérhetővé tesz egy megfelelő VM-et. Még nem ad idősorokat vagy alkalmazásszintű health-et. Az allokáció kapacitás-konfiguráció, nem bizonyíték arra, hogy az alkalmazás használta vagy túlélte ezt a kapacitást.
Üzemeltetési útmutató
Amíg az ingestion és a worker hurkok nincsenek telepítve:
- használj külső HTTP monitort az uptime-hoz;
- gyűjts alkalmazáslogokat operátor által kezelt mechanizmussal;
- használj libvirtet vagy host telemetriát a tényleges kihasználtsághoz; és
- csatolj időbélyegeket és forrásbizonyítékot az incidensrekordokhoz ahelyett, hogy csak az előnézeti eseménylistára hagyatkoznál.
A funkció csak akkor mutatható készként, ha a restart-safe ingest, probe, sampling és log-stream workerek átmentek a végponttól végpontig tartó hiba- és helyreállítási teszteken.