Lietotnes novērojamība
Pieejamība
Novērojamības API ir daļēji implementēts. Šodien noderīgi divi datu avoti:
- tikai append-only, manuāli aizpildīta notikumu timeline; un
- pašreizējais VM resursu sadalījums, ko ziņo libvirt.
Tālāk ir tikai līguma priekšskatījums:
- pieprasījumu analītika atgriež tukšu rollup sarakstu, jo access-log ingestion nedarbojas;
- uptime-probe konfigurācija tiek saglabāta, bet neviens scheduler neveic HTTP pārbaudes;
- resource samples ir tukši, jo sampler nedarbojas; un
- app log streaming nav implementēts.
Nav pabeigta novērojamības dashboard. Saglabāta probe konfigurācija nav pierādījums, ka endpoint tika pārbaudīts.
Pašreizējā REST virsma
Maršruti atrodas zem /api/app-gateway.
| Metode | Ceļš | Ko tas pierāda šodien |
|---|---|---|
GET | /analytics/{slug}?days=7 | Līgums ir sasniedzams; rollups gaidāms tukšs. |
PUT | /probes/{slug} | Probe konfigurācija tika validēta un saglabāta. |
GET | /probes/{slug} | Saglabāto konfigurāciju var nolasīt. Runtime statuss paliek nenoteikts. |
DELETE | /probes/{slug} | Saglabātā konfigurācija tika noņemta. |
POST | /events/{slug} | Caller piegādāts notikums tika pievienots. |
GET | /events/{slug}?limit=100 | Saglabātos notikumus var lasīt jaunākos vispirms. |
GET | /metrics/{slug}?vm_name={name} | Var tikt atgriezts pašreizējais sadalījums; samples ir tukšs. |
Probe konfigurācija
PUT /api/app-gateway/probes/my-app
Content-Type: application/json
{
"path": "/healthz",
"interval_s": 60,
"expected_status": 200,
"timeout_s": 5,
"enabled": true
}Lasījums pašlaik izskatās šādi:
{
"config": {
"path": "/healthz",
"interval_s": 60,
"expected_status": 200,
"timeout_s": 5,
"enabled": true
},
"last_run_at": null,
"last_status": null,
"last_http_status": null,
"consecutive_failures": 0
}Svarīgs signāls ir null runtime lauki: neviena pārbaude nav izpildīta. Izmantojiet ārēju monitoru availability brīdinājumiem, kamēr scheduler nav izlaists.
Notikumi
Notikumi ir ilgstoši ieraksti, kas rakstīti caur API, nevis automātiski pilns audit trail. Deployment, checkpoint, domain un walker hooks vēl gaida, tāpēc caller nedrīkst pieņemt, ka šīs darbības parādīsies bez explicit append.
Uzskatiet notikumu metadatus par caller piegādātiem datiem. Nelieciet tajos secrets.
Resursu sadalījums
Metrics maršruts var ziņot piešķirtos vCPU, atmiņu un diskus, kad libvirt ir pieejama atbilstoša VM. Tas vēl neziņo time series vai application-level health. Sadalījums ir capacity konfigurācija, ne pierādījums, ka lietotne izmantoja vai izturēja šo capacity.
Operacionālie ieteikumi
Kamēr ingestion un worker loop nav izvietoti:
- izmantojiet ārēju HTTP monitoru uptime;
- vāciet application logs ar operator-managed mehānismu;
- izmantojiet libvirt vai host telemetriju faktiskam utilization; un
- pievienojiet timestamps un source evidence incident records, nevis paļaujieties tikai uz priekšskatījuma notikumu sarakstu.
Funkciju var uzskatīt par gatavu tikai pēc tam, kad restart-safe ingest, probe, sampling un log-stream worker ir izturējuši end-to-end failure un recovery testus.