Hoppa till innehållet
Stackship-dokumentation English

ÖvervakningAdministratörerMaskinöversatt

Sidan Hälsa

Vad flikarna Karta, Noder och Databas på sidan Hälsa visar om plattformens komponenter, nodernas kapacitet och plattformens egen databas, och vem som kan öppna vilken.

Kräver: monitoring/platform/read

Hälsa visar själva plattformen snarare än någon kunds resurser: vad den består av och vilken del som är trasig, hur mycket kapacitet dess noder har kvar, och hur dess egen databas mår. Öppna den från Hälsa i sidomenyn eller kortet Hälsa på sidan Admin.

Vem som ser vad

Allt detta kontrolleras på plattformens rot.

Del Kräver Finns hos
Sidan, och fliken Noder monitoring/platform/read Platform Reader, Platform Contributor, Platform Owner
Fliken Karta kernel/platform/read Platform Reader, Platform Contributor, Platform Owner
Fliken Databas, och en komponents poddar och händelser på Karta kernel/platform/diagnose Platform Owner

Fliken Databas visas inte för den som saknar kernel/platform/diagnose. Varje flik uppdateras var 30:e sekund; 24-timmarskurvorna på Noder var 5:e minut.

Karta

Plattformens komponenter, grupperade i nivåer utifrån och in — Ingress, Kant, Moduler, Avstämning och Data — för varje kluster som är anslutet till plattformen.

  • En banderoll sammanfattar läget: Allt fungerar, eller hur många komponenter som behöver ses över, med antalet friska komponenter, komponenter med problem och komponenter som inte används.
  • Varje komponent visar sin status — frisk, försämrad, nere, ej installerad, används inte eller okänd — hur många av dess repliker som är klara, och dess version när livscykelhanteringen kan svara. En komponent som inte är frisk anger skälet.
  • Dölj komponenter som inte används tar bort komponenterna som är markerade används inte.
  • Plattformens eget kluster är märkt Det här klustret. Komponenter i andra kluster observeras inte härifrån: deras ram säger det, och visar för ett agentkluster när dess agent sågs senast, eller att dess agentidentitet har återkallats.

En Platform Owner kan välja en komponent för att se dess poddar — fas, beredskap, omstarter, nod och vad som hindrar en podd från att köra — dess senaste händelser, och varför den har fastnat när den har det. Komponentdetaljerna uppdateras var 10:e sekund.

Noder

Kapaciteten i plattformens eget kluster, från övervakningsmodulen.

Del Visar
Korten CPU, Minne och Lagring Hela klustret: Reserverat och Använt mot totalen. Lagring har ingen använd siffra; dess stapel Använt visar ett streck
Tabellen Noder Per nod: CPU reserverat, CPU använt, reserverad CPU under de senaste 24 h, Minne reserverat, Minne använt, reserverat minne under de senaste 24 h, och Lagring reserverat. Noden med den mest reserverade dimensionen kommer först; en siffra blir gul vid 75 % och röd vid 90 %
Volymer med problem Lagringsvolymer som är försämrade eller trasiga, med resursgruppen och anspråket som var och en hör till, eller utan koppling. Visas bara när det finns några
Aktiva plattformslarm Plattformslarmen som är aktiva just nu — se Plattformslarm. Visas bara när det finns några
  • Reserverat är vad poddarna som placerats på en nod har reserverat — summan av deras begäran om CPU och minne, systempoddar inräknade — mot vad noden kan tilldela poddar. Det avgör om nästa podd får plats.
  • Använt är vad noden mäter som använt, mot samma total. Det kan ligga långt under reserverat.
  • Lagring reserverat är lagringen som Longhorn har utlovat till volymrepliker på noden, mot nodens lagringskapacitet minus dess reserverade utrymme, multiplicerat med den procentsats för överallokering som övervakningsmodulen är inställd på. När den inställningen inte stämmer med Longhorns egen blir siffran fel i samma förhållande — se Longhorn.
  • Utan Longhorn utelämnas kolumnen Lagring och dess kort visar Ingen lagringsleverantör rapporterar mätvärden i det här klustret.

Databas

Plattformens eget PostgreSQL-kluster, som innehåller varje moduls data. Varje del visar det den kunde läsa; Allt kunde inte läsas listar det den inte kunde läsa, och varför.

Del Visar
Bakgrundsjobb som aldrig har lyckats Högst upp, i rött: databasens bakgrundsjobb som har körts och aldrig en enda gång lyckats. Övervakningsmodulens lagringstid, komprimering och sammanräkningar körs som sådana jobb — se Lagring och lagringstid för mätvärden
Ett arkiv som inte fungerar fyller den här databasens volym Visas medan plattformens säkerhetskopior rapporterar att misslyckad arkivering av transaktionsloggen (WAL) fyller volymen, med länken Pausa eller återuppta arkiveringen under Plattform → Säkerhetskopior
Klustret Namn, fas och avbild; Failover pågår från en instans till en annan; varje instans som Primär eller Replika och om den är frisk; Senaste lyckade säkerhetskopia; Återställningsbar från; länken Öppna Plattform → Säkerhetskopior
Anslutningar Anslutningar som Används mot maxantalet, antalet per tillstånd, Längsta transaktion och Väntar på lås. En anteckning säger när frågetexten är dold för att plattformens databasroll inte kan läsa andra rollers frågor
Lagring Databasstorlek mot volymkapacitet, och storleken på varje databas. Storleken räknar inte med transaktionsloggen (WAL) och temporära filer, så volymen rymmer mer än den visar
Bakgrundsjobb Varje bakgrundsjobb, med hur många av dess körningar som lyckades