opsmith / linux-system-administration / Modul

Performance und Kapazität

Latenz, Durchsatz, Sättigung und Kapazitätsreserven mit passenden Signalen statt Bauchgefühl beurteilen.

Performance als Warteschlangenproblem lesen

Einführung · 4 Abschnitte · ~13 Min Lesezeit · Stand

Die Betriebsfrage

Wo entsteht die Wartezeit eines Dienstes, welche Sättigung begrenzt ihn, und wie beweist du die Wirkung einer Kapazitäts- oder Tuningentscheidung?

Vier Signale

LatenzZeigt die Nutzerwirkung, aber nicht allein die Ursache.
TrafficBeschreibt Nachfrage und Arbeitseinheiten.
ErrorsTrennt langsame von fehlgeschlagenen Vorgängen.
SaturationZeigt eine begrenzte Ressource nahe ihrer effektiven Kapazität.

Messschleife

  1. SLO-relevantes Symptom und Baseline erfassen
  2. Engpasshypothese mit mehreren Signalen formulieren
  3. kleine reversible Änderung unter repräsentativer Last testen
  4. Wirkung und neue Grenze dokumentieren

Vor dem Check

Gelesen ist nicht geprüft: Im Modul entscheidest du die Fälle selbst und siehst danach, wo dein Urteil trägt.

5 Checks starten →

Modul-Aufbau

EINFÜHRUNGPerformance als Warteschlangenproblem lesen~13 Min
ADR-001SATURATIONsenior
ADR-002CAPACITY-PLANNINGprincipal
TRACE-003MISSION · PERFORMANCE-EVIDENCEprincipal
ADR-004CAPACITY-CHANGEprincipal
ADR-005PERFORMANCE-EVIDENCEsenior

Quellen

  1. 01sre.google/sre-book/monitoring-distributed-systems
  2. 02docs.kernel.org/admin-guide/pm/cpufreq.html
  3. 03man7.org/linux/man-pages/man1/vmstat.1.html
  4. 04sre.google/workbook/capacity-planning
  5. 05man7.org/linux/man-pages/man1/df.1.html