Der Server wird langsam. Welche Zahlen erklären warum?
CPU ist nur ein Teil des Bildes. Verbinden Sie Antwortzeiten, Fehler, Arbeitsspeicher, Datenträger und Warteschlangen bei der Diagnose.

Die Website lädt langsam und der erste Blick geht zur CPU. Deren Auslastung sieht vernünftig aus. Der Server könnte auf Datenträger, Datenbank, freie Verbindung oder externe API warten. Beginnen Sie bei dem Symptom, das Nutzer sehen, und suchen Sie anschließend die Begrenzung. Eine einzige Zahl erklärt keinen vollständigen Dienst.
Beginnen Sie mit Antwortzeit, Fehlern und Verkehr
Vergleichen Sie die langsame Phase mit dem Normalbetrieb. Stieg die Anzahl der Anfragen, änderten sich die Vorgänge oder kamen Fehler hinzu? Trennen Sie Anwendungsarbeit von Wartezeit auf Abhängigkeiten. Ergänzen Sie Durchschnittswerte durch interne Perzentile: Eine kleine Gruppe sehr langsamer Anfragen geht im Mittelwert leicht unter.
Externe Prüfungen zeigen die Verschlechterung. Interne Metriken und Logs helfen, die Stelle zu finden. Nutzen Sie dieselbe Zeitreferenz, damit sich beide mit Deployments und Hintergrundaufgaben vergleichen lassen.
Lesen Sie CPU und Speicher im Zusammenhang
Hohe CPU-Auslastung bei Stapelverarbeitung kann erwartet sein. Niedrige Auslastung bei langsamer Website kann auf das Warten auf andere Ressourcen hinweisen. Unterscheiden Sie nützlichen Cache von Speicherdruck, der Swap oder Prozessabbrüche verursacht. Prüfen Sie Containergrenzen ebenso wie die gesamte Maschinenkapazität.
Datenträger und Warteschlangen zeigen versteckte Wartezeit
Kontrollieren Sie freien Platz, verfügbare Inodes und Speicherlatenz. Ein voller Datenträger kann Logs und Datenbankschreibzugriffe blockieren. Die übertragene Datenmenge allein zeigt nicht, wie lange Vorgänge warten. Ergänzen Sie bei der Datenbank langsame Abfragen, Sperren und belegte Verbindungen.
Eine wachsende Warteschlange zeigt häufig, dass mehr Arbeit ankommt als verarbeitet wird. Messen Sie zusätzlich zur Länge das Alter der ältesten Aufgabe. Auch eine kurze Schlange mit einem sehr alten Eintrag kann einen festhängenden Prozess oder Verarbeitungsfehler aufdecken.
Erhöhen Sie Kapazität nach Prüfung des Engpasses
Zusätzliche Anwendungsinstanzen helfen nicht unbedingt, wenn alle auf dieselbe Datenbank warten. Sie können sogar den Verbindungsdruck erhöhen. Finden Sie zunächst die Begrenzung, führen Sie einen kleinen Eingriff durch und vergleichen Sie vorher und nachher. Auch eine vorübergehende Lösung sollte ein messbares Ergebnis haben.
- Antwortzeit, Fehlerquote und Anzahl der Anfragen.
- CPU, Arbeitsspeicher und Prozess- oder Containergrenzen.
- Freier Platz, Inodes und Speicherlatenz.
- Datenbanksperren, Verbindungen und Alter von Aufgaben.
Was Sie mitnehmen
Sammeln Sie eine kleine Menge von Messwerten, die sich mit Kundenauswirkungen verbinden lässt. Der beste Überblick enthält nicht die meisten Graphen, sondern führt zum richtigen Eingriff.


