Unter Linux zählt der Load Average Prozesse im uninterruptible sleep genauso mit wie lauffähige, hohe Last bei leerlaufenden CPUs heißt also fast immer, dass Prozesse auf I/O blockieren. Prüf iowait und Device-Auslastung mit iostat, such nach Prozessen im D-State und denk an eine langsame Disk, ein hängendes Netzwerkdateisystem oder ein gesättigtes Storage-Volume. Gelegentlich ist es Lock Contention oder ein hängender Mount statt Durchsatz.
Warum Interviewer das fragen
Das ist eine klassische Linux-Grundlagenfrage, an der viele Infrastruktur-Kandidaten scheitern, weil sie annehmen, Load sei gleich CPU-Bedarf. Der Interviewer will das Detail zum uninterruptible sleep und danach einen methodischen Diagnosepfad mit konkreten Tools. Es zeigt außerdem, ob du über eine laufende Kiste nachdenken kannst, statt sie sofort neu zu starten und zu hoffen, dass das Symptom verschwindet.
So baust du deine Antwort auf
- Korrigier die Annahme: Load enthält unter Linux uninterruptible sleep.
- Nenne I/O-Blockieren als wahrscheinliche Ursache.
- Gib die Diagnosesequenz mit konkreten Kommandos.
- Erwähn die selteneren Ursachen, bevor du ein Fazit ziehst.
Beispielantwort
Load Average ist unter Linux keine CPU-Queue, er zählt lauffähige plus uninterruptible Prozesse, Prozesse, die auf Disk oder einen Netzwerk-Mount warten, blähen ihn also auf, während die CPUs leerlaufen. Mein erster Schritt ist deshalb, genau das zu bestätigen: ps nach Prozessen im D-State und vmstat oder top für die iowait-Spalte. Dann iostat, um zu sehen, ob ein Device bei hundert Prozent Auslastung mit übler await-Zeit steht, was auf eine gesättigte oder sterbende Disk hindeutet oder auf ein Cloud-Volume, dem die Burst Credits ausgegangen sind, was ich mehr als einmal auf einem General-Purpose-Volume erlebt habe, das monatelang fein war und dann plötzlich nicht mehr. Wenn die D-State-Prozesse alle denselben Mount anfassen, schaue ich auf das Netzwerkdateisystem, denn ein hängender NFS-Export erzeugt genau dieses Bild, riesige Last und nichts passiert. Sieht das Storage gesund aus, weite ich auf Lock Contention oder ein Treiberproblem aus. Wichtig ist: Die Anwendung hier neu zu starten würde mir nichts sagen, denn die Anwendung ist das Opfer, nicht die Ursache.
Steht dieses Vorstellungsgespräch bald an? GhostPilot hört bei deinem Live-Call mit, erkennt die Frage in dem Moment, in dem sie gestellt wird, und bringt dir eine strukturierte Antwort in Echtzeit auf den Bildschirm. Probier es im nächsten Mock aus, oder hol dir einen $29 Session Pass, kein Abo, für den Ernstfall.
So funktioniert esNachfragen, mit denen du rechnen solltest
- Wie unterscheidest du ein gesättigtes von einem sterbenden Volume?
- Was bedeutet ein Prozess im D-State für ein Kill-Signal?
- Auf welche Metrik würdest du statt Load Average tatsächlich alarmieren?
Weitere Fragen für DevOps Engineer
Dein Interviewer stellt seine eigene Version davon. Kopier deine echte Stellenbeschreibung in den kostenlosen Question Predictor und bekomm die 20 Fragen, die diese Rolle am wahrscheinlichsten stellt, samt dem, worauf jede wirklich abzielt.
Meine Fragen vorhersagen