Symptome und Geltungsbereich
- Das System reagiert nicht mehr auf normale Interrupts oder startet durch Panic-Richtlinie neu.
- Der Kernel meldet Watchdog detected hard LOCKUP für eine CPU.
Betroffene Umgebung
Kernel mit NMI-/Perf- oder anderem unterstütztem Hardlockup-Detektor. Ein stilles Einfrieren ohne Watchdog-Meldung wird hier nicht eingeordnet.
Erkennbare Meldungen (synthetische Beispiele)
NMI watchdog: Watchdog detected hard LOCKUP on cpu 1NMI-Spur und früheren Hardware-Kontext prüfen; fehlende Detektormeldung schließt stillen Systemstillstand nicht aus.
Mögliche Ursachen
Das sind mögliche Erklärungen, keine bestätigte Diagnose. Mehrere unabhängige Fehler können gleichzeitig vorliegen.
- Ein Kernelpfad kann mit abgeschalteten Interrupts schleifen oder CPU-Fortschritt blockieren.
- Hardware-Instabilität oder Plattformprobleme können ebenfalls Fortschritt stoppen; der Watchdog meldet Erkennung, kein eindeutig defektes Bauteil.
Sicher prüfen
Führe jeweils einen Befehl in der passenden Sitzung aus. Lies zuerst die Erklärung. Großgeschriebene Platzhalter brauchen deine Werte; Werkzeuge und Rechte unterscheiden sich je nach Distribution. Die Website zeigt Befehle an und führt sie niemals aus.
Prüfschritt 1
Nach Wiederherstellung vorherigen gespeicherten Start bei Bedarf mit Administratorzugriff lesen; bei erreichbarem selben Start -b nutzen.
journalctl -b -1 -k --no-pager --grep='hard LOCKUP|watchdog|Hardware Error|Call Trace|RIP:'Ergebnis einordnen: Erste Watchdog-Spur und vorherige Hardwarefehler sichern. Leere Vorprotokolle können fehlende Speicherung oder Schreiben während Blockade bedeuten.
Prüfschritt 2
Vorhandene Detektor-/Panic-Richtlinie ohne Zuweisung lesen; Kernel-Build und Architektur können diese Schlüssel weglassen.
sysctl kernel.nmi_watchdog kernel.hardlockup_panicErgebnis einordnen: Fehlender oder abgeschalteter Detektor erklärt fehlende Belege, keinen gesunden Rechner. Panic-Einstellung kann Neustart nach Erkennung erklären.
Nächste Schritte nach Befund
Bei unterstützten Plattformstandards vergleichen
Ging Tuning den Blockaden voraus, dokumentierte CPU-/Speicherstandards wiederherstellen und nur kurzen nicht zerstörenden Auslöser vergleichen. Erscheint gleiche Spur nach Kernel-Update, bereits installierten unterstützten älteren Kernel vergleichen.
Vorsicht: Wichtige Daten sichern und wiederholte harte Stromunterbrechungen vermeiden. Mehrere Firmware- und Kerneloptionen zugleich zu ändern zerstört brauchbare Vergleichshinweise.
Wiederherstellung / Rücknahme: Vorhandenen ursprünglichen unterstützten Eintrag starten; nur dokumentierte stabile Hardware-Einstellungen statt bekannten auslösenden Tunings zurückstellen.
Hat dir dieser Hinweis geholfen?
Unterstützte Absturzerfassung planen
Gehen bei wiederholten Hardlockups alle Meldungen verloren, im Wartungsfenster unterstützte kdump- oder externe Konsolenerfassung der Distribution vorbereiten und früheste Spur melden. Konfiguration ohne absichtlichen Absturz einer Produktionssitzung prüfen.
Vorsicht: Speicherabbilder können sensible Daten enthalten und RAM reservieren. Kdump startet bei Hardwarefehlern oder stillstehenden gesamten CPUs nicht garantiert.
Wiederherstellung / Rücknahme: Bei Betriebsproblemen vorherige Absturzerfassungskonfiguration und Speicherreservierung beim Start wiederherstellen.
Hat dir dieser Hinweis geholfen?
Quellen und Prüfung
Diese Anleitung basiert auf Originalquellen von Projekten oder Distributionen und wurde am genannten Datum redaktionell geprüft. Das ist eine Quellenprüfung, kein Nachweis einer auf deiner Hardware reproduzierten Lösung. Log-Beispiele sind synthetische Testdaten. Versionsabhängige Details müssen zur installierten Ausgabe passen.
- Kernel hard-lockup detector behavior (Projekt- oder Distributionsdokumentation)
- Kernel kdump capture and requirements (Projekt- oder Distributionsdokumentation)