Symptome und Geltungsbereich
- Eine Anwendung friert ein und die Anzeige kann nach einem Reset zurückkehren.
- Der Kernel meldet i915 GPU HANG mit Fehlercode.
Betroffene Umgebung
Intel-GPUs mit i915-Bindung. Neuere GPUs oder xe-Konfigurationen haben andere Erfassungsschnittstellen; i915-Pfade dort nicht ungeprüft verwenden.
Erkennbare Meldungen (synthetische Beispiele)
i915 0000:00:02.0: [drm] GPU HANG: ecode 9:1:85dffffb, in render-app [2400]Fehlerzustand vor einem weiteren Vorfall sichern; das Muster ordnet CPU-Watchdog-Ereignisse und xe-Fehler bewusst nicht zu.
Mögliche Ursachen
Das sind mögliche Erklärungen, keine bestätigte Diagnose. Mehrere unabhängige Fehler können gleichzeitig vorliegen.
- Kernel-Scheduling oder ein Userspace-Treiberfehler bei der Auftragseinreichung kann eine Engine blockieren.
- Energieverwaltung, Firmware-Wechselwirkungen und Hardware-Instabilität bleiben möglich; der Fehlercode benötigt den umgebenden Mitschnitt.
Sicher prüfen
Führe jeweils einen Befehl in der passenden Sitzung aus. Lies zuerst die Erklärung. Großgeschriebene Platzhalter brauchen deine Werte; Werkzeuge und Rechte unterscheiden sich je nach Distribution. Die Website zeigt Befehle an und führt sie niemals aus.
Prüfschritt 1
Intel-GPU-Kernelereignisse lesen; Journalzugriff kann Administratorrechte erfordern.
journalctl -b -k --no-pager --grep='i915|GPU HANG|xe 'Ergebnis einordnen: Aktiven Treiber i915 oder xe bestätigen und zuerst betroffene Engine bestimmen. Eine spätere Reset-Zeile ist ein Wiederherstellungsversuch, keine eigenständige Ursache.
Prüfschritt 2
card0 durch die über lspci/sysfs ermittelte i915-Karte ersetzen. Nur bei vorhandener Schnittstelle lesen; Zugriff kann Administratorrechte erfordern.
cat /sys/class/drm/card0/errorErgebnis einordnen: Ein gespeicherter Fehlerzustand hilft beim Treiberbericht. No error state collected schließt einen Hänger nicht aus; Erfassung kann deaktiviert oder bereits gelöscht sein.
Nächste Schritte nach Befund
Ersten Fehlerzustand sichern
Bleibt das System erreichbar, ersten i915-Fehlerzustand und vollständige Kernel-Meldungen vor Neustart oder erneutem Auslösen sichern. GPU-PCI-ID, Kernel- und Mesa-Versionen einem minimalen Upstream-Bericht hinzufügen.
Vorsicht: Mitschnitte vor Veröffentlichung auf Prozessnamen oder Pfade prüfen. Fehlerzustand nicht löschen und aktive Anzeige-GPU nicht manuell zum Erfassen zurücksetzen.
Wiederherstellung / Rücknahme: Das Lesen ändert keine GPU-Konfiguration; nach der Erfassung zu einem normalen unterstützten Start zurückkehren.
Hat dir dieser Hinweis geholfen?
Vorhandenen unterstützten Stack vergleichen
Folgt der erste Hänger einem Update, installierten unterstützten älteren Kernel oder Mesa-Snapshot bei gleicher Minimal-Arbeitslast vergleichen. Bei nur einer betroffenen Anwendung zuerst deren optionale Overlays entfernen.
Vorsicht: Jeweils eine Schicht ändern und funktionierenden Starteintrag behalten. Energieoptionen nicht aufgrund eines Berichts zu einer anderen GPU global abschalten.
Wiederherstellung / Rücknahme: Bei fehlender Verbesserung den ursprünglichen Kernel wählen oder Paket-Snapshot und Anwendungsprofil wiederherstellen.
Hat dir dieser Hinweis geholfen?
Quellen und Prüfung
Diese Anleitung basiert auf Originalquellen von Projekten oder Distributionen und wurde am genannten Datum redaktionell geprüft. Das ist eine Quellenprüfung, kein Nachweis einer auf deiner Hardware reproduzierten Lösung. Log-Beispiele sind synthetische Testdaten. Versionsabhängige Details müssen zur installierten Ausgabe passen.
- Intel i915 driver architecture and error handling (Projekt- oder Distributionsdokumentation)
- i915 GPU error capture implementation (Upstream-Implementierung; Verhalten ist versionsabhängig)