Grafik, GPU und Anzeige

Intel i915 meldet einen GPU-Hänger

Ein i915-GPU-Hänger kann eine Engine oder den ganzen Desktop treffen; Fehlerzustand sichern und Arbeitslast, Kernel sowie Userspace getrennt vergleichen.

Auf dieser Seite
  1. Symptome und Geltungsbereich
  2. Mögliche Ursachen
  3. Sicher prüfen
  4. Nächste Schritte nach Befund
  5. Quellen und Prüfung
  6. Verwandte Probleme

Symptome und Geltungsbereich

  • Eine Anwendung friert ein und die Anzeige kann nach einem Reset zurückkehren.
  • Der Kernel meldet i915 GPU HANG mit Fehlercode.

Betroffene Umgebung

Intel-GPUs mit i915-Bindung. Neuere GPUs oder xe-Konfigurationen haben andere Erfassungsschnittstellen; i915-Pfade dort nicht ungeprüft verwenden.

Erkennbare Meldungen (synthetische Beispiele)
i915 0000:00:02.0: [drm] GPU HANG: ecode 9:1:85dffffb, in render-app [2400]

Fehlerzustand vor einem weiteren Vorfall sichern; das Muster ordnet CPU-Watchdog-Ereignisse und xe-Fehler bewusst nicht zu.

Mögliche Ursachen

Das sind mögliche Erklärungen, keine bestätigte Diagnose. Mehrere unabhängige Fehler können gleichzeitig vorliegen.

  • Kernel-Scheduling oder ein Userspace-Treiberfehler bei der Auftragseinreichung kann eine Engine blockieren.
  • Energieverwaltung, Firmware-Wechselwirkungen und Hardware-Instabilität bleiben möglich; der Fehlercode benötigt den umgebenden Mitschnitt.

Sicher prüfen

Führe jeweils einen Befehl in der passenden Sitzung aus. Lies zuerst die Erklärung. Großgeschriebene Platzhalter brauchen deine Werte; Werkzeuge und Rechte unterscheiden sich je nach Distribution. Die Website zeigt Befehle an und führt sie niemals aus.

Prüfschritt 1

Intel-GPU-Kernelereignisse lesen; Journalzugriff kann Administratorrechte erfordern.

journalctl -b -k --no-pager --grep='i915|GPU HANG|xe '

Ergebnis einordnen: Aktiven Treiber i915 oder xe bestätigen und zuerst betroffene Engine bestimmen. Eine spätere Reset-Zeile ist ein Wiederherstellungsversuch, keine eigenständige Ursache.

Prüfschritt 2

card0 durch die über lspci/sysfs ermittelte i915-Karte ersetzen. Nur bei vorhandener Schnittstelle lesen; Zugriff kann Administratorrechte erfordern.

cat /sys/class/drm/card0/error

Ergebnis einordnen: Ein gespeicherter Fehlerzustand hilft beim Treiberbericht. No error state collected schließt einen Hänger nicht aus; Erfassung kann deaktiviert oder bereits gelöscht sein.

Nächste Schritte nach Befund

Ersten Fehlerzustand sichern

Bleibt das System erreichbar, ersten i915-Fehlerzustand und vollständige Kernel-Meldungen vor Neustart oder erneutem Auslösen sichern. GPU-PCI-ID, Kernel- und Mesa-Versionen einem minimalen Upstream-Bericht hinzufügen.

Vorsicht: Mitschnitte vor Veröffentlichung auf Prozessnamen oder Pfade prüfen. Fehlerzustand nicht löschen und aktive Anzeige-GPU nicht manuell zum Erfassen zurücksetzen.

Wiederherstellung / Rücknahme: Das Lesen ändert keine GPU-Konfiguration; nach der Erfassung zu einem normalen unterstützten Start zurückkehren.

Hat dir dieser Hinweis geholfen?

Hinweis teilen#

Vorhandenen unterstützten Stack vergleichen

Folgt der erste Hänger einem Update, installierten unterstützten älteren Kernel oder Mesa-Snapshot bei gleicher Minimal-Arbeitslast vergleichen. Bei nur einer betroffenen Anwendung zuerst deren optionale Overlays entfernen.

Vorsicht: Jeweils eine Schicht ändern und funktionierenden Starteintrag behalten. Energieoptionen nicht aufgrund eines Berichts zu einer anderen GPU global abschalten.

Wiederherstellung / Rücknahme: Bei fehlender Verbesserung den ursprünglichen Kernel wählen oder Paket-Snapshot und Anwendungsprofil wiederherstellen.

Hat dir dieser Hinweis geholfen?

Hinweis teilen#

Quellen und Prüfung

Diese Anleitung basiert auf Originalquellen von Projekten oder Distributionen und wurde am genannten Datum redaktionell geprüft. Das ist eine Quellenprüfung, kein Nachweis einer auf deiner Hardware reproduzierten Lösung. Log-Beispiele sind synthetische Testdaten. Versionsabhängige Details müssen zur installierten Ausgabe passen.