Eine integrierte GPU bleibt nur dann verfügbar, wenn der neue Kernel sie erkennt, den korrekten Treiber bindet, Render-Nodes erstellt und sie für die Arbeitslast bereitstellt.
Nach einer Kernel-Aktualisierung auf einem Home-Server kann eine Medien-App auf Softwareverarbeitung zurückfallen, obwohl der Schalter für die Hardwarebeschleunigung weiterhin aktiviert ist. Der Fehler kann bei der PCI-Erkennung, der Bindung des Kernel-Moduls, dem Laden der Firmware, der Erstellung des DRM-Geräts, der VA-API-Initialisierung, den Geräteberechtigungen, der Docker-Zuweisung oder dem FFmpeg-Pfad des Medienservers auftreten. Überprüfen Sie diese Ebenen der Reihe nach und vergleichen Sie sie mit dem vorherigen Startvorgang, bevor Sie die Anwendungseinstellungen ändern.
Neuen Kernel dokumentieren und die iGPU am PCI-Bus bestätigen
Notieren Sie die Version des laufenden Kernels, die zuvor installierten Kernel, die Boot-Parameter und den Zeitpunkt der Aktualisierung. Listen Sie anschließend PCI-Geräte der Display-Klasse mit numerischen IDs sowie den aktuell an die integrierte GPU gebundenen Kernel-Treiber auf.
Wenn die iGPU in der PCI-Aufzählung fehlt, überprüfen Sie zunächst die Firmware- oder BIOS-Einstellungen, bevor Sie VA-API untersuchen. Ein Server kann ausschließlich eine dedizierte GPU anzeigen, wenn eine iGPU- oder Multi-Monitor-Option deaktiviert ist, wie in einem Fall, in dem die iGPU unter Linux verborgen war.
Vergleichen Sie die Geräte-ID und den gebundenen Treiber mit dem letzten bekannten funktionierenden Startvorgang. Bei Intel-Systemen ist dies üblicherweise i915 oder auf unterstützten neueren Pfaden xe. Verwenden Sie den für die Hardware und Distribution tatsächlich vorgesehenen Treiber, statt einen Modulnamen von einer anderen Plattform zu erzwingen.
Kernel-Protokolle auf Treiber- und Firmware-Initialisierung prüfen
Durchsuchen Sie das Protokoll des aktuellen Startvorgangs nach dem GPU-Treiber, DRM, GuC- oder HuC-Firmware, Display-Initialisierung, fehlgeschlagenen Erkennungen, Zeitüberschreitungen und Modulsperren. Vergleichen Sie dieselben Meldungen aus dem vorherigen Kernel, sofern dauerhafte Protokolle verfügbar sind.
Ein Fehler des Medientreibers kann auch auftreten, wenn die Hardware aufgelistet wird. Ein Intel-Problem dokumentiert eine fehlgeschlagene VA-API-Initialisierung auf einer integrierten Xe-LPG-GPU nach einer Änderung des umgebenden Software-Stacks und zeigt damit, dass erkannte Hardware allein nicht ausreicht.
Stellen Sie sicher, dass die erforderlichen Firmware-Pakete weiterhin vorhanden sind und dass das Modul nicht durch einen neuen Kernel-Parameter, eine Sperrliste oder eine Secure-Boot-Richtlinie blockiert wird. Installieren Sie den Medienserver nicht neu, bevor der Host-Treiber nicht fehlerfrei initialisiert wurde.
Bestätigen, dass der DRM-Render-Node weiterhin vorhanden ist
Untersuchen Sie /dev/dri und notieren Sie für jede Karte und jeden Render-Node die Major- und Minor-Nummern, Eigentümer, Gruppen und symbolischen Ziele. Gehen Sie nicht davon aus, dass die iGPU immer renderD128 bleibt, wenn eine weitere GPU vorhanden ist.
Die Hardwarebeschleunigung schlägt fehl, wenn FFmpeg einen Node verwendet, der zwar existiert, aber keine gültige VA-Anzeige mehr bereitstellt. Ein Jellyfin-Bericht zeigt den entscheidenden Fehler: keine VA-Anzeige für das Render-Gerät.
Ordnen Sie den Render-Node über sysfs wieder seinem PCI-Gerät zu und aktualisieren Sie die Container- oder Anwendungskonfiguration nur, wenn sich die Identität des Nodes tatsächlich geändert hat. Vermeiden Sie umfassende Berechtigungen wie Modus 777. Behalten Sie das Modell mit der Render-Gruppe bei und überprüfen Sie die Gruppenmitgliedschaft des Dienstkontos.
VA-API oder Quick Sync auf dem Host vor Docker testen
Führen Sie die VA-API-Diagnose der Distribution für den überprüften Render-Node aus und erfassen Sie den Treibernamen, die VA-API-Version, die unterstützten Decodierungsprofile, die Einstiegspunkte für die Kodierung sowie die Funktionen der Videoverarbeitung.
Der Medien-Treiber im Userspace muss zur Hardware-Generation und zur Kernel-Schnittstelle passen. Ein gelöster Linux-Fall betont, dass Kernel-DRM-Module und DRI- oder VA-Treiber im Userspace getrennte Ebenen sind. Eine Verwechslung kann dazu führen, dass der falsche Userspace-Treiber verwendet wird.
Wenn VA-API auf dem Host fehlschlägt, vergleichen Sie die aktuellen Medien-Treiber- und Firmware-Pakete mit den Versionen vor der Aktualisierung. Wenn VA-API auf dem Host funktioniert, lassen Sie Kernel und Treiber unverändert, während Sie die Container-Grenze untersuchen.
Dasselbe Gerät und dieselben Gruppen im Container überprüfen
Überprüfen Sie die Geräte, Gruppen-IDs und den Zugriff auf den ausgewählten Render-Node im laufenden Container. Führen Sie die mit dem Medienserver gebündelte VA-API-Diagnose oder den darin enthaltenen FFmpeg-Build im Container aus, da ein erfolgreicher Test auf dem Host keinen Erfolg im Container garantiert.
Ein Container kann /dev/dri/renderD128 erhalten und trotzdem fehlschlagen, weil seinem Prozess die passende Berechtigung für die Render-Gruppe fehlt. Ein Bericht zu einem Jellyfin-Container zeigt, dass sowohl Gerätezuordnung als auch Gruppenzugriff überprüft werden müssen.
Vergleichen Sie die numerischen Gruppen-IDs auf dem Host und im Container und erstellen Sie den Dienst bei Bedarf mit einer expliziten Geräte- und Gruppenkonfiguration neu. Der ZimaSpace-Leitfaden zum Überprüfen der Hardware-Transkodierung liefert den nächsten Nachweis auf Anwendungsebene.
Einen kleinen Codec-Test erzwingen und die tatsächlichen GPU-Engines beobachten
Verwenden Sie ein bekanntes, funktionierendes H.264- oder HEVC-Beispiel und erzwingen Sie eine Videotranskodierung ohne Untertitel oder HDR-Tonemapping. Notieren Sie den Status im Dashboard, den FFmpeg-Befehl, die Transkodierungsgeschwindigkeit, die CPU-Auslastung sowie die Aktivität der GPU-Dekodierungs- oder Kodierungs-Engine.
Ein Medienserver kann Hardwareunterstützung melden, aber automatisch das falsche VA-API-Gerät auswählen. Ein Jellyfin-Problem dokumentiert einen Fall, in dem die explizite Geräteauswahl beeinflusste, ob FFmpeg den Beschleunigungspfad erkannte.
Testen Sie Dekodierung und Kodierung nach Möglichkeit getrennt. Wenn ein Codec fehlschlägt, während ein einfacher Codec funktioniert, ist die iGPU verfügbar, aber das betreffende Profil, die Firmware-Funktion, der Treiberpfad oder der Filter wird nicht unterstützt. Bezeichnen Sie die gesamte GPU nicht aufgrund eines einzelnen erweiterten Tonemapping-Fehlers als nicht vorhanden.
Den vorherigen Kernel als kontrollierten Vergleich verwenden
Wenn PCI-Erkennung, Render-Nodes oder VA-API auf dem Host nur mit dem neuen Kernel fehlschlagen, starten Sie den zuvor installierten Kernel, ohne das Container-Image, die Medienserver-Version oder die Userspace-Konfiguration zu ändern.
Ein Jellyfin-Problemfall empfiehlt den Wechsel zurück zum vorherigen Kernel als einfachstes Unterscheidungsmerkmal, wenn der Fehler vermutlich nach einer Kernel-Änderung aufgetreten ist. Der Wert liegt in einem kontrollierten Kernelvergleich, nicht darin, den Rollback als dauerhafte Lösung zu betrachten.
Die Überprüfung ist abgeschlossen, wenn der aktuelle Kernel die iGPU am PCI-Bus anzeigt, den vorgesehenen Treiber bindet, den korrekten Render-Node erstellt, VA-API initialisiert, das Gerät im Container bereitstellt und einen echten Codec-Test beschleunigt. Wenn nur der vorherige Kernel erfolgreich ist, behalten Sie ihn vorübergehend als Boot-Option bei, während Sie die Regression in Kernel, Firmware oder Medientreiber eingrenzen.
Support & Tipps
Mehr zum Lesen

Kann Plex eine GPU mit einem anderen Docker-Container gemeinsam nutzen?
Plex und ein weiterer Container können häufig auf dieselbe GPU zugreifen, aber du musst die Treiberunterstützung, die Gerätezuordnung, die Auslastung der Video-Engine, den Speicher...

So erkennst du, ob ein Plex-Fehler vom Client oder vom Server verursacht wird
Reproduziere dasselbe Element auf einem anderen Client, vergleiche den Sitzungspfad und sammle Serverbelege erst, nachdem der Geltungsbereich dir gezeigt hat, wo der Fehler tatsächlich...

So konfigurierst du den Plex-Cache und den temporären Transcodierungs-Speicher
Schütze den persistenten Plex-Zustand, indem du temporäre Transcodierungsdateien auf geeignetem lokalem Speicher ablegst, und überprüfe anschließend die Bereinigung, den freien Speicherplatz und das Verhalten...

