Community-Lösung

So verbinden Sie Ollama-Modelle mit Open WebUI unter ZimaOS

A ZimaOS discussion comparing a failed model-download and GPU-detection attempt with a confirmed Ollama-Nvidia and Open WebUI setup running on an RTX 3060 server.

Die ursprüngliche Frage aus der Community stammte von einem ZimaOS-Nutzer, der Ollama und Open WebUI bereits auf getrennten Computern betrieb, diese Einrichtung jedoch mit den ZimaOS-Apps nicht reproduzieren konnte. Der Nutzer konnte beide Anwendungen öffnen, doch Open WebUI lud kein Ollama-Modell herunter oder zeigte eines an, und das System schien die NVIDIA-GPU nicht zu erkennen.

Die Diskussion ergab keine universelle Lösung. Stattdessen dokumentierte sie drei verschiedene Ergebnisse: einen unvollständigen docker exec-Befehl, der in dieser Form nicht funktionieren konnte, eine Empfehlung zur Installationsreihenfolge in ZimaOS für die NVIDIA-Beschleunigung und einen späteren Community-Bericht, dass Ollama-Nvidia zusammen mit Open WebUI erfolgreich auf einem Server mit RTX 3060 lief. Diese Unterscheidung zwischen den verschiedenen Ansätzen ist hilfreicher, als den Thread als ein einziges gelöstes Tutorial darzustellen.

Warum der ursprüngliche docker-exec-Befehl fehlschlug

Der erste Ratschlag, den der Autor erhielt, bestand darin, sich per SSH zu verbinden, Folgendes auszuführen: sudo docker ps, die Ollama-Container-ID zu kopieren und anschließend sudo docker execDocker gab einen Fehler zurück, weil docker exec erfordert sowohl einen laufenden Container als auch einen darin auszuführenden Befehl.

docker exec [OPTIONS] CONTAINER COMMAND [ARG...]

Ein vollständiger Befehl müsste beispielsweise die Container-ID gefolgt von einem echten Befehl enthalten. Der Community-Thread nannte oder bestätigte weder den genauen Namen des Ollama-Containers noch den vorgesehenen Befehl. Daher wäre es nicht sinnvoll, einen Copy-and-paste-Befehl zu erfinden und ihn als Lösung des Forums auszugeben.

Das größere Problem war nicht nur die Terminalsytax. Der Autor berichtete, dass der Versuch, ein Modell über Open WebUI abzurufen, kein sichtbares Ergebnis lieferte und die GPU nicht erkannt wurde. Nutzer, die denselben Stack planen, können vorab die Ollama-Hardwareanforderungen und die Hardwareanforderungen von Open WebUI prüfen, bevor sie ein Problem mit der Benutzeroberfläche von einem Problem mit der Inferenzhardware abgrenzen.

Open WebUI mit einer separaten Ollama-Instanz verbinden

Zima-Giorgio verwies den Autor zunächst auf die Dokumentation zur Ollama-Verbindung von Open WebUI, da die Ollama- und Open-WebUI-Dienste des Benutzers möglicherweise getrennt voneinander ausgeführt wurden. Der aktuelle Leitfaden zum Ollama-Anbieter in Open WebUI ordnet diese Konfiguration unter Admin Settings → Connections → Ollama → Manage ein.

Der entscheidende Architekturpunkt ist, dass Open WebUI die Benutzeroberfläche und Ollama das Backend für die Modellbereitstellung ist. Befinden sich die Dienste in unterschiedlichen Containern oder auf verschiedenen Computern, muss Open WebUI die Ollama-API über das Netzwerk erreichen können. Ein in Ollama vorhandenes Modell wird nicht allein deshalb angezeigt, weil beide App-Symbole installiert sind.

Bei Verbindungsfehlern erklärt der offizielle Open-WebUI-Verbindungsleitfaden, dass Ollama häufig auf 127.0.0.1 lauscht, was aus einem anderen Container oder von einem anderen Computer aus nicht erreichbar ist. Diese Dokumentation liefert nützlichen Kontext, aber im Forum wurde nicht bestätigt, dass dies die genaue Ursache in der ZimaOS-Installation des Autors war.

Die im Thread vorgeschlagene Reihenfolge für die NVIDIA-Installation

Für den im Februar 2025 verfügbaren App-Store-Weg von ZimaOS schlug Zima-Giorgio vor, eine zuvor installierte Open-WebUI-App zu entfernen, zuerst die NVIDIA-GPU-Unterstützung zu installieren und anschließend Open WebUI erneut zu installieren:

  1. Entfernen Sie die vorhandene Open-WebUI-Installation, falls sie vor der GPU-Unterstützung installiert wurde.
  2. Installieren Sie die NVIDIA-GPU-Unterstützung oder die GPU-spezifische Ollama-App.
  3. Installieren Sie Open WebUI, nachdem die GPU-Ebene verfügbar ist.

In der Antwort wurde dies ausdrücklich als vorübergehende Einschränkung beschrieben, die später behoben werden könnte. Daher sollte dies als historischer Ablauf aus dem Thread betrachtet werden und nicht als dauerhafte Regel für jede aktuelle ZimaOS-Version.

Der ursprüngliche Autor berichtete, dass diese Vorgehensweise das Problem auf seinem Gerät nicht löste. Schließlich installierte er Linux Mint, überprüfte, ob Linux die NVIDIA-GPU erkannte, konfigurierte den GPU-Zugriff für Docker, installierte CasaOS und richtete anschließend Ollama und Open WebUI über das Terminal ein. In dieser Umgebung konnte Open WebUI ein Modell herunterladen.

Kann Open WebUI Ollama-Modelle direkt abrufen?

Zima-Giorgio stellte später klar, dass die im Teamvideo gezeigte Bereitstellung von Open WebUI auf ZimaOS Ollama enthielt und Modelle direkt über die Benutzeroberfläche abgerufen werden konnten. Die Klarstellung deutet darauf hin, dass eine separate manuelle ollama run modelname Der Befehl war für diese gebündelte Bereitstellung nicht immer erforderlich.

Das Video wurde in der Diskussion zweimal angeboten, doch der ursprüngliche Autor sagte, es habe sein spezifisches Problem mit dem Modelldownload und der GPU-Erkennung nicht gelöst. Es bleibt eine visuelle Referenz für den gebündelten Workflow und ist kein Beleg dafür, dass sich jede Installation gleich verhält.

Eine Community-Konfiguration, die mit einer RTX 3060 funktionierte

Denzil lieferte später das klarste erfolgreiche Beispiel für ZimaOS. Auf einem älteren Lenovo-Server mit einer NVIDIA RTX 3060 installierte der Nutzer die Apps Ollama-Nvidia und Open WebUI. Ollama nutzte die GPU, Open WebUI erkannte die Ollama-Instanz, und die Oberfläche war im lokalen Netzwerk über Port 3050 in Browsern erreichbar.

Diese Konfiguration funktionierte für Textanfragen. Denzil hatte die Spracheingabe nicht aktiviert, da dafür Browser-Zertifikate erforderlich gewesen wären. Daher sollte daraus nicht abgeleitet werden, dass Sprachfunktionen eingerichtet waren. Eine separate Home-Assistant-Maschine stellte für Sprachchat-LLM-Anfragen eine Verbindung zum Ollama-Server her.

Neun Monate später berichtete Denzil, dass die Installation auf dem Lenovo-System mit der RTX 3060 nahezu dauerhaft gelaufen sei. Auf demselben ZimaOS-Server liefen außerdem Immich, Jellyfin, Joplin-bezogene Workflows, Dateifreigaben und weitere selbst gehostete Dienste. Diese Rückmeldung bestätigt die langfristige Stabilität der NVIDIA-Konfiguration dieses Nutzers, erklärt jedoch nicht, warum die Installation des ursprünglichen Autors fehlschlug.

Abgrenzung zwischen NVIDIA- und Intel-GPUs

Der erfolgreiche Bericht verwendete eine NVIDIA RTX 3060. Nutzer sollten ihre Karte mit der aktuellen Ollama-Dokumentation zur GPU-Unterstützung vergleichen und überprüfen, ob sowohl das Host-Betriebssystem als auch die Container-Laufzeitumgebung die GPU erkennen können.

Ein anderer Nutzer fragte, warum eine Intel-GPU mit Open WebUI nicht funktionierte. In diesem Thread wurde keine verifizierte Lösung für Intel veröffentlicht. Denzil sagte ausdrücklich, keine Erfahrung mit Intel-Karten zu haben, und verlinkte den Leitfaden zur GPU-Erweiterung des ZimaCube. Die Intel-Frage blieb daher ungelöst und sollte nicht durch Schlussfolgerungen aus dem Ergebnis mit der RTX 3060 beantwortet werden.

Eine praktische Checkliste auf Grundlage der Diskussion

  1. Bestätige, ob Open WebUI ein lokales Ollama-Backend enthält oder eine Verbindung zu einer separaten Ollama-Instanz herstellen muss.
  2. Wenn die Dienste getrennt sind, konfiguriere die Ollama-Verbindungs-URL in Open WebUI und bestätige, dass Port 11434 erreichbar ist.
  3. Bei NVIDIA-Beschleunigung solltest du die GPU-Erkennung auf dem Host überprüfen, bevor du Open WebUI diagnostizierst.
  4. Überprüfe, ob die Container-Laufzeitumgebung die GPU für den Ollama-Container bereitstellt.
  5. Bei den im Thread besprochenen historischen ZimaOS-App-Versionen solltest du die GPU-Unterstützung vor der Neuinstallation von Open WebUI installieren.
  6. Lade ein Modell über Open WebUI herunter und bestätige, dass es im Modellauswahlfeld erscheint.
  7. Wenn das Modell weiterhin nicht verfügbar ist, erfasse den Verbindungsstatus von Open WebUI, die Ollama-Protokolle, die Containernamen und die Ausgabe der GPU-Erkennung, anstatt einen unvollständigen docker exec Befehl.

Für Experimente ausschließlich mit der CPU oder mit geringer Leistung hilft der Shop-Leitfaden zum Ausführen lokaler KI auf einem Heim-NAS ohne GPU dabei, realistische Erwartungen an Modellgröße und Leistung zu entwickeln.

FAQ zu Ollama und Open WebUI unter ZimaOS

Warum meldete docker exec, dass mindestens zwei Argumente erforderlich seien?

Der Befehl war unvollständig. Docker benötigt eine laufende Container-ID oder einen Containernamen, gefolgt von einem auszuführenden Befehl innerhalb dieses Containers.

Kann Open WebUI Ollama-Modelle direkt herunterladen?

Laut der Antwort von Zima-Giorgio und dem geteilten Video konnte die gebündelte Open-WebUI-Bereitstellung Modelle über ihre Benutzeroberfläche herunterladen. Der ursprüngliche Autor hatte weiterhin einen fehlgeschlagenen Download, daher müssen auch die Ollama-Verbindung sowie der GPU- und Containerstatus überprüft werden.

Welche Kombination von ZimaOS-Apps funktionierte laut den Antworten?

Denzil meldete Erfolg mit Ollama-Nvidia und Open WebUI auf einem Lenovo-Server mit einer RTX 3060. Open WebUI erreichte Ollama und war im LAN über Port 3050 zugänglich.

Wurde in dem Thread eine Lösung für Intel-GPUs genannt?

Nein. Die Frage zur Intel-GPU blieb ungelöst, und die erfolgreiche Konfiguration verwendete NVIDIA-Hardware.

Ist es weiterhin erforderlich, Open WebUI zu entfernen und nach der Aktivierung der GPU-Unterstützung neu zu installieren?

Die Antwort beschrieb diese Abfolge im Februar 2025 als vorübergehende Einschränkung von ZimaOS. Prüfe das aktuelle App-Verhalten, bevor du eine bestehende Installation entfernst, und sichere zuvor die dauerhaften Anwendungsdaten.