So teilen Sie Open WebUI mit anderen Benutzern in Ihrem lokalen Netzwerk

Letzte Aktualisierung: 16/07/2026

  • Implementierung einer Mehrbenutzer-Chat-Oberfläche basierend auf Open WebUI und Ollama für lokale Bereitstellungen.
  • Konfiguration des Fernzugriffs über die Host-IP, Reverse-Proxys wie Caddy oder Cloudflare-Tunnel.
  • Hardwareoptimierung für LLM-Inferenz mittels GPU-Beschleunigung auf NVIDIA, AMD und Apple Silicon.
  • Erweiterung der Funktionalitäten durch natives RAG, benutzerdefinierte Python-Funktionen und das MCP-Protokoll.

So teilen Sie Open WebUI mit anderen Benutzern in Ihrem lokalen Netzwerk

¿Wie kann ich Open WebUI mit anderen Benutzern in meinem lokalen Netzwerk teilen? Stellen Sie sich vor, Sie könnten die Leistungsfähigkeit eines hochentwickelten Sprachmodells in Ihrem eigenen Wohnzimmer nutzen, ohne dass Ihre Daten über die Server großer Technologiekonzerne laufen. Dank der Kombination aus … ist die Einrichtung einer privaten KI-Umgebung einfacher denn je. WebUI und Ollama öffnenDadurch entsteht ein Erlebnis, das dem von ChatGPT identisch ist, aber unter Ihrer absoluten Kontrolle steht.

Für viele mag die Welt der Container und des Hostings zunächst etwas abschreckend wirken, aber sobald man versteht, dass Docker ist der Motor Es vereinfacht alles; die Abläufe funktionieren ganz natürlich. Ob Sie es auf mehreren Computern zu Hause nutzen oder einen Assistenten für Ihr Arbeitsteam einrichten möchten – entscheidend ist, zu wissen, wie Sie den Dienst freigeben, damit andere Geräte miteingreifen können.

Was genau ist dieses Ökosystem?

Um Verwechslungen bei den Namen zu vermeiden, ist es wichtig zu verstehen, dass es sich um zwei verschiedene Teile handelt, die perfekt zusammenpassen. Ollama ist der MotorDer Prozessor ist für das Herunterladen der Modelle (wie z. B. Llama 3.2 oder DeepSeek) und deren Ausführung mithilfe Ihres Prozessors oder Ihrer Grafikkarte zuständig. Er ist die technische Ebene, die die eigentliche Verarbeitung der Token übernimmt.

Auf der anderen Seite, Open WebUI ist die sichtbare SeiteEs handelt sich um eine elegante, moderne Weboberfläche für mehrere Benutzer, die mit Ollama verbunden ist. Ohne sie müssten Sie über ein langweiliges Terminal chatten; mit ihr erhalten Sie Chatverlauf, Dokumentenverwaltung und ein responsives Design, das auch auf Mobilgeräten hervorragend funktioniert.

Exklusiver Inhalt – Klicken Sie hier  Wie kann ich eine PDF-Datei mit Adobe Acrobat Reader sperren?

Der große Vorteil dieser Kombination ist die absolute PrivatsphäreDa es nicht auf externe API-Schlüssel oder Token-Abrechnung angewiesen ist, können Sie nach Herzenslust experimentieren, ohne befürchten zu müssen, Ihr Budget zu überschreiten oder dass jemand Ihre privaten Eingabeaufforderungen liest.

Schnelle Installation und Bereitstellung mit Docker

Wie man Server und Docker in Beszel überwacht

Am schnellsten lässt sich Ollama über Docker einrichten. Falls Ollama bereits installiert ist, können Sie die WebUI mit einem Befehl starten, der den Container-Port 8080 auf Port 3000 Ihres Rechners weiterleitet. Die Verwendung des entsprechenden Flags ist dabei unerlässlich. –add-host=host.docker.internal:host-gatewayinsbesondere unter Linux, damit der Container mit dem auf dem Host laufenden Ollama-Server kommunizieren kann.

Für diejenigen, die etwas Seriöseres und Professionelleres suchen, Docker Compose Das ist die beste Option. Sie ermöglicht es Ihnen, beide Dienste in einer einzigen YAML-Datei zu definieren und gemeinsam genutzte Netzwerke sowie benannte Volumes zu verwalten. Dadurch wird sichergestellt, dass Ihre Gespräche und Schauplätze überleben Selbst wenn Sie den Container löschen oder aktualisieren, wird verhindert, dass Sie Ihre gesamte bisherige Arbeit verlieren.

Wenn Sie in Geschäftsumgebungen arbeiten, stehen Ihnen Helm-Charts für die Bereitstellung zur Verfügung. KubernetesDies ermöglicht eine massive Skalierbarkeit und ein wesentlich robusteres persistentes Speichermanagement.

So öffnen Sie anderen Benutzern in Ihrem Netzwerk den Zugriff

Hier scheitern viele. Standardmäßig, wenn Sie eingeben localhost:3000Nur Sie können die Website sehen. Damit Ihr Partner, Kollege oder ein anderer PC darauf zugreifen kann, müssen Sie die folgende Funktion verwenden: lokale IP-Adresse von Ihrem Server (zum Beispiel, http://192.168.1.15:3000Wenn es nicht lädt, blockiert höchstwahrscheinlich die Windows- oder Ubuntu-Firewall den Port.

Wenn Sie noch einen Schritt weiter gehen und nicht von wechselnden IPs abhängig sein möchten, können Sie einen Reverse-Proxy verwenden. Caddy ist ein Juwel Aufgrund seiner Einfachheit: Mit einer fünfzeiligen Datei erhalten Sie automatisch ein SSL-Zertifikat und können über eine saubere Domain darauf zugreifen. Wenn Sie keine Kontrolle über die DNS-Einstellungen haben, Cloudflare-Tunnel Sie sind ein Lebensretter, da sie das Internet zugänglich machen, ohne dass Ports am Router geöffnet werden müssen.

Exklusiver Inhalt – Klicken Sie hier  Wie speichere und öffne ich komprimierte Dateien mit StuffIt Deluxe?

Ein wichtiger Sicherheitstipp: Veröffentlichen Sie diese Datei niemals ungeschützt im offenen Internet. Obwohl die Benutzerregistrierung standardmäßig aktiviert ist, sollten Sie idealerweise Folgendes beachten: Registrierungsoption deaktivieren Im Administrationsbereich müssen Sie die notwendigen Konten erstellen, um zu verhindern, dass sich Unbekannte unbefugt Zugang zu Ihrem Server verschaffen.

Leistungssteigerung durch GPUs

Nichts ist frustrierender als eine KI, die extrem langsam reagiert. Um dies zu vermeiden, ist es entscheidend, dass Ollama erkennt Ihre GPUBei einer NVIDIA-Grafikkarte benötigen Sie das NVIDIA Container Toolkit, damit die Engine auf den VRAM zugreifen kann. Für AMD-Grafikkarten wird unter Linux ROCm verwendet, um eine vergleichbare Leistung zu erzielen.

Für Mac-Nutzer gibt es ein wichtiges Detail: läuft Ollama nativ Und zwar nicht innerhalb von Docker. Denn Docker unter macOS erlaubt keinen direkten Zugriff auf die Metal-GPU. Würde man es dennoch versuchen, würde das Modell auf der CPU laufen und Ihren leistungsstarken M2- oder M3-Chip in einen veralteten Computer verwandeln.

Die Geschwindigkeit hängt von Ihrer Hardware ab. Ein Apple Silicon Chip kann Folgendes erreichen: ... 50 Token pro Sekunde Bei kleineren Modellen wie Llama 3.2 ist dies der Fall, während leistungsstärkere Modelle mehr RAM und Geduld erfordern, aber immer schneller sind als jede Software-Emulation.

KI mit RAG, Funktionen und MCP betreiben

Wie kann man einen Docker-Container automatisch neu starten, wenn er nicht mehr reagiert?

Open WebUI ist nicht nur ein Chatfenster, sondern eine erweiterbare Plattform. Eine ihrer besten Funktionen ist… native RAG (Erweiterte Generierung durch Abruf). Sie können Ihre eigenen PDFs oder Word-Dokumente hochladen, die die KI dann als Wissensdatenbank nutzt. Durch Eingabe des #-Symbols im Chat rufen Sie eine bestimmte Dokumentensammlung auf, um hochpräzise Antworten zu erhalten.

Exklusiver Inhalt – Klicken Sie hier  Clippys verschollenes Easter Egg in Office 97 taucht nach fast drei Jahrzehnten wieder auf.

Wenn Sie ein wenig Python-Kenntnisse haben, können Sie Folgendes erstellen: Funktionen und PipelinesDie Funktionen ermöglichen es Ihnen, benutzerdefinierte Schaltflächen zur Benutzeroberfläche hinzuzufügen oder Nachrichteninhalte zu filtern (z. B. um sensible E-Mails zu löschen, bevor sie das Model erreichen). Pipelines hingegen fungieren als externe Router, die Ihren Chat mit anderen Tools verbinden können.

Des Weiteren die Ankunft von Model Context Protocol (MCP) Es ermöglicht Ihrer lokalen KI, auf standardisierte Weise mit externen Tools wie Slack, GitHub oder Ihren eigenen lokalen Dateien zu interagieren und den Chat so in einen echten Produktivitätsagenten zu verwandeln.

Häufige Probleme lösen

Der häufigste Fehler ist, dass Open WebUI zwar geladen wird, die Modellliste aber leer ist. Dies geschieht, weil der Container Ollama nicht erreicht. Die Lösung besteht üblicherweise darin, die Variable zu konfigurieren. OLLAMA_BASE_URL korrekt und stellen Sie sicher, dass Ollama nicht nur mit … verknüpft ist. 127.0.0.1, aber zu 0.0.0.0 um externe Verbindungen zu akzeptieren.

Bezüglich des RAG-Systems: Sollten Sie feststellen, dass die Zitate nicht korrekt sind, versuchen Sie Folgendes: Fragmentgröße reduzieren (Chunkgröße). Sind die Chunks zu groß, können sie das Kontextfenster kleiner Modelle überlasten, wodurch die KI den Bezug zur ursprünglichen Frage verliert.

Um das System auf dem neuesten Stand zu halten, führen Sie einfach Folgendes durch: docker pull vom aktuellsten Image und starten Sie den Container neu. Vielen Dank an persistente DatenvolumesWährend des Updates gehen weder Ihre Nachrichten noch Ihre individuellen Einstellungen verloren.

Ein eigener KI-Server zu Hause bietet ein außergewöhnliches Erlebnis, das Datenschutz, Einblicke in die Infrastruktur und die Vielseitigkeit offener Modelle vereint. Von der einfachen Installation per Docker-Befehl bis hin zur fortgeschrittenen Konfiguration mit Proxys und RAG-Wissensdatenbanken positioniert sich Open WebUI als ideales Werkzeug für alle, die nicht auf die Cloud angewiesen sein und ihre Rechenleistung lieber im lokalen Netzwerk selbst verwalten möchten.