Kompletní průvodce sdílením Open WebUI a Ollama ve vaší lokální síti

Poslední aktualizace: 23/07/2026

  • Implementace soukromého, víceuživatelského chatovacího rozhraní prostřednictvím nasazení Open WebUI a Ollamy.
  • Konfigurace sítí a firewallů pro umožnění připojení mezi zařízeními v místní síti LAN.
  • Využití pokročilých funkcí, jako jsou nativní protokoly RAG a MCP a automatizace prostřednictvím Pipelines.
  • Optimalizace výkonu lokální umělé inteligence pomocí akcelerace GPU napříč různými hardwarovými architekturami.

Jak sdílet Open WebUI s ostatními uživateli ve vaší místní síti

¿Jak sdílím Open WebUI s ostatními uživateli v mé místní síti? Jsem si jistý, že se vám to už stalo: chcete mít sílu pokročilého jazykového modelu, ale pomyšlení na to, že vaše data skončí na serverech velké korporace, vás děsí. A právě zde se uplatňuje dynamická dvojice Otevřené webové rozhraní a Ollama, což je kombinace, která vám umožňuje nastavit chatovací systém identický s OpenAI, ale běžící výhradně na vašem vlastním hardwaru, bez placení jediného centu za token a s úplnou kontrolou nad vaším soukromím.

Nejlepší na tom je, že k jeho spuštění nemusíte být počítačový guru. Základní nastavení je sice hračka, ale skutečná výzva nastává, když chcete, aby ho mohl používat i zbytek vaší rodiny nebo spoluhráči. přístup k webovým stránkám z vlastních zařízeníV tomto článku si rozebereme vše od nejjednodušší instalace až po nejsložitější síťové triky, které vám pomohou zpřístupnit váš server s umělou inteligencí v celém domě nebo kanceláři.

O čem přesně mluvíme, když říkáme Open WebUI a Ollama?

Jak uspořádat konverzace pomocí složek v Open WebUI

Abychom se vyhnuli nejasnostem, je důležité si uvědomit, že mluvíme o dvou různých částech, které do sebe dokonale zapadají. Ollama je motorProgram je zodpovědný za správu modelů (těchto souborů GGUF, které jsou jako .mp3 souborů umělé inteligence), jejich načítání do paměti a provádění výpočtů. Na druhou stranu, Otevřené webové rozhraní je viditelnou tváří, vysoce propracované webové rozhraní, které nám umožňuje chatovat, spravovat uživatele a organizovat dokumenty.

Exkluzivní obsah – klikněte zde  Snížení vstupního zpoždění ve Windows 11: triky, vylepšení a nastavení, která skutečně fungují

Tato architektura je skvělá, protože umožňuje, aby vrstva chatu byla nezávislá na vykonavateli. Komunikují přes HTTP, obvykle přes port 11434. Velkou výhodou této kombinace je, že je zcela zdarma a s otevřeným zdrojovým kódem, což vám umožňuje spouštět modely jako Llama 3.2 nebo DeepSeek, aniž by jediný bit opustil vaši lokální síť.

Rychlé nastavení pro zahájení chatování

Pokud chcete jít rovnou k věci, nejrychlejší cestou je použít Docker. Pro ty, kteří již mají Ollamu nainstalovanou na svém systému, stačí spustit kontejner Open WebUI. Standardní příkaz obsahuje mapování portu 3000 a příznak. host.docker.internal:host-gatewaycož je tajemství umožnění komunikace kontejneru se službou Ollama běžící na hostiteli, zejména na systémech Linux.

Pro ty, kteří hledají něco robustnějšího, Docker Compose je ideální volbouUmožňuje definovat obě služby v jednom YAML souboru, což zajišťuje, že interní síť Dockeru automaticky rozezná názvy. Tímto způsobem, namísto použití složitých IP adres, může Open WebUI volat Ollamu jednoduše pomocí URL adresy. http://ollama:11434Díky tomu je konfigurace mnohem stabilnější a dlouhodobě se snáze udržuje.

Jak otevřít přístup ostatním uživatelům ve vaší místní síti

A právě zde se většina lidí zasekne. Ve výchozím nastavení systém obvykle reaguje pouze na localhostTo znamená, že k ní má přístup pouze počítač, na kterém je umělá inteligence umístěna. Abychom tuto bariéru překonali, musíme nejprve zajistit, aby Ollama naslouchala na všech rozhraních. Toho se dosáhne úpravou služby systemd a přidáním proměnné prostředí. OLLAMA_HOST=0.0.0.0, což nutí server, aby se neomezoval pouze na interní IP adresu.

Pokud používáte Windows s WSL2, věci se trochu komplikují, protože WSL2 má svou vlastní virtuální síť. V tomto případě je třeba vytvořit proxy portu pomocí netsh v PowerShellu s oprávněními správce. V podstatě říkáme systému Windows, že veškerý provoz přicházející na port 8080 fyzického počítače by měl být přesměrován na interní IP adresu instance Ubuntu ve WSL2. Nezapomeňte také otevřít pravidlo pro příchozí komunikaci ve firewallu Windows Defender, jinak systém zablokuje jakýkoli pokus o externí připojení.

Exkluzivní obsah – klikněte zde  Jak otevřít soubor PYZ

Optimalizace hardwaru a akcelerace GPU

CPU, GPU a NPU

Nemá smysl mít krásné rozhraní, pokud umělé inteligenci trvá věčnost, než reaguje. Klíč spočívá v Hardwarová akceleracePokud máte grafickou kartu NVIDIA, je pro přístup Dockeru k jádrům CUDA vyžadována sada NVIDIA Container Toolkit. Pro uživatele Maců s Apple Silicon je trik v tom, spustit Ollamu nativně a ne v Dockeru, protože to umožňuje využít výhod grafického procesoru Metal a dosáhnout nekonečně vyšších rychlostí tokenů za sekundu.

Pro uživatele AMD na Linuxu řešení zahrnuje použití vyhrazeného obrazu Dockeru s Podpora ROCmJe nezbytné sledovat využití VRAM; pokud se pokusíte načíst model, který je pro vaši kartu příliš velký, systém jej uloží do systémové paměti RAM a rychlost prudce klesne, čímž se váš výkonný server promění v něco, co připomíná počítač z doby před deseti lety.

Pohon umělé inteligence pomocí RAG, Pipelines a MCP

Open WebUI není jen chatovací okno; je to rozšiřitelná platforma. Jedním z jejích klenotů je Nativní RAG (generace s rozšířenou regenerací)Můžete nahrát vlastní PDF soubory, soubory Wordu nebo dokumenty Markdownu a nástroj je fragmentuje a uloží do vektorové databáze s názvem ChromaDB. Poté, když položíte otázku, umělá inteligence nejprve prohledá vaše dokumenty a na základě těchto informací odpoví. skutečné a soukromé informace.

Exkluzivní obsah – klikněte zde  Jak otevřít soubor ACCDE

Pokud chcete jít ještě o krok dál, existují Potrubí a funkcePipeliny jsou externí služby Pythonu, které mohou filtrovat zprávy nebo fungovat jako směrovače. Funkce na druhou stranu umožňují přidávat do rozhraní tlačítka pro spouštění skriptů, jako je shrnutí textu a jeho odeslání přímo do Notionu. Navíc příchod Protokol kontextu modelu (MCP) Umožňuje umělé inteligenci standardizovaným způsobem interagovat s externími nástroji, jako je GitHub nebo Slack.

Zabezpečení a pokročilý vzdálený přístup

Když otevřete svůj server ostatním uživatelům sítě LAN, bezpečnost se stává prvořadou. Je to nezbytné. zakázat otevřené protokolování Jakmile vytvoříte administrátorský a uživatelský účet, budete muset zabránit jakémukoli vetřelci ve vytvoření účtu ve vaší síti. Pro ty, kteří potřebují přístup k síti zvenčí svého domova, se doporučuje neotevírat porty na routeru, ale použít [chybějící informace – pravděpodobně samostatný, nesouvisející dokument nebo aplikaci]. Tunel nebo Caddy Cloudflare spravovat HTTPS čistým a bezpečným způsobem.

Pokud počet uživatelů roste, SQLite může začít mít problémy s výkonem. V takovém případě je nejchytřejší migrovat na PostgreSQLcož mnohem lépe zvládá souběžnost a složité dotazy v databázi konverzací. Uchovávání dat v pojmenovaném svazku Dockeru je jediný způsob, jak zajistit, že při aktualizaci obrazu Open WebUI neztratíte celou historii chatu a kolekce dokumentů.

Zpřístupnění lokální umělé inteligence velké skupině lidí vyžaduje koordinaci konfigurace serveru, správy sítě a optimalizace hardwaru. Kombinací flexibility Dockeru, výkonu Ollamy a všestrannosti Open WebUI je možné vybudovat soukromý, bezpečný a extrémně výkonný ekosystém, který není závislý na žádném externím cloudu.