Corporate LLM Agentur – Der Prozessmeister
Technik-Guide

Lokales LLM einrichten: Ollama und Open WebUI in 30 Minuten

Diese Anleitung führt Sie durch die Einrichtung eines lokalen LLMs auf Basis von Ollama und Open WebUI. Am Ende steht ein eigener KI-Chat auf Ihrem Server oder Rechner, erreichbar im Browser, komplett ohne Cloud. Für den privaten Test genügt ein aktueller Rechner; für den Unternehmensbetrieb gelten die Hinweise am Ende.

Fakten geprüft, Stand: August 2026

Schritt 1: Ollama installieren

Ollama bringt die Sprachmodelle auf den Rechner und stellt sie als lokalen Dienst bereit. Die Installation unterscheidet sich je nach System:

  • Linux: Nach der Installation läuft Ollama automatisch als Systemdienst und ist unter http://localhost:11434 erreichbar.
  • Windows: Installer von ollama.com herunterladen und ausführen, Ollama läuft dann als Hintergrunddienst.
  • macOS: Installation über Homebrew, Start des Dienstes mit ollama serve.
Linux (empfohlen für Produktivbetrieb)
curl -fsSL https://ollama.com/install.sh | sh
macOS
brew install ollama
ollama serve

Schritt 2: Erstes Modell laden und testen

Für den Start eignet sich ein 7B- oder 8B-Modell wie Llama 3.1 8B oder Mistral 7B. Der Download dauert je nach Leitung wenige Minuten, danach läuft alles offline. Größere Modelle bringt der Befehl ollama pull mit dem jeweiligen Modellnamen.

Verfügbare Modelle prüfen
ollama list
Modell laden (Beispiel)
ollama pull llama3.1:8b
ollama run llama3.1:8b

Schritt 3: Open WebUI als Oberfläche einrichten

Open WebUI liefert die webbasierte Chat-Oberfläche mit Dokument-Upload, Verlaufsfunktion und Benutzerverwaltung. Die Installation per Docker ist der empfohlene Weg.

Danach ist die Oberfläche im Browser unter http://[server-ip]:3000 erreichbar. Der erste Anmelder wird automatisch Administrator und kann weitere Nutzer freischalten.

Open WebUI per Docker
docker run -d \
  -p 3000:8080 \
  --add-host=host.docker.internal:host-gateway \
  -v open-webui:/app/backend/data \
  --name open-webui \
  --restart always \
  ghcr.io/open-webui/open-webui:main

Damit aus dem Test ein belastbarer Betrieb wird

Die Schritte oben ergeben einen funktionierenden Einzelplatz- oder Team-Chat. Für den Unternehmensbetrieb fehlen danach: Zugriffsregeln und Rollen, Datenschutz-Dokumentation, Modell-Updates mit Freigabe, Backups. Genau diese Punkte übernimmt unser Festpreis-Pilot (ab 3.500 Euro) oder unser Einrichtungs-Service, wenn Sie es komplett abgeben möchten.

Häufige Fragen

Ja, es gibt auch eine direkte Python-Installation. Docker ist aber der dokumentierte Standardweg, weil Updates und Datenhaltung damit am saubersten funktionieren.

Für fünf bis zwanzig Nutzer genügt ein moderner Server mit 32 GB RAM oder mehr. Entscheidend ist der Speicher: siehe unsere Hardware-Übersicht mit VRAM-Tabelle.

Ja. Nach Installation und Modell-Download benötigen Ollama und Open WebUI keine Internetverbindung. Einzige Voraussetzung: das interne Netzwerk erreichbar sein.

Diese Anleitung richtet den Chat ein. Ein fertiges Unternehmenssystem bringt zusätzlich Rollen, DSGVO-Dokumentation, Qualitätssicherung und Betreiberkonzept mit. Der eine Weg ist der Test, der andere der produktive Betrieb.

Kostenloser Projekt-Check

Sieben kurze Fragen – und Sie erhalten eine ehrliche Einschätzung, welcher Einstieg zu Ihrem Unternehmen passt. Unverbindlich und kostenlos.