Ollama Installation: Lokale LLM-Ausführungsanleitung
Ollama-Installation, lokale LLM-Modelle ausführen (Llama 3, Mistral, Gemma), API-Nutzung, Modellverwaltung, GPU-Beschleunigung und Docker-Deployment.
Open WebUI Installation mit Docker, Ollama-Integration, Benutzerverwaltung, RAG (Dokumentenabfrage), Modellverwaltung, benutzerdefinierte Prompts und Mehrbenutzersupport.
Open WebUI (ehemals Ollama WebUI) ist ein Open-Source-Projekt, das eine moderne ChatGPT-ähnliche Weboberfläche für Ihre lokalen LLM-Modelle bietet. Integriert mit Ollama können Sie über den Browser mit Ihren KI-Modellen chatten, Dokumente hochladen und Ihre Dokumente mit RAG (Retrieval-Augmented Generation) abfragen.
Open WebUI ist eine umfassende Weboberfläche für das Self-Hosted-KI-Erlebnis. Hauptmerkmale:
| Komponente | Minimum | Empfohlen |
|---|---|---|
| RAM | 4 GB (für UI) | 8 GB+ |
| Festplatte | 5 GB | 10 GB+ |
| Docker | 20.10+ | Neueste Version |
| Ollama | Installiert und aktiv | Gleicher Server oder Netzwerk |
docker run -d \
--name open-webui \
-p 3000:8080 \
--add-host=host.docker.internal:host-gateway \
-e OLLAMA_BASE_URL=http://host.docker.internal:11434 \
-v open-webui:/app/backend/data \
--restart unless-stopped \
ghcr.io/open-webui/open-webui:main
version: '3.8'
services:
ollama:
image: ollama/ollama
container_name: ollama
ports:
- "11434:11434"
volumes:
- ollama_data:/root/.ollama
deploy:
resources:
reservations:
devices:
- driver: nvidia
count: all
capabilities: [gpu]
restart: unless-stopped
open-webui:
image: ghcr.io/open-webui/open-webui:main
container_name: open-webui
ports:
- "3000:8080"
environment:
- OLLAMA_BASE_URL=http://ollama:11434
- WEBUI_SECRET_KEY=starker-secret-key-hier
- ENABLE_SIGNUP=true
- DEFAULT_USER_ROLE=pending
volumes:
- open-webui_data:/app/backend/data
depends_on:
- ollama
restart: unless-stopped
volumes:
ollama_data:
open-webui_data:
Starten:
docker compose up -d
Navigieren Sie zu http://SERVER_IP:3000.
Der erste registrierte Benutzer wird automatisch Admin:
Erstellen Sie den ersten Benutzer sofort. Andernfalls könnte jemand anderes Admin werden.
llama3.1)docker exec -it ollama ollama pull llama3.1
docker exec -it ollama ollama pull mistral
Admin Panel → Settings → Documents:
Chunk Size: 1000
Chunk Overlap: 200
Embedding Model: nomic-embed-text
Top K: 5
docker exec -it ollama ollama pull nomic-embed-text
Du bist ein REXE Technology technischer Support-Assistent.
Du bist spezialisiert auf Serververwaltung, Docker, Linux und Netzwerke.
Füge Codebeispiele hinzu.
Erkläre Schritt für Schritt.
server {
listen 443 ssl http2;
server_name ai.example.com;
ssl_certificate /etc/letsencrypt/live/ai.example.com/fullchain.pem;
ssl_certificate_key /etc/letsencrypt/live/ai.example.com/privkey.pem;
location / {
proxy_pass http://localhost:3000;
proxy_set_header Host $host;
proxy_set_header X-Real-IP $remote_addr;
proxy_set_header X-Forwarded-For $proxy_add_x_forwarded_for;
proxy_set_header X-Forwarded-Proto $scheme;
proxy_http_version 1.1;
proxy_set_header Upgrade $http_upgrade;
proxy_set_header Connection "upgrade";
}
client_max_body_size 100M;
}
docker compose pull
docker compose up -d
# Open WebUI Logs
docker logs open-webui
# Ollama-Verbindungstest
docker exec open-webui curl -s http://ollama:11434/api/tags
# Container-Status
docker ps | grep -E 'open-webui|ollama'
Mit REXE VPS-Servern können Sie Ihre eigene ChatGPT-Alternative mit Open WebUI einrichten. Ihre Daten bleiben vollständig unter Ihrer Kontrolle.
Open WebUI unterstützt alle über Ollama laufenden Modelle: Llama 3.1, Mistral, Gemma 2, Phi-3, CodeLlama und mehr. Es kann auch mit OpenAI API-kompatiblen Diensten verbunden werden.
RAG (Retrieval-Augmented Generation) teilt Ihre hochgeladenen Dokumente in Chunks auf und erstellt Embedding-Vektoren. Bei einer Frage werden relevante Dokumententeile gefunden und dem Modell als Kontext bereitgestellt.
Ja, Open WebUI unterstützt mehrere Benutzer. Jeder Benutzer hat seinen eigenen Chat-Verlauf, Einstellungen und Dokumente. Der Admin kann Benutzerrollen und Zugriffsrechte verwalten.
Alle Daten (Chat-Verlauf, Benutzerinfos, hochgeladene Dokumente) werden im Docker-Volume unter /app/backend/data gespeichert. Datenpersistenz wird durch Volume-Mounts sichergestellt.
Ja, Open WebUI funktioniert sowohl mit Ollama als auch mit der OpenAI API. Sie können Ihren OpenAI API-Schlüssel unter Settings → Connections hinzufügen, um Modelle wie GPT-4 zu verwenden.
Ollama-Installation, lokale LLM-Modelle ausführen (Llama 3, Mistral, Gemma), API-Nutzung, Modellverwaltung, GPU-Beschleunigung und Docker-Deployment.
NVIDIA-Treiberinstallation, CUDA-Toolkit, nvidia-container-toolkit, Modell-Serving mit vLLM, GPU-Monitoring und AI-Modell-Deployment mit Docker Anleitung.
Stable Diffusion Installation, AUTOMATIC1111 und ComfyUI Oberflächen, Modell-Download, LoRA-Training, ControlNet-Nutzung und Docker Self-Hosted Bilderzeugung Anleitung.