🧠 Lokale KI auf dem ThinkPad E14 Gen7

✅ Ubuntu 22.04 / 24.04 LTS · Intel Arc / CPU only · Docker + Ollama + Open WebUI

Diese Anleitung führt dich Schritt für Schritt durch die Installation einer privaten KI-Umgebung.
Lenovo ThinkPad E14 Gen7 (Intel Core Ultra / Core 5, 16–32 GB RAM) – ideal für lokale LLMs.
Jeder Befehl kann per „Kopieren“-Button übernommen und direkt im Terminal eingefügt werden.

📦 1. Installation & Setup

1 System aktualisieren & Tools
📋 terminal
sudo apt update && sudo apt upgrade -y
📦 curl, git, htop
sudo apt install -y curl git htop
2 Docker installieren (für Open WebUI)
🔑 Offizielles Docker Repo
curl -fsSL https://download.docker.com/linux/ubuntu/gpg | sudo gpg --dearmor -o /etc/apt/keyrings/docker.gpg
➕ Repository hinzufügen
echo "deb [arch=$(dpkg --print-architecture) signed-by=/etc/apt/keyrings/docker.gpg] https://download.docker.com/linux/ubuntu $(lsb_release -cs) stable" | sudo tee /etc/apt/sources.list.d/docker.list > /dev/null
⬇️ Docker Engine installieren
sudo apt update && sudo apt install -y docker-ce docker-ce-cli containerd.io docker-buildx-plugin docker-compose-plugin
👤 Benutzer zur Docker-Gruppe hinzufügen
sudo usermod -aG docker $USER
⚠️ Nach dem usermod musst du entweder neue Session starten (abmelden & wieder anmelden) oder folgenden Befehl ausführen:
newgrp docker (danach Docker testen)
✔️ Docker prüfen
docker --version
3 Ollama installieren (LLM Runtime)
🚀 One-Line Install
curl -fsSL https://ollama.com/install.sh | sh
🔄 Service-Status prüfen
sudo systemctl status ollama
4 Open WebUI starten (Chat-Oberfläche)
🐳 Container erstellen & ausführen
docker run -d -p 3000:8080 --add-host=host.docker.internal:host-gateway -v open-webui:/app/backend/data --name open-webui --restart always ghcr.io/open-webui/open-webui:main
🌐 Nach erfolgreichem Start ist die WebUI unter http://localhost:3000 erreichbar.
Erstelle ein Admin-Konto (E-Mail + Passwort) – deine Daten bleiben lokal.
5 Erstes LLM herunterladen & testen
🤖 Gemma 3 (1B) – leicht & schnell
ollama run gemma3:1b

Nach Download kannst du direkt im Terminal chatten. In der WebUI (http://localhost:3000) kannst du über das Modell-Menü ebenfalls gemma3:1b auswählen.

📌 Weitere Modelle verwalten
ollama list               # installierte Modelle anzeigen

🔥 Top 20 lokale LLMs für dein ThinkPad (CPU‑optimiert)

Die folgende Tabelle zeigt empfehlenswerte Modelle – von 0,5 GB bis ~9 GB.
Klick auf „Copy“ hinter jedem Befehl, um sofort ollama run ... auszuführen.
💡 Faustregel: Wähle Modelle, deren Größe + RAM-Puffer zu deinem verfügbaren Arbeitsspeicher passen (16 GB → 7B Modelle, 32 GB → auch 16B möglich).

#ModellOllama BefehlGrößeEmpf. RAM
💡 Tipp: Nach dem Kopieren des Befehls (z.B. ollama run llama3.2:3b) wird das Modell automatisch heruntergeladen. In der Open WebUI kannst du dann oben links das Modell wechseln.
🔁 Verwende ollama ps um aktive Modelle zu sehen, ollama rm <name> um Speicher freizugeben.
✅ Kopiert!