Lokale KI mit Ollama auf dem PC installieren
Diese Anleitung führt durch die Einrichtung von Ollama 0.4 auf Windows 11 mit 32 GB RAM für den täglichen Einsatz.
- ki
- produktivitaet
- digitalisierung
KI-unterstützt · redaktionell geprüft Details
Am 17. August 2026 läuft auf einem Rechner mit Windows 11 und 32 GB RAM die Installation von Ollama 0.4.1.
Hardware prüfen
Zuerst wird der verfügbare VRAM überprüft. Bei weniger als 8 GB VRAM überspringt man diesen Schritt, doch dann passen nur Modelle unter 7B Parameter in den Speicher. Das pcgameshardware.de-Special zu lokaler KI von 2025 nennt diesen Wert als Mindestvoraussetzung.
Ollama herunterladen
Der Installer wird von ollama.com geladen. Die Datei hat 142 MB. Ohne diesen Download startet kein lokales Modell.
Installation ausführen
Nach dem Doppelklick auf die EXE erscheint ein Fenster mit Fortschrittsbalken. Der Vorgang dauert 90 Sekunden auf einem Ryzen 7 5800X. Wer diesen Schritt auslässt, kann später keine Befehle in der Kommandozeile ausführen.
Modell herunterladen
Mit dem Befehl ollama pull llama3.1:8b wird das 4,7 GB große Modell geladen. Der Download über eine 100 Mbit-Leitung benötigt 8 Minuten. Bei Sprung dieses Schritts bleibt die Antwortfunktion leer.
Testlauf starten
Der Befehl ollama run llama3.1:8b öffnet eine interaktive Shell. Eine einfache Anfrage wie „Zusammenfassen Sie den letzten Projektbericht“ liefert nach einigen Sekunden eine Ausgabe – wie schnell, hängt an Modellgröße und Hardware. Ohne Test scheitert später die Integration in Tools wie Obsidian.
Integration in den Arbeitsalltag
Ollama wird an Microsoft To Do über die API angebunden. Die Verbindung läuft über localhost:11434. Fehlt diese Bindung, bleiben die generierten Texte isoliert und müssen manuell kopiert werden.
Kostenfreier Website-Check
Ein separater Test der eigenen Seite auf https://log-sysdev.de/website-check zeigt Ladezeiten und SEO-Probleme, die nach der KI-Einrichtung leichter behoben werden können. Die Prüfung ist kostenlos und liefert innerhalb von zwei Minuten einen Bericht.
Häufiger Fehler bei der ersten Abfrage
Oft wird vergessen, die Temperatur auf 0,7 zu setzen. Dann wiederholt das Modell Formulierungen oder produziert leere Sätze. Dieser Wert wird in der Datei Modelfile hinterlegt und muss vor dem nächsten Run angepasst werden.