Ollama führt offene Sprachmodelle wie Llama, Gemma oder Qwen direkt auf einem Windows-PC aus und stellt sie über eine lokale API bereit. Version 0.35.0, Open-Source (MIT).
Ollama bewerten
Durchschnitt 0,0 · Bewertungen: 0
Vielen Dank! Ihre Bewertung wurde gespeichert; Sie können sie jederzeit ändern. Die Bewertung konnte nicht gespeichert werden. Bitte versuchen Sie es später erneut. Aus Ihrem Netzwerk kamen heute zu viele Bewertungen. Bitte versuchen Sie es morgen erneut. Der Durchschnitt erscheint ab 5 Bewertungen.
Über Ollama
Ollama 0.35.0 für Windows ist ein kostenloses Open-Source-Programm, mit dem Sie große Sprachmodelle auf dem eigenen Rechner betreiben statt in der Cloud eines Anbieters. Der Download über die Schaltfläche auf dieser Seite ist der offizielle Installer von ollama.com, der stets auf das aktuelle Release verweist. Version 0.35.0 erschien am 28. September 2026.
Was Ollama macht
Im Kern lädt Ollama ein Modell einmal herunter und lässt Sie danach ohne Internetverbindung damit arbeiten. Eingaben und Antworten verlassen den PC nicht, und es fallen keine Kosten pro Token an. Es gibt zwei Zugänge: Auf der Kommandozeile startet ollama run mit dem Namen eines Modells direkt einen Chat im Terminal, und eine schlanke Desktop-App bietet dasselbe per Mausklick. Im Hintergrund läuft zusätzlich ein lokaler HTTP-Server, auch mit einer OpenAI-kompatiblen Schnittstelle. Genau deswegen installieren viele Entwickler das Programm: Oberflächen wie Open WebUI oder AnythingLLM, Editor-Erweiterungen und eigene Skripte sprechen diesen Server an, oft genügt es, die Adresse von der Cloud auf den lokalen Rechner umzustellen.
Modelle sind nicht im Installer enthalten. Ollama holt sie bei Bedarf aus seiner Bibliothek – Llama, Gemma, Qwen, DeepSeek und gpt-oss sind typische Beispiele. Jedes Modell hat eine eigene Lizenz und eigene Ansprüche an Festplatte und Arbeitsspeicher.
Systemanforderungen
| Bereich | Anforderung |
|---|---|
| Betriebssystem | Windows 10 22H2 oder neuer; auch für macOS und Linux verfügbar |
| Grafikkarte | optional: NVIDIA per CUDA (Treiber 551.61 oder neuer), AMD per ROCm, außerdem Vulkan |
| Ohne GPU | Modelle laufen auf der CPU, nur langsamer |
| Installer | OllamaSetup.exe, ca. 1,5 GB inklusive GPU-Bibliotheken; Modelle belegen zusätzlichen Platz |
Der eigentliche Engpass ist der Speicher. Ein Modell muss in den Arbeitsspeicher passen, für die Beschleunigung durch die Grafikkarte in deren Videospeicher. Welche Modelle infrage kommen, entscheidet also Ihre Hardware und nicht Ollama.
So legen Sie los
- OllamaSetup.exe herunterladen und ausführen.
- Ein Terminal öffnen und zum Beispiel
ollama run gemma3eingeben; beim ersten Aufruf wird das Modell geladen. - Im Terminal chatten oder das Modell in der Desktop-App auswählen.
- Andere Programme auf die Adresse des lokalen Ollama-Servers verweisen.
Hinweise zu Grafikkarten und zum Verschieben des Modellordners auf ein anderes Laufwerk stehen in der offiziellen Windows-Dokumentation.
Sicherheit und Quellcode
Der Installer ist von Ollama Inc. signiert, der Quellcode liegt öffentlich im Repository ollama/ollama auf GitHub, wo auch alle Releases aufgelistet sind. Da die Modelle lokal rechnen, gehen Ihre Anfragen an keinen Modellanbieter. Laden Sie Modelle am besten über die Bibliothek von Ollama und nicht aus beliebigen Tauschbörsen.
Alternativen
Ollama passt zu allen, die das Terminal nicht scheuen oder eine lokale API brauchen. Wer ein fertiges Chatfenster mit Modellkatalog möchte, schaut sich LM Studio oder Jan an. GPT4All ist auf Fragen zu eigenen Dokumenten ausgerichtet, AnythingLLM bündelt Dokumente, Agenten und mehrere Modell-Backends – und kann Ollama selbst als Motor nutzen.
Vorteile und Nachteile
- Vorteil: Open-Source unter MIT-Lizenz, kostenlos.
- Vorteil: eine lokale API, die viele andere Anwendungen bereits unterstützen.
- Vorteil: läuft mit NVIDIA, AMD, Vulkan oder nur auf der CPU.
- Nachteil: Modelle verwaltet man weiterhin am bequemsten im Terminal.
- Nachteil: großer Installer, und die Modelle kommen noch hinzu.