Ollama pour Windows : outil open source (MIT) qui exécute localement des modèles de langage ouverts comme Llama, Gemma ou Qwen et les expose via une API locale.
Noter Ollama
Moyenne 0,0 · notes: 0
Merci ! Votre note est enregistrée ; vous pouvez la modifier à tout moment. Impossible d'enregistrer la note. Veuillez réessayer plus tard. Trop de notes depuis votre réseau aujourd'hui. Veuillez réessayer demain. La moyenne s'affiche à partir de 5 notes.
À propos de Ollama
Ollama 0.35.0 est un outil gratuit et open source pour PC Windows qui fait tourner de grands modèles de langage directement sur votre ordinateur, au lieu d'un service en ligne. Pour télécharger Ollama, le bouton de cette page mène à l'installeur officiel d'ollama.com, qui pointe toujours vers la dernière version ; la 0.35.0 est sortie le 28 septembre 2026.
L'essentiel
| Logiciel | Ollama |
|---|---|
| Version | 0.35.0 (28 septembre 2026) |
| Éditeur | Ollama |
| Système | Windows 10 22H2 ou plus récent (existe aussi pour macOS et Linux) |
| Licence | open source, MIT |
| Installeur | OllamaSetup.exe, environ 1,5 Go avec les bibliothèques GPU |
Ce que fait Ollama
Ollama se présente sous deux formes. En ligne de commande, il suffit de taper ollama run suivi du nom d'un modèle pour que celui-ci soit téléchargé et qu'une discussion s'ouvre dans le terminal. Une petite application de bureau permet la même chose en quelques clics. Derrière, un serveur HTTP local répond aux requêtes des autres programmes de l'ordinateur, y compris via une interface compatible avec l'API d'OpenAI : de nombreux outils conçus pour le cloud peuvent ainsi être redirigés vers un modèle local en changeant simplement d'adresse. C'est la raison pour laquelle beaucoup de développeurs l'installent, et pour laquelle des interfaces comme AnythingLLM savent s'y connecter.
Les modèles ne sont pas inclus dans l'installeur. Llama, Gemma, Qwen, DeepSeek ou gpt-oss sont des exemples de modèles ouverts qu'Ollama récupère à la demande, chacun sous sa propre licence et avec ses propres besoins en disque et en mémoire.
Configuration requise
- Système : Windows 10 22H2 ou plus récent.
- Carte graphique (facultative) : NVIDIA via CUDA avec un pilote 551.61 ou plus récent, AMD via ROCm, ou Vulkan.
- Sans GPU : Ollama fonctionne aussi sur le seul processeur.
- Mémoire et disque : à prévoir en plus pour chaque modèle téléchargé, selon sa taille.
La documentation Windows officielle détaille ces points.
Démarrer en quatre étapes
- Téléchargez OllamaSetup.exe avec le bouton de cette page et lancez-le.
- Ouvrez l'application Ollama ou un terminal.
- Choisissez un modèle adapté à la mémoire de votre PC et lancez-le ; le téléchargement initial du modèle peut prendre du temps.
- Pour connecter un autre logiciel, indiquez-lui l'adresse du serveur local d'Ollama.
Le code source et l'historique des versions se trouvent sur GitHub et dans la page des releases.
Confidentialité et sécurité
Une fois le modèle téléchargé, vos questions et les réponses restent sur l'ordinateur. Le serveur local n'est pas fait pour être exposé sur Internet : laissez-le accessible uniquement depuis la machine, sauf configuration réfléchie. Vérifiez aussi la licence de chaque modèle avant un usage commercial.
Avantages et inconvénients
- Avantage : open source et gratuit.
- Avantage : API locale compatible avec les outils existants.
- Avantage : fonctionne avec ou sans carte graphique.
- Inconvénient : les gros modèles demandent beaucoup de mémoire.
- Inconvénient : ligne de commande au cœur de l'outil.
Alternatives
LM Studio propose une interface graphique complète pour chercher et tester des modèles, Jan ressemble à une messagerie de type ChatGPT hors ligne, GPT4All met l'accent sur la discussion avec vos documents, et AnythingLLM réunit documents, agents et modèles locaux ou en ligne.