Salt la conținut
fedi.software

Ollama download

0.35.0 · Ollama · Pagină actualizată

Open source · MIT Windows

Ollama 0.35.0 este un program gratuit și open source (MIT) pentru Windows care rulează modele de limbaj deschise pe calculator și le oferă printr-un API local.

Descarcă Link oficial de descărcare

Evaluați Ollama

Mulțumim! Evaluarea a fost salvată; o puteți modifica. Evaluarea nu a putut fi salvată. Încercați din nou mai târziu. Prea multe evaluări din rețeaua dvs. astăzi. Încercați din nou mâine. Media apare după 5 evaluări.

Despre Ollama

Ollama 0.35.0 este un program gratuit și open source pentru Windows, cu care rulați modele mari de limbaj direct pe calculator, nu în cloudul unui furnizor. Descărcarea de pe această pagină duce la instalatorul oficial de pe ollama.com, care indică mereu ultima versiune; 0.35.0 a apărut pe 28 septembrie 2026.

Ce face Ollama

Ollama descarcă o dată un model, iar apoi puteți lucra cu el fără conexiune la internet. Întrebările și răspunsurile rămân pe calculator și nu plătiți nimic pe token. Programul are două fețe: în linia de comandă, ollama run urmat de numele unui model deschide un chat în terminal, iar aplicația desktop face același lucru cu mouse-ul. În fundal rulează un server HTTP local, compatibil și cu API-ul OpenAI. De aici vine popularitatea lui printre programatori: interfețe grafice, extensii pentru editoare de cod și scripturi proprii se leagă de acest server, adesea doar schimbând adresa din cloud cu cea locală.

Modelele nu sunt incluse în instalator. Ollama le descarcă la cerere din biblioteca proprie; Llama, Gemma, Qwen, DeepSeek și gpt-oss sunt exemple tipice. Fiecare model are licența lui și nevoile lui de spațiu pe disc și de memorie.

Cerințe de sistem

ComponentăCerință
SistemWindows 10 22H2 sau mai nou; există și versiuni pentru macOS și Linux
Placă videoopțională: NVIDIA prin CUDA (driver 551.61 sau mai nou), AMD prin ROCm, Vulkan
Fără placă videomodelele rulează pe procesor, doar mai încet
InstalatorOllamaSetup.exe, aproximativ 1,5 GB, cu bibliotecile pentru GPU; modelele ocupă spațiu separat

Limita reală este memoria. Un model trebuie să încapă în RAM, iar pentru accelerare pe placa video — în memoria ei video. Hardware-ul dumneavoastră decide deci ce modele puteți folosi, nu programul.

Primii pași

  1. Descărcați OllamaSetup.exe și rulați-l.
  2. Deschideți un terminal și scrieți, de exemplu, ollama run gemma3; la prima rulare modelul se descarcă.
  3. Discutați în terminal sau alegeți modelul în aplicația desktop.
  4. Îndreptați alte programe spre adresa serverului Ollama local.

Detalii despre plăcile video și despre mutarea dosarului cu modele pe alt disc găsiți în documentația oficială pentru Windows.

Siguranță și cod sursă

Codul sursă este public, sub licența MIT, în depozitul ollama/ollama de pe GitHub, unde apar și toate versiunile publicate. Pentru că modelele calculează local, cererile nu ajung la un furnizor de modele. Descărcați modelele prin biblioteca Ollama, nu din surse întâmplătoare.

Pentru cine este

Ollama se potrivește celor care nu se tem de terminal și celor care au nevoie de un API local pentru propriile aplicații. Cine vrea o fereastră de chat gata făcută, cu catalog de modele, poate alege o aplicație cu interfață grafică.

Avantaje și dezavantaje

  • Avantaje: gratuit și open source (MIT), API local suportat de multe aplicații, merge cu NVIDIA, AMD, Vulkan sau doar pe procesor.
  • Dezavantaje: modelele se gestionează în principal din terminal, instalator mare, iar modelele ocupă spațiu în plus.

Alternative

LM Studio și Jan oferă o fereastră de chat cu catalog de modele, GPT4All pune accent pe discuția cu propriile documente, iar AnythingLLM adună documente, agenți și mai multe motoare de modele — inclusiv Ollama.