Ollama запускает открытые языковые модели (Llama, Gemma, Qwen и другие) прямо на компьютере с Windows и отдаёт их через локальный API. Версия 0.35.0, лицензия MIT.
Оцените Ollama
Средняя 0,0 · оценок: 0
Спасибо! Оценка сохранена, её можно изменить. Не удалось сохранить оценку. Попробуйте позже. Сегодня из вашей сети уже слишком много оценок. Попробуйте завтра. Средняя оценка появится после 5 оценок.
О программе Ollama
Ollama 0.35.0 для Windows — бесплатная программа с открытым кодом, которая запускает большие языковые модели на вашем компьютере, а не на серверах сторонней компании. Скачать Ollama можно кнопкой на этой странице: она ведёт на официальный установщик с ollama.com, который всегда указывает на последний релиз. Версия 0.35.0 вышла 28 сентября 2026 года.
Зачем нужна Ollama
Ollama решает одну задачу: скачать модель и дать с ней работать без облака. Запросы и ответы не покидают ПК, за токены никто не выставляет счёт, а после загрузки модели интернет уже не нужен. Работать можно двумя способами. В терминале команда ollama run с именем модели скачивает её и сразу открывает чат. Для тех, кто не любит консоль, есть небольшое окно приложения. А в фоне Ollama поднимает локальный HTTP-сервер, в том числе с API, совместимым с OpenAI. Именно ради него программу часто и ставят: к серверу подключаются Open WebUI, AnythingLLM, расширения для редакторов кода и ваши собственные скрипты — достаточно поменять адрес с облачного на локальный.
В установщик модели не входят. Ollama загружает их из своей библиотеки по запросу: типичные примеры — Llama, Gemma, Qwen, DeepSeek и gpt-oss. У каждой модели своя лицензия и свои требования к диску и памяти.
Системные требования
- Windows 10 22H2 или новее; есть версии для macOS и Linux.
- Видеокарта не обязательна. Поддерживаются NVIDIA через CUDA (драйвер 551.61 и новее), AMD через ROCm, а также Vulkan.
- Без видеокарты модели работают на процессоре — медленнее, но работают.
- Установщик OllamaSetup.exe весит около 1,5 ГБ, потому что содержит библиотеки для GPU; каждая модель занимает место дополнительно.
Главное ограничение — память. Модель должна поместиться в оперативную память, а для ускорения на видеокарте — в её видеопамять. Какие модели вам доступны, определяет железо, а не Ollama.
Как начать
- Скачайте OllamaSetup.exe и запустите установку.
- Откройте терминал и выполните, например,
ollama run gemma3— при первом запуске модель загрузится. - Общайтесь прямо в терминале или выберите модель в окне приложения.
- Для других программ укажите адрес локального сервера Ollama.
Подробности о видеокартах и о том, как перенести папку с моделями на другой диск, — в официальной документации для Windows.
Безопасно ли это
Установщик подписан компанией Ollama Inc., исходный код открыт в репозитории ollama/ollama на GitHub, там же список всех релизов. Поскольку модели работают локально, ваши запросы не уходят поставщику модели. Сами модели стоит брать из библиотеки Ollama, а не из случайных файлообменников.
Чем заменить
Ollama удобна тем, кто не боится терминала или кому нужен локальный API. Если хочется готовое окно чата с каталогом моделей, посмотрите LM Studio или Jan. GPT4All рассчитан на вопросы по вашим документам, а AnythingLLM объединяет документы, агентов и разные движки — и умеет использовать Ollama в качестве одного из них.
Плюсы и минусы
- Плюс: открытый код под лицензией MIT, программа бесплатна.
- Плюс: локальный API, который понимают многие другие приложения.
- Плюс: работает с видеокартами NVIDIA и AMD, через Vulkan и просто на процессоре.
- Минус: управлять моделями по-прежнему удобнее всего из терминала.
- Минус: объёмный установщик, а модели добавляют ещё больше.