Ir para o conteúdo
fedi.software

Ollama para Windows: rode modelos de IA no próprio PC

0.35.0 · Ollama · Página atualizada

Código aberto · MIT Windows

Ollama é um programa de código aberto que roda modelos de linguagem abertos localmente no Windows, pela linha de comando, por um app e por uma API local.

Baixar Link oficial

Avalie o Ollama

Obrigado! Sua avaliação foi salva; você pode alterá-la. Não foi possível salvar a avaliação. Tente novamente mais tarde. Muitas avaliações da sua rede hoje. Tente novamente amanhã. A média aparece a partir de 5 avaliações.

Sobre o Ollama

O Ollama é um programa de código aberto que roda modelos de linguagem no próprio computador, sem depender de um serviço na nuvem, e a versão 0.35.0 para Windows saiu em 28 de setembro de 2026. O download é gratuito no site oficial, com link direto para o instalador mais recente.

Ele atende quem quer conversar com um modelo de IA offline, testar modelos abertos ou ligar programas próprios a uma IA local. Abaixo, o que ele exige do PC e como começar.

O que o Ollama faz

O Ollama baixa e executa modelos de pesos abertos, como Llama, Gemma, Qwen, DeepSeek e gpt-oss. Esses nomes são exemplos do que ele consegue rodar, não conteúdo incluído: cada modelo é baixado à parte, com a licença do seu autor. O uso acontece de três jeitos. Pela linha de comando, você baixa um modelo e conversa com ele no terminal. Pelo aplicativo de desktop, a conversa fica numa janela, sem digitar comandos. E pela API HTTP local, também compatível com o formato da OpenAI, outros programas do computador podem enviar perguntas ao modelo, o que permite ligar editores de código, automações e interfaces de chat de terceiros ao Ollama. Como tudo roda na máquina, as conversas não saem do PC.

Requisitos

  • Sistema: Windows 10 22H2 ou mais novo; também existe para macOS e Linux.
  • Placa de vídeo: opcional. Há suporte a NVIDIA (CUDA, driver 551.61 ou mais novo), AMD (ROCm) e Vulkan; sem GPU, o Ollama roda no processador.
  • Espaço e memória: o instalador OllamaSetup.exe tem cerca de 1,5 GB porque inclui as bibliotecas de GPU. Os modelos ocupam espaço em disco e memória RAM próprios, que variam conforme o tamanho do modelo escolhido.

O desempenho depende do modelo e do hardware; nenhum modelo tem velocidade ou qualidade garantidas.

Como instalar e começar

  1. Baixe o instalador na página oficial do Ollama; o link aponta sempre para a versão mais recente.
  2. Rode o OllamaSetup.exe; o programa fica ativo na bandeja do sistema.
  3. Abra o aplicativo ou o terminal e escolha um modelo pequeno para o primeiro teste.
  4. Consulte a documentação para Windows para mudar a pasta dos modelos ou configurar a GPU.

Código aberto e atualizações

O código está no repositório do Ollama no GitHub, sob a licença MIT, e as novidades de cada versão ficam na página de lançamentos. Baixe o programa apenas pelo site oficial ou pelo GitHub do projeto, e os modelos pela biblioteca do próprio Ollama ou de fontes que você conhece.

Prós e contras

  • Pró: grátis e de código aberto.
  • Pró: conversas ficam no próprio computador.
  • Pró: API local compatível com o formato da OpenAI.
  • Contra: instalador grande por causa das bibliotecas de GPU.
  • Contra: modelos maiores exigem bastante RAM e espaço em disco.
  • Contra: a linha de comando assusta quem nunca usou terminal.

Alternativas

O LM Studio e o Jan têm interface gráfica mais completa para escolher e baixar modelos. O GPT4All conversa com documentos locais, e o AnythingLLM reúne chat, documentos e agentes num só app, podendo usar o Ollama como motor. Veja também a lista de ferramentas de IA local.