Ollama para Windows: rode modelos de IA no próprio PC
0.35.0 · Ollama · Página atualizada
Ollama é um programa de código aberto que roda modelos de linguagem abertos localmente no Windows, pela linha de comando, por um app e por uma API local.
Avalie o Ollama
Média 0,0 · avaliações: 0
Obrigado! Sua avaliação foi salva; você pode alterá-la. Não foi possível salvar a avaliação. Tente novamente mais tarde. Muitas avaliações da sua rede hoje. Tente novamente amanhã. A média aparece a partir de 5 avaliações.
Sobre o Ollama
O Ollama é um programa de código aberto que roda modelos de linguagem no próprio computador, sem depender de um serviço na nuvem, e a versão 0.35.0 para Windows saiu em 28 de setembro de 2026. O download é gratuito no site oficial, com link direto para o instalador mais recente.
Ele atende quem quer conversar com um modelo de IA offline, testar modelos abertos ou ligar programas próprios a uma IA local. Abaixo, o que ele exige do PC e como começar.
O que o Ollama faz
O Ollama baixa e executa modelos de pesos abertos, como Llama, Gemma, Qwen, DeepSeek e gpt-oss. Esses nomes são exemplos do que ele consegue rodar, não conteúdo incluído: cada modelo é baixado à parte, com a licença do seu autor. O uso acontece de três jeitos. Pela linha de comando, você baixa um modelo e conversa com ele no terminal. Pelo aplicativo de desktop, a conversa fica numa janela, sem digitar comandos. E pela API HTTP local, também compatível com o formato da OpenAI, outros programas do computador podem enviar perguntas ao modelo, o que permite ligar editores de código, automações e interfaces de chat de terceiros ao Ollama. Como tudo roda na máquina, as conversas não saem do PC.
Requisitos
- Sistema: Windows 10 22H2 ou mais novo; também existe para macOS e Linux.
- Placa de vídeo: opcional. Há suporte a NVIDIA (CUDA, driver 551.61 ou mais novo), AMD (ROCm) e Vulkan; sem GPU, o Ollama roda no processador.
- Espaço e memória: o instalador OllamaSetup.exe tem cerca de 1,5 GB porque inclui as bibliotecas de GPU. Os modelos ocupam espaço em disco e memória RAM próprios, que variam conforme o tamanho do modelo escolhido.
O desempenho depende do modelo e do hardware; nenhum modelo tem velocidade ou qualidade garantidas.
Como instalar e começar
- Baixe o instalador na página oficial do Ollama; o link aponta sempre para a versão mais recente.
- Rode o OllamaSetup.exe; o programa fica ativo na bandeja do sistema.
- Abra o aplicativo ou o terminal e escolha um modelo pequeno para o primeiro teste.
- Consulte a documentação para Windows para mudar a pasta dos modelos ou configurar a GPU.
Código aberto e atualizações
O código está no repositório do Ollama no GitHub, sob a licença MIT, e as novidades de cada versão ficam na página de lançamentos. Baixe o programa apenas pelo site oficial ou pelo GitHub do projeto, e os modelos pela biblioteca do próprio Ollama ou de fontes que você conhece.
Prós e contras
- Pró: grátis e de código aberto.
- Pró: conversas ficam no próprio computador.
- Pró: API local compatível com o formato da OpenAI.
- Contra: instalador grande por causa das bibliotecas de GPU.
- Contra: modelos maiores exigem bastante RAM e espaço em disco.
- Contra: a linha de comando assusta quem nunca usou terminal.
Alternativas
O LM Studio e o Jan têm interface gráfica mais completa para escolher e baixar modelos. O GPT4All conversa com documentos locais, e o AnythingLLM reúne chat, documentos e agentes num só app, podendo usar o Ollama como motor. Veja também a lista de ferramentas de IA local.