Ollama para Windows: cómo ejecutar modelos de lenguaje en local
0.35.0 · Ollama · Página actualizada
Ollama es un programa de código abierto que ejecuta modelos de lenguaje abiertos en tu PC con Windows, desde la terminal, una app de escritorio o una API local.
Valora Ollama
Media 0,0 · valoraciones: 0
¡Gracias! Tu valoración se ha guardado; puedes cambiarla. No se pudo guardar la valoración. Inténtalo más tarde. Hoy ya hay demasiadas valoraciones desde tu red. Inténtalo mañana. La media aparece a partir de 5 valoraciones.
Acerca de Ollama
Puedes descargar Ollama 0.35.0 para Windows gratis desde su web oficial: el enlace directo lleva siempre al instalador de la última versión, publicada el 28 de septiembre de 2026. Ollama es un programa de código abierto que ejecuta modelos de lenguaje en tu propio equipo, sin enviar las conversaciones a un servicio en la nube.
Le sirve a quien quiere probar modelos abiertos sin conexión, trabajar con datos que no deben salir del PC o conectar sus propios scripts a una IA local. A continuación tienes qué pide al hardware y cómo empezar en pocos minutos.
Qué hace Ollama
Ollama descarga y ejecuta modelos de pesos abiertos, por ejemplo Llama, Gemma, Qwen, DeepSeek o gpt-oss. Son ejemplos de lo que puede mover, no contenido incluido: cada modelo se baja aparte y conserva la licencia de su autor. Hay tres formas de usarlo. En la terminal descargas un modelo y chateas con él escribiendo comandos. En la app de escritorio la conversación ocurre en una ventana normal. Y a través de la API HTTP local, compatible también con el formato de OpenAI, otros programas del equipo pueden enviarle preguntas: así se conectan editores de código, automatizaciones o interfaces de chat de terceros sin cambiar su configuración más allá de la dirección del servidor.
Requisitos de hardware
- Sistema: Windows 10 22H2 o posterior; también hay versiones para macOS y Linux.
- Tarjeta gráfica: opcional. Admite NVIDIA (CUDA, controlador 551.61 o superior), AMD (ROCm) y Vulkan; sin GPU, Ollama funciona con el procesador.
- Disco y memoria: el instalador OllamaSetup.exe ocupa unos 1,5 GB porque trae las bibliotecas de GPU. Cada modelo necesita además su propio espacio en disco y su RAM, que dependen del tamaño que elijas.
La velocidad y la calidad de las respuestas dependen del modelo y de tu equipo; ningún modelo tiene un rendimiento garantizado.
Instalación paso a paso
- Descarga el instalador desde la web oficial de Ollama.
- Ejecuta OllamaSetup.exe; al terminar, el programa queda activo en la bandeja del sistema.
- Abre la app o la terminal y elige un modelo pequeño para la primera prueba.
- Si quieres cambiar la carpeta de los modelos o ajustar la GPU, consulta la documentación para Windows.
Un consejo práctico: antes de bajar un modelo grande, revisa cuánta RAM libre tienes y cuánto espacio queda en el disco. Si el modelo no cabe en la memoria, el sistema empezará a usar el disco y todo irá mucho más lento.
Código abierto y actualizaciones
El código está en el repositorio de Ollama en GitHub con licencia MIT, y los cambios de cada versión se publican en la página de versiones. Descarga el programa solo desde la web oficial o desde ese repositorio, y los modelos desde la biblioteca de Ollama o desde fuentes que conozcas.
Ventajas y desventajas
- Ventaja: gratuito y de código abierto.
- Ventaja: las conversaciones se quedan en tu equipo.
- Ventaja: API local compatible con el formato de OpenAI.
- Desventaja: instalador pesado por las bibliotecas de GPU.
- Desventaja: los modelos grandes piden mucha RAM y disco.
- Desventaja: la terminal puede intimidar a quien nunca la ha usado.
Alternativas
LM Studio y Jan ofrecen una interfaz gráfica más completa para buscar y descargar modelos. GPT4All permite chatear con tus documentos locales, y AnythingLLM reúne chat, documentos y agentes en una sola app que puede usar Ollama como motor. Tienes la comparación en apps de LLM locales.