Ollama es la forma más sencilla de descargar y ejecutar modelos de IA (LLMs) directamente en tu ordenador. Instalas, escribes un comando y ya estás hablando con un modelo como Llama, Gemma o DeepSeek: sin nube, sin cuentas y sin cuotas.
El problema
Usar IA suele implicar depender de servicios en la nube: pagas por uso, envías tus datos a servidores de terceros y necesitas conexión constante. Para quien valora la privacidad, quiere experimentar sin facturas sorpresa o trabajar sin conexión, esa dependencia es un freno. Y montar un modelo en local por tu cuenta es engorroso: drivers, dependencias, formatos de modelo, cuantización…
La solución
Ollama esconde toda esa complejidad detrás de un único comando. Descarga el modelo, lo optimiza para tu hardware y lo deja listo para chatear por terminal o a través de una API REST local. Todo corre en tu máquina: tus conversaciones y documentos nunca salen de tu equipo.
Características principales
- Descarga y ejecuta decenas de modelos abiertos (Llama, Gemma, DeepSeek, Qwen, Mistral…).
- API REST local para integrarlo en tus propias aplicaciones.
- Cliente de terminal interactivo en modo chat.
- Librerías oficiales para Python y JavaScript.
- Se integra con herramientas como editores de código y asistentes.
- Aprovecha tu GPU si la tienes, o funciona solo con CPU.
Vídeo
Casos de uso
- Montar tu propio chatbot privado, sin conexión.
- Desarrollar apps de IA usando la API local en lugar de pagar por tokens.
- Sistemas RAG para preguntar a tus propios documentos.
- Experimentar y comparar modelos abiertos sin coste.
Cómo empezar
En macOS o Linux, instala y arranca tu primer modelo con dos líneas:
curl -fsSL https://ollama.com/install.sh | sh
ollama run llama3.2
En Windows hay instalador oficial. La primera vez descargará el modelo; después arranca al instante.
Ficha técnica
- Lenguaje: Go
- Licencia: MIT (código abierto)
- Plataformas: macOS, Windows, Linux y Docker
- Popularidad: con más de 150.000 estrellas en GitHub
Alternativas
Otras herramientas del mismo terreno son LM Studio, LocalAI, GPT4All y Text Generation WebUI. Ollama destaca por su sencillez extrema y por su API compatible, que lo ha convertido en el motor de muchísimas apps de IA local.
Preguntas frecuentes
¿Es gratis?
Sí. Ollama es open source (licencia MIT) y los modelos que ejecuta son abiertos y gratuitos.
¿Necesito una tarjeta gráfica potente?
No es imprescindible: funciona solo con CPU, aunque una GPU acelera bastante. Hay modelos pequeños que corren bien en portátiles modestos.
¿Mis datos salen a internet?
No. Todo se ejecuta en local; tus conversaciones y archivos no se envían a ningún servidor.
Repositorio
Repositorio en GitHub: ollama/ollama
