Ollama: ejecuta IA en tu propio PC con un comando 🤖

Ollama es la forma más sencilla de descargar y ejecutar modelos de IA (LLMs) directamente en tu ordenador. Instalas, escribes un comando y ya estás hablando con un modelo como Llama, Gemma o DeepSeek: sin nube, sin cuentas y sin cuotas.

El problema

Usar IA suele implicar depender de servicios en la nube: pagas por uso, envías tus datos a servidores de terceros y necesitas conexión constante. Para quien valora la privacidad, quiere experimentar sin facturas sorpresa o trabajar sin conexión, esa dependencia es un freno. Y montar un modelo en local por tu cuenta es engorroso: drivers, dependencias, formatos de modelo, cuantización…

La solución

Ollama esconde toda esa complejidad detrás de un único comando. Descarga el modelo, lo optimiza para tu hardware y lo deja listo para chatear por terminal o a través de una API REST local. Todo corre en tu máquina: tus conversaciones y documentos nunca salen de tu equipo.

Características principales

  • Descarga y ejecuta decenas de modelos abiertos (Llama, Gemma, DeepSeek, Qwen, Mistral…).
  • API REST local para integrarlo en tus propias aplicaciones.
  • Cliente de terminal interactivo en modo chat.
  • Librerías oficiales para Python y JavaScript.
  • Se integra con herramientas como editores de código y asistentes.
  • Aprovecha tu GPU si la tienes, o funciona solo con CPU.

Vídeo

Casos de uso

  • Montar tu propio chatbot privado, sin conexión.
  • Desarrollar apps de IA usando la API local en lugar de pagar por tokens.
  • Sistemas RAG para preguntar a tus propios documentos.
  • Experimentar y comparar modelos abiertos sin coste.

Cómo empezar

En macOS o Linux, instala y arranca tu primer modelo con dos líneas:

curl -fsSL https://ollama.com/install.sh | sh
ollama run llama3.2

En Windows hay instalador oficial. La primera vez descargará el modelo; después arranca al instante.

Ficha técnica

  • Lenguaje: Go
  • Licencia: MIT (código abierto)
  • Plataformas: macOS, Windows, Linux y Docker
  • Popularidad: con más de 150.000 estrellas en GitHub

Alternativas

Otras herramientas del mismo terreno son LM Studio, LocalAI, GPT4All y Text Generation WebUI. Ollama destaca por su sencillez extrema y por su API compatible, que lo ha convertido en el motor de muchísimas apps de IA local.

Preguntas frecuentes

¿Es gratis?

Sí. Ollama es open source (licencia MIT) y los modelos que ejecuta son abiertos y gratuitos.

¿Necesito una tarjeta gráfica potente?

No es imprescindible: funciona solo con CPU, aunque una GPU acelera bastante. Hay modelos pequeños que corren bien en portátiles modestos.

¿Mis datos salen a internet?

No. Todo se ejecuta en local; tus conversaciones y archivos no se envían a ningún servidor.

Repositorio

Repositorio en GitHub: ollama/ollama