Tu primer modelo local con Ollama en 10 minutos
De cero a chatear con un LLM en tu propio ordenador, sin nube y sin tarjeta gráfica de 2000€.

La puerta de entrada perfecta al mundo local. Si solo vas a probar una receta de este blog, que sea esta.
Ingredientes
- Un ordenador con 8GB de RAM (16GB mejor)
- Sistema: Windows, Mac o Linux (todos valen)
- 10 minutos
Pasos
-
Instala Ollama: descárgalo de ollama.com e instala como cualquier programa. En Linux:
curl -fsSL https://ollama.com/install.sh | sh -
Descarga tu primer modelo (en una terminal):
ollama pull llama3.2:3bEl
3bsignifica 3 mil millones de parámetros: ligero, va bien en casi cualquier máquina moderna. -
Habla con él:
ollama run llama3.2:3bY ya está. Escribe lo que quieras. Estás chateando con una IA que vive en tu ordenador. Escribe
/byepara salir. -
Prueba un modelo mejor si tienes 16GB+ de RAM:
ollama run qwen2.5:7b
Qué esperar
- Velocidad: 10-40 tokens/segundo según máquina (fluido para leer).
- Calidad: para chat, resúmenes y dudas, perfecta. Para razonamiento complejo, se nota que es pequeño.
- Privacidad: todo queda en tu disco. Si te desconectas de internet, sigue funcionando.
Trucos
/show infodentro del chat te dice cuánta memoria usa.ollama listlista tus modelos descargados.- Para usarlo desde otras apps: Ollama expone una API compatible con OpenAI en
http://localhost:11434. Cualquier app que “hable con OpenAI” puede apuntar ahí.
El siguiente paso
Cuando esto se te quede corto: llama.cpp para más control, LM Studio si prefieres interfaz gráfica, o nuestra receta de vLLM para servir a toda la casa.