← Todas las recetasReceta · 10 de septiembre de 2025

Tu primer modelo local con Ollama en 10 minutos

De cero a chatear con un LLM en tu propio ordenador, sin nube y sin tarjeta gráfica de 2000€.

Dificultadfácil
Tiempo10 min
IngredientesOllama · Llama 3.2

La puerta de entrada perfecta al mundo local. Si solo vas a probar una receta de este blog, que sea esta.

Ingredientes

  • Un ordenador con 8GB de RAM (16GB mejor)
  • Sistema: Windows, Mac o Linux (todos valen)
  • 10 minutos

Pasos

  1. Instala Ollama: descárgalo de ollama.com e instala como cualquier programa. En Linux: curl -fsSL https://ollama.com/install.sh | sh

  2. Descarga tu primer modelo (en una terminal):

    ollama pull llama3.2:3b

    El 3b significa 3 mil millones de parámetros: ligero, va bien en casi cualquier máquina moderna.

  3. Habla con él:

    ollama run llama3.2:3b

    Y ya está. Escribe lo que quieras. Estás chateando con una IA que vive en tu ordenador. Escribe /bye para salir.

  4. Prueba un modelo mejor si tienes 16GB+ de RAM:

    ollama run qwen2.5:7b

Qué esperar

  • Velocidad: 10-40 tokens/segundo según máquina (fluido para leer).
  • Calidad: para chat, resúmenes y dudas, perfecta. Para razonamiento complejo, se nota que es pequeño.
  • Privacidad: todo queda en tu disco. Si te desconectas de internet, sigue funcionando.

Trucos

  • /show info dentro del chat te dice cuánta memoria usa.
  • ollama list lista tus modelos descargados.
  • Para usarlo desde otras apps: Ollama expone una API compatible con OpenAI en http://localhost:11434. Cualquier app que “hable con OpenAI” puede apuntar ahí.

El siguiente paso

Cuando esto se te quede corto: llama.cpp para más control, LM Studio si prefieres interfaz gráfica, o nuestra receta de vLLM para servir a toda la casa.