Gestión de modelos: organiza 500GB de pesos sin volverte loco
Sistema práctico para almacenar, versionar y limpiar modelos en local: HF_HOME, symlinks, scripts de limpieza y la política de 'un modelo entra, un modelo sale'.
Guías prácticas y reproducibles: ingredientes (herramientas), pasos numerados y el resultado esperado. Todo lo que probamos en el podcast, cocinado para que lo repliques tú.
Sistema práctico para almacenar, versionar y limpiar modelos en local: HF_HOME, symlinks, scripts de limpieza y la política de 'un modelo entra, un modelo sale'.
Cómo accedemos a nuestras sparks y al servidor desde cualquier parte del mundo sin exponer ni un puerto: la magia de la VPN mesh explicada sin jerga.
El Model Context Protocol explicado con analogías honestas: qué es, cómo conectar tus herramientas a un LLM en local y los servers que usamos a diario.
Adapta un modelo abierto a tu estilo o tu dominio con LoRA/QLoRA: qué datos necesitas, cómo entrenarlo en casa y cómo usarlo después. La magia del 'complemento' de 50MB.
Demasiados podcasts, poco tiempo. Pipeline para transcribir cualquier episodio y generar resúmenes, puntos clave y citas en local. Con feed personalizado incluido.
El RAG 'funciona' pero responde mal? Casi siempre es el retrieval. Los 7 errores más comunes (que sufrimos) y cómo arreglarlos: chunking, embeddings, reranking y prompts.
Probamos Whisper large-v3 local contra los servicios de transcripción de pago: calidad, coste, privacidad y velocidad. Con tabla comparativa y veredicto según caso de uso.
Cómo unimos nuestras dos NVIDIA Spark para correr modelos que no caben en una sola: el setup exl3/vLLM que usamos en El Laboratorio, con sus errores y sus números reales.
Nuestro flujo completo real: cómo usamos nuestra propia IA para producir En Local — transcripción, acta, capítulos, show notes y publicación web, casi sin tocar nada.
Monta tu estudio de generación de imágenes: ComfyUI + Flux Schnell, gratis, sin límites y sin que tus prompts salgan de casa.
Los benchmarks de internet no miden lo que tú haces. Crea tu propio examen de 10 prompts y decide con datos qué modelo te va mejor.
Habla con tu IA por voz: Whisper para escuchar, tu LLM para pensar, y TTS open source para responder. Un asistente estilo Siri pero 100% tuyo.
El dúo dinámico: n8n orquesta, tu LLM local piensa. Emails clasificados, notas organizadas, avisos inteligentes... todo gratis y privado.
Monta un asistente que conoce tus PDFs, notas y documentos, usando embeddings + un LLM local. Privado, gratis y sin límites de upload.
Sirve un LLM en tu servidor con API compatible OpenAI: toda tu casa y tus apps lo usan como si fuera ChatGPT, pero gratis y tuyo.
Reuniones, clases, podcast... de MP3 a texto perfectamente puntuado en tu propia máquina. Ni una palabra sale de tu disco.
De cero a chatear con un LLM en tu propio ordenador, sin nube y sin tarjeta gráfica de 2000€.
De audio de reunión a acta con puntos clave y tareas, en menos de 5 minutos.