← Todos los postsBlog · 20 de octubre de 2025

20 ganchos listos para X: el arranque de En Local

Los primeros 20 tuits de En Local, escritos y listos para publicar: benchmarks en 1 frame, ¿cabe en tu PC?, correcciones públicas, build in public y soberanía con ALIA. Copiar, adaptar, lanzar.

Los primeros 20 ganchos del arranque, escritos siguiendo las reglas del juego: primera línea = dato o tensión, números concretos, link nunca en el tuit 1, y una sola cosa por pieza.

Cómo usarlos: cada gancho indica el formato recomendado (texto, imagen o vídeo) y el objetivo. Adaptad los números a las medidas reales del rack — publicamos medido o no publicamos.


Bloque 1 — Los benchmarks en 1 frame (5 ganchos)

1. (imagen: terminal + wattímetro)

GLM-5.3 Flash. 65 tok/s. 768 GB de RAM repartidos en dos cajas del salón.

Coste de API: 0 €.
Coste de luz: menos que tu router.

Este es En Local. Vamos a medirlo todo.

2. (imagen: tabla comparativa)

El mismo modelo, dos mundos:

Qwen3.8 Flash Next en el cluster: 56 tok/s estructurado.

El mismo modelo vía API: 0,8 € por millón de tokens.

Yo lo tengo pagado. Para siempre.

Hilo con los números 👇

3. (vídeo 20s: cursor escribiendo, contador de tok/s en vivo)

"La IA local es lenta".

Mientras lo dices, esta caja de 250 € está generando 139 tokens por segundo.

Nemotron 3.5 Lightning, NVFP4, mi salón. Sin nube.

4. (imagen: terminal con TTFT)

131 milisegundos.

Eso tarda DeepSeek V4 Flash (1M de contexto) en empezar a responder en mi rack.

Tu API "instantánea" tarda más en muchos casos. Y sabe inglés mejor que español.

5. (imagen: facturas de luz vs suscripciones)

Mi laboratorio de IA consume menos que un.monitor curvo.

6 máquinas, 768 GB de memoria, modelos de 700B corriendo.

Suscripción media de IA: 240 €/año. Mi luz: ~180 €/año por TODA la pila.

Bloque 2 — ¿Cabe en tu PC? (3 ganchos)

6. (imagen: tabla clara)

¿Cabe en tu PC? Guía honesta:

8 GB RAM → 3B-8B (Q4). Chat decente.
16 GB → 8B-14B. Bueno de verdad.
24 GB → 14B-32B. Para todo lo cotidiano.
64 GB+ unificados → 70B. Nivel serio.
2× 128GB en cluster → 700B. Nivel nuestro.

¿Qué tienes? Te digo qué correr. 👇

7. (texto)

El error que todos cometen al empezar en IA local:

descargar el modelo más grande que quepa.

El mejor modelo NO es el más grande: es el que resuelve TU tarea a TU velocidad.

Mi modelo de trabajo diario: 14B. No el de 700B del cluster.

8. (imagen: el rack)

Estado real del rack esta semana:

→ GLM-5.3 Flash: 65 t/s, beta operativa
→ Qwen3.8 Flash Next: 110 t/s agregados (×8 flujos)
→ DeepSeek V4: rollback listo
→ 0 incidentes de nube caída: ∞ días

El cluster es el personaje. Esta es su ficha 👇

Bloque 3 — Corrección pública (3 ganchos)

9. (cita a un tuit con una cifra imposible)

Vi un tuit diciendo que una 5090 corre un 70B denso a 40 tok/s.

Medimos: ni arranca. No cabe en 24 GB ni de broma.

Lo que SÍ corre una 5090: 32B Q4 a 23 tok/s.

Autoridad > simpatía. Medimos o callamos.

10. (imagen: tu benchmark vs la promesa del fabricante)

La ficha técnica dice: "hasta 3.000 tok/s en servidores".

Medido en hardware real de consumo: 56.

La distancia entre el marketing y el rack es el contenido de este canal.

11. (texto)

Las cifras de benchmarks públicos no sirven para decidir qué modelo usar.

Sabemos lo que dicen. No sabemos:

→ si el examen estaba contaminado
→ si lo medirías igual en tu hardware
→ si sobrevive a una tarea real tuya

Por eso montamos nuestro propio banco. Receta completa aquí:

Bloque 4 — Soberanía: ALIA y España (3 ganchos)

12. (imagen: ALIA corriendo en el rack)

ALIA-40B (el modelo del BSC) corriendo en mi rack. En español. Sin nube.

Un modelo público español, sirviendo RAG sobre documentación jurídica, sin que un byte
salga de la red.

Casi nadie enseña esto funcionando. Nosotros sí. Hilo 👇

13. (texto)

La pregunta que todo despacho y clínica se está haciendo:

"¿Puedo usar IA con mis documentos SIN enviarlos a nadie?"

Respuesta corta: sí.
Respuesta con números: viene en camino.

Estamos preparando la demo completa: ALIA + RAG + 0 bytes fuera de casa.

14. (imagen: consola con logs en español)

Todo lo que ves en este canal corre en español, con modelos pensados para español:

ALIA (BSC) · Salamandra · Qwen · GLM · DeepSeek

La IA no tiene por qué hablar inglés primero. Y el que te lo demuestre no tiene que
estar en California.

Bloque 5 — Build in public (3 ganchos)

15. (vídeo 30s: cableado QSFP del switch)

El momento en que el cluster pasa de TCP a RoCE de verdad:

de 16 Gb/s a 196 Gb/s bidireccionales.

Un cable mal puesto = la mitad del rendimiento. Nadie te cuenta esto en el unboxing.

Build in public, episodio 1 👇

16. (imagen: factura de la luz del mes + gráfica de consumo)

Contabilidad pública del laboratorio, mes 1:

Luz: X €
Discos: X €
API gastada: 0 €
Equivalente en API de lo ejecutado: Y €

El rack se paga solo en ≥6 meses si lo usas en serio. Con números.

17. (texto)

Lo que se rompió esta semana en el laboratorio:

→ un contexto de 256K que se comió 40 GB de memoria
→ SSH que no aceptaba claves (culpa: config.d)
→ un benchmark a 91% de disco lleno

Todo documentado, todo con solución. Los errores también publicamos:

Bloque 6 — Comunidad y podcast (3 ganchos)

18. (clip 40s del podcast con subtítulos)

EP.01 — Quiénes somos y qué hay en el rack.

Sin humo, sin "los 10 prompts que cambiarán tu vida":

solo tok/s, vatios y las 3 máquinas que lo hacen posible.

Completo en YouTube y Spotify 👇

19. (texto)

Pregunta honesta para el timeline técnico en español:

¿qué modelo estás corriendo en local HOY, y para qué?

Responded con el tamaño y el hardware. Vamos a hacer el mapa de la IA local hispana.

20. (imagen: newsletter mockup)

Cada semana publicamos:

→ la ficha completa de un modelo medido en el rack
→ las configs exactas para reproducirlo
→ los errores y los arreglos

Todo gratis por email. Sin spam, sin "curiosidades de IA".

enlocal.ai — suscríbete en la bio.

El calendario de lanzamiento (semana 1)

Día Ganchos Hora
Lunes #1 (imagen), #7 08:30 · 17:00
Martes #6 (imagen), #15 (vídeo) 08:30 · 17:00
Miércoles #9, #12 (imagen) 08:30 · 17:00
Jueves #18 (clip EP.01), #10 08:30 · 17:00
Viernes #16, #19 08:30 · 17:00
Sábado #8 (imagen) 10:00
Domingo descanso o replies

Reglas de oro pegadas en la pared: primera línea con dato, números siempre, un solo CTA por pieza, responder todo en los primeros 30 min, y los números de los ganchos se sustituyen por las medidas reales del rack antes de publicar.