FLUX.2 y Stable Diffusion 3.5 — Código abierto
Explora el mundo de los modelos de imagen de código abierto: FLUX.2 de Black Forest Labs y Stable Diffusion 3.5. Aprende a usarlos mediante Hugging Face, APIs y localmente con ComfyUI.
🌊 FLUX.2 — El gigante de código abierto
FLUX.2, desarrollado por Black Forest Labs (fundada por excreadores de Stable Diffusion), es el modelo de imagen de código abierto más avanzado disponible en 2026.
FLUX.2 dev — El modelo principal
32 mil millones de parámetros. Calidad comparable a Midjourney V7 en muchos escenarios. Admite una resolución de hasta 4 megapíxeles. Ideal para producción a escala mediante API o uso local con una GPU potente (se recomiendan 16GB+ de VRAM para desarrollo).
FLUX.2 klein — Ularrápido
Versión optimizada que genera imágenes en menos de 1 segundo en GPU con apenas 8 GB de VRAM. Perfecta para crear prototipos rápidamente y usarla localmente en hardware modesto. Su calidad es ligeramente inferior a la de dev, pero su velocidad es incomparable.
💡 Por qué FLUX.2 es importante
Con FLUX.2, tienes control total: sin costos mensuales, sin límites de generación, sin términos de uso restrictivos y puedes entrenar el modelo con tus propios datos. Para producción comercial a gran escala, el costo por imagen es prácticamente cero (solo electricidad/GPU).
🎯 Stable Diffusion 3.5
Stability AI sigue siendo relevante con SD 3.5, que incorporó la nueva arquitectura MMDiT (Multimodal Diffusion Transformer):
| Variante | Parámetros | VRAM mínima | Mejor uso |
|---|---|---|---|
| SD 3.5 Large | 8B | 12GB | Máxima calidad, uso profesional |
| SD 3.5 Medium | 2.6B | 8GB | Equilibrio entre calidad y velocidad |
FLUX.2 vs SD 3.5: ¿cuál elegir?
FLUX.2 generalmente produce imágenes de mayor calidad y es más rápido con FLUX klein. SD 3.5 tiene la ventaja de un ecosistema más maduro (más extensiones, LoRAs y comunidad). Para principiantes, recomendamos empezar con FLUX.2 vía Hugging Face y explorar SD 3.5 cuando quieras tener más control con ComfyUI.
🚀 Cómo usar: local vs. API vs. Hugging Face
1. Hugging Face Spaces (más fácil)
Accede directamente desde el navegador sin instalar nada. Ve a huggingface.co/spaces y busca "FLUX" o "Stable Diffusion". Escribe tu prompt y genera. Puede haber una fila en las horas pico, pero es 100% gratis.
2. API (para integración)
Usa directamente la API de Hugging Face, Replicate o Black Forest Labs. Es ideal para automatizaciones con n8n o scripts. Pagas por uso (centavos por imagen), pero sin filas de espera y con respuesta rápida.
3. Local con ComfyUI (máximo control)
Instala ComfyUI en tu computadora, descarga el modelo y ten control total. Requiere una GPU NVIDIA con 8GB+ VRAM. Sin costos recurrentes, sin límites, sin filas. La curva de aprendizaje es mayor, pero vale la pena.
🔧 ComfyUI para principiantes
ComfyUI es una interfaz visual basada en nodos (nodes) para ejecutar modelos de difusión localmente. A primera vista parece complejo, pero el concepto es sencillo:
Flujo básico de un workflow ComfyUI
- 1. Loader — Carga el modelo (FLUX.2 o SD 3.5)
- 2. CLIP Text Encode — Convierte tu prompt en embeddings
- 3. KSampler — Genera la imagen (proceso de difusión)
- 4. VAE Decode — Convierte el resultado en una imagen visible
- 5. Save Image — Guarda el resultado
⚠️ Para este curso
ComfyUI se explorará con más profundidad en los niveles 2 y 3. En este nivel, el enfoque es usar Hugging Face Spaces y APIs para generar imágenes con FLUX.2. Si tienes una GPU potente y quieres adelantarte, consulta la documentación oficial de ComfyUI en GitHub.
✅ Lista de verificación de la clase
- Entiendo las diferencias entre FLUX.2 dev y klein
- Conozco las variantes de Stable Diffusion 3.5
- Sé las 3 formas de usar modelos de código abierto (HF, API, local)
- Generé al menos 3 imágenes mediante Hugging Face Spaces
- Entiendo el concepto básico de ComfyUI