Guía completa de Stable Diffusion

Primeros pasos

Stable Diffusion es un modelo de código abierto que puedes ejecutar en tu propio ordenador o a través de servicios en la nube que lo ofrecen. Para uso local, la opción más extendida en 2026 es ComfyUI: descarga la build portable para Windows (o clónalo en Linux/Mac), instala el ComfyUI Manager, coloca un archivo de modelo (.safetensors) en la carpeta de checkpoints, y pulsa "Queue Prompt" para generar tu primera imagen. Necesitas al menos 8GB de VRAM para flujos básicos, aunque se recomiendan 12GB o más para trabajar con comodidad.

Casos de uso

Generación de imágenes con control técnico total
A diferencia de servicios cerrados, puedes ajustar cada paso del proceso (carga de modelo, codificación de prompt, muestreo, decodificación) de forma visual.
Privacidad y trabajo sin conexión
Al ejecutarse en tu propio hardware, tus prompts e imágenes no salen de tu equipo, útil para proyectos con requisitos de confidencialidad.
Uso de modelos y estilos de la comunidad
Descarga modelos base (SDXL, Flux) y LoRAs entrenados por la comunidad para conseguir estilos muy específicos sin entrenar nada tú mismo.
Integración en tus propias aplicaciones
Al ser código abierto, se puede integrar directamente en flujos de trabajo o productos propios sin depender de una API externa de pago.

Configuración avanzada

  1. Instalar ComfyUI
    Descarga la build portable, instala el Manager de extensiones, coloca el checkpoint del modelo en la carpeta correspondiente, y construye tu flujo conectando nodos visualmente.
  2. Flujo básico de SDXL
    La cadena estándar es: cargar checkpoint → codificar el prompt (dos veces en SDXL) → crear la imagen latente vacía → muestrear (KSampler) → decodificar VAE → guardar imagen. Cubre la mayoría de necesidades de generación.
  3. Requisitos de hardware
    Mínimo 8GB de VRAM para flujos básicos; 12GB o más recomendado para trabajar cómodamente, especialmente con modelos más recientes como Flux.
  4. SDXL vs modelos más nuevos
    SDXL genera nativamente en 1024x1024 con mejor detalle que las versiones originales de Stable Diffusion; modelos más recientes como Flux ofrecen aún más calidad a cambio de más requisitos de hardware.

Trucos

  • Empieza con el flujo básico de SDXL antes de complicar el grafo de ComfyUI con nodos avanzados: cubre el 90% de las necesidades habituales de generación.
  • Usa LoRAs de la comunidad en lugar de entrenar un modelo propio desde cero cuando busques un estilo ya existente: ahorra muchísimo tiempo y recursos.
  • Si tu GPU tiene poca VRAM, prueba primero con SDXL antes que con modelos más pesados como Flux, que exigen más memoria.
  • Guarda tus flujos de ComfyUI que funcionen bien como plantillas reutilizables, en lugar de reconstruir el grafo de nodos cada vez.

Preguntas frecuentes

¿Es gratis usar Stable Diffusion?
Sí, es de código abierto y gratuito para ejecutar en tu propio hardware. El único coste real es el de tu GPU o, si usas un servicio en la nube que lo aloje, el precio de ese servicio.
¿Necesito una tarjeta gráfica potente?
Se recomienda al menos 8GB de VRAM para flujos básicos, y 12GB o más para trabajar con comodidad en modelos más recientes.
¿Qué es ComfyUI exactamente?
Es la interfaz de nodos visuales más usada en 2026 para ejecutar Stable Diffusion y modelos relacionados de forma local, dando acceso a cada paso interno del proceso de generación.
¿Puedo usar las imágenes generadas comercialmente?
Depende de la licencia específica del modelo que uses; la mayoría de modelos base permiten uso comercial, pero conviene revisar la licencia de cada modelo y LoRA de la comunidad antes de un uso comercial serio.
Basado en documentación de ComfyUI y guías técnicas de la comunidad de Stable Diffusion