Tu primer workflow de texto a imagen en ComfyUI
Vamos a montar el flujo de texto a imagen desde cero. Al terminar tendrás tu primera imagen y, más importante, entenderás qué hace cada nodo.
1. Carga el modelo Añade un nodo Load Checkpoint y elige tu modelo (por ejemplo, un SDXL o un Flux). Este nodo tiene tres salidas: MODEL, CLIP y VAE. Cada una alimenta una parte distinta del flujo.
2. Escribe los prompts Añade dos nodos CLIP Text Encode (Prompt) y conecta la salida CLIP del checkpoint a ambos: - Uno es el prompt positivo: lo que quieres ver. Sé concreto: sujeto, estilo, iluminación, lente. - Otro es el prompt negativo: lo que NO quieres (borroso, deformado, marca de agua...).
3. El espacio latente Añade un Empty Latent Image y define el tamaño (1024×1024 para SDXL/Flux). Aquí es donde nace la imagen como ruido antes de "revelarse".
4. El KSampler Es el nodo clave. Conecta: - model ← del checkpoint - positive y negative ← de tus dos CLIP Text Encode - latent_image ← del Empty Latent
Parámetros que importan: - steps: pasos de muestreo (20-30 suele bastar). - cfg: cuánto obedece al prompt (7 es un buen punto de partida). - sampler/scheduler: empieza con *dpmpp_2m* + *karras*. - seed: la semilla; fíjala para reproducir, aleatorízala para explorar.
5. Decodifica y guarda Conecta la salida del KSampler a un VAE Decode (con el VAE del checkpoint) y este a un Save Image. Pulsa *Queue Prompt* y verás tu imagen.
El truco que cambia todo No juzgues una generación: lanza varias semillas del mismo prompt y quédate con la mejor. El coste es mínimo y la calidad sube muchísimo.
¿Listo para flujos más serios? Sigue con imagen a imagen e inpainting.