FLUX
Genera imágenes de alta resolución con un transformer de flujo rectificado
El texto completo se presenta en inglés; el título y el resumen están traducidos.
QUÉ ES
FLUX is a text-to-image model family Black Forest Labs released in August 2024. The team includes the original authors of Stable Diffusion, and FLUX.1 uses a rectified-flow transformer architecture with roughly 12 billion parameters in the main model. The family includes a closed pro version, an open-weight but non-commercial dev version, and a schnell version released under Apache 2.0. It supports text-to-image and image editing, and was widely adopted in the open image community after release.
Por qué merece la pena recordarlo
Built by the original Stable Diffusion authors, it brought the rectified-flow transformer into open-weight image generation and became a major open-source text-to-image line in 2024.
Especificaciones clave
- Parameters
- About 12B in the main model
- Architecture
- Rectified-flow transformer
- Licence
- pro closed; dev open weights, non-commercial; schnell under Apache 2.0
- Released
- 2024-08
Capacidades
Conceptos relacionados
Modelos de difusión
Aprende mil pequeños pasos de eliminación de ruido y podrás crear una imagen desde ruido puro
Difusión latente y control condicional
Hacer difusión no sobre píxeles, sino dentro de un espacio semántico comprimido
Generación multimodal
Un mismo modelo que aprende a hablar, dibujar, moverse e incluso modelar el mundo 3D
Productos similares
Stable Diffusion
2022Liberó los pesos de texto a imagen y los hizo caber en GPU de consumo
Midjourney
2022Un servicio de texto a imagen conocido por su estilo estético
DALL·E 3
2023Reescribe un prompt largo en una descripción detallada y luego dibuja la imagen
Imagen
2022Genera imágenes fotorrealistas con difusión en cascada y un gran codificador de texto
Seedream
2024Un modelo texto a imagen de alta resolución nativa y buen renderizado de texto