FLUX
Erzeugt hochauflösende Bilder mit einem Rectified-Flow-Transformer
Der vollständige Artikel liegt auf Englisch vor; Titel und Zusammenfassung sind lokalisiert.
WAS ES IST
FLUX is a text-to-image model family Black Forest Labs released in August 2024. The team includes the original authors of Stable Diffusion, and FLUX.1 uses a rectified-flow transformer architecture with roughly 12 billion parameters in the main model. The family includes a closed pro version, an open-weight but non-commercial dev version, and a schnell version released under Apache 2.0. It supports text-to-image and image editing, and was widely adopted in the open image community after release.
Warum es wichtig ist
Built by the original Stable Diffusion authors, it brought the rectified-flow transformer into open-weight image generation and became a major open-source text-to-image line in 2024.
Wichtige Eckdaten
- Parameters
- About 12B in the main model
- Architecture
- Rectified-flow transformer
- Licence
- pro closed; dev open weights, non-commercial; schnell under Apache 2.0
- Released
- 2024-08
Fähigkeiten
Verwandte Konzepte
Diffusionsmodelle
Lerne tausend kleine Entrauschungsschritte, und du erzeugst ein Bild aus reinem Rauschen
Latente Diffusion und konditionale Steuerung
Diffusion nicht über Pixel, sondern in einem komprimierten semantischen Raum
Multimodale Generierung
Ein Modell, das sprechen, zeichnen, sich bewegen — und sogar die 3D-Welt modellieren lernt
Vergleichbare Produkte
Stable Diffusion
2022Veröffentlichte Text-zu-Bild-Gewichte offen und klein genug für Consumer-GPUs
Midjourney
2022Ein Text-zu-Bild-Dienst, bekannt für seinen ästhetischen Stil
DALL·E 3
2023Schreibt eine lange Eingabe in eine detaillierte Beschreibung um und zeichnet dann das Bild
Imagen
2022Erzeugt fotorealistische Bilder mit kaskadierter Diffusion und großem Text-Encoder
Seedream
2024Ein Text-zu-Bild-Modell mit nativer Hochauflösung und guter Textdarstellung