Black Forest Labs spustil FLUX 3 — prvý end-to-end model pre obraz, video aj zvuk z jedného promptu
Čo sa stalo
Black Forest Labs (BFL), tvorcovia série FLUX, spustili 23. júla 2026 model FLUX 3 — spoločne trénovaný multimodálny model schopný z jedného promptu generovať obrázky alebo kombinované video/zvuk klipy s maximálnou dĺžkou 20 sekúnd. Model bol spustený v obmedzenom prístupe.
Kontext a dopad
FLUX 3 je technologicky odlišný od predošlých generatívnych pipeline-ov, ktoré skladajú samostatné modely pre obraz, video a zvuk. End-to-end spoločný tréning naprieč modalitami je považovaný za dôležitý krok k skutočnému multimodálnemu generovaniu. BFL tým priamo konkuruje Sora (OpenAI), Veo (Google), Runway a Kling — ibaže s jedným unified modelom namiesto viacerých špecializovaných.
Detaily
- Video: až 20 sekúnd z textového promptu
- Tréning: end-to-end joint training (nie assemblage separátnych modelov)
- Modality: obraz, video, zvuk — všetky v jednom modeli
- Dostupnosť: obmedzený prístup pri launchi, širší prístup plánovaný
- Black Forest Labs: nemecký startup, tvorcovia FLUX 1.x a FLUX 2.x sérií
- Konkurenti: Sora, Veo 3, Runway Gen-4, Kling
Otvoriť pôvodný zdroj
VentureBeat