Black Forest Labs ogłosił premierę FLUX 3 Video, ambitnego modelu generatywnego, który przetestowano na wielu zadaniach związanych z wideo i osiągnięto wyniki porównywalne lub lepsze niż konkurencyjne rozwiązania. Model wykorzystuje architekturę Self Flow i wspiera szeroką gamę funkcjonalności: generowanie wideo z tekstu, animację obrazów, transformację wideo do wideo, kontynuację wideo z audio, generowanie na podstawie klatek kluczowych oraz tworzenie dialogów w wielu językach.

Model pozycjonowany jest jako kompleksowe rozwiązanie dla twórców mediów, oferując różnorodne style wizualne, nietypowe proporcje ekranu i możliwość łańcuchowania wielu klipów w dłuższe sekwencje. Każda generacja wideo zawiera natywnie wygenerowany dźwięk, co eliminuje konieczność osobnego tworzenia ścieżki audio. To reprezentuje poważny skok w technologii, biorąc pod uwagę, że zaledwie dwa lata temu BFL hintował w swoim logotypie (z motywem lasu) na przyszłą obecność modelów video.

Wydanie FLUX 3 oznacza znaczący moment w ewolucji narzędzi generatywnych, którego skala potencjalnie przewyższa inne premiery tego dnia, w tym głosowe funkcje ChatGPT i enterprise'ową wersję OpenAI. Model ma szansę na szerokie przyjęcie wśród twórców zawartości, niezależnie od poziomu zaawansowania technicznego, ze względu na łatwość użycia i wszechstronność oferowanych możliwości.