Startup Zyphra odkrył sposób na znacznie szybsze generowanie obrazów przez AI, łącząc technologię Mixture of Experts z modelami dyfuzji. Nowy model ZAYA1-8B-Diffusion-Preview przyspiesza proces tworzenia obrazów nawet siedmiokrotnie w porównaniu z dotychczasowymi metodami. To pierwszy na rynku system, który bierze autoregresyjny duży model języka i konwertuje go na model dyfuzji z architekturą MoE - połączenie, które do tej pory nie było powszechnie stosowane w branży.
Znaczenie tego przełomu tkwi w tym, że otwiera nową ścieżkę do generowania obrazów przy znacznie niższych kosztach obliczeniowych. Dotychczasowe podejścia do modelowania dyfuzji wymagały dużych mocy przetwarzania, co ograniczało dostępność takich narzędzi dla mniejszych firm i naukowców. Architektura MoE - znana z zastosowania w modelach językowych takich jak Mixtral czy Grok - pozwala aktywować tylko część sieci neuronowej podczas każdego kroku generowania. Zamiast przetwarzać wszystkie parametry, model wybiera specjalistyczne części odpowiedzialne za konkretne zadania, co radykalnie zmniejsza obciążenie obliczeniowe.
Zyphra wykazała, że ten podход nie tylko przyspieszył generowanie obrazów do 7,7 raza, ale utrzymał jakość rezultatów. To oznacza potencjalną demokratyzację generatywnego AI - więcej osób będzie mogło korzystać z zaawansowanych modeli dyfuzji bez dostępu do gigantycznych farm serwerów. Wersja Preview modelu sygnalizuje, że kompania pracuje nad jego dalszym doskonaleniem, ale już teraz pokazuje, jak innowacyjne podejścia architektoniczne mogą rewolucjonizować wydajność i dostępność narzędzi do generowania obrazów.