Firma Zyphra pokazała, że trenowanie wydajnych modeli sztucznej inteligencji wcale nie musi ograniczać się do procesorów NVIDIA - ich nowy model ZAYA1-8B, zaawansowany system oparty na architekturze Mixture of Experts, został wytrenowany na sprzęcie AMD i dorównuje lub przebija wydajność konkurencyjnych rozwiązań. Model liczący 8 miliardów parametrów zaskakuje swoją sprawnością szczególnie w zadaniach wymagających logicznego myślenia i kompleksowego rozumowania, co sugeruje, że rozmiar liczby parametrów to nie wszystko w grze o jakość sztucznej inteligencji. To znaczący krok, bo pokazuje konkretnie, że ścieżka trenowania modeli AI na alternatywnym sprzęcie niż dominujące dotychczas rozwiązania NVIDIA jest nie tylko możliwa, ale prowadzi do konkurencyjnych rezultatów.
Dotychczas rynek treningowy dla dużych modeli językowo-obrazowych zdominowały procesory NVIDIA H100 i podobne specjalizowane karty graficzne. Sytuacja stanowiła niemały problem dla startupów i badaczy, dla których koszt sprzętu Jensena Huanga stawał się często nie do przeskoczenia, a dostępność produktów spadała dramatycznie. Demonstracja ZAYA1-8B przez Zyprę potencjalnie zmieniać może ten ekosystem, otwierając drzwi dla zupełnie nowych graczy, którzy będą mogli budować zaawansowane systemy AI na dostępniejszym i bardziej dywersyfikowanym sprzęcie.
Decentralizacja możliwości treningowych to także perspektywa geopolityczna - państwa i przedsiębiorstwa, które chciałyby niezależności od monopolu technologicznego, mogą teraz szukać rozwiązań na bazie architektur AMD bez obawy, że ich modele będą gorsze. Zyphra poprzez tego typu innowacje pokazuje, że przyszłość rozwoju AI nie musi być jednotorowością, a konkurencja na rynku sprzętu może przełożyć się bezpośrednio na szybsze postępy i dostępność zaawansowanych narzędzi dla szerszego grona podmiotów.