Stability AI, firma znana z modeli generujących obrazy, poczyniła znaczący skok w produkcji muzyki sztuczną inteligencją - jej nowy model potrafi generować pełne, sześciominutowe piosenki od zera. Do tej pory modele AI były ograniczone do tworzenia krótkich fragmentów audio, zwykle trwających poniżej minuty. Ta zmiana oznacza skokowy przeskok w praktyczności tego rodzaju narzędzi dla producentów muzycznych i twórców contentu. Możliwość wygenerowania całego utworu w jednym procesie otwiera zupełnie nowe perspektywy dla przemysłu muzycznego i posługiwania się AI jako asystenta kreatywnego.
Nowy model stanowi kolejny krok w ewolucji generatywnej sztucznej inteligencji, która coraz bardziej zaciera granicę między narzędziem wspierającym twórczość a potencjalnym zamiennikiem pracy ludzkiego artysty. Technologia ta może być szczególnie atrakcyjna dla producentów soundtracków, twórców contentu wideo czy artystów eksperymentujących z nowymi brzmieniami. Zarazem jednak pojawią się praktyczne problemy - jak autorskie prawa muzyczne, kompensacja dla artystów, których utwory mogły posłużyć do trenowania modelu, i kwestia autentyczności w branży muzycznej, gdzie oryginalność tradycyjnie stanowi fundamentalną wartość.
Stability AI wydaje się zdeterminowana, by stać się głównym graczem w technologiach generatywnych. Po sukcesie modelu Stable Diffusion na rynku generowania obrazów, firma skaluje swoje ambicje na pole audio i muzyki. Jednak wdrażanie tego rodzaju narzędzi będzie musiało zmierzyć się z rosnącym oporem artystów i pytaniami regulacyjnymi, które przed branżą AI stoją coraz ostrzej. To będzie jedna z kluczowych batali o kierunek, w którym zmierza sztuczna inteligencja w najbliższych latach.