Suno uruchomiło nową funkcję generowania mowy, która pozwala użytkownikom tworzyć głosy na podstawie skryptów lub promptów opisowych. Speech trafił do publicznej bety na wszystkich platformach Suno - zarówno w wersji webowej jak i mobilnej - i jednocześnie generuje głosy do materiałów wideo czy podcastów oraz muzykę tła je towarzyszącą.
Rozszerza to ofertę firmy poza dotychczasowy focus na muzykę generowaną przez AI. Jak powiedział Jack Brody, chief product officer Suno, muzyka zawsze pozostanie sercem platformy, ale wizja firmy sięga także do innych form wyrazu ludzkiego. Speech jest pierwszym modelem audio Suno, który łączy generowanie głosu i muzyki w jednym narzędziu.
To posunięcie pokazuje trend w branży AI, gdzie platformy rozszerzają się na kilka modalności audio jednocześnie. Dla twórców treści oznacza to wygodę - mogą generować kompletne dźwiękowe pakiety do swoich projektów bez opuszczania jednej platformy. Zarazem otwiera nowe możliwości dla podcasterów, twórców YouTube'a czy producentów wideo, którzy szukają szybkich rozwiązań do dodania profesjonalnych voiceoverów.