Supertone apresenta Supertonic v3 - nową wersję modelu zamieniającego tekst na mowę, która działa całkowicie offline na urządzeniach użytkownika bez konieczności wysyłania danych do chmury. To znaczny krok naprzód dla branży text-to-speech, gdzie dotychczas główne ograniczenia stanowiły opóźnienia w transmisji sieciowej i obawy o bezpieczeństwo danych osobowych. Supertonic v3 obsługuje aż 31 języków i dialektów, co czyni go jednym z bardziej wszechstronnych rozwiązań na rynku, znacznie poszerzając możliwości lokalizacji dla aplikacji mobilnych i desktopowych.
Kluczową innowacją w trzeciej wersji jest drastyczne zmniejszenie błędów synthesizowania - model nauczył się lepiej interpretować złożone struktury tekstowe, skróty, liczby i idiomatyczne wyrażenia, co bezpośrednio przekłada się na bardziej naturalne brzmienie wygenerowanej mowy. Deweloperzy zyskali także nowe znaczniki kontrolne pozwalające na precyzyjne sterowanie ekspresją głosu - od tempa wymowy, przez wysokość tonu, aż do emocjonalnego zabarwienia wypowiadanych zdań. To otwiera drzwi przed zaawansowanymi aplikacjami od audioboków i asystentów głosowych po personalizowane powiadomienia.
Dla rynku polskiego to szczególnie istotne, bo Supertonic v3 wspiera polski język ze wszystkimi jego niuansami. Działanie offline oznacza zerowe opóźnienia, pełną kontrolę nad danymi i możliwość osadzenia syntezy mowy w każdej aplikacji bez zależności od infrastruktury chmurowej - co jest nie do przeoczenia zarówno dla startupów szukających niezawodnego rozwiązania, jak i dla podmiotów dbających o prywatność użytkowników.