Speko uruchomił platformę działającą na zasadzie routera modeli dla voice AI, która automatycznie wybiera najlepszą kombinację trzech kluczowych komponentów agenta głosowego - modelu zamiany mowy na tekst, dużego modelu językowego i zamiany tekstu na mowę.

Problematyka, którą rozwiązuje Speko, wynika z fragmentaryzacji rynku. Producenci voice agentów muszą wybierać spośród dziesiątek wiarygodnych dostawców dla każdej warstwy, a nowe modele pojawiają się co miesiąc. W praktyce zespoły dokonują wyboru raz, a następnie rzadko go ponownie oceniają, ponieważ zmiana dostawcy wymaga nowej integracji i dyskusji o wydajności. Rezultat to produkcyjne agenty głosowe działające na przestarzałych modelach, gdy lepsze i tańsze opcje są już dostępne.

Founder Bek, który wcześniej przez cztery lata budował voice agenty dla przedsiębiorstw w Azji pracujących w ponad 10 językach, zauważył ten problem w praktyce. Za każdym razem, gdy pojawił się nowy model mowy, jego zespół zatrudniał rodzimych mówiących do benchmarkowania i decydował o aktualizacji. Speko automatyzuje ten proces poprzez API. Użytkownicy wysyłają żądanie z kryteriami optymalizacji - dokładność, opóźnienie, koszt lub równowaga między nimi - wraz z językiem i regionem. System filtruje modele zmierzone dla danej kombinacji warunków, benchmarkuje je i wybiera zwycięzcę. Według feedback od zespołu wykonującego tysiące połączeń dziennie, mogą teraz po prostu wejść na dashboard, zmienić model i system zrobi to automatycznie.