Google udostępnił właśnie Gemini 3.8 Live i Gemini 3.8 Live Extended Thinking - dwa nowe modele zdolne do rozmów voice-to-voice, które są odpowiedzią na rodzinę GPT-Live od OpenAI. Narzędzie zawiera webowy interfejs użytkownika zbudowany przy użyciu modelu GPT-6 Astra Extra High, który pozwala testować nowe modele bezpośrednio w przeglądarce.
Interfejs oferuje pełną kontrolę nad doświadczeniem rozmowy - można wybrać konkretny model, ustawić głos, podać opcjonalnie system prompt, a następnie rozmawiać przez mikrofon. Kluczową funkcją jest możliwość przerwania modelu w trakcie jego wypowiadania się, co daje użytkownikowi większą kontrolę nad przepływem konwersacji. Implementacja techniczna jest minimalistyczna i nie wymaga dodatkowych bibliotek - opiera się na połączeniu WebSocket z Google Generative Language API oraz Web Audio API do obsługi nagrywania i odtwarzania dźwięku.
To wydanie reprezentuje znaczący krok w kierunku mainstream'owych rozmów głosowych z AI. Podczas gdy OpenAI już oferował GPT-Live, teraz Google na równi stoi w wyścigu o dominację w interaktywnych interfejsach głosowych. Takie narzędzia mogą fundamentalnie zmienić sposób, w jaki ludzie interagują z modelami językowymi - zamiast pisania, naturalną metodą staje się po prostu mówienie.