Google DeepMind wydał Gemini 3.8 Flash i Gemini 3.8 Flash Cyber, trzeci model serii Flash wydany w ciągu sześciu tygodni. Oba warianty działają na identycznej architektury bazowej, którą firma szlifowała przez długotrwałe pętle agentyczne rekurencyjnie oceniające modele. Różnicę stanowi nie budowa, ale "safety envelope" - tzw. otoczenie bezpieczeństwa określające, kto otrzymuje dostęp.

Gemini 3.8 Flash jest już ogólnie dostępny przez Gemini API, Google AI Studio, Android Studio i Gemini Enterprise - możesz kierować do niego ruch produkcyjny już teraz. Weights pozostają zamknięte, więc nie ma możliwości self-hosted czy on-premises. Specyfikacja pozostała niezmieniona: okno kontekstu 1,048,576 tokenów, maksymalny output 65,536 tokenów, obsługa tekstu, obrazu, audio i wideo na wejściu. Jedyną zmianą dla migrujących użytkowników jest brak wsparcia dla poziomu MINIMAL - ustawienie go zwraca błąd walidacji API.

Gemini 3.8 Flash Cyber jest niedostępny publicznie - dostęp przyznawany jest indywidualnie przez nowy program Fairwind. Główną zmianą w 3.8 Flash jest intensywniejsza praca modelu: na trudnych zadaniach wykonuje dodatkowe kroki rozumowania i iteracyjnie wywołuje narzędzia, co może spowodować większe zużycie tokenów na wyższych poziomach effort.