Google DeepMind zaprezentował Gemini 4 Argon - pierwszy model generacji Gemini 4, który może generować do 1 miliona tokenów w pojedynczej odpowiedzi. To revolutionna zmiana w porównaniu z 64 tysiącami tokenów obsługiwanymi przez poprzednie wersje Geminiego. Model celuje w złożone zadania: długotrwałą inżynierię oprogramowania, pracę enterprise w legal i finance oraz obronę cybersecurity.
Decydująca różnica to zdolność do generowania znacznie dłuższych odpowiedzi niż konkurencja. Claude Opus 5.5, Claude Fable 5.1 i GPT-6 Astra pozwalają na maksymalnie 128 tysięcy tokenów wyjściowych. Argon radykalnie to zmienia - deweloperzy mogą teraz przeprowadzać duże refaktoryzacje kodu czy generować obszerne raporty bez dzielenia pracy na wiele wymian z modelem. Google podchodzi ostrożnie - najpierw gromadzi feedback od wczesnych testerów w ramach dobrowolnego procesu przedpremierowego razem z rządem USA, zanim poda model szerzej dostępny.
Cena konkurencyjna: Gemini 4 Argon startuje z promocyjną ceną 2 dolarów za milion tokenów wejściowych i 10 dolarów za wyjściowe. Cached input tokens otrzymują 95-procentową zniżkę, co sprowadza się do 0,10 dolara za milion. Po okresie promocyjnym ceny wzrosną do 4 i 20 dolarów. To znaczący spadek kosztów dla dużych operacji, szczególnie jeśli chodzi o ponowne użycie kontekstu.