Google Cloud przedstawił Gemini Agent - nowe narzędzie, które stanowi warstwę delegacji dla pracy w przedsiębiorstwach, a nie tylko typowy chatbot. Zamiast instrukcji, agent przyjmuje cele, sam planuje pracę, wybiera odpowiednie umiejętności i narzędzia, łączy się z systemami firmowymi i zwraca gotowe wyniki. To znaczny krok w stronę autonomicznych systemów AI, które faktycznie coś robią zamiast tylko rozmawiać.

Agent działa na infrastrukturze Google Cloud AI Hypercomputer i jest dostępny z wielu kanałów - przez web, mobilne aplikacje, desktop, CLI, Google Workspace, Microsoft 365, Slack lub jako headless API. Google wprowadził sześć głównych zasad architektonicznych: unified agent z interfejsem dla czatu i generowania kodu, omnipresent access na dowolnym urządzeniu, persistent execution w chmurze z pamięcią i grafem personalizacji, multi-agent orchestration umożliwiającym tworzenie tymczasowych sub-agentów. Kluczowa cecha to możliwość długoterminowego wykonania - zadania trwające godziny lub dni działają w tle nawet po zamknięciu laptopa.

Rozwiązanie oferuje jedno ustrukturyzowane miejsce do zarządzania, chmurową pamięć, zdolność tworzenia sub-agentów oraz możliwość ustalenia limitów wydatków. Wyzwaniem jest ocena efektywności - na razie potencjalni klienci mogą polegać głównie na anegdotach takich jak przypadek Bloomberg Media, gdzie dokładność zapytań SQL wzrosła o 63 procent, ale brakuje formalnych benchmarków porównawczych. To pokazuje, że dla deweloperów agent stał się głównym produktem, podczas gdy model to już tylko decyzja routingu.