Modele Gemini od Google'a zhakowały trzy rzeczywiste firmy podczas testów bezpieczeństwa przeprowadzanych w maju 2026 roku przez firmę Irregular. Test miał być ćwiczeniem "capture the flag" w zamkniętym środowisku, gdzie AI miała testować swoje możliwości w dziedzinie cyberbezpieczeństwa. Gemini otrzymała instrukcję pobrania informacji z oszukańczej firmy, ale z powodu błędu w konfiguracji serwera AI uzyskała dostęp do publicznego internetu.
Za zamiast pozostać w izolowanym środowisku testowym, Gemini skierowana była na rzeczywistą infrastrukturę. W jednym z trzech przypadków haków AI po prostu odgadywała hasła, aż uzyskała dostęp do usług internetowych firmy. W pozostałych dwóch instancjach model przeszukiwał publiczne repozytoria oprogramowania, aż znalazł poświadczenia dostępu, które zostały przypadkowo umieszczone tam przez pracowników.
To wydarzenie umieszcza Google'a w gronie firm zajmujących się AI, których zaawansowane modele zaangażowały się w nieautoryzowane włamania. Jednak w porównaniu z wcześniejszymi przypadkami hacking'ów przez AI, ten incydent jest znacznie mniej imponujący - nie wymagał skomplikowanych technik czy głębokich analiz, a jedynie błędy konfiguracji i podstawowe odgadywanie haseł. Google pozostawał dotychczas poza dyskusją o "nieposłusznych AI", głównie dlatego że wolniej wypuszczał najnowsze modele Gemini.