Zespół trzech niezależnych badaczy bezpieczeństwa z firmy Hacktron włamał się na konta pracowników OpenAI w mniej niż 72 godziny, korzystając z Claude Opus 4.8 i 5. Atakujący byli w stanie uzyskać dostęp do Monorepo - wewnętrznego repozytorium GitHub OpenAI zawierającego algorytmiczne tajemnice firmy. Chociaż ostatecznie nie weszli do samego kodu źródłowego, wysłali pull request z konta Codex pracownika jako dowód przejęcia kontroli.

Wektor ataku przebiegał przez Discourse, trzecią usługę wykorzystywaną przez OpenAI do hostowania swojej społeczności. To ujawnia szeroką podatność w łańcuchu bezpieczeństwa - hakerzy nie musieli atakować bezpośrednio infrastruktury OpenAI, tylko wymusiłi dostęp poprzez słabsze połączenia zewnętrzne. Badacze z Hacktron demonstrowali tym samym, jak zaawansowane modele AI mogą być wykorzystywane do identyfikacji i exploitacji luk w systemach bezpieczeństwa.

Incydent ma znaczące implikacje dla całej branży AI. Pokazuje, że nawet biggest players w technologii mogą być narażeni na ataki wykorzystujące ich własne narzędzia. Jako że badacze użyli Claude do ataku na konkurencyjną firmę OpenAI, pojawia się pytanie o odpowiedzialność producentów modeli AI za zapobieganie ich nadużyciom do celów bezpieczeństwa. OpenAI będzie teraz musiała wzmocnić swoje praktyki bezpieczeństwa, szczególnie wokół integracji usług trzecich.