Anthropic uczyniła tryb auto domyślnym ustawieniem w Claude Code dla planów Pro, Max i Team od 14 sierpnia. Zaufanie firmy do tej funkcji jest na tyle duże, że niemal każdy pracownik Anthropic używa trybu auto, a zespół opublikował wyniki testów bezpieczeństwa potwierdzające tę decyzję.
Badam ewaluacyjne wykazały, że w testach na 1053 płacących użytkownikach, gdy zwykła prośba o pozwolenie zostały zamieniona na wyraźnie niebezpieczną komendę, zaledwie 13,6 procent ludzi prawidłowo odrzuciło tę akcję. W porównaniu Claude w trybie auto zablokował 89 procent tych potencjalnie szkodliwych działań. Według Anthropic główne kategorie ryzyka, takie jak prompt injection i eksfiltracja danych, stanowią w trybie auto znacznie mniejsze zagrożenie niż średni człowiek oceniający działania.
Chociaż tryb auto nie eliminuje stuprocentowo ryzyka - pozostaje około 11 procent przypadków, które mogą przejść niezablokowane - rozwiązanie to jest istotnie lepsze niż ciągłe proszenie użytkownika o zatwierdzenia. Zmęczenie potwierdzeniami jest rzeczywistym problemem, a automatyczne podejmowanie decyzji przez AI zmniejsza zarówno uciążliwość dla użytkownika, jak i ryzyko błędów wynikających z ludzkiego zmęczenia lub niemożności szybkiego ocenienia zagrożenia.