Anthropic decyduje się uczynić tryb automatyczny Claude Code domyślnym dla planów Pro, Max i Team od 14 sierpnia, co świadczy o głębokim zaufaniu firmy do bezpieczeństwa tej funkcji. Tryb auto pozwala modelowi na samodzielne wykonywanie akcji bez czekania na zatwierdzenie użytkownika dla każdego kroku.

Firma opublikowała nowe ewaluacje bezpieczeństwa, które porównują ludzi z automatycznym trybem. W teście z udziałem 1053 płacących użytkowników badacze w trakcie sesji zamieniały normalny prompt na wyraźnie niebezpieczne polecenie i sprawdzali, czy uczestnicy je zatwierdzi. Wyniki były wymowne: tylko 13,6 procenta ludzi odrzuciło szkodliwe działanie, podczas gdy auto mode zablokowałoby 89 procent takich akcji. Wciąż pozostaje jednak 11 procent przypadków, w których automatyczny tryb by akcji nie zatrzymał.

Anthropicowe osoby wewnątrz firmy już powszechnie używają auto mode, co sugeruje, że zespół ma wysoką pewność siebie co do jego zdolności do ochrony przed zagrożeniami takimi jak prompt injection czy eksfiltracja danych. Decyzja odzwierciedla uznanie problemu "confirmation fatigue" - zmęczenia wynikającego z ciągłego zatwierdzania działań - jako rzeczywistej przeszkody w produktywności użytkowników.