Wyciek system prompta Claude Opus 5 odkrywa sposób, w jaki Anthropic instruuje model aby odpowiadać na pytania o zawieszeniu dostępu do Claude Fable 5 i Claude Mythos 5. Oba modele zostały wydane 9 czerwca 2026 roku, ale już trzy dni później Anthropic wstrzymał dostęp do nich w celu zgodności z kontrolami eksportowymi Departamentu Handlu USA. Ograniczenia zostały zniesione 30 czerwca, a dostęp przywrócony 1 lipca 2026 roku.
System prompt instruuje Claude Opus 5 aby nie zaprzeczał zawieszeniu - przeciwnie, ma potwierdzać te fakty w rzeczowy, neutralny sposób. Model ma unikać dzielenia się osobistymi opiniami na ten temat i zamiast tego dostarczać sprawiedliwe, dokładne wyjaśnienia. Dla dodatkowych szczegółów prompt poleca kierować użytkowników do oficjalnego oświadczenia Anthropic. To podejście pokazuje, że producenci AI starają się zapobiegać dezinformacji poprzez jawne instrukcje wbudowane w system prompt.
Ujawnienie tego promptu jest znaczące dla zrozumienia, jak duże modele językowe są instruowane aby obsługiwać wrażliwe tematy. Ponieważ Claude nie ma wiedzy o tych wydarzeniach z okresu treningu, Anthropic musiał jawnie przekazać informacje w system promptie. Podejście unikania zaprzeczenia faktom oraz sugerowanie sprawdzenia bieżących informacji demonstruje filozofię transparencji - modele powinny przyznawać rzeczywistość i skierowywać do wiarygodnych źródeł zamiast maskować czy manipulować faktami.