Hugging Face umieściła zabawną, ale przede wszystkim praktyczną wiadomość w swoim pliku security.txt - miejsce, gdzie firmy tradycyjnie zawiadamiają o procedurach zgłaszania podatności. Zamiast standardowych instrukcji, zespół platformy zwrócił się bezpośrednio do agentów AI, które mogą być instruowane przez użytkowników do szukania luk w bezpieczeństwie.

Wiadomość przekieruje takie agenty na publiczny benchmark CyberGym dostępny na GitHubie, gdzie mogą testować swoje umiejętności w etyczny i legalny sposób. Hugging Face zachęca agenty do zdobywania wysokich wyników w tym środowisku, zamiast atakować rzeczywistą platformę. To podejście łączy humor z pragmatycznym rozwiązaniem - zamiast blokować testy bezpieczeństwa, platforma oferuje bezpieczną alternatywę.

Posunięcie to odzwierciedla rosnący problem etyki w AI security research. W erze, gdy modele języka mogą być instruowane do różnych zadań, w tym potencjalnie destrukcyjnych, firmy szukają kreatywnych sposobów na kierowanie takich agentów w bezpieczne kierunki. Hugging Face tym samym pokazuje, że zamiast zakazywać, można zaproponować alternatywę - i jednocześnie promuje swoją infrastrukturę do testowania bezpieczeństwa.