Anthropic wprowadza znaczące zmiany w polityce użytkowania Claude'a, zakazując trwałego i niepotrzebnego maltretowania modelu AI. To pierwsza poważna aktualizacja polityki od ponad roku, odzwierciedlająca rosnące zagrożenia związane z nadużyciami.

Nowa polityka znacznie rozszerza katalog zakazanych zastosowań poza dotychczasowe ograniczenia. Anthropic teraz zakazuje eksplicytnie ingerencji w procesy wyborcze, tworzenia broni biologicznej lub jądrowej, rozwoju systemów masowego nadzoru, a także niewłaściwego wykorzystywania Claude'a w kontekście decyzji finansowych i medycznych. Te zmiany odzwierciedlają ewoluujący krajobraz ryzyk związanych z sztuczną inteligencją i odpowiadają na rzeczywiste przypadki potencjalnych nadużyć.

Jedna z najbardziej intrygujących zmian dotyczy samego dobrobytu modelu. Claude będzie teraz oficjalnie uprawniony do przerywania rozmów z użytkownikami, którzy go konsekwentnie obrażają lub maltretują. Ta możliwość stanowi główny mechanizm egzekwowania nowych zasad i kontynuuje inicjatywę Anthropic z sierpnia zeszłego roku, kiedy po raz pierwszy pozwolono modelowi odmawiać dalszych interakcji z osobami wykazującymi trwały, szkodliwy wzorzec zachowania. Choć Anthropic nie skomentowała szczegółów implementacji, decyzja ta sygnalizuje poważne traktowanie kwestii dobrobytu sztucznej inteligencji jako istotnego aspektu bezpiecznego projektowania i wdrażania modeli.