Anthropic ogłosiła plany wdrożenia watermarkingu dla tekstu generowanego przez jej modele AI, w tym dla starszych wersji. Watermark to niewidoczna dla oka cyfrowa sygnatura umożliwiająca identyfikację treści utworzonych przez system sztucznej inteligencji.

Ta inicjatywa wpisuje się w szerszy wysiłek branży mający na celu zwiększenie przejrzystości i odpowiedzialności w zastosowaniu modeli generatywnych. W dobie, gdy coraz łatwiej jest generować przekonujący tekst za pomocą AI, możliwość oznaczeń wspomaga czytelników w świadomym odróżnianiu treści automatycznie wygenerowanych od autorskich. Rozszerzenie watermarkingu na starsze modele pokazuje, że Anthropic chce ujednolicić standardy bezpieczeństwa na całej gamie swoich narzędzi.

Watermarking to jeden z niewielu praktycznych mechanizmów mogących zwalczać dezinformację i oszustwa, zanim staną się powszechnym problemem. Jeśli inne firmy AI pójdą w ślady Anthropica, mogłoby to stać się branżowym standardem i znacznie utrudnić wykorzystanie AI do tworzenia fałszywych treści.