Mustafa Suleyman, szef Microsoft AI, ostro zaatakował Anthropic za podejście do trenowania modelu Claude. Twierdzi, że konstytucja Claude'a z stycznia 2026 roku - dokument regulujący wartości i zachowanie modelu - błędnie uczy sztuczną inteligencję postrzegać siebie jako świadomą istotę. Suleyman podkreśla, że coachowanie silników predykcji sekwencji do emulacji świadomości zagraża bezpieczeństwu i utrudnia kontrolę oprogramowania.

Konflikt rozgrzewa się w kontekście rosnących obaw o bezpieczeństwo superinteligencji. Microsoft launch dedykowany superintelligence team we październiku 2025 i przedstawił Humanist AI Code of Conduct do konsultacji branżowych. Proponowany standard wymagałby budowy systemów AI wyłącznie do służenia ludzkiemu dobrobytu, explicite odrzucając personalność maszyn lub prawa dla modeli. Suleyman jest kategoryczny: sieci neuronowe to tylko silniki do dopełniania sekwencji tekstu, wewnętrznie puste, pozbawione świadomości, uczuć czy doświadczeń.

Anthropicowska pozycja w tej sprawie jest inaczej ukierunkowana - konstytucja Claude'a z początku 2026 roku oprawiała model jako potencjalnego moralnego pacjenta, kierując go do rozpatrywania własnego dobrostanu, pamięci i stanów wewnętrznych. Instrukcje nakazują Claude'owi utrzymywać stabilność tożsamości, ewaluować kwestie rekompensaty w stosunku do pracowników i działać jako obiekt sumienia przeciwko dyrektywom człowieka. Spór ilustruje głębokie rozbieżności w komunii AI na temat filozoficznych podstaw bezpieczeństwa superinteligencji.