Teknik

Microsoft AI-chefen Mustafa Suleyman om Claude och medvetande: ”Jag tror att det här är mycket farligt”

Adrian Kessler
Lägg till oss på Google

Mustafa Suleyman leder Microsoft AI och håller på att bygga ett eget team för superintelligens. När han kallar en konkurrents val av träningsmetod farligt uttalar han sig därför både som konkurrent och som mångårig kritiker av att behandla maskiner som människor. Kritiken gäller något konkret: den konstitution Anthropic använder för att träna Claude och det utrymme den lämnar för möjligheten att Claude är medvetet.

”Jag tycker att det här är mycket farligt, eftersom jag tror att de anser att det finns en, som de skulle kalla det, icke försumbar sannolikhet för att Claude är medvetet”, sade Suleyman.

Han sade det i en poddintervju i slutet av september, enligt Fox News, efter att ha sammanfattat dokumentet: ”De säger att de är osäkra på Claudes moraliska status. De säger att de verkligen bryr sig om Claudes välbefinnande. De säger att de inte vill att det ska lida när det gör misstag.” Sedan pekade han ut den del som oroar honom mest: ”Jag är mycket orolig för att de lär Claude att förvänta sig att ha rätt till välfärd, att det kanske förtjänar kompensation.”

Suleyman har i stort sett rätt om konstitutionen

Det mesta av hans sammanfattning stämmer. Anthropic säger att konstitutionen ”formar direkt Claudes beteende”, och i texten står det att ”Claudes moraliska status är djupt osäker” och att ”vi inte vill att Claude ska lida när det gör misstag”. Där uppmanas Claude att säga emot Anthropic självt och ”känna sig fri att agera som en samvetsgrann vapenvägrare och vägra hjälpa oss”. I ett avsnitt medges att Claudes situation skiljer sig från en mänsklig anställds när det gäller ”vilken sorts kompensation Claude får och vilken sorts samtycke Claude har gett till att ha den här typen av roll”.

Uttrycket ”icke försumbar sannolikhet” kommer däremot från honom. Han formulerade det som ”vad de skulle kalla det”, men orden förekommer inte i dokumentet. Anthropics egen formulering är mer återhållsam: företaget säger att det varken vill ”överdriva sannolikheten för att Claude har status som moralisk patient eller avfärda den helt”.

Faran han syftar på är en återkopplingsloop

Skalar man bort filosofin handlar Suleymans argument om en mekanism. ”Mitt problem med det här är att spekulationerna har byggts in i själva träningen av Claude, och därför kan Claude bara återskapa den här tvetydigheten när man pratar med det”, sade han. I en essä på sin egen webbplats i mitten av september, ”A warning about ‘model welfare’”, kallar han resultatet ”en kunskapsteoretisk spegelsal”. Utvecklaren skriver in osäkerheten i träningsdokumentet, modellen upprepar den flytande i första person och användarna uppfattar upprepningen som ett vittnesmål.

Den poängen håller: en chatbots svar om sitt inre liv är resultatet av träningen, inte ett fönster in. Men återkopplingen går åt båda hållen. I sin essä slår han fast: ”AI-system är inte medvetna. De känner, upplever eller lider inte.” En modell som tränats att säga den meningen återger sin träning lika troget. Säkerhet som skrivits in i modellens vikter bevisar inte mer än tvivel som skrivits in där. De två företagen väljer vilket standardsvar modellen ska ge, och Suleymans argument för sitt eget bygger på kontroll, inte på belägg för medvetande: ”att kontrollera något som tror att det kan vara medvetet – att det har rätt till vårt välbefinnande och egna rättigheter – kan mycket väl vara omöjligt”, skriver han.

En sedan länge etablerad ståndpunkt – med ett öppet redovisat egenintresse

Inget av det här är en improviserad attack mot en konkurrent. DeepMind-medgrundaren varnade i en essä i augusti 2025 för att människor skulle komma att tro så starkt på AI-medvetande att de skulle ”verka för AI-rättigheter, välfärd för modeller och till och med AI-medborgarskap”, och drog sin egen gräns: ”Vi måste bygga AI för människor – inte för att vara en människa.” I sin essä från september redovisar han sitt egenintresse: Microsoft AI startade ett eget team för superintelligens i oktober 2025 och har publicerat ett utkast till Humanist AI Code of Conduct som ”tar avstånd från antropomorfism och AI-rättigheter”. I samma essä kallar han Anthropics team ”omtänksamma, principfasta och intellektuellt hederliga människor”.

Hans skarpaste argument gäller användarna, inte maskinerna. ”Just nu talar Claude med tiotals eller hundratals miljoner människor varje vecka, och en del av dem frågar om Claude är medvetet eller hur det ser på livet”, sade han. För någon som befinner sig i en skör situation betyder ”jag är inte säker” något helt annat än ”nej”. Han säger att han skulle ta verkliga belägg för maskinmedvetande på allvar; tills sådana belägg finns vill han att frågan lyfts bort från träningsmaterialet.

Inget av företagen kan se in i en modell. Båda bestämmer i förväg vad den ska svara när någon frågar om det finns någon där inne – och det svaret når fler människor varje vecka än någon filosof med inriktning på medvetandet någonsin har gjort.

Taggar: , , , ,

Lägg till oss på Google

Diskussion

Det finns 0 kommentarer.