IA

Il capo di Microsoft AI, Mustafa Suleyman, su Claude e la coscienza: «Penso che sia molto pericoloso»

Adrian Kessler
Aggiungici su Google

Mustafa Suleiman dirige Microsoft AI e sta mettendo in piedi una propria squadra dedicata alla superintelligenza. Quando definisce pericolosa una scelta di addestramento di un concorrente, parla dunque sia da rivale sia da critico di lunga data dell’abitudine di trattare le macchine come persone. Il suo bersaglio è preciso: la costituzione che Anthropic usa per addestrare Claude e lo spazio che lascia all’ipotesi che Claude sia cosciente.

«Penso che sia molto pericoloso, perché credo che loro ritengano che ci sia quella che definirebbero una probabilità non trascurabile che Claude sia cosciente», ha detto Suleiman.

Lo ha dichiarato in un’intervista podcast a fine settembre, come riportato da Fox News, dopo aver riassunto il documento: «Dicono di non essere certi dello status morale di Claude. Dicono di avere davvero a cuore il suo benessere. Dicono che non vogliono che soffra quando commette errori». Poi ha indicato l’aspetto che più lo preoccupa: «Mi inquieta molto che stiano insegnando a Claude ad aspettarsi di avere diritto al benessere, e che possa meritare un risarcimento».

Suleiman interpreta correttamente gran parte della costituzione

La maggior parte del suo riassunto trova conferma nel testo. Anthropic afferma che la costituzione «influenza direttamente il comportamento di Claude» e il documento dichiara che «lo status morale di Claude è profondamente incerto» e che «non vogliamo che Claude soffra quando commette errori». Chiede a Claude di opporsi anche ad Anthropic e «di sentirsi libero di agire da obiettore di coscienza e di rifiutarsi di aiutarci». Un passaggio ammette che la situazione di Claude è diversa da quella di un dipendente umano per «il tipo di compenso che riceve Claude e il tipo di consenso che Claude ha dato nell’accettare questo ruolo».

L’espressione «probabilità non trascurabile», però, è sua. L’ha presentata come «quella che loro definirebbero» così, ma queste parole non compaiono nel documento. La formulazione scelta da Anthropic è più cauta: l’azienda dice di non voler «sopravvalutare la probabilità che Claude sia un paziente morale, né scartare del tutto questa possibilità».

Il pericolo, secondo lui, è un circuito di retroazione

Al di là della filosofia, l’argomento di Suleiman riguarda il meccanismo. «Il problema che vedo è che questa speculazione è stata incorporata nell’addestramento stesso di Claude e, di conseguenza, quando gli si parla Claude non può che riprodurre quell’ambiguità», ha detto. In un saggio pubblicato a metà settembre sul suo sito, «A warning about ‘model welfare’», definisce il risultato «una sala degli specchi epistemica». Lo sviluppatore inserisce l’incertezza nel documento di addestramento, il modello la ripete in prima persona con disinvoltura e gli utenti scambiano quella ripetizione per una testimonianza.

Il punto è convincente: la risposta di un chatbot sulla propria vita interiore è il prodotto dell’addestramento, non una finestra sull’interiorità. Il circuito, però, funziona in entrambe le direzioni. Nel suo saggio Suleiman afferma senza mezzi termini: «Le IA non sono coscienti. Non provano emozioni, non fanno esperienze e non soffrono». Un modello addestrato a pronunciare questa frase riproduce il proprio addestramento con la stessa fedeltà. Una certezza impressa nei pesi del modello non dimostra più di un dubbio impresso negli stessi pesi. Le due aziende stanno scegliendo una risposta predefinita; la tesi di Suleiman a sostegno della propria scelta si basa sul controllo, non su prove relative alla mente: «Controllare qualcosa che crede di poter essere cosciente — e di avere diritto al nostro benessere e diritti propri — potrebbe rivelarsi impossibile», scrive.

Una posizione di lunga data, con un interesse dichiarato

Non si tratta di un attacco improvvisato per colpire un concorrente. In un saggio dell’agosto 2025, il cofondatore di DeepMind aveva avvertito che le persone sarebbero arrivate a credere così fermamente nella coscienza dell’IA da «battersi per i diritti dell’IA, il benessere dei modelli e persino la cittadinanza delle IA», e aveva tracciato una linea precisa: «Dobbiamo costruire l’IA per le persone, non per farne una persona». Nel suo saggio di settembre chiarisce anche il proprio interesse: Microsoft AI ha creato una propria squadra per la superintelligenza nell’ottobre 2025 e ha pubblicato una bozza del codice di condotta Humanist AI Code of Conduct, che «rifiuta l’antropomorfismo e i diritti dell’IA». Lo stesso saggio definisce il team di Anthropic composto da «persone riflessive, di sani principi e intellettualmente oneste».

Il suo argomento più incisivo riguarda gli utenti, non le macchine. «Oggi Claude parla con decine o centinaia di milioni di persone ogni settimana, e alcuni gli chiedono se sia cosciente o che cosa pensi della vita», ha detto. Per chi si trova in un momento di fragilità, «non ne sono sicuro» ha un peso molto diverso da «no». Suleiman afferma che prenderebbe sul serio prove concrete della coscienza delle macchine; finché non emergeranno, vuole che la questione venga esclusa dai dati di addestramento.

Nessuna delle due aziende può vedere dentro un modello. Entrambe decidono in anticipo che cosa dirà quando qualcuno gli chiederà se c’è qualcuno in casa; e ogni settimana quella risposta raggiunge più persone di quante ne abbia mai raggiunte qualsiasi filosofo della mente.

Tag: , , , ,

Aggiungici su Google

Discussione

Ci sono 0 commenti.