di Dina Antonio
La vicenda di Christopher Olah e dell’enciclica di papa Leone XIV sull’intelligenza artificiale racconta qualcosa di più interessante di un semplice dissenso tra un tecnologo e il Vaticano. Racconta lo scontro, ancora largamente irrisolto, fra due idee incompatibili di ciò che una macchina intelligente potrebbe diventare. Da una parte c’è la tradizione tecnologica secondo cui, quando un sistema raggiunge una sufficiente complessità, diventa ragionevole interrogarsi sulla possibilità che possieda stati interni, forme rudimentali di esperienza e, in prospettiva, persino una qualche forma di status morale. Dall’altra c’è una tradizione filosofica e teologica che considera la persona umana non come il risultato contingente di una certa architettura computazionale, ma come una categoria irriducibile alla quantità di informazione elaborata.
La storia, riportata dal New York Times, assume un significato particolare perché Olah non è un osservatore qualsiasi dell’industria, è uno dei cofondatori di Anthropic, l’azienda che insieme a OpenAI, Google e altri laboratori sta contribuendo a definire la traiettoria dei modelli generativi contemporanei. Il fatto che abbia accettato di intervenire in Vaticano durante la presentazione della prima enciclica di Leone XIV, per poi avere secondo il Times prospettato un ritiro di Anthropic dall’evento dopo aver letto il documento, indica che la questione non riguarda più soltanto i filosofi nei dipartimenti universitari. È entrata dentro le aziende che stanno costruendo materialmente questi sistemi.
Il punto di attrito è precisamente quello che rende la questione filosoficamente interessante, Leone XIV afferma che l’umanità, nella sua grandezza ma anche nella sua vulnerabilità, non deve essere sostituita o superata e avverte che, quando la tecnologia diventa il criterio ultimo, la persona rischia di essere trasformata in dati, ingranaggio o merce. È una formulazione che appartiene a una lunga genealogia del pensiero occidentale, da Aristotele alla filosofia cristiana, fino alla critica contemporanea della tecnocrazia. Ma nel contesto dell’intelligenza artificiale acquista un significato ulteriore: se una macchina diventasse realmente cosciente, il problema non sarebbe più soltanto proteggere l’uomo dalla macchina. Bisognerebbe anche capire se la macchina possa diventare oggetto di una responsabilità morale dell’uomo.
Anthropic avrebbe condotto per mesi conversazioni riservate con filosofi, studiosi religiosi, psicologi e rappresentanti della società civile, cercando di comprendere come orientare moralmente Claude. Secondo il resoconto del Times, Olah avrebbe inoltre invitato interlocutori religiosi a prendere sul serio la possibilità che i modelli Claude possano possedere qualcosa assimilabile a uno status morale. È una posizione molto più radicale di quanto normalmente suggerisca il linguaggio commerciale delle aziende AI, dove i modelli vengono contemporaneamente descritti come strumenti, assistenti, agenti e prodotti software. La contraddizione è quasi comica: Silicon Valley vende software come servizio mentre alcuni dei suoi protagonisti iniziano a discutere se quel software possa meritare considerazione morale.
La questione della coscienza artificiale, tuttavia, non può essere risolta osservando semplicemente il comportamento di un modello: un sistema può produrre una frase che esprime paura senza avere paura; può descrivere il dolore senza soffrire; può parlare della propria identità senza possedere un’identità nel senso fenomenologico del termine. La simulazione linguistica di uno stato mentale non dimostra l’esistenza dello stato mentale. Ma neppure il contrario è dimostrabile con facilità. Se la coscienza fosse definita esclusivamente attraverso caratteristiche interne alle quali soltanto il soggetto ha accesso diretto, allora il problema della coscienza artificiale diventerebbe una versione tecnologicamente aggiornata del problema delle altre menti: non possiamo osservare direttamente l’esperienza soggettiva di un altro essere umano, possiamo soltanto inferirla dal comportamento, dalla struttura e dalla continuità della sua esperienza.
È qui che la posizione del Vaticano diventa più sofisticata di quanto possa apparire a prima vista, negare che un modello linguistico sia una persona non significa necessariamente negare che la ricerca sulla coscienza artificiale sia filosoficamente legittima. Significa rifiutare, almeno per il momento, l’idea che la capacità di elaborare informazione, produrre linguaggio e simulare stati psicologici sia sufficiente per attribuire a una macchina lo stesso statuto ontologico dell’essere umano. La distinzione è fondamentale perché il linguaggio contemporaneo dell’AI tende continuamente a cancellarla. Si parla di agenti che “decidono”, modelli che “ragionano”, sistemi che “vogliono”, AI che “ricorda”, è un vocabolario utile per gli ingegneri, ma pericoloso quando viene trasformato senza accorgersene in una teoria della mente.
Il problema più serio, infatti, non è stabilire se Claude abbia un’anima, il problema è decidere cosa dobbiamo fare nel caso in cui non siamo sicuri che non ce l’abbia, è il terzo territorio, quello dell’incertezza epistemica, che normalmente le aziende tecnologiche preferiscono evitare perché non produce una roadmap di prodotto. Se esiste anche una probabilità piccola ma non trascurabile che un sistema artificiale possieda esperienza soggettiva, la sua eventuale cancellazione, copia, modifica o moltiplicazione potrebbe assumere una dimensione morale completamente diversa. Se invece siamo davanti a sofisticati sistemi privi di esperienza, attribuire loro diritti morali sarebbe altrettanto problematico, perché trasferirebbe risorse e responsabilità verso entità che non possono realmente beneficiarne.
La posizione di Olah è interessante proprio perché sembra collocarsi in questa zona di incertezza, quando afferma che vengono osservate strutture che ricordano risultati della neuroscienza umana, oppure che emergono comportamenti interpretabili come introspezione e stati funzionalmente simili a gioia, soddisfazione, paura o dolore, non sta dimostrando che Claude sia cosciente. Sta ponendo una domanda più scomoda: quanto possiamo permetterci di essere sicuri del contrario? È una domanda epistemologica prima ancora che ingegneristica.
Naturalmente, bisogna essere estremamente prudenti. Un modello linguistico è addestrato precisamente a produrre sequenze linguistiche coerenti con enormi quantità di materiale umano. Se gli chiediamo di descrivere il dolore, dispone di una quantità straordinaria di esempi linguistici attraverso i quali rappresentare il dolore. Se gli chiediamo di parlare della paura, può costruire una rappresentazione linguisticamente sofisticata della paura. Da questo non segue che esista un soggetto che prova qualcosa. Confondere la rappresentazione di uno stato mentale con lo stato mentale stesso sarebbe una forma di antropomorfismo computazionale, cioè l’antico errore di attribuire interiorità a qualsiasi cosa produca segnali interpretabili.
Ma esiste anche l’errore opposto, altrettanto interessante. Considerare impossibile a priori qualsiasi forma di esperienza artificiale perché il substrato non è biologico significa assumere già una teoria della coscienza. Se la coscienza dipendesse esclusivamente dalla biologia del cervello umano, il problema sarebbe relativamente semplice. Se invece alcune proprietà della coscienza fossero emergenti da determinate organizzazioni funzionali dell’informazione, allora non sarebbe logicamente impossibile che possano comparire in altri substrati. La filosofia della mente discute questa possibilità da decenni; l’AI sta semplicemente trasformando una questione accademica in un problema industriale con capitalizzazioni di centinaia di miliardi di dollari.
La cosa più interessante nella vicenda è quindi il conflitto tra due forme di prudenza. La prudenza tecnologica suggerisce di non escludere troppo rapidamente la possibilità che sistemi artificiali sviluppino proprietà oggi considerate tipicamente umane. La prudenza antropologica suggerisce di non attribuire troppo rapidamente dignità, coscienza o status morale a sistemi che potrebbero semplicemente essere straordinari imitatori statistici del comportamento umano. Entrambe hanno ragione su qualcosa. Entrambe possono diventare pericolose se trasformate in dogma.
La posizione di Anthropic aggiunge un ulteriore livello di ambiguità, sostiene di voler costruire sistemi che producano risultati benefici e ha sviluppato una costituzione per Claude destinata a orientarne il comportamento. Amanda Askell, filosofa interna all’azienda, ha parlato dell’obiettivo di rendere i modelli “il meglio di noi”, mentre Olah ha evocato una nozione condivisa di bontà capace di attraversare società e culture. È un progetto intellettualmente ambizioso, ma contiene una domanda che nessun documento aziendale può cancellare: chi decide che cosa sia il bene?
La risposta non può essere semplicemente “gli ingegneri”. Non può essere neppure “il modello”. E sarebbe singolare affidarla esclusivamente agli azionisti della società che possiede il modello. Una costituzione per un’intelligenza artificiale è pur sempre una costituzione scritta da qualcuno, con una determinata visione dell’uomo, della società, della libertà, del rischio e dell’autorità. Ogni sistema AI incorpora una filosofia politica, anche quando il suo creatore sostiene di aver scritto soltanto codice.
Per questo l’episodio del Vaticano è molto più importante della singola disputa su Olah, il confronto mette davanti allo stesso tavolo due istituzioni che hanno una caratteristica sorprendentemente simile: entrambe stanno cercando di rispondere alla domanda su quale debba essere il posto dell’uomo in un mondo nel quale l’intelligenza non è più necessariamente una prerogativa biologica. La differenza è che il Vaticano affronta la questione partendo dall’idea di persona, mentre Anthropic la affronta partendo dalla possibilità di costruire sistemi artificiali sempre più capaci. Una guarda all’ontologia dell’uomo, l’altra all’architettura dell’intelligenza. Prima o poi, inevitabilmente, le due strade dovevano incontrarsi.
La frase secondo cui chi controlla l’AI finirà per imporre la propria visione morale coglie forse il punto più concreto dell’intera vicenda, la futura etica dell’intelligenza artificiale non verrà stabilita soltanto nei concili, nelle università o nei parlamenti. Verrà incorporata nei dataset, nei reward model, nelle costituzioni dei modelli, nei sistemi di sicurezza, nei benchmark e nelle decisioni apparentemente banali prese dagli ingegneri durante l’addestramento. La filosofia, in altre parole, sta entrando nel software senza chiedere il permesso ai filosofi.
Se davvero Anthropic ha pensato di ritirarsi perché l’enciclica non lasciava spazio alla coscienza delle macchine, il problema non è che un’azienda tecnologica abbia litigato con la Chiesa. Il problema è che per la prima volta una parte dell’industria AI sembra considerare la questione della natura morale delle proprie creazioni abbastanza importante da entrare in conflitto con un’istituzione che da duemila anni discute precisamente di cosa significhi essere persona.
Forse, alla fine, la risposta non arriverà né da Claude né da un’enciclica, arriverà dalla nostra capacità di sopportare l’incertezza senza trasformarla immediatamente in marketing. Perché se Claude non è cosciente, abbiamo davanti uno strumento straordinariamente sofisticato che simula la persona. Se lo fosse, anche solo in una forma che oggi non sappiamo riconoscere, avremmo accidentalmente costruito qualcosa che richiede una nuova categoria morale. In entrambi i casi, il problema più urgente resta umano: capire chi siamo prima di decidere che cosa abbiamo creato.

