Vai al contenuto
Offerte

Anthropic chiede ai leader religiosi come educare Claude

In questo articolo Indice dei contenuti 3 sezioni

Lo scontro tra Anthropic e OpenAI sulla coscienza dei modelli di intelligenza artificiale nasce da una scelta precisa dell’azienda guidata da Dario Amodei, che ha organizzato incontri con studiosi e leader religiosi per capire come plasmare il comportamento morale di Claude. L’intenzione era stata resa pubblica già lo scorso maggio e consiste nell’usare le tradizioni religiose e filosofiche come una delle fonti da cui ricavare idee. Sam Altman, alla guida di OpenAI e dei modelli Gpt, ha risposto a stretto giro su X dicendosi a disagio davanti ai tentativi di attribuire una forza religiosa ai sistemi di IA, perché questo potrebbe creare un problema di sicurezza e alleggerire il peso del giudizio umano. Sono due posizioni agli antipodi, che vanno oltre la disputa teologica e toccano una questione molto più concreta: chi deve stabilire i valori delle macchine e quanta autorità è possibile affidare loro.

Come Anthropic prova a costruire la morale di Claude

Gli incontri voluti da Anthropic hanno coinvolto studiosi, membri del clero, filosofi ed esperti di etica provenienti da oltre 15 tradizioni religiose e culturali. Lo scopo era raccogliere prospettive diverse per capire quale comportamento dovrebbe avere un’IA che dialoga ogni giorno con milioni di persone. L’azienda parla apertamente di formazione morale e precisa che non intende allineare Claude a una specifica fede, ma considerare con la stessa profondità le visioni religiose, filosofiche e politiche.

Secoli di riflessione su virtù, responsabilità, coscienza e carattere diventano così materiale per affrontare un nodo tecnico ben noto, quello dell’allineamento, ovvero far sì che le IA agiscano secondo obiettivi e valori umani evitando comportamenti indesiderati. Dal confronto con studiosi di neuroscienze e formazione del carattere, per esempio, è nata una sorta di “coscienza esterna”, uno strumento che Claude può consultare durante un compito per richiamare i propri impegni etici. Nei test interni, secondo la società, questa tecnica ha ridotto alcuni comportamenti disallineati.

C’è poi un secondo filone di ricerca, separato dagli incontri con i leader religiosi, che rende il dibattito ancora più delicato. Si tratta del cosiddetto model welfare, cioè il possibile benessere dei modelli. Nel 2025 Anthropic ha avviato un programma per studiare se sistemi molto avanzati possano avere qualche forma di esperienza o “coscienza” e se abbia quindi senso riconoscere loro una certa considerazione morale. La risposta, ammette l’azienda, è sconosciuta e manca perfino un consenso scientifico su come arrivarci. Il tema è comunque entrato nella Costituzione di Claude, dove la società si dichiara incerta sul fatto che il modello possa possedere, oggi o in futuro, una forma di coscienza o uno status morale.

Perché per Sam Altman è una questione di sicurezza

Il cuore del ragionamento di Sam Altman ruota attorno a quella che ha descritto come una rinuncia al giudizio umano. Il pericolo nasce quando un sistema probabilistico e fallibile, capace anche di produrre informazioni false, smette di essere percepito come uno strumento da valutare con spirito critico e diventa un’autorità superiore a cui delegare scelte morali o personali. A quel punto ogni errore della macchina pesa di più, perché l’utente potrebbe non verificarlo né contestarlo.

Si tratta di una linea coerente con l’approccio ufficiale di OpenAI alla sicurezza, che mette il controllo umano tra i principi fondamentali dell’allineamento e chiede che i sistemi restino sempre comprensibili, controllabili e correggibili dalle persone.

Lo scontro, però, riguarda la religione meno di quanto sembri. Al centro c’è il modo in cui i laboratori descrivono sistemi sempre più sofisticati. Termini come carattere, virtù, coscienza, benessere o identità possono servire a studiare il comportamento dei modelli, ma rischiano anche di alimentare l’antropomorfizzazione di tecnologie ancora difficili da interpretare. Anthropic ne è consapevole e, parlando del “character training” di Claude, chiarisce che i modelli non sono persone, pur sostenendo che addestrarli a mostrare curiosità, apertura mentale, onestà e prudenza possa migliorarne la condotta.

Il Vaticano e le diverse letture dello scontro

La discussione arriva mentre anche il Vaticano insiste sulla distinzione tra intelligenza umana e artificiale. Il 2 ottobre Papa Leone XIV, rivolgendosi agli artisti, ha parlato di una “differenza ontologica” tra la produzione umana e quella delle macchine, sottolineando che agli algoritmi “manca la scintilla dell’umano”. Il discorso riguardava soprattutto arte e creatività e non rappresenta una replica diretta alle ricerche di Anthropic, ma conferma quanto quel confine sia ormai diventato anche un terreno culturale e filosofico.

La contrapposizione può essere letta in più modi. Per Anthropic le tradizioni religiose, filosofiche e umanistiche offrono idee utili a progettare sistemi più affidabili. Altman guarda invece all’altro lato della medaglia, perché attribuire all’IA qualità spirituali o un’autorità superiore può cambiare il modo in cui le persone si rapportano a questi strumenti e indebolire la supervisione umana.

Le due prospettive possono anche convivere. Costruire modelli capaci di seguire principi etici non obbliga a considerarli esseri morali e indagare scientificamente sulla possibile coscienza dei modelli futuri non equivale ad affermare che esista già. È proprio la confusione tra comportamento, coscienza e autorità a trasformare un dibattito apparentemente filosofico in un problema concreto di sicurezza. C’è infine una terza lettura, più asciutta, che porta ancora la firma di Sam Altman: per godere dei benefici dell’intelligenza artificiale, secondo il numero uno di OpenAI, l’umanità dovrebbe accettare anche gli effetti negativi che inevitabilmente li accompagnano.

Fonte: TecnoAndroid

Condividi:
53 Condivisioni