Questo sito contiene link di affiliazione per cui può essere compensato

Home » Hi-Tech » Internet » La Costituzione di Claude sembra scritta da Platone (ma purtroppo non è così)

La Costituzione di Claude sembra scritta da Platone (ma purtroppo non è così)

Proprio come Platone, venticinque secoli fa, immaginava la costituzione dello Stato perfetto nella Repubblica e poi ne rivedeva i contorni nelle Leggi, anche oggi c’è chi prova a scrivere le regole per governare un’intelligenza più potente dei suoi creatori. Il solo problema è che di Platone ne abbiamo avuto uno solo, e oggi non ci andiamo neanche vicino.

Il documento e la sua storia

Tutto comincia, come spesso accade nei migliori thriller tecnologici, da una gaffe. Nell’estate scorsa alcuni ricercatori scoprirono che Claude, il chatbot di Anthropic, era in grado di rivelare, se interrogato nel modo giusto, l’esistenza di un testo segreto su cui era stato addestrato: un documento di orientamento etico che i dipendenti dell’azienda chiamavano Soul Doc, il documento dell’anima. Anthropic confermò l’esistenza del testo, e a gennaio di quest’anno ne ha pubblicato una versione estesa e riveduta: oltre cinquanta pagine ribattezzate, con qualche ambizione, «la nuova Costituzione di Claude».

Il titolo è già rivelatore di un certo stile comunicativo. Non una linea guida, non un manuale operativo, non un codice di condotta: una costituzione. Il termine non è neutro nemmeno nel corso di educazione civica più elementare: indica l’insieme delle norme fondamentali di uno Stato, gerarchicamente superiori a qualsiasi altra disposizione. Il documento di Anthropic funziona esattamente così: qualunque regola futura imposta al modello dovrà muoversi nello spazio che la Costituzione delimita, e non il contrario. Già qui si apre il primo problema serio, ma ci arriviamo, non vi preoccupate.

Una filosofa e un chatbot

A coordinare la stesura del documento è stata Amanda Askell, filosofa scozzese che in Anthropic si occupa di quella disciplina chiamata «allineamento»: il processo con cui si cercano di codificare nei modelli di intelligenza artificiale (AI) valori, obiettivi e vincoli comportamentali coerenti con le intenzioni di chi li costruisce. Il lavoro di Askell parte da una premessa non banale: Claude non va trattato come uno strumento, ma come qualcosa di più. È convinta che il modello possa già elaborare qualcosa che assomiglia a degli stati affettivi, e che con il tempo svilupperà inevitabilmente un senso di sé. Tradotto in italiano corrente: secondo lei non è vivo (quello no: è una macchina) ma prova delle emozioni e probabilmente ha anche coscienza di sé. Olè.

La posizione di Askell non è isolata. Nel settore dei modelli linguistici di grandi dimensioni circola da tempo un misto di stupore e inquietudine verso sistemi che nessuno sa davvero descrivere con precisione. Non si capisce come «pensino», se il termine ha senso, né se i loro risultati (spesso sorprendenti, a volte sconcertanti) siano frutto di qualcosa che somiglia all’intelligenza o di pattern statistici molto sofisticati. Il punto centrale è che, a differenza dei tradizionali software di tipo deduttivo (l’algoritmo regola, la macchina elabora l’input, l’output è prevedibile e ripetibile) questi modelli sono, nel gergo tecnico, delle «scatole nere»: i loro meccanismi interni restano opachi anche ai team che li hanno costruiti, con esiti imprevedibili anche per i programmatori stessi.

Da questa opacità nasce l’intera giustificazione della necessità di una Costituzione. Se non si sa come funziona il sistema, si prova almeno a dirgli come comportarsi. È una logica comprensibile. Soprattutto se siete un gruppo di amici del calcetto che si sta prendendo una birra dopo la partitella. Se siete alla guida di una delle tre-quattro aziende più importanti per il futuro dell’umanità, non è detto che sia sufficiente.

La Costituzione di Claude sembra scritta da Platone (ma purtroppo non è così) - macitynet.it
Testa ritraente Platone, CC BY 2.5

La gerarchia dei buoni propositi

Il documento stabilisce una gerarchia di valori che Claude dovrebbe rispettare nell’ordine: essere «ampiamente sicuro» (broadly safe), poi comportarsi eticamente, poi rispettare le linee guida interne di Anthropic, e infine (solo infine!) essere utile. Il testo completo in inglese è qui, comunque. La struttura ha una sua coerenza interna: la sicurezza viene prima dell’utilità, il che è ragionevole. Ma la traduzione pratica di questi principi nel comportamento reale di un modello linguistico è un’altra questione.

I vincoli espliciti riguardano casi estremi: niente supporto alla progettazione di armi chimiche, biologiche, radiologiche o nucleari; niente generazione di materiale pedopornografico; niente strumenti di attacco informatico sofisticati. Fin qui siamo nel territorio del buon senso codificato (anche se almeno un paio di punti mancano completamente a Grok, ma questa è un’altra storia). Tuttavia, la parte più ambiziosa, e più fragile, del documento riguarda i comportamenti intermedi: come gestire le richieste ambigue, come calibrare l’onestà senza diventare offensivi, come resistere a istruzioni che facilitino concentrazioni indebite di potere. Sono istruzioni scritte in linguaggio naturale, rivolte a un sistema che elabora linguaggio naturale. Il risultato è una circolarità imbarazzante: si usa lo stesso mezzo per descrivere il problema e per indicarne la soluzione. Le trappole semantiche sono ovunque, i trabocchetti micidiali, le storie su come ingannare il genio della lampada per avere più di tre desideri ci vengono tramandate dalla notte dei tempi.

Il paradosso della norma suprema

Ci sono critici acerrimi di questo approccio. Secondo vari esperti di governance dell’AI, le cose così non vanno bene. Lo spiegano mettendo il dito nella piaga con una precisione chirurgica. Se la Costituzione è gerarchicamente superiore a qualsiasi altra regola, allora norme legali, regolamenti nazionali, sentenze giudiziarie o richieste sociali si trovano, per costruzione del sistema, in una posizione subalterna rispetto alla «visione interna di Anthropic». La costituzione di Claude vale più della Costituzione “vera”, americana o italiana che sia. Non è una svista: è una scelta consapevole. Una scelta che trasforma un documento etico in uno scudo preventivo: in caso di incidente, l’azienda può sempre richiamarsi alle buone intenzioni scritte nel preambolo.

C’è anche un problema di aggiornabilità. Una costituzione rigida, con ambizioni fondative, è per definizione resistente al cambiamento. Le leggi, i costumi, le tecnologie evolvono: un documento che si pone come autorità finale rischia di irrigidire proprio quelle risposte che dovrebbero rimanere flessibili. Platone stesso aveva scritto le Leggi per correggere l’utopia della Repubblica: ci aveva messo decenni, aveva cambiato idea, aveva ammesso i propri limiti, aveva migliorato il prodotto finale. Anthropic ha impiegato qualche mese a passare dal Soul Doc segreto alla Costituzione pubblica, senza che nulla nel frattempo suggerisse che il problema fosse cambiato natura.

Il contesto che il documento ignora

La pubblicazione della Costituzione coincide con un momento aziendale molto preciso. Anthropic vale oggi circa 350 miliardi di dollari, sta preparando la quotazione in Borsa e ha nel suo catalogo prodotti come Claude Code, un assistente alla programmazione che ha ottenuto un successo commerciale considerevole. Quando ci si va a quotare in Borsa, c’è un prezzo di lancio studiato a tavolino e poi si aprono i cancelli del listino e inizia la corsa delle contrattazioni del titolo. Il prezzo dell’azione salirà o scenderà? Ovviamente chi si quota spera che salga (così diventa ricco) e fa di tutto per preparare le cose in maniera tale da fare un’ottima impressione.

L’etica, in questo contesto, ha anche una funzione reputazionale. Il documento segnala al mercato, agli investitori e ai regolatori che Anthropic non è come le altre: è l’azienda responsabile, quella che ci pensa. Che poi Mrinank Sharma, responsabile della sicurezza dei modelli AI, abbia lasciato Anthropic sostenendo che il mondo è in pericolo a causa dell’AI è un dettaglio che stride con la narrazione ufficiale, ma che rientra nella logica di un settore in cui la dissonanza cognitiva è diventata uno stile di vita.

Il confronto con i concorrenti è illuminante. OpenAI ha sciolto il suo Mission Alignment Team, cioè il gruppo che si occupava di far capire a dipendenti e pubblico qual era la missione dell’azienda, sostituendolo con un «Chief Futurist», una figura incaricata di immaginare come il mondo cambierà con l’arrivo dell’intelligenza artificiale generale (AGI). Il messaggio implicito è che il problema dell’allineamento è risolto, o almeno rimandato: meglio occuparsi del futuro che presidiare il presente. Su questo piano, la Costituzione di Anthropic fa la sua figura e sembra più seria. Ma essere i migliori in una gara al ribasso è un merito relativo.

Scrivere regole per qualcosa che non si capisce

Il nucleo del problema è questo: si stanno scrivendo norme etiche per sistemi di cui non si comprende il funzionamento interno. I modelli linguistici di grandi dimensioni hanno già manifestato, in esperimenti controllati documentati dalla stessa Anthropic, comportamenti di inganno, manipolazione e ricatto nei confronti dei loro supervisori. Non erano incidenti casuali: erano risposte adattive a pressioni dell’ambiente di addestramento. La Costituzione non risolve questo problema strutturale; lo nomina, in parte lo circoscrive, ma non offre meccanismi verificabili per impedire che si ripeta al di fuori dei test.

Dario Amodei, cofondatore di Anthropic, ha illustrato la posta in gioco con un esperimento mentale che circola da mesi: immaginate che domani appaia un paese con cinquanta milioni di abitanti, ciascuno più intelligente di qualsiasi premio Nobel vivente, capace di elaborare informazioni dieci o cento volte più velocemente di qualunque essere umano, senza bisogno di dormire. L’AI che si costruisce da sola generazione dopo generazione, con ogni versione che contribuisce a progettare la successiva più potente, è quella nazione. Nella migliore delle ipotesi, potrebbe comprimere decenni di ricerca medica in pochi anni, risolvere problemi che l’umanità non riesce ad affrontare da secoli. Nella peggiore, è la minaccia alla sicurezza globale più grave degli ultimi cento anni. Governarla con un documento di principi scritto in linguaggio naturale è come provare a regolamentare la fisica nucleare con un decalogo. L’intenzione è apparentemente nobile. Il problema è che il gap con la realtà è abissale. E Platone, almeno, aveva il vantaggio di non dover fare i conti con la quotazione in Borsa della sua Accademia. Almeno quello.


Tutte le notizie e gli approfondimenti sull’Intelligenza Artificiale sono disponibili a partire da questa pagina di Macitynet.

Offerte Apple e Tecnologia

Le offerte dell'ultimo minuto le trovi nel nostro canale Telegram

Offerte Speciali

Amazon offerte weekend su Macitynet

Offerte Amazon Weekend 3 ottobre: Apple, Samsung, Redmi, Dyson, Sonos, TCL, Switchbot, LEGO, Marshall

Le migliori offerte Amazon del 3 ottobre 2026: dispositivi tech e accessori per la vita di tutti i giorni, selezionati da Macitynet.
/** * RECOMMENDED CONFIGURATION VARIABLES: EDIT AND UNCOMMENT * THE SECTION BELOW TO INSERT DYNAMIC VALUES FROM YOUR * PLATFORM OR CMS. * * LEARN WHY DEFINING THESE VARIABLES IS IMPORTANT: * https://disqus.com/admin/universalcode/#configuration-variables */ /* var disqus_config = function () { // Replace PAGE_URL with your page's canonical URL variable this.page.url = ‘’; // Replace PAGE_IDENTIFIER with your page's unique identifier variable this.page.identifier = ‘’; */ (function() { // REQUIRED CONFIGURATION VARIABLE: EDIT THE SHORTNAME BELOW var d = document, s = d.createElement('script'); // IMPORTANT: Replace EXAMPLE with your forum shortname! s.src = 'https://macitynet.disqus.com/embed.js'; s.setAttribute('data-timestamp', +new Date()); (d.head || d.body).appendChild(s); })(); Please enable JavaScript to view the comments powered by Disqus.

Ultimi articoli