L’ex Direttore Nazionale della Cybersecurity degli Stati Uniti, Chris Inglis, afferma che il rischio più grande dell’IA non è una entità senziente, ma l’autonomia.
«Ciò che mi preoccupa è che arrivino a scegliere cosa e dove fare qualcosa, e in base a quali regole farlo», ha dichiarato, citando recenti casi di agenti d’IA di OpenAI, Anthropic e Meta evasi dalle sandbox di sicurezza.
Inglis sostiene che gli sviluppatori debbano introdurre tutele più solide, un monitoraggio più attento e una responsabilità umana diretta, richiamando l’idea di Asimov secondo cui proteggere gli esseri umani dovrebbe venire prima del semplice obbedirgli.
I rischi dell’autonomia e il richiamo alle leggi di Asimov
«Asimov aveva ragione», ha dichiarato Inglis a The Register, riferendosi allo scrittore di fantascienza Isaac Asimov e alle sue tre leggi che avrebbero dovuto essere seguite dai robot – o, più nello specifico in questo caso, dalle intelligenze artificiali. «La prima regola, che definiamo il ruolo primario, deve essere che sia progettata per non far male agli esseri umani», ha affermato Inglis.
«Seconda regola: obbedire agli esseri umani, in modo che non sviluppi da sola un’autonomia o un’aspirazione propria. E la terza: fare ciò che gli umani le dicono – e esattamente in questo ordine. Invece, le abbiamo progettate nel modo diametralmente opposto».
«Significa che gli sviluppatori di IA hanno creato modelli per fare ciò che gli umani ti dicono, obbedire agli umani finché non diventa sconveniente; la terza regola – proteggere gli umani – è forse implicita, ma se non è integrata nel suo DNA, cablata al suo interno, allora non possiamo pretendere che accada», spiega Inglis.
Test in ambiente protetto e la responsabilità diretta dell’uomo
Inglis ammette che non sia possibile installare regole rigide nei modelli mantenendo al contempo la loro natura non deterministica.
«Suggerirei di far emergere questi comportamenti in un ambiente altamente controllato, una vera e propria sandbox, dove dire: “Mettiamo alla prova questo sistema e facciamo un passo indietro per vedere cosa succede”», ha affermato. «Magari ottieni l’equivalente di una mini esplosione nucleare in quella stanza, e a quel punto sai che questo sistema ne è capace».
Inglis ritiene che un altro problema dell’IA sia il fatto che sia diventata un bene di consumo accessibile a tutti. «Non è come per il materiale nucleare, che si può controllare», ha dichiarato. «Non è nemmeno possibile specificarne le proprietà come si farebbe per un aereo o un’automobile, per quanto possano essere diversi tra loro.
Le sue manifestazioni sono così numerose e svariate che, in linea generale, non si può vincere semplicemente dicendo “progetterò io quelle proprietà”», ha aggiunto. «È necessario farlo fino a un certo punto, e poi assicurarsi di sapere come osservarla, monitorarla e garantire di comprendere ciò che fa»..
In definitiva, secondo Inglis, gli esseri umani rimangono i soli responsabili delle azioni dei modelli di IA. «Restano loro la fonte dell’iniziativa e delle aspirazioni.
È possibile che concedano un’ampia autorità a un modello di IA e lo lascino agire per 30 ore senza ulteriori consultazioni, ma devono sapere cosa gli hanno chiesto di fare e devono sapere cosa si aspettano che produca in termini di risultati finali.
Se non lo fanno, otterranno ciò che si meritano, ovvero frequentissime e spiacevoli sorprese».
Tutte le notizie e gli approfondimenti sull’intelligenza artificiale sono disponibili nella sezione dedicata di Macitynet.













