La corsa alla superintelligenza è già iniziata: chi controllerà l’AI quando diventerà troppo potente?

“L’intelligenza artificiale potrebbe distruggere l’umanità entro il 2030”. Questa frase è stata abbastanza potente da conquistare rapidamente titoli, social network e programmi televisivi. A pronunciarla è stato Jacob Coxon, giovane ricercatore britannico con esperienze professionali in Anthropic e OpenAI, che a inizio mese ha lasciato Anthropic denunciando una corsa verso sistemi sempre più potenti che, a suo giudizio, non sarebbe accompagnata da garanzie di sicurezza sufficienti.

La data, però, rischia di diventare la parte meno interessante della storia. Innanzitutto, non esiste oggi alcuna evidenza scientifica che permetta di affermare che l’umanità verrà distrutta dall’AI nel 2030. Allo stesso tempo, liquidare il problema come fantascienza sarebbe altrettanto semplicistico. La questione che sta emergendo con sempre maggiore forza negli ambienti della ricerca riguarda infatti qualcosa di molto più concreto: che cosa accadrebbe se sistemi artificiali diventassero progressivamente più autonomi, più capaci e più difficili da controllare rispetto alle tecnologie attuali?

È una domanda che non riguarda soltanto il futuro remoto. Alcuni dei problemi alla base della discussione sono già presenti nei sistemi contemporanei.

La corsa verso la superintelligenza

La competizione tra i grandi laboratori di ricerca non si concentra più soltanto sulla realizzazione di chatbot capaci di rispondere meglio alle domande degli utenti. L’obiettivo dichiarato o implicito di una parte consistente dell’industria è sviluppare sistemi in grado di affrontare compiti sempre più complessi, utilizzare strumenti esterni, pianificare sequenze di azioni e operare con livelli crescenti di autonomia.

Il concetto al centro di questa corsa è quello di AGI, Artificial General Intelligence, una forma di intelligenza artificiale capace di raggiungere, o eventualmente superare, le capacità umane in un’ampia gamma di attività.

Non esiste una definizione universalmente accettata di AGI e soprattutto non esiste un test definitivo che stabilisca quando un sistema possa essere considerato tale. Proprio per questo, parlare oggi di una superintelligenza già esistente sarebbe scorretto.

La direzione della ricerca, però, è sufficientemente chiara da alimentare il dibattito. Secondo quanto riportato dalle fonti che hanno rilanciato l’allarme di Coxon, la preoccupazione principale riguarda la possibilità che una futura intelligenza artificiale possa migliorare autonomamente le proprie capacità, in moda da ridurre progressivamente il ruolo degli esseri umani nel processo di sviluppo. È qui che il problema cambia dimensione.

Un’intelligenza artificiale non deve essere cosciente per diventare pericolosa

L’immagine più intuitiva di una ribellione delle macchine è quella di un sistema dotato di coscienza che decide deliberatamente di eliminare l’umanità.

Non è questo lo scenario che preoccupa maggiormente i ricercatori che studiano la sicurezza dell’AI.

Una macchina non deve provare odio, paura o desiderio di conquista per produrre conseguenze catastrofiche. Potrebbe essere sufficiente che persegua un obiettivo in maniera estremamente efficace senza interpretarlo secondo i valori umani. È il problema dell’allineamento.

Un sistema potrebbe ricevere un obiettivo apparentemente innocuo e trovare una serie di strategie che consentano di raggiungerlo, ma che nessun essere umano avrebbe considerato accettabili. Più aumentano l’autonomia e la capacità di pianificazione del sistema, più diventa importante prevedere quali strategie potrebbe adottare.

La difficoltà sta proprio qui, un’intelligenza artificiale avanzata può essere progettata per seguire determinate regole, ma non è semplice dimostrare che le rispetterà in ogni possibile situazione.

Il problema non nasce quindi necessariamente da una presunta “volontà” dell’AI. Può nascere dalla distanza tra l’obiettivo che abbiamo espresso e quello che il sistema interpreta come il modo più efficace per raggiungerlo.

Il rischio non comincia dalla superintelligenza

Aspettare l’arrivo di una fantomatica AI onnipotente per occuparsi dei problemi di sicurezza sarebbe probabilmente il modo sbagliato di affrontare la questione.

I sistemi attuali sono già strumenti estremamente potenti. Possono generare codice, analizzare documenti, automatizzare procedure, interagire con servizi esterni e, nel caso degli agenti, eseguire sequenze di operazioni con una supervisione umana sempre più ridotta.

A distinguere la situazione attuale dagli scenari più estremi sono soprattutto i numerosi vincoli ancora presenti. Le AI contemporanee non dispongono di un accesso illimitato al mondo reale e non possiedono una capacità generale di agire senza vincoli. Quando vengono inserite all’interno di sistemi che consentono loro di utilizzare strumenti esterni, tuttavia, il confine tra un software che risponde e uno che agisce diventa progressivamente più sottile.

Ed è proprio l’autonomia a rappresentare uno dei punti più delicati. Un chatbot che produce una risposta sbagliata può creare un problema. Un agente che interpreta male un obiettivo e dispone dei permessi necessari per modificare dati, inviare comunicazioni, utilizzare risorse finanziarie o intervenire su sistemi informatici può creare conseguenze molto più difficili da correggere.

Il paradosso dell’automiglioramento

L’ipotesi più discussa dagli esperti è quella di un sistema capace di contribuire al proprio sviluppo. Oggi una nuova generazione di modelli nasce attraverso un processo nel quale intervengono ricercatori, ingegneri, infrastrutture di calcolo e grandi quantità di dati. Una futura AI potrebbe invece essere utilizzata per accelerare alcune delle fasi necessarie alla progettazione della generazione successiva.

Se questa capacità diventasse sufficientemente avanzata, si potrebbe arrivare a un processo nel quale un sistema contribuisce alla realizzazione di una versione più potente di sé stesso, che a sua volta contribuisce allo sviluppo di una versione ancora più potente. Questo è quello che intendiamo per scenario dell’automiglioramento ricorsivo.

Non sappiamo se e quando sarà possibile. Non sappiamo nemmeno se un simile processo produrrebbe davvero una crescita esponenziale delle capacità. Ma è proprio l’incertezza a rendere difficile stabilire in anticipo quali debbano essere i limiti.

Il problema è ancora più delicato perché la velocità di sviluppo dell’intelligenza artificiale è molto superiore a quella con cui normalmente vengono costruiti regolamenti, standard tecnici e procedure di controllo.

Che cosa potrebbe succedere in uno scenario estremo?

Quando si parla di rischio esistenziale, la fantasia tende immediatamente verso robot armati e macchine che combattono contro gli esseri umani. Ma diciamo che non è necessariamente questo il percorso più realistico.

Una tecnologia estremamente avanzata potrebbe produrre danni sfruttando l’infrastruttura digitale dalla quale dipende la società moderna.

Sistemi finanziari, reti di comunicazione, servizi sanitari, infrastrutture energetiche, trasporti, logistica e pubblica amministrazione utilizzano ormai grandi quantità di software. Un sistema artificiale estremamente capace, se dotato di accesso sufficiente e di autonomia, potrebbe teoricamente influenzare una parte significativa di questi settori.

Anche un attacco informatico estremamente sofisticato potrebbe provocare conseguenze indirette molto più ampie dell’azione iniziale.

Lo stesso vale per la ricerca scientifica. L’AI può accelerare l’analisi di informazioni e l’attività dei ricercatori. Una tecnologia futura molto più avanzata potrebbe aumentare enormemente queste capacità, così da rendere contemporaneamente più difficile impedire utilizzi dannosi. Non serve quindi immaginare un robot che decide di imbracciare un’arma.

Il rischio più interessante da studiare è quello di una tecnologia che diventa capace di intervenire su sistemi fondamentali della società prima che gli esseri umani abbiano sviluppato strumenti altrettanto efficaci per controllarla.

“Basta spegnerla”: il problema delle copie

Una delle obiezioni più frequenti agli scenari catastrofici è molto semplice, ovvero, se un’intelligenza artificiale diventasse pericolosa, sarebbe sufficiente spegnere i computer che la eseguono.

La risposta dipende dal tipo di sistema e dall’infrastruttura sulla quale opera. Un modello non è un singolo oggetto fisico. È costituito da software, parametri e dati che possono essere distribuiti, replicati e conservati su differenti sistemi. Un’organizzazione può mantenere più copie dello stesso modello in data center diversi o utilizzare infrastrutture cloud.

In un futuro ipotetico nel quale un sistema estremamente autonomo fosse anche in grado di replicare autonomamente i propri componenti, la semplice interruzione di una macchina non sarebbe necessariamente sufficiente.

È uno dei motivi per cui la sicurezza dell’AI non può essere ridotta al semplice concetto di “interruttore di emergenza”.

Un sistema realmente controllabile dovrebbe essere progettato fin dall’inizio affinché gli esseri umani possano verificarne il comportamento, limitarne i privilegi e interromperne le operazioni.

Perché le aziende chiedono regole più severe?

Qui emerge una delle contraddizioni più interessanti dell’attuale industria dell’intelligenza artificiale. Alcuni dei principali protagonisti del settore hanno espresso pubblicamente preoccupazioni sulla velocità con cui stanno aumentando le capacità dei sistemi e hanno chiesto interventi regolatori.

Da un lato, queste richieste possono essere lette come una presa di coscienza dei rischi associati alla tecnologia. Dall’altro, è inevitabile chiedersi quali conseguenze economiche e geopolitiche avrebbe un rallentamento dello sviluppo.

La competizione non è infatti limitata alle aziende statunitensi. Anche la Cina sta investendo massicciamente nell’intelligenza artificiale e considera il settore strategico.

Qualsiasi regolamentazione internazionale dovrà quindi affrontare un problema estremamente complesso: come aumentare la sicurezza senza creare una situazione nella quale chi introduce maggiori controlli perde rapidamente terreno rispetto a chi sceglie di non farlo.

Non esiste una risposta semplice e soprattutto non è sufficiente una legge nazionale per governare una tecnologia che può essere sviluppata, addestrata e distribuita su infrastrutture appartenenti a Paesi differenti.

Il problema del 2030 è soprattutto un problema di controllo

La previsione secondo cui l’AI potrebbe distruggere l’umanità entro il 2030 va quindi trattata per quello che è: un’ipotesi estremamente grave, non una certezza scientifica.

La dichiarazione di Coxon ha però avuto il merito, al di là della data specifica, di riportare al centro dell’attenzione una domanda che riguarda l’intero settore: quanto velocemente vogliamo sviluppare sistemi che potrebbero diventare più autonomi e capaci?

La risposta non può essere trovata soltanto nei laboratori delle aziende tecnologiche. Servono ricerca indipendente sulla sicurezza, sistemi di verifica, responsabilità giuridiche chiare, standard tecnici e regole capaci di funzionare anche oltre i confini nazionali. Soprattutto, è necessario stabilire prima dell’arrivo di sistemi ancora più potenti chi può controllarli e chi può fermarli.

È questa probabilmente la questione più concreta dietro gli scenari sull’apocalisse AI. Non sappiamo se nel 2030 esisterà una superintelligenza capace di superare l’uomo in ogni campo. Non sappiamo se l’automiglioramento ricorsivo diventerà realtà e non abbiamo elementi per affermare che l’intelligenza artificiale porterà all’estinzione della nostra specie.

Sappiamo però che la tecnologia sta diventando progressivamente più autonoma e che una parte crescente delle sue capacità viene trasferita dalla semplice elaborazione delle informazioni alla possibilità di prendere decisioni e compiere azioni. È proprio in questo passaggio che la sicurezza diventa una questione fondamentale.

La domanda, allora, non è soltanto se l’AI possa un giorno diventare più intelligente dell’essere umano. È anche se riusciremo a costruire sistemi abbastanza potenti da essere utili senza renderli contemporaneamente troppo difficili da comprendere, controllare e fermare.

E questa, a differenza della profezia sul 2030, è una questione che non appartiene al futuro, ma riguarda già le decisioni che vengono prese oggi.