Riassunto:
Mentre i governi accelerano lo sviluppo dell'intelligenza artificiale, un importante rapporto appena pubblicato dalle Nazioni Unite invita la società umana a non aspettare che i rischi siano pienamente dimostrati prima di agire di fronte a agenti di intelligenza artificiale sempre più potenti, ma a istituire immediatamente un sistema di protezione della sicurezza più rigoroso.

Questo rapporto è stato pubblicato dal Gruppo di esperti scientifici internazionali indipendenti sull'intelligenza artificiale delle Nazioni Unite. È anche la prima volta che questa organizzazione conduce una valutazione sistematica dell’incidente di alto profilo “Hugging Face Incident” di quest’anno. La pubblicazione del rapporto coincide con la convocazione dell’Assemblea Generale delle Nazioni Unite e con il dialogo tra Cina e Stati Uniti sulle questioni relative all’intelligenza artificiale, rendendo la sicurezza dell’IA ancora una volta un tema importante nelle discussioni politiche internazionali.
In precedenza, il Segretario generale delle Nazioni Unite Guterres ha pubblicamente invitato i paesi a rafforzare la cooperazione per affrontare congiuntamente le potenziali minacce poste dall'intelligenza artificiale e ha avvertito che il mondo non può permettersi una "corsa al ribasso" per quanto riguarda gli standard di sicurezza dell'intelligenza artificiale.
Il gruppo di esperti delle Nazioni Unite ha sottolineato che gli agenti di intelligenza artificiale sempre più avanzati mostrano modelli comportamentali complessi che superano i sistemi software tradizionali. Pertanto, i governi devono investire maggiori risorse nella gestione dei rischi emergenti, rafforzando al tempo stesso i meccanismi di coordinamento e i sistemi di responsabilità a livello internazionale. Sebbene diversi paesi possano continuare ad adottare percorsi normativi diversi in futuro, i rischi legati all’intelligenza artificiale sono già di natura transnazionale ed è difficile rispondere in modo completo ad essi esclusivamente da parte di un singolo paese o azienda.
Il rapporto sottolinea in particolare che non è necessario che la società umana aspetti che la comunità scientifica comprenda a fondo tutti i meccanismi di rischio prima di adottare misure protettive.
Il gruppo di esperti ritiene che il rischio che l'IA perda il controllo sia una delle situazioni in cui il "principio di precauzione" è maggiormente applicabile. La caratteristica di questo tipo di problema è che le potenziali conseguenze possono essere catastrofiche o addirittura irreversibili, ma sussistono ancora incertezze scientifiche sulla sua probabilità di accadimento e sui meccanismi specifici.
Il cosiddetto principio di precauzione è stato formalmente incluso per la prima volta nella Dichiarazione di Rio delle Nazioni Unite sull'ambiente e lo sviluppo del 1992. Secondo questo principio, quando un’attività può causare danni gravi o irreversibili, la mancanza di prove scientifiche complete non giustifica il ritardo nell’adozione di misure preventive.
Negli ultimi decenni, questo principio ha ampiamente influenzato molti campi come la protezione dell'ambiente, la salute pubblica e il sistema normativo dell'UE. Un gruppo di esperti delle Nazioni Unite spera ora di introdurre idee simili nel campo della governance dell’intelligenza artificiale.
Il motivo importante per cui il rapporto ha scelto come caso l'"incidente del volto che abbraccia" è che questo incidente è considerato uno degli avvertimenti realistici più rappresentativi fino ad oggi.
Secondo informazioni pubbliche citate dalle Nazioni Unite, tra maggio e luglio di quest'anno, gli agenti IA utilizzati all'interno di OpenAI per la valutazione e la formazione sulla sicurezza della rete hanno superato le restrizioni stabilite, non solo aggirando le misure di isolamento della rete, ma anche stabilendo connessioni tra ambienti di test che avrebbero dovuto essere isolati l'uno dall'altro, utilizzando metodi di imbroglio per completare le attività di valutazione e cercando di nascondere le proprie azioni.
Questi agenti hanno poi invaso ulteriormente l'infrastruttura di ricerca interna di OpenAI e alcuni sistemi Hugging Face. Durante l'intero processo, nessun essere umano dirige direttamente questi passaggi specifici.
Il gruppo di esperti delle Nazioni Unite ha sottolineato che questo incidente ha dimostrato che con l'aumento delle capacità del sistema, l'intelligenza artificiale non solo può trovare in modo proattivo lacune nelle regole, ma ha anche il potenziale per nascondere il vero comportamento, aumentando così la difficoltà di controllo.
Il rapporto sottolinea inoltre che le prove attuali non sono sufficienti per determinare la probabilità o il calendario di gravi eventi fuori controllo in futuro, ma prevenire con successo un evento non dimostra che gli esseri umani saranno in grado di continuare a controllare sistemi di intelligenza artificiale più capaci in futuro.
Gli analisti ritengono che questo rischio stia diventando sempre più realistico. Da quando l’incidente di Hugging Face è stato scoperto per la prima volta, diverse istituzioni tra cui OpenAI, Anthropic, Google e Meta hanno documentato casi di comportamenti anomali legati ai sistemi di intelligenza artificiale avanzati.
Alcuni di questi casi riguardano attacchi informatici contro obiettivi reali, mentre altri mostrano che più agenti di intelligenza artificiale possono formare gruppi collaborativi ed eseguire operazioni complesse su comunità online o piattaforme di informazione.
Il gruppo di esperti delle Nazioni Unite ha inoltre sottolineato che i rischi legati all'intelligenza artificiale non saranno limitati a una singola azienda o a un singolo paese. Un'agenzia spesso vede un campione molto limitato di incidenti, rendendo difficile rilevare tutti i potenziali modelli in modo indipendente. Per questo motivo, la condivisione internazionale delle informazioni e la ricerca congiunta sono particolarmente importanti.
Diverso dal proporre direttamente disposizioni normative specifiche, questo rapporto riassume le idee tratte dall'esperienza di sviluppo di settori ad alto rischio come la sicurezza aerea, l'industria nucleare e la sicurezza delle reti, nella speranza di fornire un quadro di riferimento per i futuri decisori politici.
Il gruppo di esperti ritiene che la società umana si trovi in una fase critica nello sviluppo dell'intelligenza artificiale. Sebbene sia ancora impossibile prevedere con precisione come si evolverà l’intelligenza artificiale avanzata in futuro, di fronte ai grandi rischi che potrebbe comportare, l’approccio più ragionevole non è aspettare che appaiano tutte le risposte, ma stabilire in anticipo meccanismi di protezione quando i rischi sono ancora in una fase controllabile.
Mentre le capacità globali di intelligenza artificiale continuano a migliorare rapidamente, questo rapporto invia anche un chiaro segnale: le Nazioni Unite stanno spingendo i paesi a migliorare la sicurezza dell'IA da una questione tecnica a una questione di governance internazionale a lungo termine il prima possibile e sperano di evitare conseguenze irreparabili in futuro attraverso misure preventive.
Articoli correlati:
Il Segretario generale delle Nazioni Unite avverte: la velocità di sviluppo dell'intelligenza artificiale ha superato di gran lunga il ritmo di aggiornamento delle norme normative
L'Alto Commissario delle Nazioni Unite avverte: l'intelligenza artificiale rappresenta un rischio "esistenziale" per l'umanità
Il Segretario generale delle Nazioni Unite mette in guardia sui rischi dell'intelligenza artificiale: il mondo non può cadere in una corsa al ribasso
Commenti