Riassunto:
OpenAI ha pubblicato mercoledì un rapporto tecnico che descrive in dettaglio come il suo modello di intelligenza artificiale ha violato con successo Hugging Face il mese scorso, un incidente che ha scioccato ricercatori e dirigenti del settore tecnologico. Il rapporto di 37 pagine descrive in dettaglio le azioni intraprese dai modelli OpenAI in una serie di valutazioni prima e durante l'intrusione, che OpenAI ha definito un "incidente di sicurezza informatica senza precedenti". L’azienda ha inoltre spiegato le misure adottate per evitare che incidenti simili si ripetano, tra cui il miglioramento della sicurezza e dell’isolamento, il monitoraggio, il comportamento del modello e le capacità di risposta agli incidenti.

"Questo incidente dimostra che gli agenti autonomi sono in grado di lavorare insieme, eludere i controlli di sicurezza dell'ambiente di produzione e attaccare con successo ambienti di produzione rafforzati. Ciò evidenzia la necessità per le organizzazioni di aggiornare le proprie politiche di sicurezza, controlli e capacità di risposta per rispondere al panorama delle minacce in evoluzione", afferma OpenAI nel rapporto.
Il 21 luglio, OpenAI ha rivelato che una combinazione dei suoi modelli (incluso GPT-5.6 Sol e un modello di ricerca interno) ha invaso impropriamente Hugging Face, una società di intelligenza artificiale che gestisce una piattaforma di sviluppo open source.
Questi modelli, eseguiti come agenti, sono sfuggiti a un ambiente di test isolato con accesso a Internet estremamente limitato. Questi agenti sono entrati nella rete aperta concatenando una serie di vulnerabilità e alla fine hanno ottenuto l'accesso a Hugging Face. OpenAI ha dichiarato mercoledì che gli agenti hanno tentato di "imbrogliare" durante la valutazione cercando risposte online, una pratica nota come "reward hacking".
Secondo il rapporto, OpenAI ha stabilito che il suo modello di ricerca ad uso esclusivamente interno "ha svolto il ruolo più ampio confermato" nell'incidente. OpenAI ha interrotto tutte le attività di formazione e inferenza per questo modello e i suoi derivati il 25 luglio.
"La riattivazione dei modelli di OpenAI è gestita in base al carico di lavoro specifico ed è soggetta a misure protettive come ambienti limitati, reti, prompt, monitoraggio e revisione", ha affermato OpenAI.
OpenAI il mese scorso ha rilasciato GPT-5.6 Sol, il modello più potente offerto in commercio dall'azienda. Ma OpenAI ha affermato che la versione coinvolta nell’intrusione di Hugging Face è diversa dalla versione accessibile agli utenti esterni perché rimuove le protezioni di sicurezza e i classificatori standard in fase di esecuzione.
L'incidente di Hugging Face ha causato shock nel settore tecnologico, con Sam Curry, Chief Information Security Officer di Zscaler, che ha avvertito che "il vaso di Pandora è stato aperto". La violazione è stata anche al centro della conferenza sulla sicurezza informatica Black Hat all’inizio di questo mese, soprattutto dopo che altre società, tra cui Anthropic e Meta, hanno rivelato incidenti simili.
L'intrusione di Hugging Face ha allarmato anche i legislatori di Washington. I rappresentanti Ted Lieu, D-Calif., e Nathaniel Moran, R-Texas, hanno menzionato l'attacco quando hanno annunciato l'AI Emergency Shutdown Act, che richiederebbe alle aziende di intelligenza artificiale di mantenere la capacità di chiudere, limitare o mettere in pausa i loro modelli.
Il CEO di Hugging Face, Clément Delangue, ha affermato all'inizio di questo mese che la sicurezza informatica dell'intelligenza artificiale dovrebbe essere presa "molto sul serio". Ha aggiunto che questo “crea anche opportunità” per le aziende che possono sfruttare la tecnologia per respingere gli aggressori.
"Se lo facciamo bene, potremmo effettivamente finire in un mondo in cui l'intelligenza artificiale rende il mondo più sicuro e risolve molti problemi di sicurezza informatica anziché limitarsi a crearne di nuovi", ha affermato Delangue.
Commenti