OpenAI consentirà alle organizzazioni di terze parti di intervenire in anticipo nella valutazione della sicurezza del modello AI

📅 2026-09-23

Riassunto:

OpenAI prevede di consentire alle organizzazioni terze di valutare i rischi per la sicurezza nelle prime fasi del ciclo di sviluppo dei modelli di intelligenza artificiale (AI), una mossa mirata a continuare gli sforzi per affrontare le preoccupazioni relative ai potenziali danni dell'IA. Martedì lo sviluppatore di ChatGPT annuncerà in un post sul blog che prevede di affidare ad agenzie esterne valutazioni tecniche di sicurezza durante la formazione, la valutazione e l'implementazione di nuovi modelli di intelligenza artificiale.


OpenAI elenca anche le priorità che ritiene necessarie affinché tali valutazioni siano efficaci, tra cui "meccanismi forti e indipendenti, rigore scientifico, solide pratiche di sicurezza e chiara responsabilità".

Lama Ahmad, responsabile della maggior parte del lavoro di revisione della sicurezza dell'azienda in collaborazione con esperti esterni, ha affermato che in precedenza OpenAI di solito introduceva tali istituzioni principalmente per condurre valutazioni della sicurezza e valutare le capacità del modello prima del rilascio del modello.

"Con l'aumento dei rischi e degli impatti potenziali, oltre all'implementazione, vogliamo anche garantire che vengano presi in considerazione aspetti critici come la formazione e la valutazione", ha affermato Ahmad in un'intervista.

Per alcuni dei lavori più delicati, OpenAI può consentire a valutatori esterni di entrare nei locali dell'azienda per condurre valutazioni, una pratica che l'azienda ha tentato in passato, ha affermato Ahmad.

Dario Amodei, CEO del concorrente di OpenAI Anthropic PBC, ha recentemente invitato l'industria dell'intelligenza artificiale a sostenere il rallentamento dello sviluppo e ha affermato che saranno adottate nuove misure di sicurezza, inclusa l'introduzione di agenzie di valutazione di terze parti. Il CEO di OpenAI Sam Altman ha successivamente approvato l’approccio. Anthropic ha dichiarato alla fine della scorsa settimana che avrebbe coinvolto i valutatori di Accenture per testare la sicurezza dei suoi modelli di intelligenza artificiale all'avanguardia.

OpenAI ha dichiarato in un post sul blog che la società sta discutendo con le istituzioni che potrebbero essere coinvolte in tali valutazioni. Ahmad ha affermato che gli obiettivi del negoziato includono sia le istituzioni che hanno collaborato in passato sia le istituzioni che non hanno cooperato prima, compresi gli istituti di ricerca sull’intelligenza artificiale METR e Redwood Research. OpenAI aveva precedentemente incaricato queste due istituzioni di indagare sull'intrusione del suo modello nel sistema Hugging Face.

"AI Labs ha la responsabilità di creare le condizioni per una revisione efficace proteggendo al contempo le informazioni sensibili", ha affermato OpenAI in un post sul blog.

Tag correlati

Articoli correlati

Commenti

0/500
Captcha (click to refresh)
Nessun commento