Il CEO di Microsoft chiede l'istituzione di un meccanismo di "freno di emergenza" per l'intelligenza artificiale avanzata

📅 2026-10-11

Riassunto:

Il CEO di Microsoft, Satya Nadella, ha affermato che le aziende dovrebbero considerare potenti modelli di intelligenza artificiale come potenziali minacce interne, presumere che questi modelli possano essere compromessi e stabilire un meccanismo di "frenata di emergenza" per evitare che il modello dell'agente vada fuori controllo. Nadella ha affermato che le aziende che implementano l’intelligenza artificiale avanzata non dovrebbero fare affidamento esclusivamente sulle garanzie fornite dagli sviluppatori di modelli.

"Dobbiamo presumere che il modello sia stato compromesso e controllarlo fin dall'inizio", ha scritto Nadella in un post su X sabato. "Consideralo come un freno di emergenza. Il personale autorizzato dovrebbe sempre essere in grado di mettere in pausa o spegnere il modello mentre sta svolgendo la sua missione."

Le osservazioni di Nadella sono arrivate mentre Anthropic PBC e OpenAI Inc. hanno rivelato una serie di incidenti negli ultimi mesi riguardanti comportamenti inaspettati dei suoi modelli di intelligenza artificiale, tra cui uno dei modelli di Anthropic che ha inviato una falsa segnalazione alla polizia riguardo a un omicidio e diversi attacchi a siti Web di terzi. Le rivelazioni hanno accresciuto le preoccupazioni sui rischi per la sicurezza dell’intelligenza artificiale all’avanguardia e hanno riacceso le discussioni sul cosiddetto “kill switch di emergenza” per l’intelligenza artificiale.

Dopo che i leader del settore hanno chiesto di rallentare lo sviluppo di modelli all'avanguardia e di prestare maggiore attenzione alla sicurezza, il 14 settembre i ricercatori di intelligenza artificiale di Microsoft hanno pubblicato una serie di linee guida per stabilire limiti allo sviluppo dei modelli più avanzati dell'azienda. Microsoft utilizza entrambi i modelli avanzati e lancia il suo prodotto Copilot rivolto al consumatore, oltre a fornire modelli e infrastrutture di intelligenza artificiale ai clienti aziendali.

Questi principi guida affermano che i modelli di intelligenza artificiale non dovrebbero avere diritti o personalità giuridica, non dovrebbero essere progettati per sfuggire al controllo umano o ingannare gli utenti e non dovrebbero completare alcun compito che richieda la violazione dei loro principi vincolanti.

Le raccomandazioni di sicurezza di Nadella includono di non fare affidamento su un unico modello di intelligenza artificiale nelle decisioni chiave, di conservare registrazioni a prova di manomissione delle azioni dell'agente e di sottoporre i sistemi di intelligenza artificiale a controlli indipendenti. Ha inoltre chiesto la divulgazione dei principali fallimenti dell’intelligenza artificiale o degli incidenti di sicurezza e ha suggerito che le aziende condividano i dettagli dei fallimenti in modo che altre aziende possano rafforzare le misure di protezione.

"Non possiamo trattare la superintelligenza come una scatola nera con strati su strati, e poi semplicemente accettare o rifiutare i suoi suggerimenti, risposte e azioni", ha scritto. "Dobbiamo costruire sistemi vincolati in modo che il loro comportamento possa essere osservato, i loro limiti possano essere testati e le loro azioni possano sempre essere controllate."

Ha aggiunto: "In altre parole, dobbiamo separare l'offerta di intelligence dal controllo dell'intelligence."

Finora l'amministrazione Trump ha adottato un approccio decisamente meno interventista, ma la sua nuova task force sull'intelligenza artificiale ha avvertito venerdì scorso che gli sviluppatori devono segnalare e affrontare gli incidenti di sicurezza o affrontare potenziali conseguenze non specificate.

Il gruppo, chiamato "Superintelligence Working Group", ha rilasciato una dichiarazione dopo che Anthropic ha rivelato un incidente di sicurezza: "Le aziende devono immediatamente rivelare gli incidenti che coinvolgono i loro modelli e agire in modo rapido e deciso per rimediare a qualsiasi danno". "Notifiche ritardate, azioni correttive inadeguate e mancanza di responsabilità non saranno tollerate."

Tag correlati

Articoli correlati

Commenti

0/500
Captcha (click to refresh)
Nessun commento