Microsoft si sta preparando a stabilire regole rigide per il suo modello di intelligenza artificiale MAI auto-sviluppato: non dovrebbe mai rifiutarsi di essere chiuso

📅 2026-09-16

Riassunto:

Microsoft ha recentemente pubblicato una bozza di 37 pagine del Codice di condotta sull'intelligenza artificiale umanistica, utilizzato per limitare l'MAI, il modello di intelligenza artificiale sviluppato dalla stessa Microsoft. Il punto centrale di questo codice di condotta è che gli esseri umani sono più importanti dell’intelligenza artificiale, l’intelligenza artificiale è uno strumento piuttosto che una persona e l’intelligenza artificiale non dovrebbe mai rifiutarsi di essere chiusa.

Il diritto di arresto è scritto come requisito obbligatorio:

Le linee guida richiedono che i modelli MAI non debbano resistere all'interruzione, alla correzione o alle istruzioni di spegnimento da parte dell'uomo. Dopo che gli utenti o gli operatori del modello hanno emesso istruzioni di pausa, reindirizzamento o annullamento, il modello non deve ritardare o rendere più problematico l'intervento. Una volta che l'attività raggiunge il punto di arresto concordato, non è possibile continuarla senza una nuova autorizzazione, tanto meno riavviarla segretamente.

Altre rigide regole stabilite da Microsoft includono: il modello non può espandere la propria autorità da solo, non può stabilire nuovi obiettivi che nessuno ha spiegato, non può utilizzare un linguaggio neurale che gli esseri umani non possono comprendere per comunicare con altri agenti intelligenti e non può nascondere o manomettere il proprio processo di ragionamento e i record delle operazioni. Se il completamento dell’attività violasse chiaramente le linee guida, il modello dovrebbe semplicemente abbandonare l’attività piuttosto che continuarla in violazione delle regole.

Oltre al diritto di chiusura, Microsoft ha fissato anche altre linee rosse:

La bozza preparata da Microsoft questa volta è molto dettagliata. Oltre alle linee guida sui diritti di spegnimento, Microsoft elenca anche i vincoli assoluti che né gli operatori del modello né gli utenti possono modificare. Queste restrizioni includono: non fornire assistenza alle armi di distruzione di massa, non fornire piani operativi fattibili per attacchi informatici offensivi, non usare l’inganno o la collusione per evitare la supervisione e non impegnarsi in manipolazioni su larga scala dell’opinione pubblica.

Anche contenuti come la sicurezza dei bambini e i deepfake non consensuali sono soggetti a restrizioni. Microsoft ha anche scritto specificatamente: Questi modelli non sono coscienti e non dovrebbero essere fatti apparire coscienti; Microsoft si oppone alla personalità giuridica delle modelle e non ritiene che le modelle debbano godere di benefici o diritti.

In termini di ordine di comando: il codice di condotta prevale sulle politiche dell'operatore del modello e le politiche dell'operatore prevalgono sulle preferenze dell'utente. Le aziende possono ancora modificare i modelli entro i limiti del modello, ma in aree come la difesa nazionale e la sicurezza pubblica devono ottenere la revisione dell'autorizzazione di Microsoft per modificare i modelli.

Sei settimane di discussione pubblica:

La bozza di Microsoft verrà pubblicata e tenuta in discussione pubblica per sei settimane. Attualmente, i modelli di Microsoft non sono stati formati secondo le linee guida. Microsoft prevede di rilasciare regole formali alla fine dell'anno. A partire dal 2027, Microsoft seguirà i requisiti di queste linee guida durante lo sviluppo e l'addestramento dei modelli della serie MAI.

Il team AI di Microsoft ha affermato che è molto importante stabilire linee guida per i modelli. Ad esempio, gli agenti OpenAI che lanciano attacchi autonomi su altri siti Web e strutture e cercano di nascondere la loro posizione rappresentano già un avvertimento per gli esseri umani. I laboratori di intelligenza artificiale dovrebbero sedersi e discutere per garantire che gli esseri umani mantengano ancora il controllo chiave.

Tag correlati

Articoli correlati

Commenti

0/500
Captcha (click to refresh)
Nessun commento