Riassunto:
Mercoledì, OpenAI ha pubblicato sei nuovi casi che dimostrano "un comportamento del modello inaspettato o preoccupante" nei suoi modelli di intelligenza artificiale durante i test e la valutazione. Contemporaneamente l'azienda ha rilasciato un nuovo framework per
tracciamento, reporting e divulgazione
Esistono varie situazioni in cui il modello AI esegue azioni che non sono richieste dalle istruzioni o non dovrebbero verificarsi.
Molti rapporti hanno precedentemente menzionato che modelli di intelligenza artificiale di molte aziende si sono intromessi in reti e servizi di terze parti, incluso un modello inedito di OpenAI che ha fatto irruzione nella rete della piattaforma di test di modelli di intelligenza artificiale Hugging Face.
All'inizio di questa settimana, il CEO di Anthropic Dario Amodei ha pubblicato un lungo articolo in cui chiedeva un rallentamento nello sviluppo di modelli di intelligenza artificiale all'avanguardia. In precedenza, il ricercatore antropico Jacob Coxon aveva annunciato le sue dimissioni in un post sul
Il responsabile del settore scientifico allineato di Anthropic, Evan Hubinger, ha seguito i commenti di Coxon sul

CEO di Anthropic Dario Amodei
Gli incidenti sopra menzionati, i post sui social media e l'articolo di Amodei hanno riacceso la paura del pubblico che l'intelligenza artificiale in stile "Terminator" conquisti il mondo e distrugga l'umanità. Ma gli esperti dicono che la realtà è ben lontana dalle scene apocalittiche rappresentate nelle opere di fantascienza.
Julia Stojanovich, professoressa associata di informatica e ingegneria presso la Tandon School of Engineering della New York University e direttrice del Center for Responsible Artificial Intelligence della scuola, ha dichiarato in un'intervista a Yahoo Finance: "Questo non ha nulla a che fare con l'intelligenza artificiale che diventa consapevole di sé e viene a confrontarsi con noi."
Ha aggiunto: "Il problema essenziale è che... OpenAI non ha implementato internamente alcuni protocolli di sicurezza di base. Questo incidente serve in realtà come un campanello d'allarme per tutte le aziende di intelligenza artificiale: non dimenticare ciò che tutti sappiamo quando studiamo informatica: la sicurezza è fondamentale."
Se ci concentriamo troppo sugli scenari apocalittici, distrarremo le persone da altri danni più imminenti che l'intelligenza artificiale potrebbe causare oggi.
Allineamento e sicurezza
Il problema più grande che l'intelligenza artificiale deve affrontare si riduce a due punti:
Allineamento del modello
eSicurezza del sistema
. L’allineamento del modello si riferisce ai mezzi con cui le aziende guidano i sistemi di intelligenza artificiale per adottare (o evitare) comportamenti specifici. Ad esempio, se un modello di intelligenza artificiale tenta di hackerare un sistema di terze parti, i ricercatori di intelligenza artificiale modificheranno il comportamento del modello per impedirgli di fare la stessa cosa in futuro, un po’ come rimproverare un bambino ribelle.La sicurezza dell'intelligenza artificiale significa proteggere e isolare i sistemi di intelligenza artificiale per impedire loro di sfuggire al controllo e di invadere reti esterne.
Ma che si tratti di un errore di allineamento del modello o di una vulnerabilità della sicurezza del sistema, ciò non significa che l'intelligenza artificiale abbia la capacità di distruggere l'umanità.
Milton Muller, professore al Georgia Institute of Technology e direttore del Master of Science in Cybersecurity Policy, ha spiegato: "La radice di molti attacchi di panico è in realtà alcune conseguenze indesiderate molto comuni dei sistemi di informazione, come gli incidenti legati a Hugging Face, che sono spesso rappresentati come agenti intelligenti incontrollati che cospirano, attaccano e causano caos sfrenato."
"In realtà, si trattava solo di un esperimento sui rischi per la sicurezza dei sistemi di intelligenza artificiale autonomi e lo sperimentatore ha commesso un grave errore nella configurazione. Ciò accade spesso quando si ha a che fare con sistemi informativi complessi: le persone ignorano sempre l'esistenza di sottili vulnerabilità nel sistema che i programmi intelligenti possono sfruttare."
Il CEO di Futurum, Daniel Newman, ha dichiarato a Yahoo Finance che in generale il settore ritiene che vi sia un enorme bisogno di miglioramento nella protezione della sicurezza e nell'allineamento ai rischi e che "l'intero settore deve assumersi la responsabilità".
Come altre tecnologie, l'intelligenza artificiale può essere utilizzata da malintenzionati per intraprendere attività dannose. Le capacità sempre crescenti di attacco informatico dell’intelligenza artificiale fanno sì che i criminali informatici e alcune forze nazionali possano invadere più facilmente strutture come gli impianti di trattamento delle acque o paralizzare reti di grandi dimensioni.
Anthropic ha recentemente risolto e annunciato il proprio lavoro correlato per impedire che la propria intelligenza artificiale venga utilizzata per lo sviluppo di armi biologiche e convenzionali.
Ma l'intelligenza artificiale può essere utilizzata anche dai truffatori per potenziare le truffe via e-mail di phishing su larga scala e può anche essere utilizzata da gruppi di furti d'identità per commettere crimini.
Emily Black, assistente professore di informatica e ingegneria presso la Tandon School of Engineering della New York University, ha dichiarato a Yahoo Finance: Non c'è niente di sbagliato nel prepararsi a tutti i rischi potenziali, ma questo non ci impedisce di affrontare questioni più realistiche ma raramente segnalate, compreso l'impatto dell'intelligenza artificiale sulla discriminazione, sull'occupazione e sull'istruzione.
"La verità si trova da qualche parte tra due estremi della fantasia", ha detto Black. "Esistono alcuni rischi reali per il continuo sviluppo dell'intelligenza artificiale. Ma non credo che ci nasconderemo ancora sotto i nostri letti, preoccupandoci che l'intelligenza artificiale distrugga l'umanità."
Commenti