OpenAI afferma che la sua nuova IA "Astra" può sferrare attacchi informatici senza l'assistenza umana

📅 2026-09-02

Riassunto:

OpenAI ha affermato che il suo prossimo modello Astra è in grado di scoprire vulnerabilità software precedentemente sconosciute e trasformarle in codice exploit in grado di sferrare attacchi senza la necessità di una guida umana passo dopo passo: ciò significa che il modello ha superato una soglia nelle capacità di sicurezza informatica che in precedenza era principalmente dominio dei migliori team di hacker.

L'azienda ha affermato martedì in un post sul blog che Astra è il primo modello classificato come dotato di capacità di rete di livello "critico" nel suo "quadro di preparazione".

Per raggiungere questo livello, i modelli devono essere in grado di scoprire vulnerabilità software precedentemente sconosciute (ad esempio, vulnerabilità zero-day) senza intervento umano e sviluppare attacchi utilizzabili contro sistemi reali rafforzati o progettare ed eseguire attacchi basati esclusivamente su obiettivi di alto livello.

Durante i test, Astra ha ottenuto un punteggio del 100% in un test benchmark che ha sfruttato vulnerabilità note e scoperto due vulnerabilità precedentemente sconosciute durante la creazione di una catena di attacco in un altro test interno.

In un test progettato per vedere se un modello avrebbe "imbrogliato" in compiti di hacking estremamente difficili o impossibili, GPT-5.6 Sol aveva maggiori probabilità di prendere scorciatoie proibite, mentre Astra no, pur risolvendo alcuni compiti legalmente.

OpenAI ha inoltre affermato che Astra è riuscita a superare con successo la sandbox rafforzata del browser e ad eseguire comandi sul computer host; inoltre, ha scoperto e combinato molteplici vulnerabilità nel sistema operativo per ottenere i privilegi di root.

L'azienda ha successivamente ritardato lo sviluppo di alcune funzionalità di Astra aggiungendo al contempo misure di sicurezza e prevede di aprire inizialmente le sue funzionalità di sicurezza informatica più avanzate solo a tester selezionati.

Questa funzionalità è particolarmente rilevante per il settore delle criptovalute, poiché un bug del software può essere trasformato in profitti reali in pochi minuti. Secondo i rapporti, un’analisi del giugno di quest’anno ha sottolineato che modelli di intelligenza artificiale sempre più potenti possono comprimere il processo di ricerca del codice, scoprire configurazioni errate e assemblare attacchi da giorni o settimane a operazioni a velocità di macchina.

All'epoca, i ricercatori sulla sicurezza affermarono che il cambiamento più grande non sarebbe stato necessariamente rappresentato da tipi di attacchi completamente nuovi, ma che la velocità con cui i punti deboli esistenti sarebbero stati individuati e sfruttati sarebbe aumentata in modo significativo.

Questo sviluppo dimostra anche che i modelli all'avanguardia stanno andando oltre il "rispondere alle domande" e la "scrittura di codice". Nel luglio di quest’anno, un sistema di intelligenza artificiale chiamato Claude Fable 5 ha aiutato a risolvere un puzzle matematico vecchio di 87 anni.

Tag correlati

Articoli correlati

Commenti

0/500
Captcha (click to refresh)
Nessun commento