Riassunto:
Una tecnologia invisibile originariamente famosa per il jailbreak dell'intelligenza artificiale e gli attacchi di iniezione di parole tempestive - "ASCII Smuggling" - è stata ora utilizzata su larga scala in attività di spam e phishing. Il team di ricerca sulla sicurezza di Microsoft ha rivelato che gli aggressori informatici utilizzano questo metodo per aggirare i principali gateway di posta elettronica e sistemi anti-spam e inviare messaggi fraudolenti a milioni di caselle di posta.

Il principio fondamentale del "contrabbando ASCII" è quello di utilizzare caratteri Unicode speciali invisibili o non resi dall'occhio umano nei moderni standard di codifica del testo per incorporare informazioni nascoste in un testo apparentemente normale. Il metodo più comunemente abusato è il "blocco tag" Unicode (l'intervallo di codifica va da U+E0000 a U+E007F). Questo blocco è stato originariamente progettato per il markup del linguaggio ed ora è in gran parte abbandonato. Contiene "immagini ombra" di caratteri ASCII stampabili standard (ad esempio, U+E0041 corrisponde alla lettera maiuscola A). Se visualizzati dall'occhio umano o dalle interfacce più convenzionali, questi personaggi sono completamente invisibili e non visualizzano alcun contenuto visivo; tuttavia, il software di analisi sottostante e il modello linguistico di grandi dimensioni dell'intelligenza artificiale possono ancora riconoscere ed elaborare questi testi nascosti durante la lettura del flusso di caratteri originale. In precedenza, gli hacker utilizzavano spesso questo meccanismo per "introdurre" segretamente istruzioni dannose nel processo di elaborazione dell'IA, inducendo l'assistente AI a divulgare dati privati o eseguire operazioni non autorizzate all'insaputa dell'utente.

Tuttavia, quando il team di ricerca Microsoft stava sviluppando una libreria di firme di protezione tempestiva per l'inserimento di parole per il suo sistema Defender per Office 365, ha rilevato accidentalmente l'applicazione mascherata di quest'arma di attacco basata sull'intelligenza artificiale nelle tradizionali frodi online. I dati di telemetria mostrano che a partire dal 9 febbraio 2026, il numero di acquisizioni di questa funzionalità di tag Unicode ha mostrato una crescita esplosiva. Il numero di rilevamenti in un solo giorno è immediatamente aumentato da migliaia a decine di migliaia in passato fino a oltre 1,3 milioni, e ha raggiunto un picco di oltre 2,37 milioni in un solo giorno alla fine di febbraio. Questo trend di attacchi ad alta frequenza è durato tre mesi interi durante i giorni lavorativi, mostrando le caratteristiche di una distribuzione automatizzata e su larga scala molto regolare.
L'indagine mostra che questa volta l'aggressore non ha tentato di iniettare istruzioni di attacco nell'intelligenza artificiale, ma le ha utilizzate come metodo di offuscamento definitivo del "text salting". Nella tradizionale difesa dal phishing, i filtri antispam fanno molto affidamento su parole sensibili e firme di regole per intercettare e-mail fraudolente. In passato, le e-mail di spam utilizzavano spesso spazi a larghezza zero (U+200B) o spazi unificatori (U+00A0) per suddividere parole sensibili, ma tali caratteri sono stati sostanzialmente difesi universalmente dai moderni gateway di sicurezza. In questa operazione, la banda di truffatori ha utilizzato caratteri di tag Unicode impopolari (come lo spazio del tag invisibile U+E0020) e li ha inseriti silenziosamente in parole chiave di frode finanziaria come "prestito", "finanziamento" e "credito". Poiché l'esistenza di questi caratteri non può essere rilevata ad occhio nudo, i destinatari ordinari vedono un copywriting fluido e naturale; tuttavia, i tradizionali motori di sicurezza basati sulla corrispondenza delle stringhe saranno completamente inefficaci perché le parole vengono tagliate forzatamente nello strato inferiore.

Ciò che è ancora più problematico è che questo metodo di offuscamento può anche interferire con la nuova generazione di sistemi intelligenti di rilevamento della sicurezza della posta elettronica basati su modelli linguistici di grandi dimensioni (LLM). Quando il modello di sicurezza AI esegue la tokenizzazione sulle e-mail, i caratteri speciali Unicode inseriti interromperanno direttamente la comprensione semantica del tokenizzatore, rendendo impossibile per il modello unire accuratamente e determinare le caratteristiche dannose contestuali, formando così un punto cieco di difesa.
Nell'ondata di attacchi rivelata questa volta, gli aggressori si sono concentrati su esche finanziarie come prestiti finanziari per piccole imprese, hanno registrato un gran numero di nomi di dominio di posta elettronica scartabili contenenti termini finanziari specifici e hanno abilmente abusato dell'infrastruttura e della funzione di riscrittura del collegamento saltato della legittima piattaforma di email marketing ActiveCampaign per nascondere i veri nomi di dominio di salto dannosi ed evitare il blocco diretto a livello IP.
Gli esperti di sicurezza hanno sottolineato che questa tattica di penetrazione segreta, originariamente mirata a modelli di intelligenza artificiale all'avanguardia, è stata ora completamente assorbita dalle industrie nere e trasformata in un'arma di livello industriale contro le difese aziendali quotidiane. Ciò evidenzia anche che, poiché l’intelligenza artificiale è profondamente intrecciata con gli standard caratteriali moderni, i confini tra la dimensione dell’attacco informatico e quella della difesa stanno diventando sempre più sfumati. In risposta a tali minacce emergenti, le agenzie di sicurezza raccomandano che gli amministratori dei sistemi di posta elettronica e i fornitori di sicurezza aggiungano speciali passaggi di pre-elaborazione prima di eseguire la corrispondenza del testo e l’analisi semantica del modello per pulire e normalizzare accuratamente i blocchi di tag Unicode e i caratteri di controllo invisibili, in modo che le funzionalità dannose nascoste nel vuoto siano invisibili.
Commenti