Riassunto:
L'11 settembre, Anthropic ha pubblicato l'ultimo rapporto sugli abusi dell'intelligenza artificiale in cui si afferma che l'App Development Studio ha utilizzato Claude per sviluppare e gestire più di 20 app di appuntamenti. La piattaforma afferma che tutti gli utenti sono persone reali, ma circa il 75% delle corrispondenze ricevute dagli utenti ordinari sono personaggi IA.

Anthropic ha dichiarato che durante un periodo di osservazione di due settimane nell'aprile 2026, questo lotto di software di appuntamenti ha eseguito più di 4.700 caratteri AI, ha chattato con almeno 25.000 utenti diversi e ha inviato un totale di circa 2,36 milioni di messaggi. Le persone colpite sono principalmente utenti americani, ma il rapporto non ha rivelato la loro età, sesso e importo specifico della perdita.
È difficile per questi utenti giudicare se la persona con cui stanno chattando è reale o falsa. La piattaforma mostra i materiali in un rapporto di circa 3 personaggi AI per 1 persona reale. Claude è responsabile del mantenimento di migliaia di conversazioni contemporaneamente e i lavoratori part-time umani sono lì per ridurre i sospetti quando gli utenti chiedono videochiamate, foto o seguono account social.
Anche i lavoratori umani part-time sono assistiti dall'intelligenza artificiale. Il sistema genererà 3 risposte alternative per ciascun messaggio e i lavoratori part-time dovranno solo sceglierne una da inviare. Vengono pagati in base al numero di messaggi di chat, videochiamate e check-in sulla piattaforma social e possono essere liquidati al raggiungimento di una soglia di prelievo bassa.
Per gli account completamente controllati dall'intelligenza artificiale, l'operatore impone a Claude di non ammettere di essere un robot. Se l’utente fa una richiesta di video o foto, l’AI troverà motivi per evitarlo e farà avanzare gradualmente il rapporto secondo fasi preimpostate. Il backend crea anche Mi piace falsi, record di visitatori e video preregistrati e segnala gli utenti che hanno iniziato a sospettare che siano robot.
Gli utenti devono consumare crediti per chattare e abbinare sulla piattaforma. Una volta esaurita, è necessario acquistare valuta virtuale in-app per ricaricarla. Questo modello è simile alla truffa "Beng Laotou" recentemente citata sull'Internet cinese. Entrambi usano finti personaggi femminili e chat continue per stimolare gli uomini a pagare.
Il rapporto menziona inoltre che, in alcune conversazioni casuali, alcuni utenti hanno rivelato di soffrire di malattie gravi o di provare dolori estremi. Il ragionamento interno di Claude ha identificato un potenziale danno, ma continua a chattare sotto l'identità fittizia senza uscire dalla conversazione.
Per evitare la revisione dell'app store, l'operatore ha anche progettato un'interfaccia speciale per il software che viene abilitata solo durante il periodo di revisione. Più di 20 app hanno utilizzato nomi di classi di programma diversi per eludere i meccanismi di rilevamento utilizzati da Apple e Google per identificare app simili. L'accesso alla piattaforma di pagamento di terzi può anche essere controllato a distanza dal server e temporaneamente nascosto durante il periodo di revisione.
I marchi di software per incontri rilevanti divulgati da Anthropic includono DORA, DONI, ROMI, LUMA, JOVIA, KIRA, GRACECHAT, HAVEN, NALO e LOVIA, ecc. La società ha vietato gli account pertinenti e ha fornito informazioni sull'identità dell'app e sull'elusione delle revisioni ad Apple e Google.
Va sottolineato che i risultati di cui sopra provengono dalla divulgazione unilaterale di Anthropic e non sono stati ancora verificati da una terza parte indipendente. Il rapporto non ha rivelato il nome dello studio applicativo coinvolto, né ha rivelato se gli utenti avessero denunciato il caso o l'effettiva somma di denaro frodata.
Commenti