Rapporto Anthropic: Claude utilizzato impropriamente per software bellici, operazioni informatiche e disinformazione

Anthropic ha reso noto che, nel periodo tra dicembre 2025 e agosto 2026, i modelli Claude sono stati utilizzati per lo sviluppo di software bellici, attacchi informatici, sorveglianza e frodi.

12punto

L'azienda di intelligenza artificiale Anthropic ha riferito che i modelli Claude sono stati utilizzati in modo improprio da diversi attori in ambiti che spaziano dai processi di sviluppo di armi convenzionali alle operazioni informatiche, dalla sorveglianza alle frodi.

Il rapporto pubblicato dall'azienda per rilevare e prevenire l'uso improprio dei propri modelli copre il periodo da dicembre 2025 ad agosto 2026. Nel documento viene indicato che gruppi sospettati di essere sostenuti da governi, attori criminali a scopo di lucro e istituzioni legate ad attività di propaganda hanno tratto vantaggio da modelli come Claude Haiku, Sonnet e Opus.

Anthropic ha annunciato che, negli esempi rilevati, gli account sono stati chiusi e che, in alcuni casi, le informazioni ottenute sono state condivise con enti pubblici e organizzazioni del settore privato.

SOFTWARE BELLICI E OPERAZIONI INFORMATICHE

Una delle sezioni più rilevanti del rapporto riguarda le scoperte sull'uso di Claude nei processi di sviluppo di software legati alle armi convenzionali. Secondo Anthropic, sono state identificate iniziative riguardanti software di puntamento e controllo per armi da fuoco, missili, droni armati, bombe e altre munizioni, oltre a sistemi che gestiscono tali armamenti.

Il team di threat intelligence dell'azienda ha indagato su numerosi attori che, l'anno scorso, hanno utilizzato Claude per produrre software destinato alla progettazione e allo sviluppo di armi, o per supportare attività di raccolta di informazioni e approvvigionamento propedeutiche ai programmi bellici. Nel rapporto si nota che tre di questi attori si trovano in Cina, due in Russia e uno nello Yemen.

Il rapporto indica che i modelli Claude sono stati menzionati in diversi esempi di uso improprio.

Anthropic ha riferito di aver rilevato che un gruppo operante nel nord dello Yemen ha utilizzato Claude Code in tre diversi programmi di sviluppo di armi, tra cui razzi guidati e vari tipi di missili. Secondo il rapporto, il gruppo ha sfruttato il modello per software di guida, navigazione e stabilizzazione dei vettori, nonché per processi di simulazione e test. L'azienda ha tuttavia sottolineato di non aver trovato prove che il gruppo sia riuscito a sviluppare un'arma operativa.

In un altro caso, è stato segnalato che un attore con sede in Cina ha utilizzato Claude per sviluppare un sistema d'arma anti-siluro. È stato affermato che l'attore ha sfruttato il modello per sviluppare alcune parti del software di controllo del fuoco, preparare piani di test e confrontare il sistema con i programmi di difesa sottomarina e anti-siluro degli Stati Uniti. Anthropic ha valutato che l'attività fosse collegata a un produttore dell'industria della difesa cinese.

Il rapporto include anche esempi relativi a operazioni informatiche. È stato indicato che le attività di spionaggio legate alla Russia hanno preso di mira principalmente l'intelligence militare dei governi ucraini ed europei. Si è inoltre registrato che attori ritenuti residenti in Cina hanno condotto tentativi di intrusione nei sistemi di produzione e attività di ricognizione contro reti governative straniere in Medio Oriente, Europa e Sud-est asiatico.

SORVEGLIANZA, FRODI E ACCUSE DI COPIATURA DEI MODELLI

Nel rapporto di Anthropic, anche le attività di sorveglianza sono state esaminate sotto un capitolo dedicato. È stato indicato che un account che prendeva di mira l'Iran e la regione del Golfo Persico nel giugno 2026 ha creato una piattaforma di sorveglianza per analizzare, classificare e profilare le attività sui social media degli utenti della regione. È stato annunciato che tale account è stato bandito.

Anthropic ha riferito che, nei tentativi di uso improprio, gli account sono stati chiusi e alcune informazioni sono state condivise con le parti interessate.

L'azienda ha dichiarato che l'indagine ha rivelato che l'account era gestito da, o per conto di, un'organizzazione chiamata "S2T Unlocking Cyberspace". Le ricerche su fonti aperte hanno indicato che l'organizzazione sarebbe un fornitore di intelligence di origine israeliano-singaporiana.

In un altro esempio di sorveglianza con base in Cina, è stato affermato che Claude è stato utilizzato come strumento automatizzato di "monitoraggio dell'opinione pubblica". Secondo il rapporto, l'utente ha sfruttato il modello per preparare briefing governativi che classificavano dissidenti, attivisti, minoranze etniche, la diaspora cinese e i media stranieri come minacce alla stabilità politica.

Per quanto riguarda le frodi, è stato segnalato che uno studio di applicazioni con sede in Cina ha creato una rete composta da oltre 20 app di incontri con l'aiuto di Claude. Nel rapporto si afferma che, nonostante fosse stato dichiarato che i servizi erano forniti interamente da esseri umani, sono stati sviluppati personaggi basati sull'intelligenza artificiale che chattavano con gli utenti. È stato registrato che sono stati identificati oltre 4.700 personaggi IA che hanno chattato con almeno 25 mila persone in un periodo di due settimane.

Il rapporto ha affrontato anche i tentativi di copiatura non autorizzata dei modelli di intelligenza artificiale.

Il rapporto include anche esempi relativi al metodo della "distillazione", che consiste nell'addestrare un modello di capacità inferiore utilizzando gli output di modelli di intelligenza artificiale più avanzati. Anthropic ha precisato che il metodo è una tecnica di addestramento comune nel campo dell'IA, ma diventa illegale quando ha lo scopo di copiare altri modelli senza autorizzazione.

L'azienda ha sostenuto che attori legati ad Alibaba hanno tentato di copiare illegalmente le capacità dei modelli e che questa attività rappresenta il più grande "attacco di distillazione illegale" registrato finora. Nel rapporto si ipotizza che siano state effettuate circa 3 milioni di operazioni al giorno da oltre 3.500 account falsi.

Anthropic ha inoltre condiviso esempi relativi a Moonshot AI, DeepSeek e Xiaomi. Mentre è stato indicato che alcuni utenti di Moonshot hanno inoltrato le proprie richieste a Claude invece che al proprio modello Kimi, nel rapporto si legge: "Gli utenti pensavano di utilizzare il modello Kimi, ma in realtà ricevevano risposte da Claude". È stato inoltre sostenuto che DeepSeek abbia analogamente reindirizzato le comunicazioni a Claude senza informare i propri clienti, e che Xiaomi abbia trasferito a Claude le chat degli utenti ottenute dai modelli MiMo.

Nella sezione sulle operazioni di influenza, è stata posta attenzione alle reti che producono contenuti ingannevoli attraverso profili social falsi e siti di notizie. Anthropic ha annunciato di aver identificato e rimosso un'operazione di manipolazione dell'informazione legata alla Russia nella Repubblica Centrafricana e una rete di disinformazione commerciale gestita da un'agenzia di pubblicità digitale con sede in Francia.