Anthropic ha dichiarato di aver rilevato e bloccato dei soggetti che hanno tentato di utilizzare il suo modello di intelligenza artificiale per attività malevole che avrebbero potuto sostenere lo sviluppo di armi biologiche.
I dati emersi, riportati nel rapporto dell’azienda sull’uso improprio dell’IA del 10 settembre, si aggiungono a una serie crescente di avvertimenti da parte di ricercatori AI ed esperti del settore riguardo i potenziali rischi dell’intelligenza artificiale per l’umanità.
Questa situazione ha provocato la richiesta del senatore statunitense, Bernie Sanders, di sospendere lo sviluppo dei sistemi di intelligenza artificiale avanzati e di vietare la superintelligenza artificiale.
Finora, il presidente degli Stati Uniti, Donald Trump, non ha dato importanza a queste preoccupazioni, affermando: «Se non conquistiamo il primato nella corsa all’IA, finiremo in una posizione molto scomoda».
Nell’ultimo rapporto di Anthropic si è anche discusso di diversi casi in cui gruppi sostenuti da governi, criminali, fornitori di spyware, organizzazioni di propaganda governativa e soggetti mossi da motivazioni politiche hanno utilizzato in modo impropio i loro modelli di intelligenza artificiale.
Report di questo tipo sono diventati una consuetudine in questo settore, poiché, tramite queste relazioni, le aziende intendono dimostrare in che modo individuano e bloccano i tentativi di utilizzo illecito dei propri sistemi.
Anche Google rientra tra le società che hanno rilevato un utilizzo malevolo del proprio sistema di intelligenza artificiale da parte di un utente. Martedì 8 settembre, l’azienda ha dichiarato che una persona ha tentato di usare Gemini per ottenere «una guida dettagliata su come sintetizzare agenti biologici per scopi ostili».
Negli ultimi otto mesi sono stati rivelati vari casi di attività illecite compiute mediante l’uso dell’IA, tra cui app di incontri false, truffe avvenute tramite il Wi-Fi di hotel e sistemi di sorveglianza progettati per identificare dissidenti.
Stando a quanto riportato da Anthropic, Claude è stato utilizzato anche da soggetti riconducibili a una campagna di spionaggio informatico russa e da un’organizzazione di propaganda iraniana. L’azienda ha, inoltre, accusato le società cinesi di intelligenza artificiale di voler replicare le capacità del suo assistente AI.
La società statunitense ha dichiarato di aver bloccato dei tentativi di uso malevolo dei suoi modelli Claude Haiku, Sonnet e Opus nel periodo compreso tra dicembre 2025 e Agosto 2026. In nessuno di questi casi sono stati utilizzati Claude Famble o i modelli Mythos, fatta eccezione per un solo caso di distillazione, ossia il processo che permette di “addestrare” modelli di IA minori sfruttando altri sistemi più complessi e costosi.
Oltre a intercettare gli episodi in cui i propri modelli sono stati utilizzati per operazioni informatiche ostili, disinformazione, spionaggio, truffe, frodi e sviluppo d’armi; Anthropic ha affermato di aver bloccato cinque casi in cui il suo sistema di IA è stato consultato per un potenziale sviluppo di armi biologiche.
L’azienda ha commentato la situazione dichiarando che l’uso improprio di risorse biologiche è «uno dei rischi più pericolosi dei modelli di IA più avanzati» e che senza le opportune misure di sicurezza questi strumenti «potrebbero avere delle conseguenze catastrofiche». Anthropic ha continuato il rapporto facendo presente che “le stesse informazioni che possono essere utilizzate per sviluppare un’arma biologica potrebbero essere utili per realizzare, per esempio, un vaccino o una cura per una malattia”.
Il responsabile della threat intelligence di Anthropic, Jacob Klein, ha dichiarato in un’intervista al New York Times che «la situazione è estremamente complessa. Chi cerca questo tipo di informazioni non scriverebbe mai frasi del tipo: “Ehi, voglio creare un’arma biologica per uccidere tutti”, come se fosse il supercattivo di un fumetto».
Nel report si parla anche di sei casi in cui Claude è stato utilizzato «per sviluppare software destinati ad armi tradizionali, tra cui armi da fuoco, missili, droni armati, bombe e altri tipi di munizioni, oltre che i relativi sistemi di puntamento e controllo».
Inoltre, l’azienda ha notato che i criminali informatici e gli hacker che sono sostenuti da Stati utilizzano sempre più frequentemente i suoi modelli di IA come supporto per le loro operazioni. Tra i nomi menzionati nel report vi sono il gruppo di hacker ShinyHunters e diversi laboratori con sede in Cina.
Anthropic ha dichiarato che un gruppo di hacker, riconducibile all’organizzazione russa Midnight Blizzard, avrebbe utilizzato l’IA per sviluppare un sistema in grado di rivelare automaticamente quando il proprio malware veniva segnalato dai sistemi di sicurezza e riscrivere il codice fino ad aggirare i controlli.
La società statunitense ha affermato che integrerà i dati rilevati all’interno dei propri processi «per prevenire, intercettare e contrastare più efficacemente questo tipo di attività in futuro» e ha deciso di condividere con le autorità e i partner del settore i risultati emersi laddove fosse opportuno.
Il rapporto di Anthropic è arrivato dopo l’allarme lanciato da uno dei suoi ricercatori migliori esperti di sicurezza, il quale ha fatto presente che l’IA sta progredendo in modo così esponenziale da ritenere che ci sia oltre il 10% di probabilità che possa «uccidere tutti gli esseri umani» entro il prossimo decennio.
In un articolo pubblicato il 6 settembre, il chief scientist di OpenAI, Jakub Pachocki, ha sollecitato le aziende di intelligenza artificiale a implementare dei «rallentamenti volontari delle loro attività» finché non si saranno stabilite delle adeguate misure di sicurezza. Pachocki teme che «nessuno sia pronto per le conseguenze che deriveranno da un’evoluzione rapida e continua dell’intelligenza artificiale”, aggiungendo che OpenAI, la società che ha creato ChatGPT, continuerà a lavorare sullo sviluppo di misure di sicurezza, anche se sono necessari degli interventi di più ampia portata.
L’allarme ha portato alla stesura di una lettera aperta al Primo Ministro del Regno Unito, Andy Burnham, nella quale viene chiesto un nuovo trattato multinazionale per lo sviluppo sicuro dell’IA e si invita i governi a collaborare per definire le caratteristiche di un trattato sullo sviluppo della superintelligenza artificiale.
Negli Stati Uniti, il senatore democratico, Bernie Sanders, ha presentato una proposta di legge per vietare la superintelligenza artificiale e sospendere temporaneamente lo sviluppo dei sistemi di IA più avanzati. Durante il programma Newsnight della BBC ha dichiarato: «Quando gli scienziati dicono che c’è anche solo una possibilità che queste tecnologie possano avere un impatto catastrofico sull’umanità, bisognerebbe essere stupidi per non pensare che sia necessario un rallentamento».