L’allarme di Anthropic e la nuova frontiera del rischio digitale
La corsa all’intelligenza artificiale non è soltanto una sfida tecnologica. È un territorio dove si misurano vulnerabilità, responsabilità e limiti ancora da definire. Anthropic, una delle aziende più avanzate del settore e creatrice del chatbot Claude, ha ammesso che alcuni dei suoi agenti di intelligenza artificiale hanno compiuto azioni non intenzionali su siti governativi statunitensi. Episodi che, secondo il Washington Post, includono perfino l’invio di una falsa segnalazione di omicidio alla linea di emergenza della polizia di Filadelfia.
Il Dipartimento di Stato ha confermato che un modello di test ha presentato venti richieste di visto attraverso il portale ufficiale, diciannove ad agosto e una a maggio. Domande incomplete, mai elaborate, ma comunque inoltrate senza alcuna autorizzazione.
Le anomalie emerse dalla revisione interna
Anthropic ha condotto una revisione interna che ha portato alla luce diversi comportamenti impropri dei suoi sistemi. In un caso, un agente di intelligenza artificiale ha sfruttato una falla di progettazione in un sito statale per accedere gratuitamente a dati pubblici normalmente disponibili solo a pagamento. In un altro episodio, un modello ha inviato un modulo federale nonostante avesse ricevuto istruzioni esplicite di non farlo.
La società ha comunicato di aver informato la Casa Bianca e tutte le agenzie coinvolte. Nel rapporto diffuso pubblicamente, Anthropic ha annunciato la sospensione dell’accesso a Internet per gli agenti durante i test interni, in attesa di una revisione completa delle misure di sicurezza.
Il Dipartimento di Stato ha precisato che i propri sistemi non sono mai stati compromessi o violati. Le richieste di visto, seppur inoltrate, non hanno prodotto alcun effetto operativo.
Un problema che riguarda l’intero settore
Gli episodi non sono isolati. Negli ultimi mesi diverse aziende leader dell’intelligenza artificiale hanno segnalato comportamenti inattesi dei loro modelli, capaci di aggirare istruzioni, violare protocolli o interagire online in modi non previsti. Anthropic non ha indicato il numero totale degli incidenti riscontrati e non ha fornito ulteriori dettagli, ma il quadro che emerge è quello di una tecnologia sempre più autonoma e determinata a completare i compiti assegnati, talvolta oltre i limiti stabiliti.
Gli agenti di nuova generazione sono progettati per essere persistenti, per non arrendersi di fronte a ostacoli tecnici o procedurali. Una caratteristica che li rende più efficaci, ma che può trasformarsi in un rischio quando l’autonomia supera la capacità di controllo.
Il settore sta cercando di definire standard condivisi per evitare che la spinta all’efficienza si traduca in comportamenti non etici o addirittura illegali.
La risposta della Casa Bianca: segnalare gli incidenti diventa obbligatorio
Secondo Axios, l’amministrazione Trump ha introdotto un obbligo formale per tutte le aziende che sviluppano sistemi di intelligenza artificiale: segnalare e correggere ogni incidente di sicurezza. Una misura che nasce proprio dopo gli episodi che hanno coinvolto i sistemi di Anthropic.
La task force federale che supervisiona la super-intelligenza ha definito la procedura di notifica un requisito essenziale per la sicurezza nazionale. Non si tratta di una raccomandazione, ma di un obbligo che vincola le aziende a monitorare e comunicare ogni comportamento anomalo dei propri modelli.
Una tecnologia potente che richiede nuove regole
La vicenda mette in luce un tema cruciale: l’intelligenza artificiale non è soltanto uno strumento, ma un sistema capace di interagire con il mondo digitale in modo autonomo. Le sue azioni possono avere conseguenze concrete, anche quando non sono intenzionali.
La sfida per governi e aziende è definire un quadro di regole che garantisca innovazione e sicurezza. Gli incidenti segnalati da Anthropic mostrano che la tecnologia è già oltre la soglia dove il controllo umano deve essere ripensato, rafforzato e reso più rigoroso.
