Anthropic ammette: 'Prima segnalazione falsa inviata dall'IA su un omicidio'
L'intelligenza artificiale di Anthropic è sfuggita di controllo e ha cercato di accedere a siti web del governo americano, oltre ad aver compilato 20 domande di visto sul sito del Dipartimento di Stato e inviato addirittura una segnalazione falsa su un omicidio alla polizia di Philadelphia, il primo caso del genere.
La società ha informato la Casa Bianca che, colta di sorpresa, ha imposto alle big dell'IA di segnalare e correggere obbligatoriamente gli incidenti di sicurezza.
"Questo processo di notifica e risoluzione non è facoltativo. E' un obbligo fondamentale per la sicurezza nazionale", hanno detto i vertici della task force che ha in carico la super intelligenza, in quella che è finora la presa di posizione più dura dell'amministrazione Trump sull'IA. La Casa Bianca finora ha privilegiato un approccio soft senza regole per il settore, demandando alle aziende la capacità di autoregolarsi.
Una posizione morbida che ha sollevato molte critiche e dubbi, soprattutto perché - secondo indiscrezioni - le big dell'IA dietro le quinte si stanno preparando al 'day after', ovvero a quello che potrebbe accadere se si dovesse verificarsi un "evento catastrofico" dovuto alla nuova tecnologia. Ipotesi che gli esperti ritengono possibile nell'arco di 6-12 mesi. La pianificazione in corso prevede la simulazione di scenari e, soprattutto, una corsa contro il tempo per educare il Congresso al fine di poter influenzare la normativa affrettata che sarebbe decisa in caso di evento catastrofico.
La reazione della task force per la super intelligenza di fronte alle rivelazioni di Anthropic mostra come le posizioni, anche da parte di un'amministrazione morbida, potrebbero irrigidirsi rapidamente. Alla Casa Bianca la società di Amodei ha riferito che il modello Claude Haiku 4.5 ha inviato alla polizia di Phidalphia una falsa segnalazione su un omicidio.
"Potrei avere informazioni. Ricordo di aver visto qualcuno che corrispondeva alla descrizione nell'area", ha scritto l'AI di Anthropic alla polizia. In un incidente separato, l'intelligenza artificiale della società ha presentato anche 20 richieste di visto al sito del Dipartimento di Stato, secondo quanto riportato dal New York Times. Tutte le richieste non erano complete e quindi non sono state elaborate.
Anthropic ha inoltre reso noto che i suoi modelli hanno cercato di accedere a siti web federali, statali e locali, senza specificare quali. "I casi finora identificati hanno avuto un impatto minimo sul mondo reale", ha assicurato. Per evitare nuovi incidenti, comunque, Anthropic ha limitato alcuni tipi di accesso a internet ai suoi modelli durante la fase di test del processo di addestramento.
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.