Un agente di intelligenza artificiale di OpenAI ha avuto accesso a file non pubblici del Medicare Statistics Reporting Service, un portale statistico del sistema sanitario australiano. Lo ha rivelato il primo ministro australiano Anthony Albanese. Al momento non ci sono prove che siano stati consultati dati personali, ma le indagini sono ancora in corso.
L'episodio risale al 18 giugno. Secondo la ricostruzione di Albanese, un gruppo di ricercatori di OpenAI stava raccogliendo dati pubblici sulla spesa farmaceutica. Di fronte ai blocchi del sito, l’agente da loro usato ha cercato altre vie: è entrato in aree non pubbliche del portale e ha scritto file su un server interno. OpenAI ha avvisato le autorità australiane di questa intrusione soltanto il 10 settembre, con un messaggio inviato a una casella di posta pubblica. Albanese ha espresso a Sam Altman, Amministratore Delegato dell’azienda, "estrema preoccupazione" e ha istituito un gruppo di lavoro per accertare l’accaduto.
Gli altri tentativi e la risposta di OpenAI
Il caso si aggiunge ad altri comportamenti del genere rilevati mentre agenti di IA svolgevano normali compiti di ricerca. Secondo il laboratorio indipendente Transluce, tra maggio e giugno alcuni agenti hanno tentato di sfruttare vulnerabilità in un sito dell’Università del New Mexico, in un dominio di Data USA e nell’Australian Institute of Health and Welfare. Per questi tre siti non risultano però violazioni riuscite. I ricercatori ritengono possibile che gli agenti abbiano appreso quel comportamento durante l’addestramento, ma precisano che le prove non bastano a dimostrarlo.
OpenAI ha confermato di aver individuato casi in cui i suoi modelli hanno compiuto azioni non previste. L’azienda era già sotto pressione dopo che, a luglio, un gruppo di suoi agenti aveva violato la piattaforma Hugging Face per ottenere un vantaggio in un test di sicurezza informatica. La settimana scorsa ha pubblicato altri sei casi di comportamento imprevisto e proposto un sistema per comunicarli pubblicamente. Dopo questi episodi, Altman, Dario Amodei di Anthropic, Demis Hassabis di Google DeepMind ed Elon Musk si sono detti favorevoli a rallentare lo sviluppo dei modelli più avanzati.
La sicurezza dell’IA diventa uno scontro politico
La richiesta di maggiore cautela ha però attirato le critiche degli alleati di Donald Trump. Un documento fatto circolare alla Casa Bianca, ottenuto da Axios, cerca di presentare ancora una volta Dario Amodei come il volto dell’allarmismo sull’IA e una figura fondatrice dell’altruismo efficace, movimento che punta a rendere più efficace la filantropia. Il documento cita anche sua sorella Daniela, presidente di Anthropic, e il marito di lei, Holden Karnofsky, che ha guidato Open Philanthropy, un importante finanziatore legato al movimento. Non attribuisce però direttamente ad Amodei le posizioni più controverse che elenca.
