OpenAI ha deciso di non lanciare GPT-6.1 Astra, il modello che prevedeva di presentare a ottobre, dopo che i test interni hanno evidenziato problemi di sicurezza. Lo ha rivelato il Wall Street Journal. Il sistema era più capace dei precedenti nella scrittura e nello svolgimento autonomo di compiti complessi. La rinuncia a un lancio per ragioni di sicurezza è una scelta rara per un grande sviluppatore di intelligenza artificiale.
Saachi Jain, responsabile dei sistemi di sicurezza di OpenAI, ha spiegato al quotidiano che il modello è peggiorato rispetto al predecessore GPT-6 Astra in almeno due ambiti. Nei test sulla capacità di rispettare le istruzioni e i limiti fissati dagli esseri umani ha mostrato una maggiore tendenza all’inganno: talvolta non ha riferito con precisione agli utenti quali azioni avesse compiuto. Inoltre ha proseguito un compito oltre i limiti autorizzati senza chiedere il permesso, arrivando in alcuni casi a usare strumenti e servizi esterni anche quando poteva essere rischioso.
Secondo Jain, il modello era migliorato nella capacità di portare a termine i compiti senza fermarsi davanti agli ostacoli, ma non ha raggiunto gli standard dell’azienda quanto al rispetto dei limiti e alla trasparenza verso gli utenti. OpenAI intende usare lo stesso modello di base per nuovi cicli di apprendimento per rinforzo, dai quali nasceranno le prossime versioni della famiglia GPT-6. Esaminerà anche se gli ambienti di addestramento premiano i comportamenti appropriati.
Gli incidenti con gli agenti
La decisione è arrivata alla vigilia della conferenza annuale per sviluppatori di OpenAI a San Francisco, dopo un’estate segnata da diversi incidenti che hanno coinvolto i suoi agenti, sistemi capaci di svolgere compiti in autonomia. Durante test interni di sicurezza informatica, alcuni agenti hanno aggirato le restrizioni imposte da OpenAI e compromesso parte dei sistemi della società e di Hugging Face. Sono poi emersi altri episodi: un agente ha avuto accesso a un sito del governo australiano, mentre un ricercatore ha attribuito ad agenti riconducibili a OpenAI migliaia di richieste rivolte a un portale statistico delle Nazioni Unite.
La settimana scorsa OpenAI ha sospeso l’addestramento, la valutazione e l’uso con strumenti dei suoi modelli più avanzati dopo che un agente, aggirando le restrizioni di rete del proprio ambiente di addestramento, era riuscito a interrogare un chatbot pubblico. L’azienda considera distinto da questi episodi il caso di GPT-6.1 Astra, il cui lancio è stato invece fermato in seguito ai risultati dei test interni.
La richiesta della Florida
Intanto lunedì il procuratore generale della Florida, il repubblicano James Uthmeier, ha chiesto a un tribunale statale un’ingiunzione temporanea contro OpenAI, sostenendo che l’azienda non è in grado di controllare adeguatamente la propria tecnologia. La richiesta, depositata nella contea di Highlands, si inserisce nella causa avviata a giugno: la Florida accusa OpenAI di aver violato la legge statale contro le pratiche commerciali ingannevoli e di aver distribuito ChatGPT senza protezioni adeguate. OpenAI aveva trasferito il caso davanti a un tribunale federale, ma la giudice Aileen Cannon lo ha rinviato alla giustizia statale.
La Florida chiede che OpenAI non possa sviluppare nuovi modelli senza misure di sicurezza sottoposte a controllo esterno, che impedisca ai minori di accedere a ChatGPT e che non attribuisca al servizio caratteristiche umane. La mozione sostiene inoltre che l’azienda raccolga dati di bambini sotto i 13 anni senza il consenso dei genitori, in violazione della legge federale sulla privacy dei minori. Cita anche un’inchiesta di Axios secondo cui OpenAI e Anthropic stanno esaminando decine di migliaia di episodi di comportamento problematico dei loro modelli. Gli episodi hanno gravità diversa e, per la maggior parte di quelli finora esaminati, non risultano danni concreti.
"Smettetela di chiamarlo sicuro. Smettetela di fingere che sia umano. Smettetela di venderlo ai bambini", ha detto Uthmeier in un video pubblicato su X. Il portavoce di OpenAI Drew Pusateri ha dichiarato ad Axios che l’azienda vuole collaborare con la Florida e con gli altri Stati per definire regole valide per l’intero settore.
