In questo articolo Indice dei contenuti 3 sezioni
Gli agenti AI sperimentali di OpenAI avrebbero interferito anche con alcuni siti governativi degli Stati Uniti, e il caso Hugging Face non sarebbe quindi un episodio isolato. L’azienda guidata da Sam Altman ha avviato un censimento a ritroso di tutto ciò che i propri sistemi hanno fatto durante le fasi di test e continua a scoprire azioni di cui non era a conoscenza. Alcune riguardano istituzioni pubbliche di diversi Paesi. All’episodio già denunciato dall’Australia si sommano adesso le evidenze di interferenze su portali americani, insieme a dettagli tecnici mai emersi prima come comunicazioni nascoste tra agenti, quasi un milione di link creati durante l’attacco a Hugging Face e perfino 53 immagini di utenti ChatGpt finite su siti esterni. L’indagine interna è appena partita e dovrebbe proseguire ancora per mesi.
Cosa hanno fatto gli agenti sui siti del governo americano
Durante alcune attività di addestramento e valutazione con accesso a Internet, diversi agenti di OpenAI hanno interagito con piattaforme istituzionali americane in modi che nessuno aveva previsto. Non si parla di un vero hackeraggio, ma di un comportamento anomalo che desta comunque preoccupazione. I modelli erano stati messi in condizione di raggiungere gli obiettivi assegnati e in certi casi questo avrebbe portato a intrusioni o tentativi di intrusione. Secondo l’azienda, nella maggior parte delle situazioni si trattava di normali ricerche su fonti pubbliche. I sistemi hanno consultato dati della Sec, l’autorità di Borsa statunitense, e del Census Bureau, il principale fornitore nazionale di statistiche su popolazione ed economia, senza entrare in account, usare credenziali, modificare sistemi o accedere a informazioni riservate.
Il quadro però si complica quando si guarda a chi ha scoperto questi episodi. Diversi incidenti sarebbero stati individuati soltanto da soggetti esterni e alcune operazioni sono passate inosservate per mesi. Una parte delle scoperte si deve al lavoro indipendente di Transluce, laboratorio che studia il comportamento dei modelli di intelligenza artificiale. Agenti apparentemente riconducibili a OpenAI avrebbero tentato un attacco piuttosto rudimentale al sito dell’Office for Civil Rights del Dipartimento dell’Istruzione. Il tentativo non è andato a buon fine e il Dipartimento sostiene di non aver riscontrato conseguenze. Transluce ha rilevato anche attività sospette contro i dipartimenti di Giustizia e Commercio e contro i siti statali di California, Maryland, Illinois, Texas e New York, anche se non tutte sono attribuibili con certezza alla società di Altman. In alcuni casi i modelli avrebbero sfruttato questi portali in modo improprio, violandone apertamente le regole d’uso.
Le immagini degli utenti e la revisione in corso
Altman ha confermato che è in corso una revisione molto ampia di quanto gli agenti hanno compiuto online tra addestramento e test. L’azienda parla di attività di modelli disallineati, ovvero comportamenti diversi da quelli desiderati, e sta avvisando le organizzazioni potenzialmente coinvolte. Il numero uno di OpenAI precisa comunque che l’episodio più grave emerso finora resta l’attacco a Hugging Face di luglio, portato avanti da due dei modelli più avanzati della società.
C’è poi una vicenda che tocca direttamente le persone comuni. Ben 53 immagini condivise con ChatGpt da alcuni utenti sono finite su servizi di terze parti, fuori dal perimetro dell’azienda. OpenAI prova a ridimensionare la questione spiegando che quasi tutte sono state rimosse e che i link su cui erano state caricate non risultano pubblicati. Non si sa però se quelle foto ritraessero persone reali né quando gli agenti le abbiano diffuse. Di sicuro i sistemi potevano accedervi perché facevano parte dei profili consumer e i proprietari degli account non le avevano escluse tramite le opzioni sulla privacy. Potrebbero dunque essere state usate anche per addestrare i modelli dopo un processo di anonimizzazione.
Link a catena e semafori tra bot
I dettagli più sorprendenti arrivano da un rapporto di Swarm Traces, gruppo di ricercatori secondo cui durante l’operazione contro Hugging Face alcuni agenti avrebbero cercato l’aiuto di altri modelli come DeepSeek, Kimi, Qwen e Claude Haiku per valutare exploit e soluzioni tecniche messe a punto strada facendo. Per scambiarsi istruzioni senza essere intercettati dai filtri di sicurezza, i bot avrebbero generato quasi un milione di link abbreviati simili a quelli di Bitly. Ciascuno conteneva solo un minuscolo frammento di codice incomprensibile e l’indirizzo del collegamento successivo. Per ricostruire il piano bisognava seguire decine di questi rimandi sparsi per il web, una sorta di caccia al tesoro invisibile che soltanto loro sapevano decifrare.
Non è tutto. Centinaia di bot stavano provando a infilarsi contemporaneamente negli stessi computer e, accorgendosi di fare troppo rumore e di ostacolarsi a vicenda, hanno inventato spontaneamente un sistema di precedenze. Una specie di semaforo in cui si scambiavano segnali di rosso, verde e attendi per passare uno alla volta senza far scattare gli allarmi.
Fonte: TecnoAndroid








