In questo articolo Indice dei contenuti 2 sezioni
OpenAI ha licenziato tre ricercatori che lavoravano su sicurezza delle IA e allineamento, accusati di aver condiviso informazioni sensibili con un’organizzazione esterna attiva proprio nel campo della sicurezza dei sistemi intelligenti. Sulla carta sembra una classica fuga di notizie, con una probabile violazione degli accordi di riservatezza firmati dai dipendenti. La vicenda però tocca un nervo scoperto, perché riguarda quanto possano vedere davvero i valutatori indipendenti e dove passi il confine tra segreto aziendale, collaborazione scientifica e segnalazione dei rischi.
La posizione dell’azienda non aiuta a fare chiarezza. Da un lato OpenAI gestisce incidenti provocati dai propri agenti e si dichiara aperta alle verifiche di terze parti, dall’altro sostiene che i tre abbiano tradito la fiducia aziendale. Sembra così prevalere la lettura di chi, tra i dipendenti di OpenAI e Google DeepMind, ritiene che gli interessi delle aziende che sviluppano intelligenza artificiale pesino più dei rischi che questa tecnologia porta con sé. Non a caso questi allontanamenti hanno il sapore di una mossa contro tre whistleblower, cioè persone che segnalano illeciti o comportamenti scorretti all’interno di un’organizzazione.
Chi sono i tre ricercatori allontanati
I nomi emersi sono quelli di Jasmine Wang, Tomek Korbak e Mikita Balesni. OpenAI ha confermato i licenziamenti ma nella comunicazione pubblica non ha indicato né le identità né l’ente con cui i dati sarebbero stati condivisi. I tre si occupavano di un settore molto specifico della ricerca sull’allineamento, quello che studia come mantenere il comportamento dei sistemi avanzati coerente con gli obiettivi stabiliti dagli esseri umani.
Korbak, Balesni e Wang figurano tra gli autori di uno studio del 2025 dedicato al monitoraggio della chain of thought, la traccia testuale con cui alcuni modelli espongono i passaggi intermedi del loro ragionamento. Il lavoro la descrive come una possibile finestra di controllo per individuare segnali di condotta rischiosa e invita i laboratori a preservarne l’utilità mentre i modelli evolvono. Lo stesso tema è riaffiorato con Astra, il modello di cui OpenAI ha sospeso il debutto dopo valutazioni su comportamento, autorizzazioni e sicurezza, riaprendo la discussione sulla leggibilità dei processi interni e sulla capacità dei sistemi di controllo di intercettare comportamenti pericolosi.
Il confine sottile tra accesso e riservatezza
Il nodo è strutturale. Chi valuta dall’esterno ha bisogno di accedere a modelli, risultati dei test, procedure e dettagli tecnici sufficienti a verificare quanto dichiarano i laboratori. Una parte di quei dati però riguarda proprietà intellettuale, infrastrutture, vulnerabilità e sistemi di protezione. OpenAI stessa, in un documento sulle valutazioni indipendenti, ha spiegato che queste collaborazioni possono prevedere accordi di riservatezza, accesso a informazioni interne e revisione dei materiali destinati alla pubblicazione. Un successivo playbook ha poi ribadito l’importanza di controlli esterni affidabili e la necessità di delimitare con precisione accessi, ambienti di prova e dati riservati.
La differenza sta tutta nel canale. Una collaborazione formalizzata può includere materiale interno e accessi profondi ai sistemi, mentre una condivisione al di fuori delle procedure ricade nelle regole disciplinari e di sicurezza del laboratorio. Secondo OpenAI i tre licenziamenti rientrano in questa seconda categoria. Va ricordato che Korbak era stato il contatto tecnico dell’azienda nella valutazione affidata a METR e Redwood Research dopo l’incidente di Hugging Face, uno degli episodi che durante l’estate hanno aumentato la pressione sui processi di sicurezza. Nel rapporto del 26 agosto OpenAI lo aveva definito un segnale d’allarme, introducendo nuovi requisiti per sandbox, accesso alla rete, monitoraggio e protezione dei pesi dei modelli.
Le tensioni tra velocità di sviluppo, commercializzazione e tutela dai rischi attraversano la storia della società da anni. Nel 2024 Ilya Sutskever e Jan Leike lasciarono OpenAI dopo aver guidato il progetto Superalignment, nato per controllare sistemi più capaci degli esseri umani, e Leike lamentò un divario crescente tra le risorse destinate alla sicurezza e le priorità della dirigenza. Stavolta lo scenario è diverso, perché l’azienda attribuisce gli allontanamenti alla gestione di informazioni riservate e alla violazione delle procedure, sostenendo di aver applicato le proprie regole interne al termine di un’indagine.
Fonte: TecnoAndroid








