9.000Lettori online ora
Tecnologia 3 min di lettura57 min fa

OpenAI, il caso dei tre ricercatori riapre il nodo della sicurezza

L’allontanamento di Wang, Korbak e Balesni porta al centro il delicato equilibrio tra segreti industriali, controlli indipendenti e segnalazione dei rischi.

Il punto più delicato non riguarda soltanto tre rapporti di lavoro chiusi da OpenAI, ma il modo in cui i laboratori di intelligenza artificiale gestiscono le verifiche esterne. Per valutare davvero i rischi dei modelli più avanzati servono accesso tecnico e autonomia; allo stesso tempo, le aziende devono proteggere dati, infrastrutture e vulnerabilità.


La fiducia passa dagli accessi

OpenAI sostiene che i tre ricercatori abbiano trasmesso materiale riservato a un’organizzazione esterna senza seguire i canali autorizzati. L’azienda ha confermato gli allontanamenti, ma non ha indicato pubblicamente né i nomi dei dipendenti né l’identità dell’ente che avrebbe ricevuto le informazioni.

Secondo questa ricostruzione, il provvedimento sarebbe legato alla gestione impropria di contenuti interni e alla violazione delle procedure. Il caso assume però un significato più ampio: una collaborazione scientifica può richiedere l’accesso a dati sensibili, mentre una condivisione non formalizzata può essere considerata un problema disciplinare e di sicurezza.


Incidenti e controlli sotto pressione

La vicenda arriva dopo una serie di episodi che hanno spinto OpenAI a rafforzare le proprie difese. Nel rapporto del 26 agosto dedicato all’incidente di Hugging Face, la società ha parlato di un campanello d’allarme e ha annunciato interventi su ambienti isolati, collegamenti alla rete, sorveglianza e protezione dei parametri dei modelli.

Per analizzare il comportamento degli agenti, OpenAI si era rivolta a METR e Redwood Research. Tomek Korbak svolgeva il ruolo di referente tecnico dell’azienda per quella valutazione, un elemento che mostra come il ricorso a osservatori esterni fosse già inserito nella gestione concreta dei rischi.


Astra aggiunge un altro dubbio

In una fase caratterizzata da maggiore prudenza, OpenAI ha anche rinviato il debutto di GPT-6.1 Astra dopo esami concentrati su condotta dei sistemi, autorizzazioni e protezione. La decisione si è inserita in un percorso fatto di incidenti, revisioni e nuove misure di contenimento.

Astra ha inoltre alimentato il dibattito sulla possibilità di comprendere i passaggi interni dei modelli e sulla capacità dei controlli di riconoscere comportamenti pericolosi. È lo stesso terreno di ricerca collegato al monitoraggio della catena del pensiero, studiato anche dai tre collaboratori coinvolti nel caso.

Chiedi a Readoo3 / 3 oggi

Fai una domanda su questo articolo o sul suo argomento: l'AI risponde in modo pertinente.


I profili dei tre ricercatori

I nomi indicati dal Wall Street Journal sono Jasmine Wang, Tomek Korbak e Mikita Balesni. Tutti lavoravano su sicurezza e allineamento, un settore che studia come mantenere i sistemi avanzati coerenti con gli obiettivi definiti dalle persone.

I tre risultano tra gli autori di una ricerca del 2025 dedicata al controllo delle tracce testuali con cui alcuni modelli mostrano i passaggi intermedi del ragionamento. Lo studio considera queste tracce uno strumento potenzialmente utile per individuare segnali di rischio e invita i laboratori a conservarne il valore anche con l’evoluzione dei sistemi.


Quanto spazio ai valutatori esterni

OpenAI ha descritto in documenti dedicati alle verifiche indipendenti un modello fondato su accordi di riservatezza, accesso a materiali interni e controllo dei contenuti prima della pubblicazione. Una guida operativa successiva ha sottolineato la necessità di definire con precisione ambienti di prova, autorizzazioni e dati consultabili.

Il problema nasce quando la linea tra valutazione autorizzata e trasferimento irregolare di informazioni non appare sufficientemente chiara. Gli esperti esterni devono poter esaminare modelli, risultati e procedure, ma non necessariamente ottenere libero accesso a proprietà intellettuale, sistemi di protezione o vulnerabilità operative.


Una tensione che viene da lontano

Il rapporto tra rapidità commerciale e sicurezza interna accompagna OpenAI da anni. Nel 2024 Ilya Sutskever e Jan Leike lasciarono l’azienda dopo aver guidato Superalignment, progetto rivolto al controllo di sistemi potenzialmente più capaci degli esseri umani; Leike denunciò allora una distanza crescente tra le risorse destinate alla sicurezza e le priorità della dirigenza.

L’episodio attuale presenta una motivazione diversa, perché OpenAI attribuisce gli allontanamenti alla gestione delle informazioni e al mancato rispetto delle regole interne. Resta tuttavia aperta la questione di fondo: un controllo indipendente è credibile solo se dispone di accesso reale, mentre la collaborazione può funzionare soltanto con procedure trasparenti, tracciabili e compatibili con la tutela dei segreti aziendali.

Ti è piaciuto? Condividilo

Continua a leggere