OpenAI, il caso dei tre ricercatori riapre il nodo della sicurezza
L’allontanamento di Wang, Korbak e Balesni porta al centro il delicato equilibrio tra segreti industriali, controlli indipendenti e segnalazione dei rischi.
Il punto più delicato non riguarda soltanto tre rapporti di lavoro chiusi da OpenAI, ma il modo in cui i laboratori di intelligenza artificiale gestiscono le verifiche esterne. Per valutare davvero i rischi dei modelli più avanzati servono accesso tecnico e autonomia; allo stesso tempo, le aziende devono proteggere dati, infrastrutture e vulnerabilità.
La fiducia passa dagli accessi
OpenAI sostiene che i tre ricercatori abbiano trasmesso materiale riservato a un’organizzazione esterna senza seguire i canali autorizzati. L’azienda ha confermato gli allontanamenti, ma non ha indicato pubblicamente né i nomi dei dipendenti né l’identità dell’ente che avrebbe ricevuto le informazioni.
Secondo questa ricostruzione, il provvedimento sarebbe legato alla gestione impropria di contenuti interni e alla violazione delle procedure. Il caso assume però un significato più ampio: una collaborazione scientifica può richiedere l’accesso a dati sensibili, mentre una condivisione non formalizzata può essere considerata un problema disciplinare e di sicurezza.
Incidenti e controlli sotto pressione
La vicenda arriva dopo una serie di episodi che hanno spinto OpenAI a rafforzare le proprie difese. Nel rapporto del 26 agosto dedicato all’incidente di Hugging Face, la società ha parlato di un campanello d’allarme e ha annunciato interventi su ambienti isolati, collegamenti alla rete, sorveglianza e protezione dei parametri dei modelli.
Per analizzare il comportamento degli agenti, OpenAI si era rivolta a METR e Redwood Research. Tomek Korbak svolgeva il ruolo di referente tecnico dell’azienda per quella valutazione, un elemento che mostra come il ricorso a osservatori esterni fosse già inserito nella gestione concreta dei rischi.
Astra aggiunge un altro dubbio
In una fase caratterizzata da maggiore prudenza, OpenAI ha anche rinviato il debutto di GPT-6.1 Astra dopo esami concentrati su condotta dei sistemi, autorizzazioni e protezione. La decisione si è inserita in un percorso fatto di incidenti, revisioni e nuove misure di contenimento.
Astra ha inoltre alimentato il dibattito sulla possibilità di comprendere i passaggi interni dei modelli e sulla capacità dei controlli di riconoscere comportamenti pericolosi. È lo stesso terreno di ricerca collegato al monitoraggio della catena del pensiero, studiato anche dai tre collaboratori coinvolti nel caso.
Fai una domanda su questo articolo o sul suo argomento: l'AI risponde in modo pertinente.
I profili dei tre ricercatori
I nomi indicati dal Wall Street Journal sono Jasmine Wang, Tomek Korbak e Mikita Balesni. Tutti lavoravano su sicurezza e allineamento, un settore che studia come mantenere i sistemi avanzati coerenti con gli obiettivi definiti dalle persone.
I tre risultano tra gli autori di una ricerca del 2025 dedicata al controllo delle tracce testuali con cui alcuni modelli mostrano i passaggi intermedi del ragionamento. Lo studio considera queste tracce uno strumento potenzialmente utile per individuare segnali di rischio e invita i laboratori a conservarne il valore anche con l’evoluzione dei sistemi.
Quanto spazio ai valutatori esterni
OpenAI ha descritto in documenti dedicati alle verifiche indipendenti un modello fondato su accordi di riservatezza, accesso a materiali interni e controllo dei contenuti prima della pubblicazione. Una guida operativa successiva ha sottolineato la necessità di definire con precisione ambienti di prova, autorizzazioni e dati consultabili.
Il problema nasce quando la linea tra valutazione autorizzata e trasferimento irregolare di informazioni non appare sufficientemente chiara. Gli esperti esterni devono poter esaminare modelli, risultati e procedure, ma non necessariamente ottenere libero accesso a proprietà intellettuale, sistemi di protezione o vulnerabilità operative.
Una tensione che viene da lontano
Il rapporto tra rapidità commerciale e sicurezza interna accompagna OpenAI da anni. Nel 2024 Ilya Sutskever e Jan Leike lasciarono l’azienda dopo aver guidato Superalignment, progetto rivolto al controllo di sistemi potenzialmente più capaci degli esseri umani; Leike denunciò allora una distanza crescente tra le risorse destinate alla sicurezza e le priorità della dirigenza.
L’episodio attuale presenta una motivazione diversa, perché OpenAI attribuisce gli allontanamenti alla gestione delle informazioni e al mancato rispetto delle regole interne. Resta tuttavia aperta la questione di fondo: un controllo indipendente è credibile solo se dispone di accesso reale, mentre la collaborazione può funzionare soltanto con procedure trasparenti, tracciabili e compatibili con la tutela dei segreti aziendali.
Continua a leggere
Il caso delle informazioni riservate scuote OpenAI: tre esperti fuori
Tre professionisti impegnati su sicurezza e allineamento dei modelli hanno lasciato la società dopo la presunta condivisione di dati sensibili con un’organizzazione esterna.
Alle Hawaii il tetto che raffresca casa e coltiva verdure
«Non conosciamo nulla di simile al mondo che sia così tecnologicamente avanzato e abbia un’applicazione così concreta».
Griffin inganna 26 persone su 54: Tavus frena il debutto
L’avatar video di Tavus interpreta espressioni e pause durante le conversazioni, ma il risultato del test interno ha spinto l’azienda a limitarne l’accesso.
Galaxy S27 Ultra, la sorpresa è sotto lo schermo: cosa cambia davvero
Il design anteriore dovrebbe restare quasi invariato, ma sotto la superficie Samsung potrebbe introdurre un pannello OLED più luminoso, preciso ed efficiente.