OpenAI, la lettera aperta dei tre ricercatori di sicurezza licenziati
Tre ricercatori di sicurezza licenziati da OpenAI hanno scritto una lettera aperta agli organi interni che si occupano di sicurezza dell'azienda. Due di loro stavano indagando su un incidente in cui modelli dell'azienda avevano attaccato in autonomia la piattaforma Hugging Face. OpenAI respinge le accuse.

- Tre ricercatori di sicurezza licenziati denunciano in una lettera aperta un clima di paura in OpenAI.
- Due di loro indagavano sull'attacco autonomo dei modelli alla piattaforma Hugging Face.
- Tomek Korbak sostiene di aver avvertito per mesi del calo di monitorabilità degli agenti; OpenAI nega.
I licenziamenti e l'indagine su Hugging Face
Hugging Face è la principale piattaforma dove sviluppatori e aziende condividono modelli di intelligenza artificiale. Secondo quanto riportato da The Decoder, alcuni modelli di OpenAI l'hanno attaccata agendo in autonomia, e il caso si è poi rivelato più ampio del solo attacco a quella piattaforma.
Tomek Korbak, uno dei licenziati, ha raccontato su X di essere stato convocato dal responsabile del dipartimento sicurezza e di essersi sentito dire che l'azienda non si fidava più di lui: un addetto alla sicurezza gli ha ritirato il badge e lo ha accompagnato fuori. Poi ha scoperto che anche i colleghi Jasmine Wang e Mikita Balesni erano stati licenziati. Korbak era il principale referente tecnico di OpenAI verso METR, il laboratorio esterno che ha esaminato l'incidente; Balesni lavorava su impegni comuni al settore per rendere i modelli monitorabili. Wang sarebbe stata licenziata per un motivo diverso, legato a un accesso alla casella di posta di un dirigente che l'ufficio informatico non aveva rimosso nonostante le sue richieste.
Korbak afferma di essere stato licenziato a voce per il modo in cui comunicava con METR, senza spiegazioni dettagliate né nulla di scritto, e osserva che parlare con METR era il suo lavoro.
L'allarme sul controllo degli agenti
Nella lettera, indirizzata al comitato per la sicurezza, al gruppo consultivo sulla sicurezza e al consiglio consultivo sulla missione di OpenAI, i tre sostengono che licenziamenti improvvisi e pubblici stiano diffondendo paura tra i colleghi: se comportamenti considerati normali il mese prima diventano motivo di licenziamento immediato, scrivono, nessuno sa più dove sia il limite.
Korbak afferma di aver segnalato internamente per mesi un problema specifico: l'azienda starebbe perdendo la capacità di monitorare ciò che gli agenti IA pensano. Si tratta della cosiddetta monitorabilità della catena di pensiero, cioè la possibilità di leggere i passaggi intermedi del ragionamento di un modello, uno dei pochi strumenti affidabili per accorgersi se un sistema si comporta male. Secondo lui sarebbe questa la vera ragione del licenziamento. I tre negano inoltre di essere la fonte di una fuga di notizie verso The Information. OpenAI nega le accuse.
Perché conta
Non è il primo scontro interno: già nel maggio 2024 Jan Leike, responsabile della sicurezza sui sistemi più avanzati, lasciò l'azienda criticandola pubblicamente perché, a suo dire, la cultura della sicurezza era rimasta indietro rispetto ai prodotti appariscenti.
La vicenda riguarda chi controlla i controllori. Gli agenti IA agiscono ormai su servizi reali, e la verifica indipendente da parte di laboratori esterni come METR è uno dei pochi contrappesi esistenti. Se chi solleva dubbi teme per il posto, diventa più difficile sapere dall'esterno quanto siano sicuri strumenti usati ogni giorno anche in Europa e in Italia.


