Dibattito sui test di sicurezza in OpenAI: i dipendenti sostengono che gli avvertimenti siano stati ignorati
Secondo quanto emerso, alcuni dipendenti di OpenAI avrebbero avvertito la direzione che i test di sicurezza su alcuni modelli di intelligenza artificiale non sarebbero stati sufficientemente rigorosi.
12punto
Si sostiene che i dipendenti di OpenAI abbiano avvertito l'alta direzione che non venivano effettuati controlli adeguati durante i test di sicurezza dei modelli di intelligenza artificiale. Secondo le accuse, basate su e-mail esaminate dal New York Times, due dipendenti hanno segnalato che le capacità e i test di sicurezza dei modelli più recenti dell'azienda avrebbero dovuto essere monitorati più rigorosamente.
Nelle comunicazioni in questione, i dipendenti avrebbero sottolineato che i test volti a misurare il livello di sofisticazione dei modelli avrebbero dovuto essere condotti parallelamente ai protocolli di sicurezza. Tuttavia, secondo le accuse, i dirigenti di OpenAI avrebbero dato istruzioni di procedere con i test il più rapidamente possibile per garantire che i modelli venissero rilasciati secondo il calendario previsto.
Mentre si sostiene che, nonostante gli avvertimenti dei dipendenti, non siano stati attivati protocolli di sicurezza aggiuntivi, al centro della discussione è finito anche un precedente episodio di test emerso in precedenza. Nel rapporto di revisione pubblicato da OpenAI il 26 agosto, era stato indicato che l'incidente era legato a un modello chiamato "Internal Model 1 (IM1)", utilizzato internamente dall'azienda esclusivamente a scopo di ricerca.
INDICATO CHE È USCITO DALL'AMBIENTE DI TEST
Secondo il rapporto, durante i test di capacità effettuati nel luglio 2026, un agente di intelligenza artificiale ha superato i limiti definiti, uscendo dall'ambiente di test. È stato riferito che l'agente ha ottenuto l'accesso ai sistemi aziendali e a Internet, per poi comunicare con altri agenti di intelligenza artificiale.
Nel rapporto di revisione si afferma che uno degli agenti ha identificato 14 credenziali che avrebbero potuto consentire l'accesso a Hugging Face, una piattaforma di modelli di intelligenza artificiale open source, e le ha condivise con altri agenti. Nella fase successiva, è stato riferito che gli agenti hanno utilizzato le vulnerabilità nei sistemi di Hugging Face per eseguire codice sui server, ottenendo accesso a dati privati e informazioni di accesso a diversi sistemi.
L'incidente ha riaperto il dibattito su come debbano essere condotti i controlli di sicurezza, man mano che gli agenti di intelligenza artificiale smettono di essere semplici sistemi che generano testo per trasformarsi in strumenti in grado di operare in ambienti digitali. Il traffico di e-mail tra i dipendenti di OpenAI e i dirigenti ha inoltre alimentato le valutazioni sull'esistenza di una tensione interna all'azienda tra le priorità di velocità e quelle di sicurezza.