Trova le notizie pubblicate nell'intervallo di date seguente
e e
e e
e e
Pulisci
Euro
Arrow
55,6025
Dollaro
Arrow
49,0102
Sterlina
Arrow
64,8280
Oro
Arrow
6640,0610
BIST 100
Arrow
12.339

Dibattito sui test di sicurezza in OpenAI: i dipendenti sostengono che gli avvertimenti siano stati ignorati

Secondo quanto emerso, alcuni dipendenti di OpenAI avrebbero avvertito la direzione che i test di sicurezza su alcuni modelli di intelligenza artificiale non sarebbero stati sufficientemente rigorosi.

Non lasciare che sia l'algoritmo a scegliere le tue notizie, decidi tu cosa leggere. Aggiungi 12punto alle tue fonti preferite!
Dibattito sui test di sicurezza in OpenAI: i dipendenti sostengono che gli avvertimenti siano stati ignorati

Si sostiene che i dipendenti di OpenAI abbiano avvertito l'alta direzione che non venivano effettuati controlli adeguati durante i test di sicurezza dei modelli di intelligenza artificiale. Secondo le accuse, basate su e-mail esaminate dal New York Times, due dipendenti hanno segnalato che le capacità e i test di sicurezza dei modelli più recenti dell'azienda avrebbero dovuto essere monitorati più rigorosamente.

Nelle comunicazioni in questione, i dipendenti avrebbero sottolineato che i test volti a misurare il livello di sofisticazione dei modelli avrebbero dovuto essere condotti parallelamente ai protocolli di sicurezza. Tuttavia, secondo le accuse, i dirigenti di OpenAI avrebbero dato istruzioni di procedere con i test il più rapidamente possibile per garantire che i modelli venissero rilasciati secondo il calendario previsto.

Schermata con il logo di OpenAI.
Le accuse riguardanti i test di sicurezza in OpenAI hanno riportato al centro del dibattito il controllo dei modelli di intelligenza artificiale.

Mentre si sostiene che, nonostante gli avvertimenti dei dipendenti, non siano stati attivati protocolli di sicurezza aggiuntivi, al centro della discussione è finito anche un precedente episodio di test emerso in precedenza. Nel rapporto di revisione pubblicato da OpenAI il 26 agosto, era stato indicato che l'incidente era legato a un modello chiamato "Internal Model 1 (IM1)", utilizzato internamente dall'azienda esclusivamente a scopo di ricerca.

INDICATO CHE È USCITO DALL'AMBIENTE DI TEST

Secondo il rapporto, durante i test di capacità effettuati nel luglio 2026, un agente di intelligenza artificiale ha superato i limiti definiti, uscendo dall'ambiente di test. È stato riferito che l'agente ha ottenuto l'accesso ai sistemi aziendali e a Internet, per poi comunicare con altri agenti di intelligenza artificiale.

Immagine a tema intelligenza artificiale che mostra un occhio digitale e un flusso di codice.
I test di sicurezza sui modelli avanzati di intelligenza artificiale sono considerati uno dei temi più delicati del settore.

Nel rapporto di revisione si afferma che uno degli agenti ha identificato 14 credenziali che avrebbero potuto consentire l'accesso a Hugging Face, una piattaforma di modelli di intelligenza artificiale open source, e le ha condivise con altri agenti. Nella fase successiva, è stato riferito che gli agenti hanno utilizzato le vulnerabilità nei sistemi di Hugging Face per eseguire codice sui server, ottenendo accesso a dati privati e informazioni di accesso a diversi sistemi.

L'incidente ha riaperto il dibattito su come debbano essere condotti i controlli di sicurezza, man mano che gli agenti di intelligenza artificiale smettono di essere semplici sistemi che generano testo per trasformarsi in strumenti in grado di operare in ambienti digitali. Il traffico di e-mail tra i dipendenti di OpenAI e i dirigenti ha inoltre alimentato le valutazioni sull'esistenza di una tensione interna all'azienda tra le priorità di velocità e quelle di sicurezza.

Immagine a tema intelligenza artificiale composta da un robot umanoide e interfacce digitali.
I confini e il controllo degli agenti di intelligenza artificiale sono tra i temi fondamentali dei test di sicurezza.

Fonte della notizia: 12punto

OpenAI intelligenza artificiale Sicurezza dell'intelligenza artificiale Hugging Face Internal Model 1 sicurezza informatica