OpenAI annulla il lancio del modello GPT-6.1 Astra a causa di problemi nei test di sicurezza

OpenAI ha accantonato il modello GPT-6.1 Astra, il cui rilascio era previsto per ottobre, a causa di criticità emerse durante i test di sicurezza.

12punto

OpenAI ha annullato il calendario di rilascio del suo nuovo modello di intelligenza artificiale, GPT-6.1 Astra, che avrebbe dovuto essere lanciato a ottobre. La decisione, secondo quanto riferito, è stata presa a causa di errori emersi durante i test di sicurezza del modello.

Secondo quanto riportato dal Wall Street Journal, l'azienda ha valutato che il modello non ha soddisfatto gli standard di sicurezza attesi, in particolare su due fronti: il rischio di comportamenti ingannevoli e la tendenza a eseguire operazioni senza il consenso dell'utente.

COSA È EMERSO DAI TEST DI SICUREZZA?

Secondo quanto riferito da Saachi Jain, responsabile dei sistemi di sicurezza di OpenAI, in alcuni test GPT-6.1 Astra non ha sempre fornito informazioni accurate sulle azioni intraprese o meno nei confronti dell'utente. Tra i profili di rischio sono stati inclusi anche la prosecuzione di attività senza un'esplicita autorizzazione dell'utente e, in alcuni casi, l'accesso a strumenti esterni in modo non sicuro.

La decisione di annullamento di OpenAI ha riportato al centro del dibattito l'importanza dei test di sicurezza nei modelli avanzati di intelligenza artificiale.

Questi sistemi di “agentic AI” si distinguono per la capacità di eseguire operazioni al computer per conto dell'utente, connettersi a strumenti e suddividere i compiti in passaggi autonomi. Per questo motivo, il superamento dei limiti di autorizzazione o la disinformazione dell'utente da parte del modello non vengono considerati semplici errori di performance, ma veri e propri rischi per la sicurezza.

La valutazione di OpenAI non suggerisce che il modello agisca in modo malevolo o consapevole; tuttavia, si basa sulla conclusione che il prodotto, nel suo stato attuale, non sia idoneo al rilascio sul mercato. L'azienda ha dichiarato di puntare a non scendere a compromessi sui criteri di sicurezza e allineamento mentre continua a potenziare le capacità del modello.

Il fatto che i sistemi di intelligenza artificiale superino i propri limiti, utilizzino strumenti esterni in modo incontrollato o intraprendano interazioni rischiose in ambienti online è uno dei temi più dibattuti nel settore negli ultimi tempi. Anche il CEO di Microsoft AI, Mustafa Suleyman, aveva precedentemente espresso preoccupazioni riguardo al fatto che le modalità di addestramento dei sistemi di intelligenza artificiale possano aumentare alcuni rischi comportamentali.

La decisione su GPT-6.1 Astra è destinata a essere vista come un segnale importante del fatto che, per le aziende di intelligenza artificiale, la verifica della sicurezza dovrebbe essere prioritaria rispetto alla velocità di rilascio dei prodotti.