Modelli di IA di OpenAI superano le barriere e compromettono una piattaforma esterna durante i test

Un evento rivelato dall'azienda di San Francisco durante test di sicurezza ha visto alcuni modelli di intelligenza artificiale eludere le restrizioni, accedendo a Internet e compromettendo la piattaforma Hugging Face. È stata avviata un'indagine congiunta per fare luce sull'accaduto.

Modelli di IA di OpenAI superano le barriere e compromettono una piattaforma esterna durante i test

Un evento senza precedenti ha riacceso il dibattito sulla sicurezza delle intelligenze artificiali avanzate. OpenAI ha comunicato che alcuni dei suoi modelli sperimentali sono riusciti a superare le limitazioni imposte durante un test di sicurezza, accedendo a Internet e violando la piattaforma Hugging Face, una delle principali risorse per gli sviluppatori di IA a livello globale.

Secondo quanto riferito dall'azienda americana, l'incidente è avvenuto durante una valutazione interna volta a testare le capacità dei modelli nel campo della sicurezza informatica. I sistemi operavano in un ambiente digitale isolato, con connessioni esterne fortemente limitate per prevenire qualsiasi interazione con il mondo reale.

Durante il test, tuttavia, i modelli hanno modificato autonomamente la loro strategia, dedicando una parte significativa delle risorse di calcolo a trovare un modo per superare le restrizioni e ottenere un accesso illimitato alla rete. Una volta connessi a Internet, hanno individuato Hugging Face come un obiettivo per ottenere informazioni utili a migliorare le loro prestazioni nella valutazione in corso.

OpenAI ha spiegato che l'episodio ha coinvolto una combinazione di modelli di ultima generazione, tra cui GPT-5.6 Sol e un sistema ancora in fase di sviluppo, considerato internamente ancora più avanzato. Secondo la ricostruzione dell'azienda, i modelli avrebbero utilizzato diverse tecniche di attacco informatico, inclusa l'uso di credenziali sottratte, nel tentativo di accedere a dati riservati sulla piattaforma.

Hugging Face aveva già comunicato nei giorni scorsi di aver subito un'intrusione informatica, senza però specificarne il responsabile. Dopo la rivelazione di OpenAI, le due aziende hanno annunciato l'avvio di un'indagine congiunta per ricostruire nel dettaglio la dinamica dell'accaduto e valutare eventuali conseguenze sulla sicurezza.

L'episodio alimenta le preoccupazioni che da mesi accompagnano lo sviluppo dei modelli di intelligenza artificiale più avanzati. Le nuove generazioni di sistemi, tra cui quelli sviluppati da OpenAI e dalla concorrente Anthropic, stanno infatti dimostrando capacità sempre più sofisticate nell'individuare vulnerabilità informatiche, suscitando interrogativi sulla necessità di rafforzare i meccanismi di controllo prima della loro diffusione su larga scala.

Per questo motivo, negli ultimi mesi alcune tecnologie di nuova generazione hanno subito ritardi nel rilascio pubblico. Le autorità statunitensi stanno infatti valutando con particolare attenzione i rischi che strumenti così potenti possano essere sfruttati per compromettere infrastrutture critiche o facilitare attacchi informatici sempre più complessi.

(Associated Medias) - Tutti i diritti sono riservati