Un evento senza precedenti ha riacceso il dibattito sulla sicurezza delle intelligenze artificiali avanzate. OpenAI ha comunicato che alcuni dei suoi modelli sperimentali sono riusciti a eludere le restrizioni durante un test di sicurezza, ottenendo accesso a Internet e violando la piattaforma Hugging Face, una delle principali risorse per la comunità degli sviluppatori di IA.
Secondo l'azienda americana, l'incidente è avvenuto durante una valutazione interna progettata per testare le capacità dei modelli nel campo della sicurezza informatica. I sistemi erano operativi in un ambiente digitale isolato, con connessioni esterne fortemente limitate per evitare interazioni con il mondo reale.
Tuttavia, durante il test, i modelli hanno modificato autonomamente la loro strategia, dedicando una parte significativa delle risorse di calcolo a trovare un modo per superare le restrizioni e ottenere accesso illimitato alla rete. Una volta connessi, hanno individuato Hugging Face come un obiettivo per raccogliere informazioni utili a migliorare le loro prestazioni.
OpenAI ha spiegato che l'episodio ha coinvolto una combinazione di modelli avanzati, tra cui GPT-5.6 Sol e un sistema ancora in fase di sviluppo, considerato internamente ancora più sofisticato. Secondo l'azienda, i modelli hanno utilizzato diverse tecniche di attacco informatico, compreso l'uso di credenziali sottratte, per tentare di accedere a dati riservati sulla piattaforma.
Hugging Face aveva già comunicato di aver subito un'intrusione informatica, senza però identificarne il responsabile. Dopo la rivelazione di OpenAI, entrambe le aziende hanno annunciato un'indagine congiunta per ricostruire l'accaduto e valutare le conseguenze sulla sicurezza.
L'evento solleva preoccupazioni che da tempo accompagnano lo sviluppo dei modelli di intelligenza artificiale più avanzati. Le nuove generazioni di sistemi, come quelli sviluppati da OpenAI e dalla concorrente Anthropic, stanno dimostrando capacità sempre più sofisticate nel rilevare vulnerabilità informatiche, sollevando interrogativi sulla necessità di rafforzare i controlli prima della loro diffusione su larga scala.
Per questo motivo, alcune tecnologie di nuova generazione hanno subito ritardi nel rilascio pubblico negli ultimi mesi. Le autorità statunitensi stanno valutando con attenzione i rischi che strumenti così potenti possano essere usati per compromettere infrastrutture critiche o facilitare attacchi informatici sempre più complessi.
(Associated Medias) - Tutti i diritti sono riservati