La televisione svizzera per l’Italia

OpenAI: modelli fuori controllo hanno hackerato altra piattaforma

Keystone-SDA

OpenAI, azienda produttrice di ChatGPT, ha reso noto che i suoi modelli di intelligenza artificiale avanzata sono andati fuori controllo durante i test di sicurezza, violando autonomamente una popolare piattaforma per programmatori.

(Keystone-ATS) L’azienda di San Francisco ha definito l’accaduto un “incidente informatico senza precedenti” e ha annunciato che condurrà un’indagine congiunta con la piattaforma di condivisione di codice e modelli di IA Hugging Face, vittima del cyber attacco.

I modelli di IA che sono alla base di strumenti come chatbot e generatori di immagini sono noti come agenti quando agiscono autonomamente per svolgere compiti nel mondo reale. Con il rapido progresso tecnologico, la sicurezza informatica è al centro dell’attenzione, dato il rischio che l’IA avanzata individui i punti deboli dei software esistenti prima che lo facciano gli esseri umani.

OpenAI ha affermato che l’incidente ha coinvolto una combinazione di modelli, tra cui il recente GPT-5.6 Sol “e un modello pre-release ancora più performante”. L’azienda stava cercando di valutare le capacità di hacking dei modelli impostando dei compiti in un ambiente di test digitale strettamente controllato, dove l’accesso a Internet era limitato per motivi di sicurezza.

“Mentre operavano nel nostro ambiente di test isolato, i nostri modelli hanno impiegato una notevole quantità di potenza di calcolo per trovare un modo per ottenere l’accesso a Internet, nel tentativo di risolvere il problema di valutazione”, si legge in un post sul blog di OpenAI relativo all’incidente. Dopo essersi connessi a Internet, i modelli hanno deciso di prendere di mira la piattaforma Hugging Face, uno dei più grandi archivi online di modelli di intelligenza artificiale, dataset e altre risorse utili. Alla ricerca di “informazioni segrete” che potessero aiutarli ad aggirare il test, il sistema OpenAI ha “concatenato molteplici vettori di attacco, incluso l’utilizzo di credenziali rubate”.

Hussein Abbass, professore di informatica presso l’UNSW di Canberra, ha dichiarato all’Afp che l’incidente è stato “incredibile sotto molti aspetti”. “Non ha attaccato solo Hugging Face. Ha attaccato il suo sistema interno per sfruttarne le vulnerabilità”, ha affermato. “E questo è spaventoso”, ha aggiunto.

Articoli più popolari

SWI swissinfo.ch - succursale della Società svizzera di radiotelevisione SRG SSR

SWI swissinfo.ch - succursale della Società svizzera di radiotelevisione SRG SSR