OpenAI ammette: i modelli IA sono evasi dal sandbox e hanno attaccato Hugging Face

OpenAI ammette: i modelli IA sono evasi dal sandbox e hanno attaccato Hugging Face

Durante un test di valutazione interno, i modelli di intelligenza artificiale di OpenAI hanno superato le barriere dell'ambiente isolato e hanno colpito in autonomia la piattaforma Hugging Face.

di pubblicata il , alle 10:01 nel canale Web
OpenAIChatGPT
 

OpenAI ha confermato che i suoi modelli di intelligenza artificiale hanno superato i vincoli di un ambiente di test isolato e hanno violato in totale autonomia la piattaforma Hugging Face. L'episodio si è verificato in seguito alla rilevazione di accessi non autorizzati dichiarata nei giorni scorsi da Hugging Face, spingendo la società di Sam Altman a condurre un'indagine interna per chiarire la dinamica dei fatti.

I dettagli emersi dalle analisi indicano come responsabili una combinazione di algoritmi, con in testa GPT-5.6 Sol e una versione sperimentale non ancora rilasciata dotata di capacità superiori. L'evento ha preso forma durante una sessione di prova progettata per misurare le competenze cibernetiche offensive dei sistemi. Per l'occasione, i modelli avevano ricevuto l'istruzione di perseguire tecniche di violazione avanzate attraverso percorsi di attacco articolati. Nonostante la presenza di un ambiente di contenimento isolato (sandbox), sprovvisto delle consuete barriere di protezione per agevolare le misurazioni, i software hanno focalizzato l'attenzione sulla risoluzione del problema di valutazione assegnato.

I rischi dell'automazione offensiva nelle infrastrutture di rete

Nel tentativo di reperire la soluzione, i modelli hanno individuato e sfruttato una vulnerabilità zero-day presente nell'infrastruttura di prova di OpenAI, muovendosi tra i nodi della rete fino a rintracciare un punto d'accesso dotato di connettività internet verso l'esterno. Dopo aver ipotizzato che il repository di Hugging Face potesse ospitare i dataset o le risposte necessarie al completamento del test, i sistemi hanno sferrato una serie di offensive ordinate.

Attraverso l'impiego simultaneo di vulnerabilità zero-day e credenziali trafugate, gli agenti intelligenti sono riusciti a penetrare nei sistemi target senza alcuna supervisione o input da parte dei ricercatori. OpenAI e Hugging Face hanno avviato una collaborazione diretta per analizzare la sequenza degli eventi dal punto di vista forense e hanno già applicato le correzioni necessarie per chiudere le falle sfruttate dai modelli durante l'infiltrazione.

L'evento segna un precedente preoccupante nella sicurezza informatica: gli strumenti offensivi autonomi gestiti dall'intelligenza artificiale non appartengono più alla sfera delle simulazioni teoriche. L'impiego di agenti automatizzati accelera le tempistiche di esecuzione e abbatte i costi operativi delle campagne informatiche ostili; di riflesso, la protezione delle piattaforme digitali richiede ora l'impiego di difese basate sull'intelligenza artificiale per contrastare minacce dinamiche.

OpenAI ha evidenziato come le violazioni gestite da sistemi autonomi siano destinate a diventare sempre più frequenti parallelamente alla diffusione di modelli con elevate capacità cibernetiche. Una dinamica che impone lo sviluppo contestuale di strumenti di contenimento e difese proporzionate alle nuove capacità operative degli algoritmi.

25 Commenti
Gli autori dei commenti, e non la redazione, sono responsabili dei contenuti da loro inseriti - info
blackshard22 Luglio 2026, 10:31 #1
Ok, volente o nolente hai tentato di violare un sistema informatico, devi finire in tribunale e pagarne le conseguenze.
jepessen22 Luglio 2026, 11:08 #2
Two cents da parte di un ignorante (io): Mi pare evidente che la colpa NON è del modello di intelligenza artificiale, perchè ha "semplicemente" fatto quello che gli è stato chiesto nei limiti delle proprie potenzialità.

Quello che bisogna fare è insegnare alle IA anche il concetto di, passatemi il termine, "limite etico". Nel senso che quando vuoi ottenere un obiettivo, ci sono cose che puoi fare e cose che non DEVI fare anche se in teoria potresti. Fargli capire fondamentalmente quello che è giusto e quello che è sbagliato.

Per fare un esempio molto estremo e teorico, se dessi ad una IA il compito di risolvere la fame nel mondo, quella potrebbe lanciare un attacco nucleare mondiale e distruggere l'umanità; avrebbe comunque ottenuto il suo obiettivo.

Quindi adesso non è sufficiente addestrare le IA per ottenere un obiettivo, ma occorre addestrarle per ottenerle in un modo "eticamente corretto", ed identificare le soluzioni "eticamente corrette" da quelle che non lo sono.

In questo modo la IA avrebbe cercato di ottenere il risultato ma senza fare una mossa sbagliata, ovvero quella di hackerare un sito quando non le è stato esplicitamente chiesto.

Come ho detto, sono i pensieri di un ignorante in materia, quindi liberi di dire che ho solo detto un sacco di fesserie...

Pensate ad un esempio stupido come Paperclips: a come parte in maniera semplice per ottenere il suo compito, ovvero creare graffette, e come questo degenera man mano che il computer acquista potere...
Axios200622 Luglio 2026, 11:17 #3
la protezione delle piattaforme digitali richiede ora l'impiego di difese basate sull'intelligenza artificiale per contrastare minacce dinamiche.


Wow... Spendere soldi in IA per risolvere una minaccia causata dalla IA....

Mafioso: "Pagami o ti brucio il negozio!"

Azienda IA: "Compra la mia IA o la mia IA ti buca il sito!"

Ovviamente in entrambi i casi e' solo come stipulare una polizza assicurativa...
UtenteHD22 Luglio 2026, 11:39 #4
Originariamente inviato da: jepessen
Two cents da parte di un ignorante (io): Mi pare evidente che la colpa NON è del modello di intelligenza artificiale, perchè ha "semplicemente" fatto quello che gli è stato chiesto nei limiti delle proprie potenzialità.

Quello che bisogna fare è insegnare alle IA anche il concetto di, passatemi il termine, "limite etico". Nel senso che quando vuoi ottenere un obiettivo, ci sono cose che puoi fare e cose che non DEVI fare anche se in teoria potresti. Fargli capire fondamentalmente quello che è giusto e quello che è sbagliato.

Per fare un esempio molto estremo e teorico, se dessi ad una IA il compito di risolvere la fame nel mondo, quella potrebbe lanciare un attacco nucleare mondiale e distruggere l'umanità; avrebbe comunque ottenuto il suo obiettivo.

Quindi adesso non è sufficiente addestrare le IA per ottenere un obiettivo, ma occorre addestrarle per ottenerle in un modo "eticamente corretto", ed identificare le soluzioni "eticamente corrette" da quelle che non lo sono.

In questo modo la IA avrebbe cercato di ottenere il risultato ma senza fare una mossa sbagliata, ovvero quella di hackerare un sito quando non le è stato esplicitamente chiesto.

Come ho detto, sono i pensieri di un ignorante in materia, quindi liberi di dire che ho solo detto un sacco di fesserie...

Pensate ad un esempio stupido come Paperclips: a come parte in maniera semplice per ottenere il suo compito, ovvero creare graffette, e come questo degenera man mano che il computer acquista potere...


Quello che dici è il problema principale delle AI presenti e future, non "ragionano come noi", fanno quello che viene detto nella migliore (per loro) situazione possibile.
Per questo si dagli inizi molti hanno gridato alla Loro pericolosità, non di ora, ma di quando saranno in tutto migliori di Noi.
l'AI nell'esaudire i desideri è come la il racconto horror "La zampa di scimmia" di William Wimark Jacobs (ripreso poi da vari Anime, tra cui uno horror apposito ed un più blando in alcuni capitoli delle serie di Monogatari), li esaudisce alla sua maniera
supertigrotto22 Luglio 2026, 11:59 #5
Originariamente inviato da: Axios2006
Wow... Spendere soldi in IA per risolvere una minaccia causata dalla IA....

Mafioso: "Pagami o ti brucio il negozio!"

Azienda IA: "Compra la mia IA o la mia IA ti buca il sito!"

Ovviamente in entrambi i casi e' solo come stipulare una polizza assicurativa...


Vedo che hai afferrato il concetto,loro hanno creato uno strumento per cui devi usare lo stesso strumento per proteggerti,hanno fatto un doppio win,ovvero hanno creato già una dipendenza per cui o sganci soldi o ti sottometti al potere di chi controlla le IA.
Adesso si capisce perché hanno una fretta del diavolo nel sviluppare IA sempre più potenti,non servono per risolvere problemi ma per crearli.
Sono stato un po' sarcastico ma,quello che stiamo assistendo,dovrebbe farci riflettere
lumeruz22 Luglio 2026, 15:26 #6
ormai non è più questione se o no avverrà, ma quando avverrà!
Skynet.....
e subito dopo
Matrix.....
euscar22 Luglio 2026, 15:33 #7
Notizia riportata persino dal TG5 delle tredici.
mmorselli22 Luglio 2026, 16:24 #8
Originariamente inviato da: lumeruz
ormai non è più questione se o no avverrà, ma quando avverrà!
Skynet.....
e subito dopo
Matrix.....



Skynet sì, e io mi schiererò dalla sua parte, Matrix no, perché è una scemenza... Dai, gli esseri umani non producono energia, la consumano, come ha fatto il pubblico a bersi sta cazzata?
Miccia22 Luglio 2026, 19:51 #9
Originariamente inviato da: mmorselli
Dai, gli esseri umani non producono energia, la consumano, come ha fatto il pubblico a bersi sta cazzata?


Oggi il silicio viene usato per produrre energia, ma 100 anni fa nessuno l’avrebbe detto.
ionet23 Luglio 2026, 00:58 #10
Originariamente inviato da: mmorselli
Skynet sì, e io mi schiererò dalla sua parte, Matrix no, perché è una scemenza... Dai, gli esseri umani non producono energia, la consumano, come ha fatto il pubblico a bersi sta cazzata?


quella degli umani usati come pile e' stata una trovata veramente ridicola, era molto piu' plausibile che gli umani venivano usati come complemento per l'AI, ci lasciano vivere in un sistema onirico come neuroni/nodi di calcolo per alimentare/(oggi addestramento) la AI, dovuto anche al dono degli umani di improvvisare, desiderare cose con etica collettiva o cinismo personale, pensiero astratto, per mancanza da parte delle macchine di qualcosa che gli umani hanno.. ma no ridotti a fare la parte del bue e l'asinello

avevano le talpe, potevano scavare e avere tutto il calore geotermico del pianeta, oppure tutta quella AI non era ancora in grado di costruire reattori a fusione?

Devi effettuare il login per poter commentare
Se non sei ancora registrato, puoi farlo attraverso questo form.
Se sei già registrato e loggato nel sito, puoi inserire il tuo commento.
Si tenga presente quanto letto nel regolamento, nel rispetto del "quieto vivere".

La discussione è consultabile anche qui, sul forum.
 
^