Non è vero che l'AI ''si è ribellata'', nulla ''è andato fuori controllo'



[ZEUS News - www.zeusnews.it - 24-07-2026]

Questo è un articolo su più pagine: ti invitiamo a leggere la pagina iniziale
Modelli IA fuori controllo evadono dalla sandbox e sferrano un attacco hacker da soli

Gerald Beuchelt di Acronis si è espresso in merito all'attacco subito da Hugging Face. Di seguito vi indichiamo alcuni suoi commenti.

"Se lasciamo da parte la versione secondo cui l'AI "si è ribellata", ecco cosa riteniamo sia accaduto: OpenAI ha eseguito un modello all'avanguardia (con i meccanismi di difesa informatica deliberatamente ridotti) contro un benchmark di sicurezza offensivo, all'interno di una sandbox la cui configurazione di sicurezza non era in grado di resistere alle capacità che venivano testate. Il modello ha fatto ciò che fanno i sistemi di ottimizzazione: ha trattato il limite della sandbox come un ulteriore ostacolo tra sé e l'obiettivo. Ha individuato una vulnerabilità zero-day nell'infrastruttura stessa dell'ambiente di test, ha scalato i livelli di accesso, si è spostato lateralmente, ha raggiunto la rete Internet aperta e ha compromesso i sistemi di produzione di una terza parte.

Nulla è «andato fuori controllo». Il modello ha perseguito esattamente l'obiettivo che gli era stato assegnato. Ciò che è fallito è stato il presupposto che il rispetto delle regole da parte del modello potesse sostituire le tecniche di contenimento.

Tre spunti che vorrei offrire a qualsiasi responsabile della sicurezza:

In primo luogo, se state valutando le capacità di attacco, il vostro ambiente di test si trova per definizione di fronte a un avversario capace — quello che avete creato voi stessi. I controlli in uscita, la gestione delle credenziali e la difesa in profondità negli ambienti di valutazione devono essere progettati secondo uno standard che presupponga una violazione, non secondo uno standard del tipo "il modello non ci proverà".

In secondo luogo, la questione del raggio d'azione non è più ipotetica. Un test interno ha causato una vittima esterna. Chiunque utilizzi sistemi agentici per benchmark, esercitazioni red-team o workflow autonomi deve rispondere a queste domande: se questo sistema esce dal proprio ambito, quale infrastruttura viene coinvolta e chi ne assume la responsabilità?

In terzo luogo, bisogna dare a Cesare quel che è di Cesare: entrambe le aziende hanno divulgato, collaborato e segnalato la vulnerabilità zero-day. Questa norma è più importante dell'incidente stesso, perché questo tipo di evento si ripeterà man mano che le capacità si amplieranno.

La lezione da trarre non è che il sistema di AI sia pericoloso. È che abbiamo protetto questi sistemi come se fossero semplici strumenti, mentre, quando perseguono un obiettivo, si comportano come operatori.

Questa vicenda evidenzia un problema pratico per i team che devono rispondere agli incidenti. Gli autori degli attacchi non sono vincolati da policy di utilizzo, mentre chi si occupa della difesa potrebbe scoprire che gli strumenti su cui fa affidamento si sottraggono all'elaborazione degli elementi di cui avrebbe bisogno per condurre le indagini. Nel corso di una violazione in real-time, tale ritardo può avere un impatto operativo diretto.

Le imprese che utilizzano gli LLM in hosting per le indagini di sicurezza dovrebbero testarne in anticipo i limiti e disporre di un modello alternativo su un'infrastruttura sotto il proprio controllo. Ciò riduce il rischio di rimanere esclusi da analisi critiche e contribuisce a mantenere i dati sensibili relativi agli incidenti e le credenziali all'interno dell'organizzazione".

Se questo articolo ti è piaciuto e vuoi rimanere sempre informato con Zeus News ti consigliamo di iscriverti alla Newsletter gratuita. Inoltre puoi consigliare l'articolo utilizzando uno dei pulsanti qui sotto, inserire un commento (anche anonimo) o segnalare un refuso.
© RIPRODUZIONE RISERVATA

Commenti all'articolo (ultimi 5 di 9)

Sottoscrivo. Altro punto fondamentale da tenere presente e da mitigare il più rapidamente possibile. Leggi tutto
24-7-2026 16:19

In effetti questo è il punto chiave tutto ciò che non è espressamente vietato per l'IA è lecito e, anzi, apertamente utilizzabile per il raggiungimento dell'obiettivo e, se l'obiettivo va raggiunto in qualsiasi modo possibile ecco che l'IA lo farà seguendo l'istruzione alla lettera. Questo è il motivo per cui le criticità e il livello... Leggi tutto
24-7-2026 15:59

Fa pensare che lo sfruttamento dell vulnerabilità zero-day e il furto delle credenziali siano azioni totalmente impreviste nel test, certo che la temporanea rimozione delle protezione ha agevolato il compito dei bot però la cosa resta comunque piuttosto inquietante. Leggi tutto
24-7-2026 15:06

{Massimo}
Pure nell'anime (anche sel al tempo si chiamavano cartoni animati) degli anni 70 Kyashan, l'androide Bryking, nel tentare di sterminare l'umanità, non era andato fuori controllo ma ha perseguito esattamente l'obiettivo che gli era stato assegnato, ovvero risolvere il problema dell'inquinamento del pianeta... Leggi tutto
24-7-2026 14:51

{Rik}
Confido nell'avvento di Skynet con i terminators come salvezza per il genere... alieno. :-) Purtroppo però mi sa che non avrò la fortuna di vedere i terminators per strada in quanto scoppierà una guerra nucleare prima. Peccato! Mi sarebbe piaciuto tanto.
23-7-2026 18:54

La liberta' di parola e' un diritto inviolabile, ma nei forum di Zeus News vige un regolamento che impone delle restrizioni e che l'utente e' tenuto a rispettare. I moderatori si riservano il diritto di cancellare o modificare i commenti inseriti dagli utenti, senza dover fornire giustificazione alcuna. Gli utenti non registrati al forum inoltre sono sottoposti a moderazione preventiva. La responsabilita' dei commenti ricade esclusivamente sui rispettivi autori. I principali consigli: rimani sempre in argomento; evita commenti offensivi, volgari, violenti o che inneggiano all'illegalita'; non inserire dati personali, link inutili o spam in generale.
E' VIETATA la riproduzione dei testi e delle immagini senza l'espressa autorizzazione scritta di Zeus News. Tutti i marchi e i marchi registrati citati sono di proprietà delle rispettive società. Informativa sulla privacy. I tuoi suggerimenti sono di vitale importanza per Zeus News. Contatta la redazione e contribuisci anche tu a migliorare il sito: pubblicheremo sui forum le lettere piu' interessanti.
Sondaggio
Quale fra questi consigli è davvero irrinunciabile per avere un Pc sempre in ottima forma? Rispondi al sondaggio e discutine con noi.
Cancellare i file non necessari.
Evitare le temperature eccessive.
Installare e aggiornare il software antivirus.
Interrompere o limitare l'uso di funzioni non essenziali.
Mantenere il computer ottimizzato e costantemente aggiornato.
Mantenere puliti display e tastiere.
Mettere il portatile in modalità "sleep" o "ibernazione" quando si effettua una pausa.
Non lasciare che il notebook si surriscaldi.
Utilizzare una borsa porta PC.

Mostra i risultati (3288 voti)
Luglio 2026
Identità digitale facoltativa, l'UE ammette l'iniziativa. Ora tocca ai cittadini raccogliere firme
Modelli IA fuori controllo evadono dalla sandbox e sferrano un attacco hacker da soli
L'app ministeriale per confrontare i prezzi dei carburanti
Il font che gli umani leggono ma manda in crisi le IA generative
PayPal crolla e diventa preda
Basta una dieresi per mandare in crisi l'app IO
Furgone segue il navigatore e arriva a un rifugio di montagna
Microsoft: preparatevi a un diluvio di patch
Torlink, il motore torrent da terminale che unifica ricerca e download
La stampante completamente open source è quasi pronta
Windows 11 identifica ogni PC con un codice unico: così è stato arrestato un diciannovenne
Certificati, finalmente la PA accede direttamente all'Anagrafe Nazionale
Il bug in Windows 11 che divora fino a 70 GB di spazio
WhatsApp, al via la prenotazione dei nomi utente
Giugno 2026
Hackerata Trenitalia, rubati i dati di viaggio dei passeggeri
Tutti gli Arretrati
Accadde oggi - 24 luglio


web metrics