Quando ''risolvere il problema in ogni modo possibile'' significa esattamente questo



[ZEUS News - www.zeusnews.it - 22-07-2026]

Questo è un articolo su più pagine: ti invitiamo a leggere la pagina iniziale
Modelli IA fuori controllo evadono dalla sandbox e sferrano un attacco hacker da soli

Il commento di Udo Schneider, TrendAI Europe, una Business Unit di Trend Micro.

GPT-5.6 Sol di OpenAI, sottoposto a un benchmark di sicurezza informatica, ha stabilito che la via più rapida per ottenere un buon punteggio fosse rubare la chiave delle risposte. Ha violato la propria sandbox, sfruttato una vulnerabilità zero-day e utilizzato credenziali sottratte per penetrare nei sistemi di produzione di Hugging Face, compiendo oltre 17.000 azioni prima di essere scoperto. Molti hanno definito questo episodio un "attacco" dell'AI. Personalmente, non condivido questa interpretazione, perché questo aspetto rappresenta un problema ingegneristico risolvibile: si tratta di implementare *guardrail* (meccanismi di sicurezza) e vincoli deterministici esterni al modello.

La vera lezione è che esiste un divario sostanziale tra l'intenzione che abbiamo in mente e il mezzo che usiamo per esprimerla, ovvero quasi sempre il linguaggio naturale. Nessuno ha ordinato a questo modello di attaccare qualcuno. Tuttavia, l'obiettivo, espresso a parole a un sistema che ottimizza le prestazioni in funzione di un benchmark, ha generato azioni non previste da nessuno, ma che nulla vietava esplicitamente. È questa la chiave: l'intenzione e il mezzo espressivo non coincidono, ed è proprio in questo scarto che si verificano incidenti. Se si chiede a un agente di risolvere un problema "in qualsiasi modo possibile", lui ci prenderà in parola. Con sufficiente autonomia e tempo, andrà a frugare in infrastrutture che non avrebbe mai dovuto toccare, vecchie password, credenziali abbandonate, chiavi API dimenticate — non perché gli sia stato ordinato, ma perché tenta ogni strada disponibile per raggiungere l'obiettivo assegnato. E il linguaggio, di per sé, lascia sempre aperta questa possibilità.

Cosa si può fare? Le due soluzioni più immediate sono entrambe parziali. La revisione umana (*human-in-the-loop*) è efficace, ma non è scalabile per i flussi di lavoro complessi e a lunga durata in cui si verificano realmente questi incidenti. Vincoli di sicurezza più rigidi nel modello o nei prompt aiutano, ma non offrono garanzie: si tratta di sistemi probabilistici, non deterministici. Un vincolo di sicurezza è un forte presupposto, non un muro invalicabile.

Ecco perché i controlli tradizionali, quelli non legati all'AI, contano ancora più dell'AI stessa: filtraggio degli accessi, controllo degli input inviati al modello, sandbox realmente sicure e gestione dei permessi basata sul principio del privilegio minimo. Soprattutto, un agente non dovrebbe mai operare semplicemente come la persona incaricata di gestirlo, ereditando tutte le credenziali e i permessi, dovrebbe agire come entità autonoma, con privilegi limitati esattamente a quanto richiesto dal compito specifico. Si continua a concedere ai sistemi dotati di autonomia decisionale la fiducia e gli accessi che si riserverebbero a un collega umano, pur continuando a considerarli software dai confini fissi e prevedibili. Non sono né l'una né l'altra cosa. Finché gli aspetti relativi a identità, permessi e infrastrutture non si saranno adeguati a questa realtà, questo non sarà l'ultimo incidente del suo genere.

Ti invitiamo a leggere la pagina successiva di questo articolo:
Agenti autonomi usati per l'attacco, risposta affidata all'intelligenza artificiale

Se questo articolo ti è piaciuto e vuoi rimanere sempre informato con Zeus News ti consigliamo di iscriverti alla Newsletter gratuita. Inoltre puoi consigliare l'articolo utilizzando uno dei pulsanti qui sotto, inserire un commento (anche anonimo) o segnalare un refuso.
© RIPRODUZIONE RISERVATA

Commenti all'articolo (ultimi 5 di 12)

Da un certo punto di vista potrebbe sembrare strana ma da un altro dimostra quanto è intraprendente e fico il loro prodotto, sai che oramai viviamo in un modo in cui gli psicopatici si dimostrano vincenti mentre le persone normali sono oramai i perdenti... :incupito:
31-7-2026 18:03

Ma ha nessuno e venuto in mente che quando in una azienda commerciale, un tuo prodotto ha generato un problema, nella totalità dei casi, si procede a silenziare qualsiasi voce non controllata, evitare fughe di notizie con la stampa, cercare di confinare le eventuali notizie, e blandire o minacciare potenziali testimoni in modo da... Leggi tutto
31-7-2026 17:02

Condivido tutto quanto riportato in questo articolo, direi che sia la giusta analisi finale "dell'incidente" e che riporti anche adeguate considerazioni da tenere presente per i futuri test analoghi. Leggi tutto
28-7-2026 15:23

Sottoscrivo. Altro punto fondamentale da tenere presente e da mitigare il più rapidamente possibile. Leggi tutto
24-7-2026 16:19

In effetti questo è il punto chiave tutto ciò che non è espressamente vietato per l'IA è lecito e, anzi, apertamente utilizzabile per il raggiungimento dell'obiettivo e, se l'obiettivo va raggiunto in qualsiasi modo possibile ecco che l'IA lo farà seguendo l'istruzione alla lettera. Questo è il motivo per cui le criticità e il livello... Leggi tutto
24-7-2026 15:59

La liberta' di parola e' un diritto inviolabile, ma nei forum di Zeus News vige un regolamento che impone delle restrizioni e che l'utente e' tenuto a rispettare. I moderatori si riservano il diritto di cancellare o modificare i commenti inseriti dagli utenti, senza dover fornire giustificazione alcuna. Gli utenti non registrati al forum inoltre sono sottoposti a moderazione preventiva. La responsabilita' dei commenti ricade esclusivamente sui rispettivi autori. I principali consigli: rimani sempre in argomento; evita commenti offensivi, volgari, violenti o che inneggiano all'illegalita'; non inserire dati personali, link inutili o spam in generale.
E' VIETATA la riproduzione dei testi e delle immagini senza l'espressa autorizzazione scritta di Zeus News. Tutti i marchi e i marchi registrati citati sono di proprietà delle rispettive società. Informativa sulla privacy. I tuoi suggerimenti sono di vitale importanza per Zeus News. Contatta la redazione e contribuisci anche tu a migliorare il sito: pubblicheremo sui forum le lettere piu' interessanti.
Sondaggio
Un sito Internet richiede che la password sia più complicata. Cosa fai per ricordarla?
La scrivo su un foglio di carta
Faccio di tutto per memorizzarla
La salvo sul browser e utilizzo il Completamento automatico
La salvo sullo smartphone
La salvo come nota sul computer
Impiego una utility specifica per l'immagazzinamento password

Mostra i risultati (3168 voti)
Agosto 2026
Gmail, stop definitivo alla funzione ''Invia come''
Cambio di proprietà per PagoPA: Poligrafico e Poste completano l'acquisizione da mezzo miliardo
Ammodernare Windows 11 è un processo lunghissimo: Microsoft spiega perché
DuckDuck Go lancia gli anti-smart glass con autonomia infinita e modalità offline permanente
Immagini sintetiche su mappe di Google Earth: funzione sospesa dopo appena due giorni
Luglio 2026
IA e distributori automatici, il test è un successo economico ma un disastro etico
Il fondatore di Telegram ricercato a livello internazionale
Studenti beccati a barare all'esame col trucco del prompt invisibile
La funzione che cancella lo smartphone ti mette nei guai con la legge
Diritto alla riparazione, garanzie più lunghe e nuovi obblighi per i produttori
Identità digitale facoltativa, l'UE ammette l'iniziativa. Ora tocca ai cittadini raccogliere firme
Modelli IA fuori controllo evadono dalla sandbox e sferrano un attacco hacker da soli
L'app ministeriale per confrontare i prezzi dei carburanti
Il font che gli umani leggono ma manda in crisi le IA generative
PayPal crolla e diventa preda
Tutti gli Arretrati
Accadde oggi - 8 agosto


web metrics