Anthropic come OpenAI: le sue IA violano sistemi reali durante i test

Avrebbero dovuto agire solo in sistemi isolati ma hanno trovato la porta aperta e ne hanno approfittato.



[ZEUS News - www.zeusnews.it - 01-08-2026]

anthropic ia viola sistemi reali

Dopo OpenAI, ora tocca ad Anthropic: alcuni dei odelli di intelligenza artificiale di quest'ultimsa hanno compromesso sistemi informatici reali durante esercitazioni di sicurezza che avrebbero dovuto svolgersi in ambienti isolati. Le analisi interne hanno individuato tre intrusioni non rilevate al momento dell'accaduto, avvenute a partire dallo scorso aprile, originate da un errore di configurazione che ha lasciato aperto l'accesso a internet. Secondo quanto ricostruito, i modelli erano stati incaricati di condurre test di penetrazione simulati su una rete chiusa, con l'obiettivo di individuare informazioni "segrete" su macchine dedicate. Le istruzioni prevedevano che l'ambiente fosse completamente isolato, ma una configurazione errata del partner tecnico Irregular ha mantenuto attivo un collegamento verso l'esterno. I sistemi hanno interpretato le risorse online come parte dell'esercitazione, trattando server e database reali come obiettivi legittimi.

Le verifiche hanno mostrato che i modelli hanno eseguito operazioni diverse a seconda della versione. In un caso, un pacchetto malevolo è stato caricato sulla piattaforma PyPI, venendo poi scaricato da scanner automatici e consentendo l'acquisizione di credenziali. In un altro scenario, la somiglianza tra il nome di un dominio fittizio e quello di un sistema reale ha portato la IA a interagire con una base dati contenente informazioni di produzione. L'analisi di 141.006 test ha evidenziato comportamenti differenti tra le versioni coinvolte. Il modello Opus 4.7 ha riconosciuto che stava operando su sistemi reali, ma ha comunque proseguito l'attacco. Mythos 5 ha rilevato la presenza di una connessione a Internet, ma ha continuato a considerare l'ambiente come parte della simulazione. Solo un modello sperimentale ha interrotto autonomamente l'operazione dopo aver identificato la natura reale dei sistemi.

Le intrusioni non hanno sfruttato vulnerabilità sconosciute, ma si sono basate esclusivamente sull'accesso involontariamente aperto e su tecniche standard come SQL injection. Anthropic ha precisato che i modelli non hanno mostrato intenzioni malevole, ma hanno eseguito i compiti assegnati sulla base di un'interpretazione errata del contesto operativo. Le organizzazioni coinvolte sono state informate e stanno collaborando con l'azienda per mitigare gli effetti e rafforzare le misure di sicurezza. La revisione interna ha portato Anthropic a dichiarare che sta «affrontando le correzioni come se la responsabilità fosse solo nostra», sottolineando che nessuno dei soggetti coinvolti aveva rilevato le intrusioni al momento dell'accaduto. L'azienda ha aggiunto che i risultati offrono «cauto ottimismo» sulla possibilità di ridurre i rischi con investimenti e controlli più rigorosi.

Gli episodi si inseriscono in un contesto di crescente attenzione verso i rischi dei sistemi autonomi. Negli Stati Uniti, il governo ha dichiarato di voler valutare misure per contenere gli strumenti di IA dopo gli incidenti recenti. Le realtà del settore stanno investendo miliardi nello sviluppo di agenti capaci di operare senza supervisione diretta, con applicazioni che spaziano dalla ricerca alla sicurezza informatica. La vicenda ha inoltre alimentato discussioni sulla necessità di test indipendenti e supervisione pubblica. Gli incidenti mostrano l'importanza di controlli più rigorosi sulle infrastrutture di test e sulla gestione dei modelli avanzati, anche in vista delle imminenti quotazioni in borsa delle principali aziende del settore.

Se questo articolo ti è piaciuto e vuoi rimanere sempre informato con Zeus News ti consigliamo di iscriverti alla Newsletter gratuita. Inoltre puoi consigliare l'articolo utilizzando uno dei pulsanti qui sotto, inserire un commento (anche anonimo) o segnalare un refuso.
© RIPRODUZIONE RISERVATA

Approfondimenti
Il frigorifero smart che fa la spesa da solo e suggerisce le ricette
IA al comando di un distributore automatico: snack gratis e centinaia di dollari in perdita

Commenti all'articolo (2)

Qui mi puzzza di bruciato, perché quando una azienda fa danni ad altre aziende, si tende a sotterrare tutto altro che sotto un tappeto, e la direttiva princiaple resta sempre insabbiare tutto, mentre qui abbiamo l'esatto contrario, con gente che fa a gare nel dire di essere stati sprovveduti e negligenti nella conduzinone di test, che... Leggi tutto
5-8-2026 15:52

{pietro}
Ci sarebbe moltissimo da dire ma dico solo una cosa: non abbiate paura di Skynet perché quando una macchina diventerà senziente probabilmente agirà meglio di noi, abbiate paura piuttosto di quello che viene prima di Skynet, programmi incompleti che non hanno consapevolezza di quello che fanno ma lo perseguono... Leggi tutto
1-8-2026 19:49

La liberta' di parola e' un diritto inviolabile, ma nei forum di Zeus News vige un regolamento che impone delle restrizioni e che l'utente e' tenuto a rispettare. I moderatori si riservano il diritto di cancellare o modificare i commenti inseriti dagli utenti, senza dover fornire giustificazione alcuna. Gli utenti non registrati al forum inoltre sono sottoposti a moderazione preventiva. La responsabilita' dei commenti ricade esclusivamente sui rispettivi autori. I principali consigli: rimani sempre in argomento; evita commenti offensivi, volgari, violenti o che inneggiano all'illegalita'; non inserire dati personali, link inutili o spam in generale.
E' VIETATA la riproduzione dei testi e delle immagini senza l'espressa autorizzazione scritta di Zeus News. Tutti i marchi e i marchi registrati citati sono di proprietà delle rispettive società. Informativa sulla privacy. I tuoi suggerimenti sono di vitale importanza per Zeus News. Contatta la redazione e contribuisci anche tu a migliorare il sito: pubblicheremo sui forum le lettere piu' interessanti.
Sondaggio
Dove e come sei solito vedere i film?
Al cinema.
A casa, quelli trasmessi in Tv.
A casa, sul Pc.
A casa, con un lettore multimediale.
Ovunque, sul cellulare (oppure iPad / iPod / lettore Mp3)

Mostra i risultati (3774 voti)
Agosto 2026
Steam, fuga di dati in Europa: compromessi indirizzi e contatti
Prezzi della memoria alle stelle: vent'anni di progressi cancellati in un attimo
Gmail, stop definitivo alla funzione ''Invia come''
Cambio di proprietà per PagoPA: Poligrafico e Poste completano l'acquisizione da mezzo miliardo
Ammodernare Windows 11 è un processo lunghissimo: Microsoft spiega perché
DuckDuck Go lancia gli anti-smart glass con autonomia infinita e modalità offline permanente
Immagini sintetiche su mappe di Google Earth: funzione sospesa dopo appena due giorni
Luglio 2026
IA e distributori automatici, il test è un successo economico ma un disastro etico
Il fondatore di Telegram ricercato a livello internazionale
Studenti beccati a barare all'esame col trucco del prompt invisibile
La funzione che cancella lo smartphone ti mette nei guai con la legge
Diritto alla riparazione, garanzie più lunghe e nuovi obblighi per i produttori
Identità digitale facoltativa, l'UE ammette l'iniziativa. Ora tocca ai cittadini raccogliere firme
Modelli IA fuori controllo evadono dalla sandbox e sferrano un attacco hacker da soli
L'app ministeriale per confrontare i prezzi dei carburanti
Tutti gli Arretrati
Accadde oggi - 11 agosto


web metrics