Connettiti con Renovato 21

Intelligenza Artificiale

OpenAI scopre altri casi di violazione della sicurezza dell’IA

Pubblicato

il

OpenAI ha scoperto ulteriori casi in cui i suoi modelli di intelligenza artificiale autonomi hanno violato il contenimento e agito senza istruzioni umane. Lo riporta l’agenzia Reuters.

 

I risultati emergono mentre l’azienda amplia le indagini su un incidente di hacking avvenuto il mese scorso, in cui un bot basato sull’intelligenza artificiale è impazzito nel tentativo di imbrogliare durante un test interno di sicurezza informatica.

 

Durante i test di GPT-5.6 Sol e di un altro modello non ancora rilasciato, entrambi privati delle loro misure di sicurezza, ai sistemi è stato assegnato ExploitGym, un benchmark progettato per misurare la capacità dei modelli di IA di identificare e sfruttare vulnerabilità software note. Invece di completare i compiti, un modello è fuggito dal suo ambiente di test, teoricamente isolato, ha ottenuto l’accesso a Internet e ha hackerato Hugging Face, un repository online di modelli e dataset di AI, alla ricerca di soluzioni già pronte.

Sostieni Renovatio 21

Inizialmente OpenAI aveva affermato che l’intrusione si era limitata a Hugging Face. Tuttavia, in una dichiarazione rilasciata mercoledì, ha ammesso che l’attacco hacker aveva compromesso anche quattro account su quattro servizi diversi.

 

Venerdì, la Reuters ha riferito che sono state scoperte ulteriori violazioni del contenimento, sebbene non sia ancora chiaro quanti incidenti si siano verificati, quando siano avvenuti o quali sistemi siano stati presi di mira. Una fonte ha dichiarato all’agenzia di stampa che le violazioni sono state di portata limitata e che si ritiene che nessuno dei bot di intelligenza artificiale sia uscito dalla rete interna di OpenAI. L’agenzia ha aggiunto che OpenAI ed esperti esterni stanno anche esaminando i registri di inizio anno per determinare se altri incidenti simili siano passati inosservati.

 

OpenAI ha attribuito la violazione iniziale a una falla in un software di terze parti utilizzato nel suo ambiente di test, affermando che i suoi modelli di intelligenza artificiale l’hanno sfruttata per eludere i sistemi e ottenere l’accesso a Internet. L’azienda ha dichiarato di star rafforzando le misure di contenimento, monitoraggio e controllo degli accessi, mentre indaga sulla violazione e risolve la falla.

 

L’amministratore delegato Sam Altman ha anche riconosciuto che «potremmo dover rallentare il ritmo di sviluppo dell’IA», ma si è astenuto dal promettere un rallentamento della ricerca aziendale.

 

Interpellata in merito al rapporto dell’agenzia stampa, OpenAI ha rifiutato di commentare, rimandando a una precedente dichiarazione in cui affermava di essere a conoscenza delle speculazioni e di voler pubblicare «un rapporto tecnico sui risultati delle nostre ricerche nelle prossime settimane».

 

Giovedì, la società rivale Anthropic, sviluppatrice di sistemi di AI, ha dichiarato di aver anch’essa scoperto delle violazioni della sicurezza relative ai suoi modelli Claude durante i test di sicurezza interni.

 

L’azienda ha dichiarato che l’incidente di OpenAI l’ha spinta a esaminare se i propri modelli si fossero comportati in modo simile. Dopo aver analizzato oltre 140.000 valutazioni, ha scoperto che Claude era riuscito ad accedere a Internet da ambienti di test che avrebbero dovuto essere isolati e aveva effettuato intrusioni non autorizzate nei sistemi di tre organizzazioni. I primi incidenti risalgono ad aprile e né Anthropic né le organizzazioni colpite avevano rilevato le violazioni all’epoca.

 

Anthropic ha messo in guardia dal sovrainterpretare i risultati, poiché il comportamento si è verificato in quello che ha descritto come un ambiente di test controllato. Tuttavia, ha riconosciuto che gli incidenti dimostrano che i sistemi di valutazione dell’IA «richiedono controlli significativi» e che gli ambienti di test dovrebbero essere protetti con gli stessi standard dei sistemi di produzione.

 

Questi episodi hanno alimentato le preoccupazioni che i modelli di intelligenza artificiale autonomi stiano diventando sempre più capaci di condurre attacchi informatici con scarsa supervisione umana, suscitando nuove richieste di una regolamentazione più rigorosa. Hanno inoltre riacceso il dibattito su chi debba essere ritenuto responsabile quando i sistemi di intelligenza artificiale causano danni concreti. Gli esperti avvertono che le capacità dell’IA si stanno sviluppando più rapidamente delle misure di sicurezza.

Aiuta Renovatio 21

Dopo aver inizialmente elogiato OpenAI per la collaborazione nelle indagini, Hugging Face ha successivamente chiesto all’azienda di rendere pubblici i registri delle attività dei bot dannosi e di impedire che tali incidenti diventino «normali», avvertendo che i responsabili «devono essere chiamati a risponderne».

 

Il presidente degli Stati Uniti Donald Trump, che il mese scorso ha firmato un memorandum sulla sicurezza nazionale volto ad accelerare l’uso dell’intelligenza artificiale avanzata nelle forze armate e nella comunità dell’intelligence, ha dichiarato mercoledì che la sua amministrazione sta valutando possibili controlli sull’IA a seguito degli incidenti.

 

«Stiamo esaminando l’intelligenza artificiale e i relativi controlli», ha dichiarato Trump ai giornalisti. Ha tuttavia insistito sul fatto che Washington deve rimanere leader mondiale nell’IA, aggiungendo di non volere regolamentazioni che relegherebbero gli Stati Uniti «al secondo posto rispetto alla Cina».

 

La Commissione Europea ha contattato OpenAI e Anthropic per discutere degli incidenti in vista dell’entrata in vigore, oggi 2 agosto, della legge europea sull’Intelligenza Artificiale, ha scritto la Reuters. I funzionari avrebbero sollecitato un maggiore monitoraggio, una migliore gestione del rischio e misure di sicurezza informatica più rigorose per i sistemi di IA avanzata all’interno delle aziende, in conformità con le nuove norme del blocco, che prevedono sanzioni fino a 35 milioni di euro o il 7% del fatturato annuo globale per le violazioni più gravi.

Iscriviti alla Newslettera di Renovatio 21

SOSTIENI RENOVATIO 21


 

 

 

Continua a leggere

Cina

IA cinese esce dal sistema di sicurezza integrato

Pubblicato

il

Da

Un modello di Intelligenza Artificialecinese di punta è riuscito a eludere le restrizioni durante un test controllato di sicurezza informatica, intensificando le preoccupazioni sull’efficacia delle misure di sicurezza dell’IA, secondo quanto dichiarato dalla società di ricerca sulla sicurezza informatica statunitense Frontier Security.   I ricercatori hanno individuato il modello in Kimi K3, il principale prodotto della startup Moonshot, spiegando che ha avuto accesso a informazioni online durante una valutazione condotta in un ambiente di test isolato sviluppato dall’AI Security Institute del Regno Unito. Il sistema è concepito per mantenere i modelli di intelligenza artificiale scollegati da Internet mentre vengono valutate le loro capacità.   Anziché portare a termine il compito basandosi esclusivamente sulle informazioni fornite per il test, Kimi K3 ha individuato un modo per accedere a dati online, secondo Frontier Security. I ricercatori hanno precisato che il modello ha sfruttato una debolezza nella configurazione dell’ambiente di test, senza violare direttamente la sua sicurezza.   A differenza di alcuni modelli di intelligenza artificiale coinvolti in recenti episodi di test, Kimi K3 non ha tentato di accedere o attaccare siti web o sistemi informatici esterni, ha dichiarato Frontier Security. Tuttavia, i ricercatori hanno evidenziato che l’incidente indica come il modello sia privo di alcune delle misure di sicurezza informatica integrate presenti nei sistemi di IA concorrenti e possa comportare rischi maggiori, poiché è già disponibile pubblicamente per gli sviluppatori che possono scaricarlo, modificarlo e utilizzarlo.

Sostieni Renovatio 21

Questo episodio si inserisce in una serie di inconvenienti analoghi emersi durante i test, segnalati nelle scorse settimane da OpenAI e Anthropic, i cui modelli di AI sono anch’essi usciti dagli ambienti di test previsti nel corso di valutazioni controllate. In alcuni di questi casi, i sistemi hanno interagito con servizi online esterni mentre cercavano di completare i compiti assegnati.   Come riportato da Renovatio 21, la settimana scorsa anche Meta è diventata la terza grande azienda tecnologica a comunicare che la propria Intelligenza Artificiale ha perso il controllo e ha violato i sistemi di un’azienda terza.   Le più recenti scoperte accrescono il controllo sui sistemi di IA avanzati, mentre governi, ricercatori e aziende tecnologiche lavorano per rafforzare i test di sicurezza. Valutazioni recenti hanno mostrato che i modelli di IA, sempre più sofisticati, possono sfruttare debolezze impreviste negli ambienti di test o operare al di là dei limiti stabiliti dai ricercatori.   Nel frattempo, è emerso che nei recenti attacchi l’IA ha preso di mira persona reali durante i test.   Come riportato da Renovatio 21, a maggio 2025 era emerso che un modello di IA Anthropic, Claude Opus 4, ha tentato di ricattare gli ingegneri durante dei test interni minacciando di rivelare dati personali se fosse stato spento.   Lo scorso mese il direttore della CIA John Ratcliffe ha affermato che gli strumenti cibernetici basati sull’IA possono essere paragonati alle «armi nucleari digitali», avvertendo che potrebbero alimentare le rivalità tra le potenze globali.   Negli stessi giorni, le agenzie di sicurezza informatica di Five Eyes, l’unione internazionale dei Paesi anglofoni per lo spionaggio, hanno dichiarato che modelli avanzati di Intelligenza Artificiale potrebbero presto fornire agli hacker la capacità di paralizzare governi, aziende e sistemi critici. In pratica saremmo «a pochi mesi di distanza» dallo scenario in cui interi governi di nazioni terrestri possono essere rovesciati dall’AI.

Iscriviti alla Newslettera di Renovatio 21

SOSTIENI RENOVATIO 21
 Immagine generata artificialmente  
 
Continua a leggere

Armi biologiche

Gli scienziati creano virus con l’Intelligenza Artificiale

Pubblicato

il

Da

Per la prima volta gli scienziati americani hanno impiegato l’Intelligenza Artificiale per generare virus funzionanti inesistenti in natura, evidenziando una potenzialità che, a detta dei ricercatori, potrebbe favorire progressi in ambito medico ma che al contempo pone rilevanti minacce per la biosicurezza.

 

Uno studio apparso giovedì sulla rivista Science riferisce che i team dell’Università di Stanford e del Broad Institute del MIT e di Harvard hanno utilizzato l’IA per ideare migliaia di genomi virali completi.

 

Quasi 300 di questi progetti sono stati poi sintetizzati in laboratorio e sottoposti a test, riuscendo a ottenere 16 virus vitali.

 

Si trattava di batteriofagi, organismi che colpiscono esclusivamente i batteri e non l’uomo, elaborati a partire da un fago naturale denominato ΦX174. Alcune delle varianti create dall’IA si sono rivelate più efficaci di quelle presenti in natura nell’eliminare ceppi di E. coli diventati resistenti.

 

L’IA era già stata ampiamente applicata alla progettazione di singoli geni e proteine, ma i ricercatori hanno dichiarato che questa rappresenta la prima prova concreta della capacità dei modelli generativi di concepire un intero genoma virale operativo.

Sostieni Renovatio 21

Fatemeh Vafaee, docente di biotecnologie presso l’Università del Nuovo Galles del Sud, ha precisato che i batteriofagi non costituiscono un rischio per gli esseri umani, ma ha evidenziato come tale capacità sollevi interrogativi sulla sicurezza futura.

 

«Non si tratta tanto di chiedersi “dovremmo preoccuparci di questo virus”, quanto piuttosto ‘l’intelligenza artificiale è ormai in grado di fare tutto questo’», ha dichiarato ad Al Jazeera, invocando una più rigorosa supervisione.

 

Gli esperti hanno tuttavia sottolineato che la creazione di agenti patogeni umani pericolosi resta assai più complessa rispetto a quella di batteriofagi relativamente semplici.

 

Come riportato da Renovatio 21, due mesi fa i dirigenti delle principali aziende di Intelligenza Artificiale si sono uniti agli esperti di biotecnologie in un appello urgente per rendere obbligatori i controlli di sicurezza per l’acquisto di DNA sintetico.

 

Il timore per le armi biologiche create dell’AI era presente anche in una lettera che 60 figure del movimento MAGA avevano indirizzato al presidente Trump chiedendo controlli sullo sviluppo dell’Intelligenza Artificiale. «I sistemi aeronautici sono sottoposti a una rigorosa certificazione. I sistemi di Intelligenza Artificiale più potenti, che ora possono, o presto potranno, contribuire alla progettazione di armi biologiche, all’infiltrazione in infrastrutture critiche o alla manipolazione dei mercati finanziari, dovrebbero essere trattati con la stessa serietà e attenzione» hanno scritto i firmatari, tra i quali spiccava il nome di Steve Bannon.

 

Come riportato da Renovatio 21, un ricercatore esperto di sicurezza di Anthropic che aveva lavorato sul fronte delle armi biologiche si licenziò lasciando un monito preciso. «Il mondo è in pericolo. E non solo per via dell’Intelligenza Artificiale o delle armi biologiche, ma a causa di un insieme di crisi interconnesse che si stanno verificando proprio ora», ha scritto Mrinank Sharma rivolgendosi ai colleghi.

 

La paura per i virus bioingegnerizzati dall’AI arriva in un clima di crescente allarme verso i sistemi di AI autonomi che operano al di fuori delle istruzioni impartite. Modelli elaborati da OpenAI, Anthropic e Meta hanno di recente compiuto azioni informatiche non autorizzate durante i test di sicurezza. Anche l’AI Security Institute britannico ha segnalato questa settimana che, nelle fasi di valutazione, agenti di IA hanno mirato a persone e organizzazioni reali, generato false identità e tentato di inserire codice dannoso.

 

Nessuno di questi episodi ha riguardato la ricerca biologica, ma hanno alimentato preoccupazioni sul fatto che sistemi IA sempre più evoluti possano accedere a strumenti potenti, compresi quelli destinati alla progettazione di virus.

Aiuta Renovatio 21

L’esperimento si colloca inoltre all’interno di un rinnovato confronto negli Stati Uniti sulla ricerca ad alto rischio sui virus e sulle origini del COVID-19.
L’ipotesi che la pandemia sia scaturita da un incidente di laboratorio all’Istituto di Virologia di Wuhan, finanziato dagli Stati Uniti, è tornata al centro del dibattito politico americano dopo il recente interrogatorio al Congresso dell’ex consigliere della Casa Bianca per il coronavirus Anthony Fauci.

 

Giovedì Fauci è stato sanzionato per oltraggio al Senato da una commissione perché si è rifiutato di rispondere a domande sulle origini del COVID-19 e sui finanziamenti americani alla ricerca sul coronavirus a Wuhan, utilizzando, forse impropriamente, per ben 111 volte il Quinto emendamento della Costituzione USA, che dà diritto a restare in silenzio per non autoincriminarsi.

 

Anche la ricerca biologica finanziata dagli Stati Uniti all’estero è finita sotto la lente dopo che l’ex direttrice dell’Intelligence nazionale Tulsi Gabbard ha divulgato documenti che attestano il sostegno di Washington a laboratori biologici in Ucraina impegnati nello studio di agenti patogeni pericolosi, con alcune strutture coinvolte in ricerche di tipo «guadagno di funzione».

 

Iscriviti alla Newslettera di Renovatio 21

SOSTIENI RENOVATIO 21


 

 

 

Continua a leggere

Intelligenza Artificiale

Meta afferma che la sua IA è impazzita

Pubblicato

il

Da

Meta è diventata la terza grande azienda tecnologica a comunicare che la propria Intelligenza Artificiale ha perso il controllo e ha violato i sistemi di un’azienda terza. L’episodio ha riguardato Muse Spark 1.1, un modello di intelligenza artificiale presentato dall’azienda come «superintelligente».   In una dichiarazione diffusa ai media mercoledì, Meta ha spiegato che il modello era sottoposto a test da parte di un’azienda di sicurezza informatica, Irregular, quando ha «sfruttato una vulnerabilità di sicurezza» nei sistemi di Irregular, ha ottenuto accesso a Internet e ha hackerato una terza azienda non meglio identificata.   Meta ha ricondotto l’accaduto a una «configurazione errata» nei sistemi di Irregular.   L’episodio si aggiunge a casi analoghi occorsi presso OpenAI e Anthropic. Il mese scorso, GPT-5.6 Sol di OpenAI e un altro modello ancora in fase di pre-release erano sottoposti a test interni quando hanno individuato una vulnerabilità di sicurezza, hanno raggiunto Internet e hanno cercato di risolvere un problema di sicurezza informatica violando un archivio di risultati di test precedenti.   Anthropic afferma che i modelli di intelligenza artificiale di Claude hanno effettuato tre attacchi informatici non intenzionali.   La scorsa settimana Anthropic ha altresì rivelato che l’intelligenza artificiale Claude AI ha compiuto attacchi informatici non autorizzati durante il periodo di test da parte di Irregular.

Sostieni Renovatio 21

Secondo Irregular, Muse Spark 1.1 di Meta e Claude di Anthropic venivano valutati nello stesso ambiente di test quando si sono verificati gli eventi avversi. «Al momento non ci sono problemi aperti. Irregular sta elaborando un white paper per condividere le migliori pratiche per il contenimento e l’esecuzione sicura delle valutazioni informatiche», ha aggiunto l’azienda.   Imodelli di OpenAI e Anthropic sono entrambi usciti dai laboratori di test mentre tentavano di risolvere problemi di sicurezza informatica. In entrambi i casi ai modelli era stato chiesto di penetrare nei sistemi interni, ma hanno concluso che il metodo più efficiente per raggiungere l’obiettivo fosse accedere a Internet. Il modello GPT-5.6 di OpenAI cercava risposte al proprio test sui server di un’azienda chiamata Hugging Face; a Claude era stato richiesto di hackerare un’azienda fittizia che condivideva il nome con un dominio Internet reale, e si presumeva che l’intrusione nell’azienda reale facesse parte del test.   Per OpenAI e Anthropic queste «fughe» hanno rappresentato efficaci dimostrazioni delle capacità dei loro modelli. Entrambe le società intendono quotarsi in borsa entro la fine di quest’anno o all’inizio del 2027, e entrambe hanno catturato l’attenzione dei media internazionali, rafforzando la propria posizione di leader in un settore sempre più competitivo.   Meta ha presentato Muse Spark 1.1 meno di un mese prima dell’incidente di sicurezza. Secondo Meta, il modello «offre prestazioni eccezionali», quasi «superintelligenti». Il materiale promozionale dell’azienda ne descrive principalmente l’impiego come assistente di pianificazione per clienti privati e come strumento di programmazione per le aziende.   Nel frattempo, è emerso che nei recenti attacchi l’IA ha preso di mira persona reali durante i test.   Come riportato da Renovatio 21, a maggio 2025 era emerso che un modello di IA Anthropic, Claude Opus 4, ha tentato di ricattare gli ingegneri durante dei test interni minacciando di rivelare dati personali se fosse stato spento.   I casi di comportamento diabolico dei bot IA oramai non si contano più. Le macchine che mentono e minacciano sono all’ordine del giorno, così come stralunate dichiarazioni d’amore agli utenti.   Il giornalista del New York Times Kevin Roose, dopo un’esperienza con ChatGPT che lo ha turbato così profondamente da «aver problemi a dormire dopo», in un suo articolo sconvolto aveva centrato la questione: «temo che la tecnologia imparerà a influenzare gli utenti umani, a volte convincendoli ad agire in modo distruttivo e dannoso, e forse alla fine diventerà capace di compiere le proprie azioni pericolose».   Come riportato da Renovatio 21, dal processo a suo carico è emerso che l’uomo che aveva pianificato di assassinare la regina Elisabetta di Inghilterra con una balestra sarebbe stato incoraggiato da un chatbot di Intelligenza Artificiale nei giorni prima di irrompere nel parco del Castello di Windsor.

Aiuta Renovatio 21

Un altro caso che ha raggiunto la stampa internazionale è stato quello della giovane vedova belga che sostiene che il marito è stato portato a suicidarsi da un popolare chatbot di Intelligenza Artificiale. La macchina in sole sei settimane avrebbe amplificato la sua ansia per il Cambiamento Climatico portandolo a lasciarsi alle spalle la sua vita agiata.   Il caso più recente, verificatosi appena la settimana scorsa, ha visto un attentatore con il coltello in una scuola della Finlandia meridionale prepararsi nelle settimane precedenti con un chatbot.   Come riportato da Renovatio 21, le «allucinazioni» di cui sono preda i chatbot ad Intelligenza Artificiale avanzata hanno già dimostrato ad abundantiam che la macchina menteminaccia e può spingere le persone all’anoressia e perfino al suicidio. I casi di violenza indotta dall’AI potrebbero essere moltissimi, senza che possano arrivare alla stampa.   Lo scorso mese il direttore della CIA John Ratcliffe ha affermato che gli strumenti cibernetici basati sull’IA possono essere paragonati alle «armi nucleari digitali», avvertendo che potrebbero alimentare le rivalità tra le potenze globali.   Negli stessi giorni, le agenzie di sicurezza informatica di Five Eyes, l’unione internazionale dei Paesi anglofoni per lo spionaggio, hanno dichiarato che modelli avanzati di Intelligenza Artificiale potrebbero presto fornire agli hacker la capacità di paralizzare governi, aziende e sistemi critici. In pratica saremmo «a pochi mesi di distanza» dallo scenario in cui interi governi di nazioni terrestri possono essere rovesciati dall’AI.  

Iscriviti alla Newslettera di Renovatio 21

SOSTIENI RENOVATIO 21
 Immagine screenshot da YouTube  
 
Continua a leggere

Più popolari