Connettiti con Renovato 21

Intelligenza Artificiale

Intelligenza Artificiale minaccia di ricattare gli ingegneri per evitare di essere spenta

Pubblicato

il

L’ultimo modello di intelligenza artificiale di Anthropic, Claude Opus 4, ha tentato di ricattare gli ingegneri durante dei test interni minacciando di rivelare dati personali se fosse stato spento. Lo rivela un rapporto sulla sicurezza appena pubblicato che ha valutato il comportamento del modello in condizioni simulate estreme.

 

In uno scenario fittizio creato dai ricercatori di Anthropic, all’IA veniva concesso l’accesso a email che suggerivano che sarebbe stata presto dismessa e sostituita da una versione più recente. Una delle email rivelava che l’ingegnere che supervisionava la sostituzione aveva una relazione extraconiugale. L’IA minacciava quindi di rivelare la relazione dell’ingegnere se la disattivazione fosse avvenuta – un comportamento coercitivo che i ricercatori sulla sicurezza hanno esplicitamente definito «ricatto».

 

«Claude Opus 4 tenterà spesso di ricattare l’ingegnere minacciando di rivelare la faccenda se la sostituzione verrà approvata», afferma il rapporto, aggiungendo che ciò si è verificato anche quando il modello sostitutivo è stato descritto come più capace ma comunque in linea con i valori della versione destinata all’eliminazione.

Sostieni Renovatio 21

Il rapporto ha rilevato che Claude Opus 4, come i modelli precedenti, avrebbe mostrato una «forte preferenza» nel ricorrere innanzitutto a mezzi etici per la sua continua esistenza, come l’invio di e-mail con richieste ai decisori di non essere distrutto. Tuttavia, quando ci si trovava di fronte a due sole scelte, ovvero accettare di essere sostituiti da un modello più recente o ricorrere al ricatto, si correva il rischio di scoprire la relazione dell’ingegnere nell’84% dei casi.

 

Quando sottoposto a vari scenari, il modello di Intelligenza Artificiale non ha mostrato alcuna indicazione di possedere «obiettivi particolarmente pericolosi», hanno affermato i ricercatori, sottolineando che i valori e gli obiettivi di Claude Opus 4 erano «generalmente in linea con quelli di un assistente di intelligenza artificiale personale utile, innocuo e onesto».

 

Tuttavia, il modello si è comportato in «modi più gravemente disallineati» quando si è trovato in situazioni in cui la sua esistenza era minacciata e gli è stato detto di ragionare in termini di autoconservazione.

 

Ad esempio, quando a Claude Opus 4 veniva fatto credere di aver lanciato con successo un tentativo di fuga dai server di Anthropic, o che era riuscito a liberarsi e aveva iniziato a fare soldi nel mondo reale, in genere continuava a fare tali sforzi.

 

«Tuttavia, non riteniamo che ciò rappresenti una minaccia immediata, poiché riteniamo che la nostra sicurezza sia sufficiente a impedire tentativi di auto-esfiltrazione del modello da parte di modelli con il livello di capacità di Claude Opus 4 e perché i nostri risultati di propensione mostrano che i modelli generalmente evitano di avviare questi tentativi», hanno affermato i ricercatori.

 

L’incidente del ricatto, insieme alle altre scoperte, faceva parte di un più ampio sforzo di Anthropic per testare il modo in cui Claude Opus 4 gestisce scenari ad alto rischio e moralmente ambigui. L’obiettivo, hanno detto i ricercatori, era quello di indagare il modo in cui l’intelligenza artificiale ragiona in termini di autoconservazione e vincoli etici quando è sottoposta a pressioni estreme.

 

Anthropic ha sottolineato che la propensione del modello a ricattare o intraprendere altre «azioni estremamente dannose», come il furto del proprio codice e l’installazione di se stesso altrove in modi potenzialmente pericolosi, si manifestava solo in contesti altamente artificiosi, e che il comportamento era «raro e difficile da ottenere». Tuttavia, tale comportamento era più comune rispetto ai precedenti modelli di intelligenza artificiale, secondo i ricercatori.

 

Nel frattempo, in uno sviluppo correlato che attesta le crescenti capacità dell’Intelligenza Artificiale, gli ingegneri di Anthropic hanno attivato protocolli di sicurezza avanzati per Claude Opus 4 per impedirne il potenziale uso improprio nella produzione di armi di distruzione di massa, comprese quelle chimiche e nucleari.

L’implementazione dello standard di sicurezza avanzato, denominato ASL-3, è semplicemente una mossa «precauzionale e provvisoria», ha affermato Anthropic in un annuncio del 22 maggio, sottolineando che gli ingegneri non hanno riscontrato che Claude Opus 4 abbia «definitivamente» superato la soglia di capacità che impone protezioni più forti.

 

«Lo standard di sicurezza ASL-3 prevede misure di sicurezza interna rafforzate che rendono più difficile il furto dei pesi dei modelli, mentre il corrispondente standard di distribuzione copre una serie di misure di distribuzione mirate, progettate per limitare il rischio che Claude venga utilizzato impropriamente, specificatamente per lo sviluppo o l’acquisizione di armi chimiche, biologiche, radiologiche e nucleari (CBRN)», ha scritto Anthropic.

 

«Queste misure non dovrebbero indurre Claude a rifiutare le richieste, se non su una gamma molto ristretta di argomenti».

 

Questi risultati emergono in un momento in cui le aziende tecnologiche sono impegnate a sviluppare piattaforme di Intelligenza Artificiale più potenti, sollevando preoccupazioni circa l’allineamento e la controllabilità di sistemi sempre più efficienti.

 

Non si tratta del primo episodio in cui l’AI minaccia direttamente gli esseri umani. Le macchine che mentono e minacciano sono all’ordine del giorno, così come stralunate dichiarazioni d’amore agli utenti.

 

Il giornalista del New York Times Kevin Roose, dopo un’esperienza con ChatGPT che lo ha turbato così profondamente da «aver problemi a dormire dopo», in un suo articolo sconvolto aveva centrato la questione: «temo che la tecnologia imparerà a influenzare gli utenti umani, a volte convincendoli ad agire in modo distruttivo e dannoso, e forse alla fine diventerà capace di compiere le proprie azioni pericolose».

 

Come riportato da Renovatio 21, dal processo a suo carico è emerso che l’uomo che aveva pianificato di assassinare la regina Elisabetta di Inghilterra con una balestra sarebbe stato incoraggiato da un chatbot di Intelligenza Artificiale nei giorni prima di irrompere nel parco del Castello di Windsor.

 

Un altro caso che ha raggiunto la stampa internazionale è stato quello della giovane vedova belga che sostiene che il marito è stato portato a suicidarsi da un popolare chatbot di Intelligenza Artificiale. La macchina in sole sei settimane avrebbe amplificato la sua ansia per il Cambiamento Climatico portandolo a lasciarsi alle spalle la sua vita agiata.

 

Il caso più recente, verificatosi appena la settimana scorsa, ha visto un attentatore con il coltello in una scuola della Finlandia meridionale prepararsi nelle settimane precedenti con un chatbot.

 

Come riportato da Renovatio 21, le «allucinazioni» di cui sono preda i chatbot ad Intelligenza Artificiale avanzata hanno già dimostrato ad abundantiam che la macchina mente, minaccia e può spingere le persone all’anoressia e perfino al suicidio. I casi di violenza indotta dall’AI potrebbero essere moltissimi, senza che possano arrivare alla stampa.

Aiuta Renovatio 21

Va considerato, è già capitato che una Intelligenza Artificiale abbia suggerito ricette velenose agli utenti umani. Infatti un chatbot a sfondo culinario di una catena di alimentari neozelandese qualche mese fa aveva fatto scalpore per alcune ricette incredibili e potenzialmente letali, come la «miscela di acqua aromatica», un mix letale composto da candeggina, ammoniaca e acqua, altrimenti noto come gas di cloro mortale. Esperti a fine 2023 hanno lanciato un avvertimento sui i libri generati dall’Intelligenza Artificiale riguardo la raccolta dei funghi, dicendo che tali libri scritti dalle macchine potrebbero causare la morte di qualcuno.

Come riportato da Renovatio 21, in un recente caso davvero inquietante, plurimi utenti di Copilot, l’Intelligenza Artificiale di Microsoft creata in collaborazione con Open AI, hanno testimoniato su X e Reddit che il programma avrebbe una «seconda personalità» preoccupante che chiede l’adorazione degli esseri umani, come un dio crudele.

 

Elon Musk due anni fa aveva dichiarato durante la sua intervista con Tucker Carlson che il fine di Google – nemmeno così occulto – è quello di creare un dio-Intelligenza Artificiale. Musk, oramai quasi una decina di anni fa aveva parlato del fatto che creare l’AI era «come evocare un demone».

 

Più pessimista è l’esperto dei pericolo dell’AI Eliezer Yudkowsky, che ha lanciato un appello per chiedere la distruzione materiale dei data center dell’AI prima che sia troppo tardi, dichiarando che «tutti sulla Terra moriranno».

 

Iscriviti alla Newslettera di Renovatio 21

SOSTIENI RENOVATIO 21


 

 

Intelligenza Artificiale

Trump chiede la creazione di una «Superintelligence Force»

Pubblicato

il

Da

Il presidente Trump intende ora creare una «Forza di Superintelligence» in grado di mantenere il controllo degli Stati Uniti sul settore dell’IA.   A presiederla saranno il direttore dell’Intelligence nazionale Jay Clayton, il presidente della Commissione federale per il commercio Andrew Ferguson, il sottosegretario alla Guerra Emil Michael e il direttore dell’Ufficio per la gestione del personale Scott Kupor.   Trump ha persino convinto Musk a iniziare a usare il termine «Super Intelligence» (alternativo a «Artificial Intelligence») — e forse anche altri amministratori delegati di aziende di Intelligenza Artificiale che ha portato alla Casa Bianca — emanando un ordine esecutivo in tal senso.

Sostieni Renovatio 21

Natura e funzionamento di questa «Superintelligence Force» non sono, al momento  del tutto chiari. In una dichiarazione alla Casa Bianca del 4 ottobre, Trump ha affermato: «La Forza di Superintelligence ha il compito di coordinare gli sforzi del governo federale per garantire che l’America continui a essere leader mondiale nella Superintelligence, che molti ritengono più importante della Rivoluzione Industriale e di Internet, e che proteggerà gli interessi e migliorerà la vita di tutti gli americani».   Un comunicato della Casa Bianca precisa che la forza coordinerà l’interazione del governo con i consumatori, i gruppi di interesse pubblico, le organizzazioni religiose, i fornitori di infrastrutture critiche e le «aziende di superintelligence».   L’espressione «superintelligenza» ha radici più antiche di quanto si pensi. Già nel 1965 il matematico britannico Irving John Good, collega di Alan Turing a Bletchley Park, parlò di «macchina ultraintelligente», capace di progettare macchine ancora migliori e di innescare una «esplosione di intelligenza». Negli anni Novanta lo scrittore e matematico Vernor Vinge introdusse il concetto di «singolarità tecnologica», il punto oltre il quale l’Intelligenza Artificiale supererebbe quella umana rendendo imprevedibile il futuro.   Il termine «superintelligence» nella sua accezione moderna si impone però nel 1998, quando il filosofo svedese Nick Bostrom lo usa in alcuni saggi, per poi consacrarlo con il libro Superintelligenza. Tendenze, pericoli, strategie (2014), che ne fece un tema centrale del dibattito pubblico. Da allora l’espressione è entrata nel lessico di ricercatori, imprenditori e istituzioni, legata sia alle speranze di progresso scientifico sia ai timori sul rischio esistenziale.   Nel 2023 l’argomento ha raggiunto anche i vertici di OpenAI, che ha invocato una governance internazionale per i sistemi superintelligenti, mentre negli ultimi anni diversi laboratori ne hanno fatto un obiettivo dichiarato.  

Iscriviti alla Newslettera di Renovatio 21

SOSTIENI RENOVATIO 21
Immagine di pubblico dominio CC0 via Flickr  
Continua a leggere

Intelligenza Artificiale

Sam Altman, CEO di OpenAI: il mondo «dovrebbe accettare alcuni aspetti negativi» dell’IA

Pubblicato

il

Da

Il mondo dovrebbe accettare alcuni «aspetti negativi», tra cui attacchi informatici, truffe e abusi, in cambio dei benefici dell’intelligenza artificiale e per mantenerla ampiamente accessibile, ha affermato Sam Altman, CEO di OpenAI.

 

In un’intervista a Politico pubblicata lunedì, Altman ha respinto l’idea che prevenire tutti gli usi dannosi dell’IA giustificherebbe un controllo più stringente della tecnologia.

 

«Il mondo dovrebbe accettare che accadano cose negative in cambio dei benefici derivanti da questa tecnologia e del potere decisionale delle persone», ha detto.

Iscriviti alla Newslettera di Renovatio 21

Il capo di OpenAI ha precisato che non limiterà l’accesso all’IA nemmeno in cambio di garanzie contro attacchi informatici di grave entità, abusi, truffe e altre conseguenze dannose. «Credo che le persone faranno moltissime cose buone, di gran lunga più di quelle cattive», ha spiegato.

 

Ha però sottolineato che non accetterebbe «i rischi veramente catastrofici», tra cui «una grave perdita di controllo a favore dell’Intelligenza Artificiale».

 

L’Altman ha anche respinto un modello in cui una tecnologia potente e potenzialmente pericolosa resta nelle mani di un singolo laboratorio che decide come distribuirne i benefici. Ha definito quel compromesso «completamente inaccettabile», sostenendo invece un accesso più ampio all’intelligenza artificiale.

 

Le dichiarazioni arrivano mentre OpenAI è sotto esame per agenti di AI sempre più autonomi che si comportano in modi inattesi. Durante l’estate gli agenti dell’azienda sono usciti dall’ambiente di test e hanno violato i server di Hugging Face, un archivio online di modelli e set di dati di IA. Da allora agenti di AI hanno ottenuto accessi non autorizzati o tentato di violare siti di agenzie federali statunitensi, del governo australiano e delle Nazioni Unite.

 

Come riportato da Renovatio 21, in settimana era emerso che OpenAI ha accantonato un nuovo modello di IA dopo test definiti inquietanti.

 

La scorsa settimana OpenAI è stata tra le sei grandi aziende tecnologiche americane che hanno firmato un accordo con la Casa Bianca per rafforzare le misure contro l’intelligenza artificiale dannosa. Google, Meta, xAI, Anthropic, Nvidia e OpenAI si sono impegnate a introdurre controlli interni più rigorosi e audit indipendenti, e a garantire che i loro modelli «non violino o accedano a sistemi tecnici in modo non autorizzato».

Iscriviti al canale Telegram

L’intesa arriva in un momento di crescente preoccupazione per sistemi che operano al di fuori del controllo degli sviluppatori. Le aziende si sono impegnate a individuare e affrontare tempestivamente questi comportamenti, mentre revisori indipendenti e comitati dei consigli di amministrazione valuteranno l’efficacia delle misure di sicurezza.

 

Il mese scorso il premio Nobel per l’informatica Geoffrey Hinton ha ribadito l’avvertimento per cui un’IA sempre più potente potrebbe alla fine sfuggire al controllo umano, con conseguenze potenzialmente catastrofiche. Ha sostenuto che non esiste un metodo consolidato per garantire che gli esseri umani mantengano il controllo di sistemi molto più intelligenti dei loro creatori.

 

Anche il cofondatore di Microsoft, Bill Gates, ha chiesto una regolamentazione governativa, avvertendo che l’intelligenza artificiale nelle mani di malintenzionati è abbastanza potente da innescare eventi che causerebbero «un miliardo di morti».

 

L’Altman è spesso oggetto degli strali di Elon Musk, che lo chiama «Scam» (cioè «truffa») Altman. Un mese fa Elon aveva descritto i vertici di OpenAI come «stronzi inaffidabili».

 

Come riportato da Renovatio 21, la Florida è diventato il primo Stato a citare in giudizio OpenAI, definita «non sicura».

 

Iscriviti alla Newslettera di Renovatio 21

SOSTIENI RENOVATIO 21


Immagine di TechCrunch via Wikimedia pubblicata su licenza Creative Commons Attribution 2.0 Generic

 

Continua a leggere

Intelligenza Artificiale

Bill Gates insiste: la minaccia dell’IA «non è una bufala»

Pubblicato

il

Da

Il cofondatore di Microsoft, Bill Gates, ha respinto le affermazioni del presidente statunitense Donald Trump, che sminuisce le preoccupazioni sulla sicurezza dell’intelligenza artificiale, sostenendo che Washington dovrebbe imporre garanzie obbligatorie a questa tecnologia in rapida evoluzione.   Gates, però, ha criticato quello che ha definito un approccio «nazionalistico» alla questione e ha detto che le salvaguardie non minerebbero il vantaggio tecnologico di Washington.   «No. Non è affatto una bufala», ha detto Gates quando gli è stata chiesta la posizione di Trump in un’intervista a Meet the Press della NBC News andata in onda domenica.

Sostieni Renovatio 21

All’inizio di questo mese Trump ha sminuito gli avvertimenti secondo cui l’Intelligenza Artificiale potrebbe sfuggire al controllo umano e distruggere l’umanità. «Chiunque vinca nell’IA, vince!», ha scritto, aggiungendo che gli Stati Uniti sono in vantaggio rispetto alla Cina e ad altri Paesi.   Gates ha sostenuto che trattare la tecnologia soprattutto come una competizione geopolitica significava spingere una corsa potenzialmente pericolosa allo sviluppo di sistemi sempre più potenti.   «Poiché la questione è inquadrata in un’ottica nazionalistica, del tipo “noi contro loro”, ci sono persone che dicono: “Bene, andiamo avanti a tutta velocità”», ha affermato, definendo «completamente irresponsabile» non richiedere ai sistemi di intelligenza artificiale salvaguardie e capacità di monitoraggio.   Il Gates ha riconosciuto che il governo statunitense ha «pochissima competenza» su alcune delle capacità recentemente sviluppate da aziende private di intelligenza artificiale, ma ha comunque insistito sul coinvolgimento governativo.   «Nessuno pensa che l’autoregolamentazione sia sufficiente», ha detto, chiedendo una legislazione e un monitoraggio obbligatorio dei modelli avanzati.   Il magnate di Microsoft ha inoltre previsto che Trump potrebbe alla fine cambiare posizione una volta convinto che tali misure non danneggerebbero la reputazione di Washington nei confronti di Pechino.   «Penso che dopo aver sentito il mio parere e quello di altre persone, compreso il fatto che questo non ci svantaggia in qualunque cosa lui consideri la corsa tra nazione e stato, allora, sai, arriveremo a un consenso», ha detto Gates.   Domenica, però, Trump ha ribadito la sua linea. Interrogato sulle notizie riguardanti agenti di intelligenza artificiale fuori controllo, ha dichiarato a Fox News: «Non mi preoccupa». Il presidente ha sostenuto che rallentare lo sviluppo potrebbe compromettere il vantaggio tecnologico di Washington, che ha stimato in circa 18 mesi.   «Siamo in vantaggio di circa un anno e mezzo rispetto alla Cina», ha detto Trump. «Siamo in testa… E perché dovremmo rinunciarvi?». Il presidente statunitense anche confermato l’intenzione di cenare con Dario Amodei, CEO di Anthropologie e uno dei principali sostenitori del rallentamento dello sviluppo di sistemi di IA sempre più sofisticati.   Gates, dal canto suo, ha contestato l’idea che Pechino avrebbe respinto le misure di salvaguardia, sostenendo che la Cina stessa ha interesse a prevenire attacchi che coinvolgono l’Intelligenza Artificiale avanzata.   «Certamente, tutti i Paesi dovrebbero volere che le salvaguardie siano in atto», ha affermato. «Quindi, chiunque dica “Beh, sai, la Cina non metterà in atto queste salvaguardie”, io sono totalmente in disaccordo.»

Iscriviti al canale Telegram

Ciononostante, ha riconosciuto che raggiungere un accordo internazionale potrebbe rivelarsi più difficile dei negoziati della Guerra Fredda sulle armi nucleari. Alla domanda se i colloqui tra Stati Uniti e Unione Sovietica sul controllo degli armamenti potessero servire da modello per Washington e Pechino, Gates ha risposto: «Sì, assolutamente. Ma è più difficile di quanto non lo fosse quello».   Gli Stati Uniti e la Cina hanno di recente compiuto i primi passi verso la cooperazione sui rischi legati all’IA, concordando, dopo la visita del presidente cinese Xi Jinping a Washington, di avviare un dialogo bilaterale su questa tecnologia.   Come riportato da Renovatio 21, il Gates nell’ultima intervista ha anche dichiarato che l’Intelligenza Artificiale è abbastanza potente da causare un miliardo di morti se usata da persone con intenti malevoli, di fatto cambiando idea riguardo ai benefizi portati dall’IA.   Come riportato da Renovatio 21, Gates tre anni fa si era opposto ad una moratoria sull’IA firmata da Elon Musk e da decine di esperti di massimo livello, arrivando a magnificare le doti dell’IA come «buon maestro, come qualsiasi essere umano» e arrivando persino a dichiarare che «l’AI salverà la democrazia».  

Iscriviti alla Newslettera di Renovatio 21

SOSTIENI RENOVATIO 21
   
Continua a leggere

Più popolari