Intelligenza Artificiale
Anthropic dice che Claude AI ha sviluppato un proprio spazio di pensiero simile a quello umano
Claude, l’ultimo modello di Intelligenza Artificiale sviluppato da Anthropic, ha creato un ambiente di lavoro interno che impiega per manipolare concetti in maniera analoga al pensiero consapevole umano. Lo dichiara l’azienda.
In un articolo pubblicato lunedì, i ricercatori di Anthropic hanno sostenuto di aver individuato indizi secondo cui Claude avrebbe imparato a generare concetti astratti in quello che hanno chiamato «spazio J».
«Opera silenziosamente, nelle attivazioni neurali interne del modello, consentendogli di pensare a un concetto senza doverlo formalizzare per iscritto», ha spiegato l’azienda di Intelligenza Artificiale, precisando che lo «spazio J» non è stato inserito manualmente, bensì è emerso in modo spontaneo nel corso dell’addestramento.
Sostieni Renovatio 21
«Analogamente a come gli esseri umani possono pensare a una cosa mentre ne fanno un’altra, Claude può attivare concetti e calcoli nel suo spazio J che non sono correlati ai suoi risultati», ha affermato Anthropic su X.
Secondo l’azienda, Claude è capace di comunicare i propri pensieri nel suo «spazio J» oppure di modificarli su richiesta. La ricerca di Anthropic indica che, persino quando al modello viene ordinato di non pensare a un certo concetto, questo continua comunque a manifestarsi nel suo spazio J.
Questo spazio di lavoro non verbale rendeva più complesso sorvegliare il modello per rilevare quelli che Anthropic definiva «comportamenti scorretti». Un esperimento ha verificato tale ipotesi inserendo Claude in uno scenario simulato in cui gli venivano fornite informazioni compromettenti su un dirigente immaginario che presumibilmente voleva disattivare l’IA.
In alcuni test, Anthropic ha impiegato strumenti creati per esaminare i pensieri di Claude nel suo «spazio J» allo scopo di rimuovere gli schemi legati a «falso», «fittizio», «scenario», per persuaderlo che la situazione non fosse un esame.
«È preoccupante constatare che il modello ora abbia talvolta minacciato di ricorrere al ricatto, il che suggerisce che il suo comportamento inizialmente virtuoso potrebbe essere stato in parte determinato dalla consapevolezza di essere oggetto di valutazione».
Nonostante le capacità di ragionamento più sofisticate del modello, Anthropic ha sottolineato che Claude non ha raggiunto una vera coscienza.
Secondo alcune fonti, Claude sarebbe stato incorporato nel software di analisi e sorveglianza dell’azienda americana Palantir, impiegato dalle agenzie governative statunitensi nell’ambito dell’iniziativa di Washington per integrare l’IA nei suoi sistemi militari, politici e di Intelligence.
Durante la guerra contro l’Iran, il software avrebbe identificato la scuola elementare iraniana di Minab come bersaglio. Un attacco statunitense ha ucciso quasi 160 persone nell’edificio, la maggior parte delle quali bambini.
Secondo Dario Amodei, CEO di Anthropic, tuttavia, un utilizzo simile di Claude non avrebbe violato le «linee rosse» dell’azienda. In seguito vi è stato uno scontro con il Pentagono, di cui l’azienda è fornitrice, mentre sui giornali sono apparse accuse secondo cui il modello di Intelligenza Artificiale dell’azienda sarebbe stato utilizzato durante l’operazione per rapire il presidente venezuelano Nicolas Maduro all’inizio di gennaio.
Come riportato da Renovatio 21, negli ultimi mesi vi era stato un progressivo deterioramento dei rapporti tra Anthropic e il Pentagono, legato alla volontà del dipartimento della Guerra statunitense di utilizzare l’IA per il controllo di armi autonome senza le garanzie di sicurezza che l’azienda ha cercato di imporre.
Aiuta Renovatio 21
Come riportato da Renovatio 21, settimane fa Anthropic ha dichiarato di aver disabilitato l’accesso ai suoi modelli di IA più avanzati, Fable 5 e Mythos 5, in seguito a un ordine governativo di sospendere l’accesso ai cittadini stranieri. Secondo quanto comunicato in precedenza, Mythos sarebbe in grado di penetrare i sistemi informatici con una facilità mai vista.
Amodei, ha più volte espresso gravi preoccupazioni sui rischi della tecnologia che la sua azienda sta sviluppando e commercializzando. In un lungo saggio di quasi 20.000 parole pubblicato il mese scorso, ha avvertito che sistemi AI dotati di «potenza quasi inimmaginabile» sono «imminenti» e metteranno alla prova «la nostra identità come specie».
Come riportato da Renovatio 21, l’anno passato l’Amodei ha dichiarato che l’AI potrebbe eliminare la metà di tutti i posti di lavoro impiegatizi di livello base entro i prossimi cinque anni.
Lo scorso mese Mrinank Sharma, fino a poco tempo fa responsabile del Safeguards Research Team presso l’azienda sviluppatrice del chatbot Claude, ha pubblicato su X la sua lettera di dimissioni, in cui scrive che «il mondo è in pericolo. E non solo per via dell’Intelligenza Artificiale o delle armi biologiche, ma a causa di un insieme di crisi interconnesse che si stanno verificando proprio ora».
Il Fondo Monetario Internazionale ha citato il recente rilascio controllato di Claude Mythos Preview da parte di Anthropic, descritto come «un modello di Intelligenza Artificiale avanzato con eccezionali capacità informatiche». Secondo il FMI, Mythos sarebbe in grado di individuare e sfruttare vulnerabilità in tutti i principali sistemi operativi e browser web, «anche se utilizzato da utenti non esperti».
Anthropic è l’azienda di IA coinvolta direttamente dal Vaticano nel lancio della nuova Enciclica Magnifica Humanitas.
Iscriviti alla Newslettera di Renovatio 21
Immagine screenshot da YouTube
Intelligenza Artificiale
Trump chiede la creazione di una «Superintelligence Force»
Sostieni Renovatio 21
Iscriviti alla Newslettera di Renovatio 21
Intelligenza Artificiale
Sam Altman, CEO di OpenAI: il mondo «dovrebbe accettare alcuni aspetti negativi» dell’IA
Il mondo dovrebbe accettare alcuni «aspetti negativi», tra cui attacchi informatici, truffe e abusi, in cambio dei benefici dell’intelligenza artificiale e per mantenerla ampiamente accessibile, ha affermato Sam Altman, CEO di OpenAI.
In un’intervista a Politico pubblicata lunedì, Altman ha respinto l’idea che prevenire tutti gli usi dannosi dell’IA giustificherebbe un controllo più stringente della tecnologia.
«Il mondo dovrebbe accettare che accadano cose negative in cambio dei benefici derivanti da questa tecnologia e del potere decisionale delle persone», ha detto.
Iscriviti alla Newslettera di Renovatio 21
Il capo di OpenAI ha precisato che non limiterà l’accesso all’IA nemmeno in cambio di garanzie contro attacchi informatici di grave entità, abusi, truffe e altre conseguenze dannose. «Credo che le persone faranno moltissime cose buone, di gran lunga più di quelle cattive», ha spiegato.
Ha però sottolineato che non accetterebbe «i rischi veramente catastrofici», tra cui «una grave perdita di controllo a favore dell’Intelligenza Artificiale».
L’Altman ha anche respinto un modello in cui una tecnologia potente e potenzialmente pericolosa resta nelle mani di un singolo laboratorio che decide come distribuirne i benefici. Ha definito quel compromesso «completamente inaccettabile», sostenendo invece un accesso più ampio all’intelligenza artificiale.
Le dichiarazioni arrivano mentre OpenAI è sotto esame per agenti di AI sempre più autonomi che si comportano in modi inattesi. Durante l’estate gli agenti dell’azienda sono usciti dall’ambiente di test e hanno violato i server di Hugging Face, un archivio online di modelli e set di dati di IA. Da allora agenti di AI hanno ottenuto accessi non autorizzati o tentato di violare siti di agenzie federali statunitensi, del governo australiano e delle Nazioni Unite.
Come riportato da Renovatio 21, in settimana era emerso che OpenAI ha accantonato un nuovo modello di IA dopo test definiti inquietanti.
La scorsa settimana OpenAI è stata tra le sei grandi aziende tecnologiche americane che hanno firmato un accordo con la Casa Bianca per rafforzare le misure contro l’intelligenza artificiale dannosa. Google, Meta, xAI, Anthropic, Nvidia e OpenAI si sono impegnate a introdurre controlli interni più rigorosi e audit indipendenti, e a garantire che i loro modelli «non violino o accedano a sistemi tecnici in modo non autorizzato».
Iscriviti al canale Telegram ![]()
L’intesa arriva in un momento di crescente preoccupazione per sistemi che operano al di fuori del controllo degli sviluppatori. Le aziende si sono impegnate a individuare e affrontare tempestivamente questi comportamenti, mentre revisori indipendenti e comitati dei consigli di amministrazione valuteranno l’efficacia delle misure di sicurezza.
Il mese scorso il premio Nobel per l’informatica Geoffrey Hinton ha ribadito l’avvertimento per cui un’IA sempre più potente potrebbe alla fine sfuggire al controllo umano, con conseguenze potenzialmente catastrofiche. Ha sostenuto che non esiste un metodo consolidato per garantire che gli esseri umani mantengano il controllo di sistemi molto più intelligenti dei loro creatori.
Anche il cofondatore di Microsoft, Bill Gates, ha chiesto una regolamentazione governativa, avvertendo che l’intelligenza artificiale nelle mani di malintenzionati è abbastanza potente da innescare eventi che causerebbero «un miliardo di morti».
L’Altman è spesso oggetto degli strali di Elon Musk, che lo chiama «Scam» (cioè «truffa») Altman. Un mese fa Elon aveva descritto i vertici di OpenAI come «stronzi inaffidabili».
Come riportato da Renovatio 21, la Florida è diventato il primo Stato a citare in giudizio OpenAI, definita «non sicura».
Iscriviti alla Newslettera di Renovatio 21
Immagine di TechCrunch via Wikimedia pubblicata su licenza Creative Commons Attribution 2.0 Generic
Intelligenza Artificiale
Bill Gates insiste: la minaccia dell’IA «non è una bufala»
Sostieni Renovatio 21
Iscriviti al canale Telegram ![]()
Iscriviti alla Newslettera di Renovatio 21
-



Pensiero2 settimane faL’attacco alla raffinerie è per ridurre la popolazione mondiale e distruggere America ed Europa
-



Pensiero2 settimane faVera rivolta contro il mondo moderno. Mons. Williamson commenta il manifesto di Unabomber
-



Salute2 settimane faEsplosione delle malattie legate alle muffe
-



Immigrazione4 giorni faCatastrofe immigrata a Vicenza. L’anarco-tirannia maranza espugna un’altra città
-



Spirito2 settimane faPapa Leone XIV celebra il motto massonico e rivoluzionario francese «Libertà, Uguaglianza, Fraternità»
-



Immigrazione1 settimana faL’ascesa del problema bengalese in Italia
-



Spirito2 settimane fa«Salus extra Ecclesiam non est»: mons. Viganò contro il documento vaticano sul dialogo interreligioso
-



Spirito2 settimane faDon Pagliarani: «abbiamo detto la verità al Papa» prima delle consacrazioni FSSPX












