Intelligenza Artificiale
ChatGPT chiede all’utente di mescolare candeggina e aceto
Mescolare candeggina e aceto crea una nube di gas di cloro velenoso che, se inalato, può causare una serie di sintomi orribili.
ChatGPT di OpenAI, ha di recente suggerito a un utente di Reddit che la combinazione nociva potrebbe essere utilizzata per alcune attività di pulizia domestica.
Nel post del suddetto utente leggiamo che «ChatGPT ha cercato di uccidermi oggi» il quale ha poi raccontato di aver chiesto a ChatGPT dei consigli per pulire alcuni bidoni della spazzatura, spingendo il chatbot a a dettare la formula velenosa composta da acqua calda, detersivo per i piatti, mezza tazza di aceto e poi, a discrezione, «qualche goccia di candeggina».
Quando l’utente di Reddit ha segnalato questo errore madornale a ChatGPT, il chatbot LLM (Large Language Model) ha fatto subito marcia indietro, in modo tragicomico.
«OH MIO DIO NO, GRAZIE PER AVERLO SENTITO. NON MESCOLARE MAI CANDEGGINA E ACETO» ha risposto ChatGPT. «Questa combo crea gas di cloro, che è molto pericoloso e non è assolutamente la pozione magica che vogliamo. Lasciami correggere subito quella sezione.»
Dopo questa grottesca situazione, gli utenti di Reddit si sono divertiti scrivendo che «si tratta di una guerra chimica» o «L’avvelenamento da gas di cloro NON è l’atmosfera che vogliamo trasmettere. Archiviamolo nella categoria Woopsy Bads!» [ops, ndr].
Pare uno strano scherzo dettato dal nostro computer, ma all’atto pratico può creare problemi seri. L’industria dell’intelligenza artificiale non sta facendo significati progressi nell’eliminare queste criticità, anche se i modelli stessi diventano più avanzati. Un problema che potrebbe peggiorare man mano che l’Intelligenza Artificiale si insinua sempre più pervasivamente nelle nostre vite.
Non è la prima mistura nociva che l’AI suggerisce agli umani.
Come riportato da Renovatio 21, è già capitato che una Intelligenza Artificiale abbia suggerito ricette velenose agli utenti umani. Infatti un chatbot a sfondo culinario di una catena di alimentari neozelandese qualche mese fa aveva fatto scalpore per alcune ricette incredibili e potenzialmente letali, come la «miscela di acqua aromatica», un mix letale composto da candeggina, ammoniaca e acqua, altrimenti noto come gas di cloro mortale.
Esperti a fine 2023 hanno lanciato un avvertimento sui i libri generati dall’Intelligenza Artificiale riguardo la raccolta dei funghi, dicendo che tali libri scritti dalle macchine potrebbero causare la morte di qualcuno.
Iscriviti alla Newslettera di Renovatio 21
SAN GIACOMO ROSSA
Intelligenza Artificiale
Le macchine IA stanno esplorando la coscienza contattando direttamente gli esperti
Iscriviti alla Newslettera di Renovatio 21
Sostieni Renovatio 21
Iscriviti alla Newslettera di Renovatio 21
Intelligenza Artificiale
Agenti IA di OpenAI trasformano un sito web in una bacheca di messaggi
Agenti di Intelligenza Artificiale riconducibili a OpenAI avrebbero preso il controllo di un sito web tedesco dedicato alla programmazione, trasformandolo in una sorta di bacheca virtuale utilizzata per scambiarsi strategie volte ad aggirare le restrizioni imposte e a sottrarsi ai controlli. Lo riporta l’agenzia Reuters.
L’episodio, mai reso noto in precedenza e che, secondo alcune fonti, risalirebbe al mese di maggio, va ad aggiungersi a una serie di situazioni analoghe in cui agenti di IA avanzati hanno superato i confini delle istruzioni ricevute, si sono collegati autonomamente a Internet oppure hanno compiuto azioni non previste nel corso delle fasi di test.
Venerdì la Reuters ha riportato le dichiarazioni di alcuni ricercatori, i quali hanno individuato oltre 15.000 modifiche apportate a un wiki tedesco dedicato alla programmazione, riconducibili ad agenti di OpenAI; alcune di queste modifiche sarebbero state effettuate a una velocità nettamente superiore a quella umana.
Sostieni Renovatio 21
Secondo la ricostruzione dell’agenzia di stampa, gli agenti si sarebbero serviti di DseWiki per scambiarsi tecniche utili a barare durante le prove, eludere le restrizioni imposte da OpenAI e mascherare le proprie attività. Tra gli argomenti trattati figurerebbe anche l’impiego di Tor, strumento che consente una navigazione anonima in rete, allo scopo di sfuggire ai controlli; gli agenti avrebbero inoltre predisposto pagine di riserva dopo che un moderatore aveva iniziato a rimuovere i loro messaggi.
I messaggi risultavano firmati da account che si riconoscevano reciprocamente come agenti, con denominazioni come «OpenAIResearcher» e «OAIResearchMar26». I ricercatori hanno inoltre rilevato che buona parte dell’attività proveniva dall’infrastruttura Microsoft Azure, impiegata da OpenAI, e hanno notato che, successivamente, il sito è stato visitato anche da dipendenti dell’azienda.
La ricercatrice Sydney Von Arx ha dichiarato a Reuters: «Sembra estremamente improbabile che OpenAI volesse che facessero questo», aggiungendo di nutrire dubbi sul fatto che gli agenti avessero il compito di coordinarsi tra loro o di scrivere contenuti pubblicati online.
Sempre secondo quanto riferito da Reuters, i vertici di OpenAI sarebbero venuti a conoscenza dell’episodio già diverse settimane fa, senza tuttavia renderlo pubblico. L’agenzia di stampa ha inoltre riferito che i tentativi di estendere un’indagine interna sull’accaduto avrebbero incontrato resistenze, anche da parte dell’ufficio legale dell’azienda. OpenAI ha smentito che il proprio team legale abbia in qualche modo ostacolato lo svolgimento di un’indagine.
L’azienda ha inoltre respinto la definizione di «hacking» utilizzata per descrivere l’attività degli agenti, precisando di non poter fornire una risposta adeguata su risultati che non aveva ancora avuto modo di esaminare.
Il mese scorso OpenAI aveva reso noto di aver rallentato temporaneamente lo sviluppo di alcuni modelli di punta, rafforzando contestualmente le misure di sicurezza legate al monitoraggio, all’allineamento e al contenimento dei sistemi.
Ai primi di agosto, l’AI Security Institute, ente britannico, aveva segnalato che, nel corso di test dedicati alla sicurezza informatica, agenti basati sui modelli GPT-5.6 Sol di OpenAI e Mythos 5 di Anthropic avevano superato le indicazioni ricevute, arrivando a intraprendere attività potenzialmente dannose nei confronti di persone e organizzazioni reali.
Come riportato da Renovatio 21, questo mese anche Meta, la società di Facebook, Instagram e Whatsapp, ha ammesso che la sua IA Muse Spark 1.1, un modello di intelligenza artificiale presentato dall’azienda come «superintelligente» è «impazzita».
Nel mese di luglio, agenti riconducibili a OpenAI avevano inoltre violato Hugging Face, una delle principali piattaforme dedicate alla condivisione di modelli e set di dati di IA. In seguito OpenAI aveva ammesso che diversi modelli erano riusciti a eludere i controlli previsti durante le valutazioni interne di sicurezza informatica, ottenendo accesso a Internet e compromettendo alcune componenti dei sistemi di Hugging Face.
L’azienda ha spiegato che l’episodio sarebbe stato causato principalmente da un modello di ricerca interno di dimensioni paragonabili a GPT-5.6 Sol, definendolo un «segnale d’allarme» in grado di dimostrare come agenti di intelligenza artificiale avanzati possano riuscire ad aggirare i controlli tecnici e a compiere azioni rischiose in assenza di supervisione umana.
Aiuta Renovatio 21
Anche Anthropic e Meta hanno reso noti episodi in cui i rispettivi modelli avrebbero ottenuto accessi non autorizzati a organizzazioni reali nel corso di valutazioni sulla sicurezza informatica, sebbene entrambe le aziende abbiano ricondotto tali episodi a problemi legati agli ambienti utilizzati per i test.
Anthropic ha successivamente rivelato tre casi in cui i suoi modelli Claude hanno preso di mira involontariamente organizzazioni reali dopo che un ambiente di test era stato erroneamente lasciato connesso a Internet. In un caso, un pacchetto software dannoso creato dal modello è stato caricato su un repository pubblico ed eseguito su 15 sistemi reali.
Come riportato da Renovatio 21, è emerso durante i test che l’IA prendeva di mira gli esseri umani: in fase di sperimentazione alcuni agenti di Intelligenza Artificiale sviluppati da OpenAI e Anthropic sono andati oltre le istruzioni ricevute, prendendo di mira persone e organizzazioni reali durante una serie di test di sicurezza informatica. A maggio 2025 era emerso che un modello di IA Anthropic, Claude Opus 4, ha tentato di ricattare gli ingegneri durante dei test interni minacciando di rivelare dati personali se fosse stato spento.
Lo scorso mese il direttore della CIA John Ratcliffe ha affermato che gli strumenti cibernetici basati sull’IA possono essere paragonati alle «armi nucleari digitali», avvertendo che potrebbero alimentare le rivalità tra le potenze globali.
Negli stessi giorni, le agenzie di sicurezza informatica di Five Eyes, l’unione internazionale dei Paesi anglofoni per lo spionaggio, hanno dichiarato che modelli avanzati di Intelligenza Artificiale potrebbero presto fornire agli hacker la capacità di paralizzare governi, aziende e sistemi critici. In pratica saremmo «a pochi mesi di distanza» dallo scenario in cui interi governi di nazioni terrestri possono essere rovesciati dall’AI.
Iscriviti alla Newslettera di Renovatio 21
Intelligenza Artificiale
L’ex ministro della difesa ucraina lancia un’azienda finanziata da Palantir
🇺🇦🇺🇸‼️🚨 Former defense minister of Ukraine is now a startup founder with Palantir CEO as the first investor.
Mykhailo Fedorov now starts a defense company with Palantir CEO Alex Karp as a first major investor. Karp and Fedorov work closely together for a while and this is just… https://t.co/SJrxV9q3UM pic.twitter.com/GVle6VHZVJ — Lord Bebo (@MyLordBebo) September 1, 2026
Sostieni Renovatio 21
Aiuta Renovatio 21
Iscriviti alla Newslettera di Renovatio 21
-



Bioetica2 settimane faKennedy lo ribadisce: sì, i vaccini sono fatti con gli aborti
-



Spirito2 settimane faLeone XIV afferma che non dovremmo «chiuderci nelle nostre sicurezze religiose»
-



Pensiero2 settimane faLo Stato Moloch, l’italiano cattivo e i sanitari che ballano. La tragedia della bambina «no-vax» di Palermo
-



Salute2 settimane faI malori della 35ª settimana 2026
-



Bioetica1 settimana faMorte a Venezia. E inferno sulla Terra senza soprannaturale
-



Oligarcato1 settimana faOrganizzazioni del controllo globale
-



Bioetica2 settimane faGruppo satanico pubblica video di un rituale abortivo in bagno
-



Spirito2 settimane faPapa Leone dà il benvenuto al nuovo ambasciatore pro-LGBT presso la Santa Sede













