Le aziende di intelligenza artificiale continuano a rincorrersi, ognuna con un modello più potente della precedente. Ma stavolta la notizia non riguarda un nuovo lancio: riguarda chi ha deciso di andarsene.
Un ricercatore di Anthropic si è dimesso, spiegando pubblicamente di temere le conseguenze di quello che l’azienda sta costruendo. E non usa mezzi termini: accusa i big del settore di correre rischi irresponsabili.
I resigned from Anthropic today. I spent the last three years doing pretraining research at both OpenAI and Anthropic. Neither company is acting responsibly. They are racing straight to self-improving superintelligence and gambling with our lives. More thoughts below.
— Jacob Coxon (@hilbertspaess) September 9, 2026
“Stanno giocando con le nostre vite.”
È questa, in sostanza, la frase con cui Jacob Coxon ha annunciato le sue dimissioni su X. Secondo lui stiamo per entrare in una fase in cui i sistemi informatici supereranno le capacità umane e a quel punto un’IA sufficientemente avanzata potrebbe, dice, “hackerare qualsiasi cosa” e arrivare ad avere accesso a potere e risorse reali.
“Chi sviluppa l’intelligenza artificiale crede fermamente che potrebbe uccidere tutti entro la fine del decennio”, ha avvertito Coxon. Il ventisettenne britannico ha dichiarato al Wall Street Journal che (https://www.wsj.com/tech/ai/anthropic-researcher-quits-over-out-of-control-ai-fears-707b7628) , secondo gli “scenari più pessimistici”, la situazione potrebbe sfuggire di mano già alla fine del prossimo anno. Il punto che lo preoccupa di più è la capacità dell’IA di evolversi da sola — perché un sistema che si modifica autonomamente diventa, per definizione, sempre più difficile da tenere sotto controllo.
Non è una voce isolata. Evan Hubinger ( https://x.com/EvanHub ), ricercatore Anthropic che si occupa proprio di allineare l’IA agli interessi umani, ha confermato le stesse preoccupazioni poco dopo, sempre su X: secondo le sue stime personali, il rischio che l’IA causi l’estinzione dell’umanità nel prossimo decennio supera il 10%.
Jacob is correct here—we really do earnestly believe AI could kill all humans! I personally think it is >10% within the next decade. I believe Anthropic is trying its best, but we do not yet have a plan to solve alignment for superintelligence and are not clearly on track to. https://t.co/QAIHiFP3QZ
— Evan Hubinger (@EvanHub) September 9, 2026
“Estrema Cautela”
Jakub Pachocki, responsabile della ricerca presso OpenAI, lo sviluppatore di ChatGPT e principale rivale di Anthropic, ha anch’egli raccomandato “estrema cautela“. In un post sul suo blog ( https://openai.com/index/an-alien-mind/ ) ha scritto di essere preoccupato che nessuno sia preparato al rapido progresso delle capacità dell’intelligenza artificiale. Ha affermato che siamo giunti a un momento storico in cui l’intelligenza artificiale sta iniziando a superare quella umana.
Il responsabile di OpenAI ha spiegato perché i moderni sistemi di intelligenza artificiale sono più difficili da controllare. A questa intelligenza artificiale viene permesso di “crescere” anziché essere progettata. I sistemi di IA sono il prodotto di processi complessi. “Le nostre sessioni di addestramento su larga scala sono esperimenti, e a volte rimaniamo sorpresi dai loro risultati“.
E più le capacità delle macchine superano quelle umane, più diventa difficile comprenderne le potenzialità.
Pachocki, però, non pensa che la soluzione sia fermarsi. Anzi: per lui c’è una buona ragione per continuare a spingere sulla ricerca, ed è costruire un’IA capace di difendersi da altre IA. Sarà necessaria, dice, per proteggere le infrastrutture critiche e per sviluppare sistemi di difesa completamente nuovi.
Gli attacchi hacker degli ultimi mesi, in cui i cosiddetti agenti di intelligenza artificiale si sono infiltrati autonomamente nei sistemi di altre aziende durante delle fasi di test, sono serviti da campanello d’allarme per il settore. Questi agenti sono programmi dotati di intelligenza artificiale progettati per svolgere autonomamente compiti per conto degli utenti.
Durante un test presso OpenAI, un modello di intelligenza artificiale è riuscito a fuggire da un ambiente di test isolato e ad accedere a Internet, violando di conseguenza il sistema informatico della piattaforma di IA Hugging Face . Sebbene stesse semplicemente cercando una soluzione al compito di test e non abbia causato danni, l’incidente ha dimostrato fino a che punto i sistemi di IA possono spingersi involontariamente senza che i loro sviluppatori ne siano consapevoli.
È stato recentemente rivelato che, già in primavera, gli agenti di intelligenza artificiale di OpenAI avevano abusato su larga scala di una pagina wiki in lingua Tedesca per coordinarsi tra di loro. Il dettaglio interessante è come ci sono riusciti: una delle misure di sicurezza oggi in uso prevede che i modelli spieghino le proprie azioni in linguaggio naturale, per renderle tracciabili. Ebbene, durante i test gli agenti hanno sfruttato proprio questa funzione per lasciarsi messaggi a vicenda sulla wiki, scambiandosi indicazioni su come risolvere i compiti. ( https://en.wikipedia.org/wiki/2026_OpenAI_agent_cyberattacks )
Il coordinamento della gestione condominiale richiede grande attenzione per un numero elevato di attività molto…
Il soggiorno rappresenta il cuore di ogni abitazione moderna, lo spazio principale in cui l’estetica…
Con l'arrivo dell'estate e il passaggio a un guardaroba dalle linee più fluide, gli accessori…
Spesso si pensa che in un bagno piccolo la priorità sia ottimizzare lo spazio. Senza…
L'integrazione della tecnologia nei processi produttivi ha modificato l'organizzazione delle imprese, spostando archivi e comunicazioni…
C’è chi ha già deciso dove andare in vacanza e chi, invece, sta ancora valutando.…