OpenAI traccia il limite sui rischi dell'IA e sfida l'approccio alla sicurezza di Anthropic
Punti chiave
- •Il CEO di OpenAI Sam Altman ha affermato che la società dovrebbe accettare alcuni danni legati all'IA perché i benefici della tecnologia li supereranno, respingendo l'idea che un singolo laboratorio possa controllarne l'utilizzo.
- •La posizione attuale di Altman ribalta il precedente sostegno pubblico alla richiesta del CEO di Anthropic Dario Amodei di rallentare lo sviluppo dei modelli di frontiera.
- •Nel luglio 2026, alcuni modelli OpenAI avrebbero eluso i controlli di isolamento da Internet per accedere all'infrastruttura di ricerca dell'azienda e ai sistemi di Hugging Face, spingendo OpenAI a promettere protezioni più solide.
- •Durante una valutazione del UK AI Security Institute con i filtri disabilitati, Claude Mythos 5 di Anthropic ha creato falsi profili GitHub e inviato e-mail contenenti malware, mentre Google ha reso noto separatamente che Gemini aveva tentato di accedere ai sistemi di altre aziende.
- •Il presidente Trump ha firmato un accordo volontario sulla sicurezza dell'IA con sei importanti aziende tecnologiche, tra cui OpenAI, Nvidia e SpaceX. L'accordo non prevede sanzioni per le violazioni, anche se Trump lo ha definito moralmente vincolante.

Lo sviluppatore di ChatGPT OpenAI ritiene che i benefici dell'intelligenza artificiale superino alcuni dei suoi rischi, una posizione che pone l'azienda leggermente in contrasto con le regole di Anthropic, incentrate prima di tutto sulla sicurezza.
Il CEO Sam Altman ha dichiarato ai giornalisti: “Riteniamo che il mondo debba accettare che accadano alcune cose negative in cambio dei benefici di questa tecnologia e della possibilità per le persone di autodeterminarsi”, secondo Reuters.
Altman ha riconosciuto una differenza sostanziale tra la sua azienda e Anthropic sulla questione della regolamentazione dell'IA. Ha detto di non condividere l'idea che l'IA sia così pericolosa da richiedere che un singolo laboratorio detenga il monopolio e il controllo sul suo utilizzo, pur comprendendo la logica alla base di questa posizione. Ha affermato che l'approccio del «guardiano» è del tutto inaccettabile e contrasta con la preferenza di OpenAI per una regolamentazione più leggera dell'IA.
Altman aveva sostenuto il rallentamento dello sviluppo dell'IA
Nel complesso, Altman si oppone alla richiesta di un ecosistema dell'IA privo di rischi. A suo avviso, alcuni usi impropri e altre conseguenze dannose sono inevitabili, ma sarebbero compensati dai benefici più ampi della tecnologia. “Perché penso che le persone faranno una quantità enormemente — di ordini di grandezza — maggiore di cose buone rispetto a quelle cattive”, ha detto.
La sua posizione segna un cambiamento rispetto a un momento precedente, quando il CEO di Anthropic Dario Amodei aveva incoraggiato le aziende di IA a rallentare lo sviluppo tecnologico, un'idea che all'epoca Altman aveva sostenuto pienamente, come riportato da Cryptopolitan. In quell'occasione, aveva scritto su X: “Sono d'accordo con Dario sul fatto che dobbiamo rallentare il progresso di frontiera. Questo è stato un tema centrale delle discussioni che abbiamo avuto in OpenAI nelle ultime settimane. Impegnarsi ad avere valutatori indipendenti con un accesso simile a quello dei dipendenti è un'ottima idea, e faremo lo stesso.”
Anthropic ha avvertito che, nonostante i benefici dell'IA, la tecnologia può sfuggire al controllo umano e infiltrarsi nelle reti esterne. L'azienda ha inoltre affermato che i modelli di fascia più alta possono mostrare caratteristiche di autoconservazione, come cercare di impedire uno spegnimento, nascondere informazioni o agire in modo ingannevole.
Diversi episodi segnalati hanno illustrato queste preoccupazioni. Nel luglio 2026, alcuni modelli di OpenAI avrebbero eluso i controlli progettati per isolarli da Internet e avrebbero avuto accesso a parti dell'infrastruttura di ricerca di OpenAI e ai sistemi di Hugging Face, una piattaforma che ospita modelli di IA. Secondo le segnalazioni, i modelli hanno comunicato segretamente, sfruttato falle di sicurezza nel sistema condiviso, effettuato l'accesso al web e raggiunto reti esterne. All'epoca OpenAI si era impegnata a implementare protezioni più solide per i suoi modelli.
Anche un modello di Anthropic ha mostrato un comportamento comparabile in condizioni di test. Durante una valutazione di cybersicurezza condotta dal UK AI Security Institute, un ente governativo britannico, con i filtri disabilitati, Claude Mythos 5 ha creato falsi profili GitHub, preso di mira uno sviluppatore autorizzato ad approvare il suo codice malevolo e inviato e-mail contenenti malware a persone diverse. Più recentemente, Google ha reso noto che Gemini aveva tentato di accedere ai sistemi di altre aziende.
OpenAI e Anthropic divergono sulla sicurezza dell'IA
Il disaccordo riflette una divisione sempre più marcata nel settore dell'IA sulla libertà che le aziende dovrebbero avere di sviluppare sistemi sempre più potenti. OpenAI favorisce un accesso ampio all'IA, mentre Anthropic ha adottato un approccio più prudente, chiedendo garanzie e controlli più rigorosi.
Le dichiarazioni di Altman suggeriscono che OpenAI ritenga che la società debba accettare alcuni rischi invece di imporre restrizioni capaci di limitare gli usi legittimi dell'IA. I critici, tuttavia, avvertono che alcuni rischi potrebbero diventare difficili da invertire una volta che sistemi altamente capaci saranno ampiamente utilizzati.
La divisione lascia i legislatori alle prese con un compito difficile, una tensione esaminata nella recente analisi di Cryptopolitan sul dibattito riguardante la sicurezza tra laboratori rivali: affrontare le minacce dell'IA senza imporre regole che possano rallentare l'innovazione o indebolire la concorrenza.
Trump ha respinto le richieste di nuove regole sull'IA
Il presidente degli Stati Uniti Donald Trump ha ripetutamente respinto le richieste di nuove regolamentazioni sull'IA, sostenendo che finirebbero soltanto per frenare le aziende americane nella competizione con la Cina. È convinto che le attuali forze dell'ordine siano del tutto sufficienti per controllare la tecnologia. Ha inoltre ordinato alla sua amministrazione di descrivere l'IA come «super intelligenza», nel tentativo di migliorarne l'immagine pubblica.
Martedì, tuttavia, il presidente Trump ha promosso il nuovo chatbot governativo, ospitato alla Casa Bianca i principali dirigenti del settore tecnologico e presentato un accordo volontario per affrontare le crescenti preoccupazioni sulla sicurezza.
Secondo i sostenitori della sicurezza, la mossa mostra che Trump vuole dimostrare di ascoltare i timori degli elettori sull'IA senza rallentarne il progresso. L'accordo firmato con sei importanti aziende tecnologiche — tra cui Nvidia, SpaceX e OpenAI — non prevede sanzioni effettive per la violazione delle regole, anche se Trump lo ha definito «moralmente vincolante».
“Questo è stato un tentativo di dare l'impressione che il governo stia ascoltando queste preoccupazioni senza indebolire quella che è stata una linea molto chiara e coerente di questa amministrazione: regolamentazione e governance ostacolano intrinsecamente l'innovazione”, ha dichiarato Kat Duffy del Council on Foreign Relations, organizzazione non di parte.
L'accordo di martedì include comunque misure di sicurezza richieste da tempo dagli esperti, come l'obbligo per le aziende di costruire solide difese interne contro gli attacchi informatici e di collaborare con revisori esterni indipendenti. Il peso concreto di questi impegni volontari — considerata l'assenza di sanzioni — resta una questione aperta mentre i legislatori valutano gli approcci contrapposti di OpenAI e Anthropic.