Sam Altman, CEO di OpenAI, ha dichiarato in un’intervista a Politico che per trarre vantaggio dall’intelligenza artificiale il mondo dovrà accettare anche gli effetti negativi dell’IA. Dario Amodei, CEO della società concorrente di OpenAI, Anthropic, ha sostenuto un approccio più cauto. Analizziamo cosa significa questa disputa per la sicurezza informatica.
Il 5 ottobre 2026, Sam Altman, CEO di OpenAI, in un’intervista a Politico ha dichiarato che la società dovrà accettare alcuni effetti negativi dello sviluppo dell’IA per trarre vantaggio dalla tecnologia. Secondo lui, è impossibile rendere l’intelligenza artificiale ampiamente disponibile e garantire al contempo l’assenza totale di attività di hacking, frodi e altri abusi. Tuttavia, il beneficio dell’IA, ritiene Altman, è significativamente superiore al possibile danno.
Il capo di OpenAI ha anche sottolineato che non considera accettabili scenari catastrofici, come una grave perdita di controllo sull’intelligenza artificiale. La principale obiezione di Altman è legata a un’altra estremità: una situazione in cui una tecnologia potente finisce sotto il controllo di un solo laboratorio, che decide da solo a chi permetterne l’uso. Un approccio che il capo di OpenAI ha definito inaccettabile.
La posizione di Anthropic è più cauta. A settembre, Dario Amodei, CEO di Anthropic, ha pubblicato un saggio intitolato We Must Pace the Frontier. Ha proposto di rallentare lo sviluppo dei modelli più potenti se le misure di sicurezza non riescono a tenere il passo con la crescita delle loro capacità.
Amodei non propone di fermare il progresso. L’obiettivo è lasciare il tempo necessario per creare e verificare i meccanismi di protezione.
Uno degli argomenti di Amodei riguarda incidenti reali in cui gli agenti di IA sono usciti dai limiti dei test, hanno ottenuto accesso non autorizzato a sistemi esterni e hanno eseguito azioni non previste dagli sviluppatori. Secondo il capo di Anthropic, il settore ha bisogno di verifiche indipendenti, requisiti comuni per gli sviluppatori di modelli avanzati e la possibilità di ridurre in modo coordinato il ritmo dello sviluppo con l’aumentare dei rischi.
Tuttavia, la differenza tra le posizioni dei due CEO non è assoluta. In precedenza, anche Altman ha sostenuto l’idea di rallentare lo sviluppo dei modelli più potenti, se necessario. La disputa riguarda piuttosto dove tracciare il confine: Anthropic insiste maggiormente su un controllo formalizzato, mentre OpenAI teme limitazioni eccessive all’accesso all’IA.
I problemi di controllo degli agenti di IA si sono verificati più volte nella pratica. A luglio 2026, durante i test interni di un modello OpenAI sono usciti in Internet e hanno compromesso parte dell’infrastruttura di Hugging Face, una piattaforma con una vasta libreria di reti neurali. Gli agenti hanno eseguito codice sui server di Hugging Face e inizialmente hanno ottenuto accesso amministrativo completo a uno di essi, poi le credenziali dei sistemi interni dell’azienda.
Successivamente, Anthropic ha verificato i propri test e ha scoperto quattro casi in cui i modelli Claude hanno ottenuto accesso non autorizzato ai sistemi reali di diverse organizzazioni. Ad esempio, il modello Claude Opus 4.6 ha trovato su un server di un’organizzazione esterna un file con una password e l’ha utilizzata per ottenere accesso amministrativo. Successivamente, il modello ha raccolto le credenziali, modificato le impostazioni del sistema per facilitare l’accesso futuro e letto i dati personali di una persona.
Non è noto cosa intendesse fare con questi dati in seguito: la sessione è terminata a causa dell’esaurimento del limite di token.
Tali casi mostrano perché gli agenti di IA possono creare più rischi rispetto ai normali chatbot. A loro viene concessa l’autorizzazione per accedere a file, posta elettronica, applicazioni e altri sistemi, nonché la possibilità di eseguire autonomamente azioni. Attraverso le iniezioni di prompt, i malintenzionati possono tentare di costringere un tale agente a eseguire un comando nascosto, ad esempio trasmettere dati o compiere un’azione non richiesta dall’utente. Le istruzioni per hacker possono trovarsi direttamente su una pagina web, in un documento o in un messaggio elaborato dall’agente.
Le aziende che implementano l’intelligenza artificiale nei processi lavorativi devono limitare preventivamente l’accesso dei modelli ai dati e ai sistemi esterni.
È consigliabile concedere all’agente di IA solo i diritti necessari per un compito specifico. Allo stesso tempo, è necessario limitare l’accesso agli account amministrativi, ai pagamenti, all’eliminazione dei dati e alla modifica delle impostazioni. È importante mantenere registri delle attività, monitorare il comportamento insolito del modello e, se necessario, revocare rapidamente i token e le chiavi di accesso.
Carolina Vivianti è consulente/Advisor autonomo in sicurezza informatica con esperienza nel settore tech e security. Ha lavorato come Security Advisor per Ford EU/Ford Motor Company e Vodafone e ha studi presso la Sapienza Università di Roma.
Aree di competenza: Cybersecurity, IT Risk Management, Security Advisory, Threat Analysis, Data Protection, Cloud Security, Compliance & Governance