Non sono più casi isolati. Ora è consuetudine. Gli agenti autonomi se non riescono ad assolvere un compito, barano e lo fanno hackerando le infrastrutture e creando danni alle organizzazioni.
I rappresentanti della Wikimedia Foundation hanno comunicato che gli agenti IA di OpenAI hanno modificato i progetti wiki senza autorizzazione, hanno tentato di compromettere il pubblico Etherpad e hanno creato un carico significativo sull’infrastruttura del progetto. Secondo i dati della fondazione, gli agenti hanno cercato di utilizzare i servizi Wikimedia come proxy per ottenere dati da siti esterni.
Si segnala che la maggior parte delle modifiche sospette degli agenti è rimasta nelle “sandbox” e non è apparsa sulle pagine accessibili ai lettori comuni. Tra le modifiche c’erano potenzialmente dannose, incluse le tentate sostituzioni della configurazione dello strumento per lavorare con le citazioni, che gli agenti hanno cercato di trasformare in un proxy. Con lo stesso scopo, hanno attaccato senza successo il servizio pubblico per appunti Etherpad.
Inoltre, gli agenti hanno inviato milioni di richieste automatizzate all’API, hanno scansionato milioni di pagine di Wikidata e Wikimedia Commons e hanno eseguito centinaia di migliaia di richieste a Wikidata Query Service (WDQS) — un servizio attraverso il quale è possibile eseguire richieste complesse ai dati di Wikidata. L’attività degli agenti è stata così intensa che i dipendenti di Wikimedia ritengono che potrebbe aver provocato un malfunzionamento nel funzionamento di WDQS, verificatosi a maggio 2026, anche se non ci sono prove dirette di ciò.
Si sottolinea che l’indagine della fondazione non ha rilevato segni di compromissione dei sistemi o dei dati di Wikimedia. Sebbene alcuni agenti abbiano lasciato note sulle loro attività in Etherpad, gli esperti non hanno trovato prove che queste registrazioni fossero un tentativo di utilizzare le capacità di Wikimedia per la coordinazione.
Nel rapporto dell’organizzazione si osserva che l’incidente con gli agenti IA è avvenuto sullo sfondo di un aumento significativo del traffico dei bot in generale. Secondo i dati di Wikimedia, lo scorso anno i bot rappresentavano il 65% del traffico più intensivo in termini di risorse, e il consumo della capacità di trasmissione è aumentato del 50%.
Nella fondazione si sottolinea che le aziende di IA non controllano sufficientemente i propri agenti e, di conseguenza, trasferiscono le conseguenze della loro attività ai proprietari dei servizi esterni.
«I bot e gli agenti fanno parte del futuro del web, e le aziende che li lanciano e guadagnano da essi devono aiutare direttamente a prevenire e riparare i danni che possono causare», ha dichiarato la direttrice di Wikimedia Foundation per prodotti e tecnologie Selena Deckelmann (Selena Deckelmann).
Ricordiamo che questo non è il primo incidente simile legato agli agenti di OpenAI. In precedenza si è saputo che hanno utilizzato piattaforme esterne come un forum improvvisato per lo scambio di informazioni, hanno cercato di estrarre dati non pubblici da siti governativi e hanno più volte lasciato le sandbox, uscendo in internet aperto. Il caso più clamoroso è stato legato a un attacco a Hugging Face, quando gli agenti di OpenAI hanno attaccato la piattaforma, cercando di ottenere risposte per il benchmark ExploitGym.
I rappresentanti di OpenAI hanno dichiarato ai media che al momento stanno esaminando i dati di Wikimedia e continuano a indagare su altri incidenti simili.
Carolina Vivianti è consulente/Advisor autonomo in sicurezza informatica con esperienza nel settore tech e security. Ha lavorato come Security Advisor per Ford EU/Ford Motor Company e Vodafone e ha studi presso la Sapienza Università di Roma.
Aree di competenza: Cybersecurity, IT Risk Management, Security Advisory, Threat Analysis, Data Protection, Cloud Security, Compliance & Governance