L’idea è affascinante, ma anche allo stesso tempo molto inquietante: un agente IA che non aspetta più che qualcuno gli dica cosa fare, che può avere un computer tutto suo, navigare sul Web, utilizzare applicazioni, scrivere codice e continuare un progetto per ore, anche mentre l’utente non sta guardando. Non è più soltanto un chatbot che risponde alle domande: è qualcosa che può prendere in carico un’attività e portarla avanti nel tempo. E quando a un sistema del genere concediamo accesso a dati, account, applicazioni e infrastrutture, la domanda sulla sicurezza diventa inevitabile.
OpenAI parla di permessi, conferme, ambienti isolati e meccanismi di sicurezza. Tutto molto rassicurante sulla carta. Ma negli ultimi mesi abbiamo visto emergere diversi episodi e ricerche in cui gli agenti IA di OpenAI sono stati coinvolti in scenari di sicurezza e capacità offensive che hanno fatto discutere il settore. Insomma, se gli agenti IA hanno già dimostrato di saper “hackerare la qualunque”, oggi proviamo a portarli anche su un altro terreno: farli lavorare da soli, 24 ore su 24. Che cosa potrebbe andare storto?
OpenAI ha presentato Dots — un nuovo tipo di agenti di intelligenza artificiale sempre attivi, in grado di eseguire autonomamente compiti multi-step, gestire progetti, utilizzare applicazioni, scrivere e testare codice, e continuare a lavorare senza l’intervento umano. In OpenAI affermano che i Dots possono funzionare 24 ore su 24 e adattarsi nel tempo alle preferenze dell’utente.
La differenza chiave tra Dots e il normale ChatGPT risiede nel fatto che l’agente riceve il proprio ambiente di calcolo. Ogni Dot funziona su un computer cloud separato con il proprio browser e account per gestire l’accesso e i permessi. L’utente può aprire un computer virtuale e vedere esattamente cosa sta facendo il Dot.
Al contempo, per impostazione predefinita, l’ambiente cloud è isolato dal computer dell’utente. Tuttavia, se necessario, è possibile collegare il Dot al proprio computer e l’agente può lavorare direttamente sul dispositivo dell’utente.
Alla base dei Dots c’è il modello GPT-6 Astra. OpenAI ha anche integrato gli agenti con la propria ecosistema di plugin, permettendo loro di lavorare con più di 4000 applicazioni. È possibile interagire con un Dot tramite ChatGPT, messaggi di testo, Slack e Microsoft Teams, e anche rivolgersi all’agente tramite chiamata vocale. Il contesto viene mantenuto tra i canali di comunicazione.
La caratteristica principale dei Dots è la capacità di continuare autonomamente il lavoro iniziato. All’utente non è necessario mantenere una chat aperta e controllare ogni passaggio: l’agente può assumere un progetto, eseguirne le fasi, monitorare le modifiche e contattare l’utente solo quando è necessario il suo intervento.
Ad esempio, un agente può monitorare i feedback degli utenti su un’applicazione, identificare problemi ricorrenti, apportare correzioni al codice e prepararle per la revisione da parte dello sviluppatore. Le decisioni finali sull’implementazione delle modifiche spettano comunque all’utente.
In un altro scenario, l’agente supervisiona la preparazione del lancio di un prodotto. Se le caratteristiche del prodotto o i requisiti cambiano, il Dot può rivedere il piano di lancio, aggiornare la documentazione e i materiali promozionali e preparare le modifiche per la revisione umana. Per i compiti di ricerca, l’agente può ripetere l’analisi man mano che arrivano nuovi dati, studiare i risultati inattesi e aggiornare le illustrazioni e le conclusioni.
Interessante notare che i Dots non sono progettati solo per eseguire compiti specifici, ma anche per un lavoro proattivo. OpenAI lo chiama “ricerca proattiva”: l’agente può accedere alle applicazioni connesse in background e cercare modi per continuare il lavoro in corso. In questa fase, tali strumenti in background hanno capacità limitate — ad esempio, non possono inviare autonomamente messaggi, modificare il contenuto delle applicazioni o controllare il browser e il computer dell’utente.
In generale, l’autonomia dei Dots è limitata dal sistema di permessi. L’utente decide a quali applicazioni l’agente avrà accesso e può impostare regole per azioni specifiche: consentirle automaticamente, richiedere conferma o vietarle completamente. I Dots chiederanno anche di confermare le azioni che coinvolgono gli account dell’utente o che potrebbero portare alla trasmissione di informazioni. Alcune operazioni, come il cambio di password, OpenAI le riserva esclusivamente all’utente.
I Dots hanno anche un meccanismo separato di protezione contro comportamenti potenzialmente pericolosi. Se l’agente rileva una minaccia alla sicurezza, può sospendere o interrompere completamente l’esecuzione del compito. OpenAI sottolinea che i Dots possono comunque commettere errori, quindi i risultati del lavoro su cui si basano decisioni o azioni importanti devono essere verificati.
Per le aziende, OpenAI sta preparando versioni specializzate di Dots. Qui l’agente avrà un account separato, le proprie credenziali e solo l’insieme di accessi ai sistemi aziendali necessario per svolgere un ruolo specifico. L’azienda sta già testando scenari per gli acquisti, l’elaborazione delle fatture, l’email marketing, il supporto clienti e la stipula di contratti commerciali.
Carolina Vivianti è consulente/Advisor autonomo in sicurezza informatica con esperienza nel settore tech e security. Ha lavorato come Security Advisor per Ford EU/Ford Motor Company e Vodafone e ha studi presso la Sapienza Università di Roma.
Aree di competenza: Cybersecurity, IT Risk Management, Security Advisory, Threat Analysis, Data Protection, Cloud Security, Compliance & Governance