Red Hot Cyber
Sicurezza Informatica, Notizie su Cybercrime, Analisi Vulnerabilità e Intelligenza Artificiale
Due robot umanoidi, uno maschile e uno femminile, in un ambiente futuristico con persone in sottofondo

Anthropic è attenta al “benessere dei modelli”. Se insulti o maltratti Claude, verrai bloccato!

9 Ottobre 2026 08:05
In sintesi

Anthropic ha aggiornato le regole d'uso dei suoi modelli di IA, vietando agli utenti di insultare sistematicamente o maltrattare il bot Claude. L'azienda ha anche rafforzato i limiti sull'uso dell'IA per sorveglianza, sviluppo di armi e interferenza nelle elezioni.

Anthropic ha aggiornato le regole d’uso delle sue modelli di IA e ha vietato per la prima volta esplicitamente agli utenti di insultare sistematicamente o maltrattare il bot. Se si esagera, Claude interromperà semplicemente la conversazione. Allo stesso tempo, l’azienda ha rafforzato i limiti sull’uso dell’IA per la sorveglianza, lo sviluppo di armi e l’interferenza nelle elezioni.

Ad agosto dell’anno scorso, l’azienda aveva annunciato che avrebbe permesso a Claude di interrompere il dialogo con gli utenti che dimostrano «comportamento dannoso o offensivo persistente», nell’ambito di uno studio sulle questioni del «benessere del modello». Nelle regole aggiornate è indicato che l’interruzione della comunicazione rimane «il principale meccanismo di risposta».

In Anthropic non hanno specificato nella nuova policy se sia previsto l’introduzione di ulteriori misure, come il blocco degli utenti per il trattamento scorretto di Claude. L’azienda ha spiegato che le nuove regole «hanno lo scopo di agire solo nei casi estremi, quando gli utenti si comportano ripetutamente e senza un apparente scopo in modo crudele nei confronti dei nostri modelli. Queste misure non si applicano ai casi in cui gli utenti esprimono semplicemente insoddisfazione o dissenso, affrontano temi creativi cupi, nonché testano o studiano il modello».

Advertising

Oltre alle misure per garantire il «benessere del modello», Anthropic ha unificato una serie di limitazioni precedentemente introdotte in un divieto unico per la conduzione di campagne commerciali o politiche fuorvianti. In questo modo, l’azienda ha risposto al problema crescente della diffusione di propaganda creata con l’IA. Il divieto riguarda «i tentativi di nascondere l’autore reale del messaggio o di aumentare artificialmente la portata del contenuto con account e pubblicazioni falsi». La sezione dedicata alle elezioni vieta anche l’inganno degli elettori e il sabotaggio del processo elettorale diffondendo disinformazione «sui candidati o sulle modalità di voto, spacciandosi per candidati o funzionari delle commissioni elettorali, nonché i tentativi di ridurre l’affluenza alle urne».

Sebbene le regole d’uso vietassero già esplicitamente lo sviluppo di armi con Claude, sono state registrate numerose tentativi di utilizzare il modello per creare istruzioni e software di controllo per armamenti. In conseguenza di ciò, le regole aggiornate ampliano il divieto. Ora esso copre «il software e i componenti che garantiscono il funzionamento delle armi, nonché azioni come l’equipaggiamento di sistemi di combattimento per droni e altri veicoli autonomi». Inoltre, sullo sfondo di tentativi sempre più frequenti di utilizzare sistemi basati su Claude per la sorveglianza e l’identificazione di «dissidenti politici», Anthropic ha formulato in modo più chiaro i divieti relativi alla sorveglianza delle persone.

«Il tracciamento delle persone senza il loro consenso è vietato — indipendentemente dal fatto che avvenga in tempo reale o attraverso l’analisi di dati precedentemente raccolti», hanno sottolineato in Anthropic. «Claude non può essere utilizzato per prendere decisioni o formulare raccomandazioni su chi debba essere sottoposto a indagini, arrestato o accusato nell’ambito delle attività di applicazione della legge o del procedimento penale. Proibiamo inoltre l’uso di Claude per creare o migliorare strumenti destinati alla sorveglianza».

In Anthropic si nota che queste regole possono essere modificate nell’ambito di «contratti con determinati clienti governativi […] se, a giudizio di Anthropic, i limiti contrattuali sull’uso e le misure di protezione previste sono sufficienti per prevenire potenziali danni». In precedenza, l’azienda aveva già collaborato con le forze armate degli Stati Uniti, riporta The Verge.

Anthropic ha introdotto anche una nuova regola: se i modelli «sono connessi a dispositivi in grado di compiere azioni fisiche autonome e causare lesioni», allora «un operatore qualificato deve essere in grado di monitorare il dispositivo e, se necessario, fermarlo». Tuttavia, non è specificato se questo operatore debba essere un essere umano. Questa regola riflette la crescente tendenza: i laboratori di IA investono in robotica e altri dispositivi hardware per dotare i sistemi di IA di un’incarnazione fisica. Forse questo può anche essere un accenno a futuri partenariati di Anthropic in questo settore.

Advertising

Nell’ultimo anno, in Anthropic si è discusso più volte dell’idea che i suoi modelli di IA possano, in qualche misura, possedere coscienza. «Le questioni relative all’esperienza interna potenziale, alla coscienza, allo status morale e al benessere dei modelli sono temi seri che stiamo studiando man mano che i modelli si perfezionano e la loro funzionalità si espande», ha dichiarato a febbraio in una conversazione con The Verge Kyle Fish (Kyle Fish), a capo delle ricerche sull’azienda dedicate al benessere dei modelli. 


📢 Resta aggiornatoTi è piaciuto questo articolo? Rimani sempre informato seguendoci su 🔔 Google News.
Ne stiamo anche discutendo sui nostri social: 💼 LinkedIn, 📘 Facebook e 📸 Instagram.
Hai una notizia o un approfondimento da segnalarci? ✉️ Scrivici


Carolina Vivianti 300x300
Carolina Vivianti è consulente/Advisor autonomo in sicurezza informatica con esperienza nel settore tech e security. Ha lavorato come Security Advisor per Ford EU/Ford Motor Company e Vodafone e ha studi presso la Sapienza Università di Roma.
Aree di competenza: Cybersecurity, IT Risk Management, Security Advisory, Threat Analysis, Data Protection, Cloud Security, Compliance & Governance