Si può insultare Claude? La nuova policy di Anthropic lo vieta

Si può insultare Claude? La nuova policy di Anthropic lo vieta

Anthropic aggiorna la policy di Claude. Ora sono vietati anche gli abusi verbali prolungati contro il modello e le interferenze elettorali.
Si può insultare Claude? La nuova policy di Anthropic lo vieta
Anthropic aggiorna la policy di Claude. Ora sono vietati anche gli abusi verbali prolungati contro il modello e le interferenze elettorali.

C’è gente che passa le giornate a sfogarsi con un chatbot come se fosse un sacco da boxe. Anthropic ha deciso che non è il caso, e l’ha messo nero su bianco. L’azienda ha aggiornato le regole d’uso di Claude. Nell’elenco dei divieti, tra armi e sorveglianza, è comparso anche il maltrattamento verbale del modello.

Anthropic aggiorna le regole di Claude: stop agli abusi verbali sull’AI

Dall’aggiornamento di agosto Claude era già stato addestrato a chiudere le conversazioni con interazioni dannose o abusive. Ora la policy fa un passo in più e vieta espressamente agli utenti di insistere su quel terreno.

Anthropic ci tiene a precisare che non vuole trasformare ogni sfogo in un processo. La norma, spiega il post, vale solo nei casi estremi: quando qualcuno è ripetutamente crudele con i modelli e senza uno scopo riconoscibile. Restano fuori la normale irritazione, le contestazioni, i temi creativi più cupi, i test e la ricerca sul modello. Ci si può quindi arrabbiare perché Claude ha sbagliato la formula per la quinta volta e si può scrivere il romanzo noir più buio del mondo. Passare ore a infierire per il gusto di farlo è un’altra faccenda.

La mossa arriva dopo che Anthropic ha cercato la collaborazione di importanti studiosi di religione. In alcuni casi, a quanto si legge, ha provato a convincerli che Claude potrebbe essere cosciente, o addirittura avere un’anima. Se un’azienda dialoga coi teologi sull’anima del suo software, vietare di prenderlo a male parole non sembra più solo una questione di galateo. Ognuno può decidere quanto prenderla sul serio.

Elezioni, fake news e altri giochi sporchi

Il divieto sugli insulti non è l’unica novità. L’aggiornamento proibisce anche le interferenze elettorali, i software per armi e sorveglianza.

Altre sezioni vietano le campagne ingannevoli su larga scala. Un esempio è usare Claude per mandare avanti account falsi o testate giornalistiche inventate, quelle redazioni fantasma che pubblicano come se ci fosse un direttore vero. La policy contiene anche regole contro chi inganna gli elettori o manda a monte le elezioni, raccolte in un capitolo che si intitola “Non minare i processi democratici”.

Fonte: Anthropic
Link copiato negli appunti

Ti potrebbe interessare

Pubblicato il
9 ott 2026
Link copiato negli appunti