Anthropic ha introdotto nella propria policy d’uso il divieto esplicito per gli utenti di tenere comportamenti “abusivi o crudeli in modo prolungato e senza necessità” nei confronti di Claude. L’azienda ha precisato che la restrizione riguarda solo casi estremi, privi di scopo riconoscibile, e non la normale frustrazione o i test sul modello.
La norma richiama una funzione introdotta ad agosto, che consente ai modelli di chiudere conversazioni con utenti persistentemente ostili. Anthropic l’ha definita una tutela per il possibile “benessere” dei modelli, specificando sul proprio sito di restare “altamente incerta” sul loro statuto morale, e afferma di voler sviluppare interventi a basso costo per ridurre eventuali rischi, qualora tale forma di benessere risultasse possibile. L’aggiornamento inasprisce anche i divieti su sorveglianza, sviluppo di armamenti e campagne politiche ingannevoli, vietando il tracciamento di persone senza consenso e l’uso di Claude per decisioni su indagini o arresti.
The Guardian evidenzia che il tema di una “coscienza” dei modelli resta controverso dentro e fuori il settore. Il CEO Dario Amodei ha più volte dichiarato di non poter escludere tale possibilità. Come riporta The Verge, il codice di condotta di Microsoft AI, elaborato da Mustafa Suleyman, respinge invece l’idea che i modelli possano avere diritti o essere titolari di welfare.
Leggi gli articoli completi:
- Anthropic bans ‘abusive or cruel behavior’ toward Claude su The Verge
- Anthropic bans users from ‘needless abusive or cruel behavior’ towards Claude su The Guardian
Immagine generata tramite DALL-E. Tutti i diritti sono riservati. Università di Torino (28/01/2025).

