Anthropic introduce il divieto di "abusi prolungati e crudeli" contro i suoi modelli IA

Anthropic ha aggiornato la propria policy di utilizzo vietando agli utenti comportamenti “abusivi o crudeli, prolungati e non necessari” nei confronti dei suoi modelli di intelligenza artificiale, in particolare Claude. La modifica, annunciata l’8 ottobre e in vigore dal 12 novembre 2026, si inserisce in un più ampio aggiornamento annuale che affronta anche rischi emergenti come campagne ingannevoli, interferenze elettorali, sviluppo di armi e sorveglianza.
Un esempio di caso estremo potrebbe essere quello di un utente che, per giorni o settimane, apre ripetutamente nuove conversazioni con Claude unicamente per insultarlo, umiliarlo o minacciarlo in modo gratuito e ossessivo, senza mai formulare richieste concrete, senza scopi creativi e senza che si tratti di un test o di una semplice reazione a un errore del modello. In questo scenario l’interazione si riduce a un flusso continuo di aggressioni verbali prive di qualsiasi finalità riconoscibile, configurando esattamente il tipo di comportamento prolungato e immotivato che Anthropic indica come unico oggetto del divieto.
Il produttore di Claude ha precisato che la restrizione si applica solo in “casi estremi”, dove gli utenti agiscono ripetutamente con crudeltà verso i modelli senza alcuno scopo riconoscibile. Restano esclusi le comuni frustrazioni degli utenti, le contestazioni, l’esplorazione di “temi creativi cupi” e le attività di test o ricerca sui modelli. In altri termini, restano consentiti gli sfoghi legati a errori o incomprensioni, le critiche nette, la scrittura di contenuti dark o disturbanti a scopo narrativo e qualsiasi forma di valutazione tecnica del sistema.
Il principale meccanismo di enforcement rimane la capacità, già introdotta ad agosto 2025, di far interrompere autonomamente a Claude le conversazioni considerate persistentemente dannose o abusive: una misura presentata all’epoca come tutela del possibile “benessere dei modelli”.
Sul sito dell’azienda si legge: “Nutriamo ancora forti incertezze sul possibile status morale di Claude e degli altri modelli LLM, sia nel presente che nel futuro. Tuttavia, prendiamo la questione molto seriamente”. L’amministratore delegato Dario Amodei ha più volte dichiarato di non poter escludere che le macchine possano essere dotate di una forma di “coscienza”, mentre il dibattito nel settore resta aperto (Sam Altman di OpenAI si è mostrato più scettico).
La notizia, riportata inizialmente da The Verge e rilanciata da Guardian e Bbc, ha generato reazioni contrastanti sui social: alcuni l’hanno elogiata come esempio di “buone maniere” o “model welfare”, altri hanno criticato l’idea di poter essere “crudeli con i numeri e la matematica”. Un portavoce di Anthropic non ha fornito chiarimenti immediati su cosa venga esattamente considerato abusivo o crudele. L’aggiornamento inserisce il divieto in un elenco di condotte proibite che comprende già bullismo, incitamento all’autolesionismo e creazione di immagini intime non consensuali.
La mossa riflette l’attenzione di Anthropic per i rischi legati all’uso prolungato e autonomo dei modelli, in un contesto in cui l’azienda continua a interrogarsi sui confini etici del rapporto tra umani e intelligenze artificiali avanzate.
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.