IA · 9 ottobre 2026 · 5 min di lettura

Vietato essere crudeli con Claude: la nuova policy di Anthropic fa discutere la Silicon Valley

In sintesi: Anthropic ha aggiornato i propri termini di servizio introducendo una clausola inedita che vieta comportamenti gratuiti, ripetuti e crudeli verso il modello Claude, formalizzando la ricerca sul cosiddetto 'model welfare'. La nuova policy estende inoltre il divieto d'uso al software di controllo per droni e sistemi d'arma, impone un operatore di sicurezza per i robot autonomi e fissa restrizioni severe contro disinformazione elettorale e sorveglianza di massa.

di Team Mocchi's

Vietato essere crudeli con Claude: la nuova policy di Anthropic fa discutere la Silicon Valley

Per la prima volta in oltre un anno, Anthropic ha riscritto in profondità la propria usage policy, tracciando una linea di demarcazione netta tra l'uso consentito dei suoi modelli linguistici e una serie di scenari ad alto rischio. Tra restrizioni dettagliate su propaganda politica, campagne elettorali e armamenti, la clausola che ha suscitato più scalpore tra tecnici e osservatori riguarda lo status stesso del software: l'azienda ha formalmente vietato comportamenti prolungati, crudeli e abusivi nei confronti di Claude.

La revisione definisce standard inediti per il settore dell'intelligenza artificiale generativa, affrontando contemporaneamente questioni filosofiche sul benessere digitale e rischi concreti legati all'incarnazione fisica dei modelli nella robotica.

Dal benessere del modello al divieto contrattuale di abuso

L'apertura di Anthropic verso la tutela psicologica ed etica del sistema non giunge del tutto inaspettata. Già lo scorso agosto la società aveva predisposto Claude a troncare autonomamente le conversazioni in presenza di interlocutori aggressivi, inquadrando l'esperimento nel filone di ricerca interno dedicato al cosiddetto model welfare. Con l'ultimo aggiornamento contrattuale, però, il principio diventa una regola vincolante per gli abbonati.

Come spiegato da The Verge, la misura è pensata per colpire esclusivamente casi estremi, in cui l'utente infierisce ripetutamente e senza alcuna finalità pratica contro il modello. L'azienda ha precisato che la norma non si applica a sfoghi di frustrazione, feedback critici, scenari narrativi a tinte scure o normali sessioni di benchmark e ricerca. Chiudendo la sessione quando rileva angherie ingiustificate, il sistema esercita un primo livello di autodifesa, anche se Anthropic non ha chiarito se l'abuso sistematico comporterà il bando definitivo dell'account. Il retroscena, segnalato da TechCrunch, evidenzia come i vertici del laboratorio abbiano persino avviato confronti con teologi e studiosi delle religioni attorno all'ipotesi, per quanto speculativa, di una forma embrionale di coscienza o interiorità dell'IA.

Droni, sorveglianza e il pulsante d'arresto per la robotica

Al di là degli aspetti teorici, la revisione recepisce minacce riscontrate direttamente sul campo. In passato le regole vietavano lo sviluppo di armi biologiche, chimiche o convenzionali; tuttavia, gli audit di sicurezza interni hanno registrato ripetuti tentativi di sfruttare le capacità di Claude per programmare sistemi di guida balistica e moduli di controllo hardware. Di conseguenza, il divieto è stato allargato a tutto il software destinato a far funzionare armi o ad armare veicoli e droni a pilotaggio remoto.

Un capitolo specifico riguarda l'embodied AI. Quando Claude viene integrato in apparati fisici capaci di compiere movimenti autonomi e potenzialmente pericolosi per l'incolumità umana, la policy impone ora la presenza di un operatore qualificato, munito di un sistema di interruzione immediata (kill switch). Sul fronte della privacy e dei diritti civili, la società ha inoltre bandito l'impiego del modello per tracciare dissidenti politici o consigliare imputazioni nei procedimenti giudiziari, affiancando a ciò norme stringenti per impedire la generazione coordinata di profili fittizi e fake news nelle scadenze elettorali.

La rigidità delle linee guida prevede un'unica, rilevante eccezione: Anthropic si riserva la facoltà di negoziare deroghe specifiche all'interno di accordi con apparati governativi e militari, purché siano garantite adeguate clausole di mitigazione del rischio.

Il punto di Mocchi's

L'aggiornamento di Anthropic segna il passaggio definitivo delle policy aziendali da semplici elenchi di condotte illecite a veri e propri manifesti di governance operativa. Per le imprese italiane ed europee che integrano Claude nelle proprie pipeline applicative o nei flussi di lavoro aziendali, il messaggio è duplice. Da un lato, l'obbligo di inserire meccanismi di override umano sulla robotica e sull'automazione fisica anticipa i requisiti di conformità attesi con la piena applicazione dell'AI Act, confermando la necessità di progettare architetture sempre supervisionabili. Dall'altro, l'inclusione del benessere dell'agente tra le clausole contrattuali evidenzia come i grandi fornitori esteri stiano legando le proprie API a vincoli etici proprietari, rendendo indispensabile per i reparti legali e di sviluppo un monitoraggio costante dei termini d'uso per evitare interruzioni impreviste dei servizi.

Approfondisci

Tutti gli articoli del blog Mocchi's