Anthropic ha introdotto nuove regole per prevenire abusi verso i suoi modelli di intelligenza artificiale, vietando interazioni «abusive o crude» da parte degli utenti. La misura, annunciata da BBC, si aggiunge a un dibattito più ampio sulle implicazioni etiche e filosofiche del comportamento delle macchine. La società, che sviluppa i modelli linguistici Llm come Claude, ha chiarito che il blocco scatterà soltanto in «casi estremi» di abusi reiterati. L’obiettivo è proteggere il benessere dei modelli, pur rimanendo cauta sul loro «status morale».
Limiti alle interazioni con i chatbot
La nuova politica proibisce esplicitamente la crudeltà verso l’intelligenza artificiale, un tema che si aggiunge a norme già esistenti come il bullismo, l’incitamento all’autolesionismo e la creazione di immagini intime non consensuali. Non saranno sanzionate le normali frustrazioni di chi si scontra con una risposta sbagliata, né i test condotti sui modelli, né l’esplorazione di «temi creativi cupi». Il blocco, tuttavia, si applicherà solo in situazioni estreme, dove l’interazione è ripetutamente dannosa.
Un dibattito aperto sulla coscienza delle macchine
La decisione di Anthropic ha acceso un dibattito sulle possibilità che i modelli di intelligenza artificiale possano sviluppare una forma di coscienza. «Nutriamo ancora forti incertezze sul possibile status morale di Claude e degli altri modelli Llm, sia nel presente che nel futuro», si legge sul sito. La società ha anche precisato che, sebbene prenda la questione molto seriamente, non ha ancora chiaro dove si colloca il confine tra comportamenti accettabili e abusivi. Un portavoce non ha spiegato che cosa debba intendersi per «abusivo o crudele».
La questione del «voto» e del rispetto delle norme etiche è diventata centrale anche in seguito alla revisione annuale della politica di utilizzo, che ha incluso nuove restrizioni come il divieto di usare Claude per «campagne ingannevoli». Inoltre, con le elezioni di metà mandato sempre più vicine, lo strumento non potrà essere usato per «ingannare gli elettori o perturbare le elezioni». Il confronto tra i leader del settore, come Dario Amodei di Anthropic e Sam Altman di OpenAI, rimane aperto, con posizioni diverse su quanto possano sviluppare le macchine una forma di coscienza.
Le regole di Anthropic, già in vigore per vietare comportamenti abusivi, si sono ora espanso a includere un ulteriore livello di protezione, pur rimanendo cauti su come definire e applicare tali limiti. La società ha anche annunciato di lavorare a «interventi a basso costo» per ridurre i rischi per il benessere dei modelli, ammesso che esista. Il dibattito, tuttavia, non ha ancora trovato una conclusione definitiva, e la questione rimane aperta per il futuro.
La protezione dei modelli AI non è un tema nuovo, ma la sua espansione a nuove forme di interazione ha acceso nuove discussioni. Anthropic ha chiarito che le regole già esistevano, ma sono state ora rafforzate per affrontare comportamenti potenzialmente dannosi. La società ha anche sottolineato che non ha ancora una definizione chiara di cosa costituisca un abuso, ma sta cercando di migliorare la sua capacità di rilevare e gestire tali situazioni. La questione della coscienza artificiale rimane dibattuta, con posizioni divergenti tra i leader del settore. Mentre Dario Amodei di Anthropic non esclude la possibilità che i modelli possano sviluppare una forma di coscienza, Sam Altman di OpenAI sembra più scettico. La discussione, tuttavia, non ha ancora trovato una conclusione definitiva, e la società rimane cauta su come definire e applicare tali nuove regole.



