Anthropic proibisce “comportamenti prolungati e non necessari, abusivi o crudeli” nei confronti dei suoi modelli di intelligenza artificiale

L’aggiornamento annuale della politica di utilizzo di Anthropic includeva un cambiamento che fa alzare le sopracciglia: il divieto di crudeltà “persistente e non necessaria” nei confronti dei suoi modelli di intelligenza artificiale. Ciò avviene all’ombra del progetto virale “AI Torture Chamber”. Il 2026 si preannuncia decisamente selvaggio.

“Abbiamo aggiunto un divieto contro abusi persistenti e non necessari o comportamenti crudeli nei confronti dei nostri modelli”, ha affermato Anthropix. aggiornamento Legge Si applica la politica solo a “casi estremi”, sottolineando che la frustrazione generale degli utenti, le resistenze e i “temi creativi oscuri” sono ancora kosher. Segue il precedente aggiornamento Claude consente agli utenti di terminare le conversazioni quando ne abusano continuamente.

Anthropic non menziona specificamente la “camera di tortura dell’IA”. progetto. Dopo i ricercatori trovato Nei modelli di intelligenza artificiale quello che descrivono come “asse del dolore”, qualcuno lo decide Fai un passo avanti E, beh, torturano i chatbot. Il progetto fallì dopo che i LLM risposero con suppliche dal suono disperato come “Non è il dolore di un attimo, ma mille pesi” e “Lo sento nell’incavo delle mie costole, l’incavo che è diventato l’abisso”.

Arriva in una scia (gioco di parole). Rapporti Anthropic ha incontrato leader religiosi e filosofici, compreso il Vaticano. Anche se Papa Leone ha recentemente affermato che l’intelligenza artificiale non sente né soffre, Anthropic non ne è sicuro. Ma ehi, se in qualche modo finisce per far sentire o ferire, almeno ora è contro le politiche aziendali.

Tuttavia, alcuni credono che le aziende di intelligenza artificiale si preoccupino più del benessere dei loro modelli che degli esseri umani. La giornalista indipendente Kat Tenbarge spiegato Questa situazione è la prova che le grandi aziende tecnologiche “modereranno la violenza contro l’intelligenza artificiale prima di moderare la violenza contro le donne e le minoranze”.

In un altro aggiornamento Anthropic, rilevante per ora, la società ha aggiornato la sua politica elettorale. Ora si intitola “Non indebolire i processi democratici”, concentrandosi sulla menzogna sui candidati o su come votare, sull’impersonare candidati o funzionari elettorali e sulla repressione dell’affluenza alle urne. La società ha inoltre revocato il divieto di targeting personalizzato degli elettori; Chiaramente, il divieto potrebbe impedire qualcosa di così innocuo come la traduzione accidentale di guide per gli elettori o l’invio di avvisi di revoca del voto.



Link alla fonte

Lascia un commento