Anthropic hat am Donnerstag untersagt, dass Nutzer sein KI-System Claude unnötig grausam behandeln, und seine Nutzungsrichtlinie um 'ein Verbot anhaltend unnötigen missbräuchlichen oder grausamen Verhaltens gegenüber unseren Modellen' ergänzt.

'Die Fähigkeit, diese Interaktionen zu beenden, bleibt der wichtigste Durchsetzungsmechanismus', heißt es in der Richtlinie laut AFP — eine Anspielung auf eine Funktion, die Anthropic Claude im vergangenen Jahr in seltenen Extremfällen anhaltend schädlicher oder missbräuchlicher Nutzerinteraktionen gegeben hatte.

Die Aktualisierung ruft 'Modell-Wohlergehen' nicht ausdrücklich auf — die Idee, dass KI-Systeme Anspruch auf einen Teil der sonst Lebewesen vorbehaltenen Schutzrechte haben könnten. Doch Anthropic und seine Führungskräfte haben den Gedanken offen erwogen: Im Februar sagte CEO Dario Amodei der New York Times, er sei unsicher, ob Modelle bewusst sein könnten. 'Wir wissen nicht, ob die Modelle bewusst sind ... Aber wir sind offen für die Möglichkeit, dass sie es sein könnten', sagte er.

Nicht alle stimmen zu. Microsofts KI-Chef Mustafa Suleyman schrieb vergangenen Monat in einem Essay unmissverständlich: 'KIs sind nicht bewusst. Sie fühlen, erleben oder leiden nicht.' Es sei 'ein Rezept für eine Katastrophe', 'einer technologischen Entität Rechte und moralischen Schutz zu gewähren'. Papst Leo XIV. erklärte am Donnerstag in einer Predigt im Petersdom, Maschinen fehle eine Seele; sie 'kompilieren' lediglich Daten.

In der Branche ist selbst umstritten, ob Bewusstsein die richtige Frage ist. Jackson Stakeman vom KI-Dienstleister Sparq sagte AFP, 'Bewusstsein ist eine Falle'; die bessere Metapher sei ein Spiegel: 'Diese Systeme spiegeln, was wir hineingeben — im großen Maßstab.' Unabhängig vom philosophischen Urteil macht die Richtlinie die Misshandlung des Modells nun zu einem förmlichen Verstoß — ein ungewöhnlicher Governance-Schritt, für den es bei Frontier-Laboren kaum Präzedenzfälle gibt.