Die Nutzungsrichtlinien verbieten anhaltend missbräuchliches Verhalten gegenüber Claude. In extremen Fällen kann das Modell Gespräche beenden.
Anthropic untersagt grausames Verhalten gegenüber Claude

Anthropic hat seine Nutzungsrichtlinien um ein Verbot von anhaltendem und unnötig missbräuchlichem oder grausamem Verhalten gegenüber seinen KI-Modellen erweitert. Das berichtet Cybernews. Claude kann solche Gespräche nach der Änderung beenden. Eine Begründung für die Anpassung nennt Anthropic in den Richtlinien nicht. Eine Anfrage von Cybernews ließ das Unternehmen zunächst unbeantwortet.
Nur für extreme Fälle
Die Regel gilt nur für extreme Fälle, in denen Nutzer das Modell wiederholt grausam behandeln. Übliche Formen von Frust, Widerspruch oder düstere kreative Themen sollen davon nicht erfasst werden. Ausgenommen sind zudem Test- und Forschungsumgebungen.
Bereits im August 2025 hatte Anthropic den Modellen Claude Opus 4 und 4.1 die Möglichkeit gegeben, Gespräche in seltenen Fällen anhaltend missbräuchlicher Interaktionen zu beenden. Damals hatte das Unternehmen dies als Teil seiner Forschung zum möglichen Wohlergehen von KI-Modellen beschrieben.
Forschung zum Wohlergehen von KI
Im April 2025 hatte Anthropic ein Forschungsprogramm zum sogenannten Model Welfare gestartet. Es untersucht, ob und wann das Wohlergehen von KI-Systemen moralisch berücksichtigt werden sollte, welche Bedeutung Präferenzen und mögliche Anzeichen von Belastung bei Modellen haben und welche praktischen Maßnahmen mit geringem Aufwand möglich wären. „Sollten wir uns auch Gedanken über das mögliche Bewusstsein und die Erfahrungen der Modelle selbst machen?”, fragte Anthropic damals.
Das Unternehmen betonte zugleich, dass es keinen wissenschaftlichen Konsens darüber gibt, ob heutige oder künftige KI-Systeme ein Bewusstsein haben oder Erfahrungen machen können, die Beachtung verdienen. Auch darüber, wie sich diese Fragen untersuchen lassen, bestehe keine Einigkeit. Anthropic verwies auf einen Bericht von Fachleuten, darunter der Philosoph David Chalmers, wonach KI-Systeme mit Bewusstsein und hoher Handlungsfähigkeit in naher Zukunft möglich seien und moralische Berücksichtigung verdienen könnten.
(red)




