Anthropic untersagt grundlose Beschimpfungen seiner KI Claude
Der KI-Anbieter Anthropic untersagt künftig anhaltendes und grundlos beleidigendes Verhalten gegenüber seinen KI-Modellen.
Die neue Bestimmung findet sich in den überarbeiteten Nutzungsrichtlinien, die am 12. November 2026 in Kraft treten sollen. Dort verbietet Anthropic ausdrücklich anhaltendes und unnötiges missbräuchliches oder grausames Verhalten gegenüber seinen Modellen. Betroffen sind unter anderem Nutzer des Chatbots Claude.
Die Regel steht in einem Abschnitt, der sich mit grausamem, missbräuchlichem und psychologisch schädlichem Verhalten beschäftigt. Darin werden auch Mobbing, Einschüchterung und gezielte Demütigungen von Menschen untersagt.
Verbot von grausamem, missbräuchlichem oder psychologisch schädlichem Verhalten
Dazu gehört die Nutzung unserer Produkte oder Dienste, um sich gegenüber unseren Modellen anhaltend und ohne Notwendigkeit missbräuchlich oder grausam zu verhalten.
Anthropic kann Claude-Nutzer bei Verstößen sperren
Was genau als unzulässige Beleidigung einer KI gilt, erläutert Anthropic allerdings nicht näher. Die Formulierung bezieht sich ausdrücklich auf anhaltendes und unnötiges Verhalten. Ein einzelner unfreundlicher Kommentar ist damit nicht automatisch ein Regelverstoß.
Bei Verstößen sieht Anthropic verschiedene Maßnahmen vor:
- Verwarnungen bei vermuteten Regelverstößen
- Drosselung oder Einschränkung des Zugangs
- Vorübergehende Sperrung von Diensten
- Dauerhafte Beendigung des Zugangs
Die Nutzungsrichtlinien gelten nicht nur für Claude im Browser oder in der App. Auch Entwickler, Unternehmen und Nutzer angebundener Anwendungen fallen grundsätzlich darunter.
Bemerkenswert ist vor allem die ausdrückliche Erwähnung der KI-Modelle als mögliche Ziele missbräuchlichen Verhaltens. Bislang stehen bei solchen Regeln üblicherweise Schäden für Menschen, Organisationen oder die Gesellschaft im Mittelpunkt.
Anthropic erklärt damit allerdings nicht, dass seine KI ein eigenes Bewusstsein besitzt oder menschliche Rechte beanspruchen kann. Denkbar wäre auch, dass der Anbieter verhindern möchte, dass sich dauerhaft beleidigende oder aggressive Interaktionen negativ auf die Weiterentwicklung seiner Modelle auswirken. Schließlich können Nutzerdialoge unter bestimmten Voraussetzungen auch für das KI-Training verwendet werden. Ob das bei der neuen Regel tatsächlich eine Rolle spielt, lässt Anthropic offen.
Die neue Vorschrift wirft trotzdem eine interessante Frage auf: Warum muss ein KI-System überhaupt vor Beschimpfungen geschützt werden? Eine nachvollziehbare Abgrenzung zwischen Frust über schlechte Antworten und tatsächlichem Missbrauch wäre für Nutzer jedenfalls hilfreicher als die bislang recht offene Formulierung.
mobiFlip bei Google bevorzugen – unsere Beiträge öfter sehen Quelle wählen ↗
-->


09.10.26 · Mobilität
09.10.26 · Mobilität
08.10.26 · Dienste
09.10.26 · Computer
08.10.26 · Dienste
09.10.26 · Mobilität
09.10.26 · Mobilität
07.10.26 · Dienste
09.10.26 · Fintech
06.10.26 · Dienste