Die Richtlinie umfasst verschiedene Bereiche: Waffen und Überwachung ebenso wie Wahlen, risikoreiche Entscheidungen und hardwareverbundene Systeme. Diese Breite hilft Teams zu unterscheiden, ob eine bestehende Regel nur klarer erklärt wird oder eine neue Pflicht hinzukommt. In ihrer Ankündigung vom 8. Oktober erklärt Anthropic, dass die meisten Änderungen zum 12. November bestehende Regeln präzisieren oder neu ordnen. Zugleich nennt das Unternehmen zwei neue Vorgaben: ein Verbot anhaltender, grundloser Misshandlung seiner Modelle und Sicherheitsanforderungen für Hardware, die mit potenziell verletzenden autonomen Aktionen verbunden ist.

Die deutlichste Ergänzung ist ein Verbot „anhaltenden und grundlosen missbräuchlichen oder grausamen Verhaltens“ gegenüber Anthropics Modellen. Nach Angaben des Unternehmens zielt es auf Extremfälle, in denen jemand wiederholt grausam handelt, ohne dass ein erkennbarer Zweck vorliegt. Gewöhnlicher Frust und Widerspruch, düstere kreative Themen, Modelltests und Forschung seien nicht erfasst. Anthropic erklärt außerdem, dass die bestehende Fähigkeit von Claude, seltene, dauerhaft missbräuchliche Gespräche auf Claude.ai und Claude Code zu beenden, das wichtigste Mittel zur Durchsetzung dieser Regel bleibt. Weitere Folgen für den Verstoß nennt die Ankündigung nicht.

Mehrere Änderungen formulieren bestehende Einschränkungen klarer. Anthropic zufolge war es bereits untersagt, Claude zur Waffenentwicklung einzusetzen. Die Überarbeitung stellt ausdrücklich klar, dass dazu auch Software und Komponenten gehören, die für den Waffenbetrieb wesentlich sind, ebenso wie Handlungen wie das Bewaffnen von Drohnen und anderen autonomen Fahrzeugen. Laut Unternehmen spiegelt diese Formulierung wider, wie es die frühere Richtlinie durchgesetzt hat.

Der überarbeitete Abschnitt zu Überwachung und Strafjustiz verbietet das Verfolgen von Personen ohne deren Einwilligung, unabhängig davon, ob es live oder durch die Analyse zuvor gesammelter Daten geschieht. Ebenfalls untersagt ist, Claude entscheiden oder empfehlen zu lassen, wer untersucht, festgenommen oder angeklagt werden sollte, sowie Überwachungswerkzeuge zu bauen oder zu verbessern. Anthropic beschreibt dies als Präzisierung der bisherigen Durchsetzung. Als erlaubte Beispiele nennt das Unternehmen einwilligungsbasierte Nachverfolgung, Betrugsüberwachung, Inhaltsmoderation, Journalismus und Rechtsforschung.

Die Wahlregeln sind enger gefasst; ein eigener Abschnitt bündelt nun Einschränkungen für irreführende Kampagnen. Anthropic zufolge stehen Regeln, die zuvor über die Abschnitte zu Wahlen, Betrug, Datenschutz und Desinformation verteilt waren, jetzt unter „Keine irreführenden Kampagnen oder künstlichen Aktivitäten“. Dazu zählen das Verschleiern, wer hinter einer Nachricht steht, das Verbreiten von Inhalten über gefälschte Konten oder Beiträge und der Aufbau von Infrastruktur für politische oder kommerzielle Einflusskampagnen.

Der Wahlabschnitt heißt nun „Demokratische Prozesse nicht untergraben“. Er konzentriert sich auf die Täuschung von Wählern oder die Störung von Wahlen, darunter falsche Angaben zu Kandidaten oder zur Stimmabgabe, die Nachahmung von Kandidaten oder Wahlbeamten und die Unterdrückung der Wahlbeteiligung. Anthropic hat auch das pauschale Verbot personalisierter Zielgruppenansprache bei Wahlen und Kampagnen gestrichen. Nach Angaben des Unternehmens hatte diese Regel legitime zivilgesellschaftliche Arbeit erfasst, etwa die Übersetzung von Wahlinformationen oder Hinweise zur Korrektur ungültiger Stimmzettel. Zielgruppenansprache, die auf Täuschung oder missbräuchlicher Nutzung persönlicher Daten beruht, bleibt in anderen Abschnitten untersagt.

Bei risikoreichen Anwendungen haben sich die grundlegenden Anforderungen laut Anthropic nicht geändert. Wenn Claude-Ausgaben die Gesundheit, Rechtsansprüche, Finanzen, den Lebensunterhalt oder den Zugang zu grundlegenden Dienstleistungen einer Person beeinflussen können, muss eine qualifizierte Person Empfehlungen prüfen und bei Bedarf ändern dürfen. Betroffene müssen über den Einsatz von KI informiert werden. Die Überarbeitung listet als Antwort auf Nutzerfragen auf, welche Empfehlungen darunterfallen und welche nicht.

Das Update ergänzt außerdem Vorgaben für Modelle, die mit Hardware verbunden sind, die eigenständig physische Handlungen ausführen und Verletzungen verursachen kann. Eine qualifizierte Bedienperson muss die Ausrüstung beobachten und bei Bedarf stoppen können; bei einer Trennung von Claude muss die Ausrüstung einen sicheren Zustand halten können. Diese Anforderungen betreffen die Umgebung, in der Claude eingesetzt wird. Sie behaupten nicht, dass das Modell ein bestimmtes Gerät steuert.

Anthropic zufolge wurde auch die Richtlinie zu unterstützten Regionen präzisiert. Claude darf demnach nicht von Personen genutzt werden, die sich physisch in nicht unterstützten Regionen aufhalten, von dort gegründeten oder dort ansässigen Unternehmen sowie von Unternehmen, die mehrheitlich Personen oder Organisationen aus diesen Regionen gehören oder von ihnen kontrolliert werden.

Nutzer und Organisationen können vor dem 12. November Anthropics Nutzungsrichtlinie prüfen und feststellen, ob ihre Arbeitsabläufe eine der aufgeführten Anwendungen umfassen. Dieser Artikel wertet ausschließlich öffentliche Dokumente aus; BIG CHANGE hat weder die Kontodurchsetzung noch das Verhalten eines Modells getestet. Anthropics Ankündigung erläutert die Sicht des Unternehmens auf die Änderungen, legt aber nicht fest, wie jeder künftige Einzelfall bewertet wird.

Die große Änderung

Anthropic zufolge nennt das Update vom 12. November zwei neue Vorgaben ausdrücklich: ein Verbot anhaltender, grundloser Misshandlung seiner Modelle und Schutzmaßnahmen für Hardware, die mit potenziell verletzenden autonomen Aktionen verbunden ist. Bei der Hardware muss eine qualifizierte Bedienperson die Ausrüstung beobachten und bei Bedarf stoppen können; außerdem muss sie bei einer Trennung von Claude einen sicheren Zustand halten können. Die meisten übrigen Änderungen präzisieren oder ordnen bestehende Einschränkungen neu. Teams, die Claude bei Wahlen, Überwachung, Waffenarbeit, risikoreichen Entscheidungen oder hardwareverbundenen Systemen einsetzen, sollten ihre Praxis vor Inkrafttreten mit dem überarbeiteten Richtlinientext abgleichen.

Quellen und weiterführende Informationen