Dev

Anthropics Usage Policy 2026 für Agent-Entwickler: Der Stoppknopf für Hardware steht in der Ankündigung, die Klausel zum Abo-Proxy nicht

Die Hardware-Regeln lassen sich mit einem gezogenen Kabel prüfen. Unautorisiertes Proxying über Consumer-Abos, die Verantwortung für das, was ein Agent mit seinen Tools tut, und eine niedrigere Schwelle für die Durchsetzung lassen sich von außen nicht prüfen, und sie kamen kommentarlos hinzu.

Anthropic hat am 8. Oktober eine neue Usage Policy veröffentlicht. Sie gilt ab dem 12. November und ersetzt die Fassung vom September 2025. Die Schlagzeile bei TechCrunch stellte eine einzige neue Zeile nach vorn, das Verbot, das Modell zu misshandeln. Legt man den neuen Text Zeile für Zeile neben den archivierten, zeigt sich: Die Teile, die Agent-Entwickler binden, stehen woanders. Mehrere kommen in Anthropics Zusammenfassung gar nicht vor.

So wie ich es lese, enthält die Policy jetzt zwei Arten von Klauseln. Die eine prüfst du, indem du ein Kabel ziehst. Die andere kannst du überhaupt nicht prüfen, und ab November wird sie schon bei bloßem Verdacht durchgesetzt.

Was verlangt Anthropics Usage Policy jetzt, wenn Claude Hardware steuert?

Eine Person, die die Anlage beobachten und stoppen kann, einen sicheren Zustand, wenn diese Person eingreift oder die Verbindung abreißt, und Grenzwerte, die das Modell nicht wegdiskutieren kann. Der Text ist neu und konkreter, als Nutzungsrichtlinien es üblicherweise sind:

text
For High-risk Physical Actions, there must be a qualified individual who is
able to observe the equipment’s operation and stop it at any time, and the
equipment must stop or hold a safe state when that individual intervenes or
when connection to our services is lost. Any operating limits to keep the
equipment within safe bounds, such as speed, force, reach, temperature,
pressure, voltage, energy output, dose, or operating area, must be enforced
by the equipment or a controller independent of model output.

Das gilt, wenn Hardware „ohne menschliche Freigabe“ auf Claudes Output hin handelt und jemanden verletzen kann: Fahrzeuge und Roboter in gemeinsam genutzten Räumen, Pressen und Roboterarme, gefährliche Energie, Geräte, die auf den Körper wirken, Sicherheitssysteme, industrielle Prozesse. Haushaltsgeräte sind nur ausgenommen, wenn sie innerhalb der eingebauten Sicherheitsgrenzen des Herstellers bleiben und das schlimmste Ergebnis „Unbehagen oder Unannehmlichkeiten“ sind. Monitoring ohne Steuerung ist ebenfalls ausgenommen, genauso alles, was eine qualifizierte Person prüft, bevor es auf der Anlage läuft. Die Zusammenfassung verknüpft den Abschnitt mit dem Model Hardware Standard, der seit dem 27. August als Research Preview vorliegt.

Den letzten Satz der Klausel würde ich mir einrahmen. In Ein Prompt ist keine Invariante habe ich argumentiert, dass eine tragende Regel dort sitzen muss, wohin die Entscheidung des Modells nicht reicht. Hier ist das eine Nutzungsbedingung, und zwar für die eine Klasse von Agenten, bei der ein Fehler mit einer zerquetschten Hand endet. Von einem Agenten, der nur Daten bewegt, verlangt die Policy nichts dergleichen.

Welche Klauseln der Anthropic Usage Policy für Agent-Entwickler fehlen in der Ankündigung?

Zuerst die Proxy-Klausel, denn bei ihr hätte ich erwartet, dass die Zusammenfassung sie erwähnt. Sie ist neu im Abschnitt über Plattformmissbrauch:

text
Resell, proxy, or otherwise provide access to Claude through unauthorized
means, including services that route requests through consumer subscriptions
or misrepresent the product or client being used

Im Mai habe ich geschrieben, dass ein Drittanbieter-Harness auf einem Claude-Abo gegen die Bedingungen verstieß und praktisch geduldet wurde. Was als autorisiert gilt, steht nicht in der Policy. Anthropics eigener Hilfeartikel sagt heute, dass Apps von Drittanbietern mit den Abo-Limits funktionieren. Ich lese die Klausel so, dass sie auf Dienste zielt, die anderen Leuten über einen Abo-Login Zugang verschaffen. „Das verwendete Produkt oder den verwendeten Client falsch darstellen“ ist die Formulierung, die du zweimal lesen solltest, wenn sich dein Tool als etwas ausgibt, das es nicht ist. Die Zeile daneben nennt jetzt außerdem die „Umgehung des Prozesses zur Kontoregistrierung oder Anmeldung“ als Umgehung.

Die Agenten-Klausel sagte früher, agentische Nutzung müsse die Policy „weiterhin einhalten“, und verwies auf einen Hilfeartikel. Jetzt ordnet sie die Handlungen zu:

text
Users are responsible for ensuring that agents they build or deploy,
including actions those agents take through tools, browsers, or connected
systems, comply with this Usage Policy.

Und der Absatz zur Durchsetzung wechselte von „Wenn wir erfahren, dass du verstoßen hast“ („If we learn that you have violated“) zu „Wenn wir vermuten, dass du verstoßen haben könntest“ („If we suspect that you may have violated“). Neben Drosseln, Sperren und Kündigen stehen jetzt auch „verwarnen“ und „einschränken“.

Was hat Anthropics Usage Policy bei Hochrisiko-Entscheidungen über Menschen geändert?

Die beiden Grundsätze sind geblieben, ein qualifizierter menschlicher Prüfer und Offenlegung, und der Text darunter wurde neu geschrieben. Laut Zusammenfassung haben sich die Anforderungen „nicht geändert“. Der Wortlaut schon. Offenlegung galt bisher, wenn Modell-Output einer Person direkt angezeigt wurde. Jetzt erreicht sie jeden, der „Gegenstand einer Entscheidung“ ist, die auf der Empfehlung beruht. Die Offenlegung folgt jetzt der Entscheidung und nicht mehr dem Bildschirm. Ein Agent, der im Backoffice Bewerber bewertet, schuldet sie also Menschen, die nie ein Wort des Modells zu sehen bekommen.

Die Liste der erfassten Bereiche ist genauer geworden, bis hinunter zu „Schichten, Arbeitsstunden oder Bezahlung festlegen oder ändern“. Eine Kategorie ist herausgefallen: Medien. 2025 erfasste sie den Einsatz von Claude, um „automatisch Inhalte zu erzeugen und für den externen Konsum zu veröffentlichen“.

Reicht das Verbot der Anthropic Usage Policy, KI-Antworten mit platzierten Inhalten zu füttern, bis in die SEO-Arbeit?

Nur dort, wo der Inhalt darüber lügt, wer dahintersteht. Der neue Abschnitt zu Täuschungskampagnen enthält Folgendes:

text
Manipulate the sources from which search engines or AI systems draw answers
by seeding them with content that misrepresents its origin, authorship, or
independence (e.g., networks of sites posing as unaffiliated sources
corroborating the same claims)

Zusammen mit dem Wegfall der Kategorie Medien ist das dieselbe Bewegung, an zwei Stellen sichtbar. Die Policy behandelt automatisiertes Veröffentlichen nicht mehr als das Risiko und macht die verschleierte Herkunft zum Verstoß. Nach meiner Lesart sind Herkunft, Urheberschaft und Unabhängigkeit der Maßstab, nicht die Optimierung. Wer Inhalte unter eigenem Namen veröffentlicht und nicht verbirgt, wer sie geschrieben hat, wer dafür bezahlt hat und mit wem sie verbunden sind, steht außerhalb der Klausel. Auch zu messen, ob ein Assistent dich zitiert, bleibt außerhalb. Ein Ring von Websites, die sich als voneinander unabhängig ausgeben, fällt darunter, und das Bauen der Werkzeuge dafür ebenso.

Wie wird das Verbot von Grausamkeit gegenüber Claude in der Anthropic Usage Policy bei API-Entwicklern durchgesetzt?

Dadurch, dass Claude das Gespräch beendet. Das sagt allerdings die Zusammenfassung. Die Policy selbst sagt nichts zum Wie. Laut Zusammenfassung bleibt die Fähigkeit, Gespräche zu beenden, „der primäre Durchsetzungsmechanismus“, genannt wird sie für Claude.ai und Claude Code. Wenn das der ganze Mechanismus ist, liegt ein Produkt auf der API nicht auf diesem Pfad, und dafür gilt der allgemeine Absatz, der jetzt beim Verdacht beginnt. Das ist mein Schluss. Keines der beiden Dokumente sagt es.

Was sollte ein Agent-Entwickler in Anthropics Usage Policy vor dem 12. November prüfen?

Fang mit dem an, was du testen kannst. Trenne an einem Hardware-Aufbau die Verbindung und schau, was die Anlage tut. Sieh nach, ob dein Chatbot oder Agent zu Beginn einer Sitzung oder in der Oberfläche sagt, dass er eine KI ist. Der neue Text lässt beides gelten. Prüfe, ob irgendetwas, das du auslieferst, Claude im Auftrag anderer über den Abo-Login einer Person erreicht. Formulierungen wie „sinnvoll prüfen“ („meaningfully review“) und „darauf ausgelegt, zu erleichtern“ („designed to facilitate“) lassen sich von außen nicht testen. Das sind Ermessensfragen, und die erklärte Schwelle, ab der Anthropic bei einer davon handelt, ist jetzt der Verdacht.

Diskussion

Hier gibt es keine Kommentarspalte. Diskussionen laufen auf X.

Max Nardit

Max Nardit

@mnardit

Weitere Artikel