Nachdem die Ankündigung eines Wasserzeichens für KI-generierte Texte diese Woche für Unruhe unter den Nutzern von Claude gesorgt hatte, ist das KI-Unternehmen Anthropic in die Offensive gegangen. In einem am Freitag veröffentlichten Blogbeitrag verteidigt und erklärt das Labor die Technologie und benennt zugleich deren Grenzen. Ausgelöst hatte die Debatte eine aktualisierte Support-Seite zum Sprachmodell Claude, auf der Anthropic offenlegte, KI-erzeugte Texte künftig als solche kennzeichnen zu wollen. Manche Kunden zogen daraus bereits Konsequenzen: Gegenüber Business Insider gaben einige an, ihr Claude-Abonnement wegen des Wasserzeichens gekündigt zu haben.
- Anthropic kennzeichnet von Claude erzeugte Texte, um dem EU-KI-Gesetz (AI Act) zu entsprechen.
- Das Wasserzeichen steckt allein in der Wortwahl – es gibt keine versteckten Zeichen, Schriftarten oder Geheimtexte.
- Betroffen sind alle Claude-Produkte mit Modellen, die nach dem 2. August veröffentlicht wurden; ältere Modelle folgen in den kommenden Monaten.
Anthropic verweist auf das EU-KI-Gesetz als Auslöser
Als zentralen Grund nennt das Unternehmen die Transparenzregeln der Europäischen Union. Man setze das Wasserzeichen ein, um dem EU-KI-Gesetz (AI Act) zu entsprechen – und auch andere Anbieter müssten dies tun, heißt es in dem Beitrag, was als Anspielung auf OpenAI gelesen werden kann. Tatsächlich kündigte OpenAI laut einer vor zwei Wochen aktualisierten Support-Seite ebenfalls an, Texte künftig mit Wasserzeichen zu versehen. Auf eine Anfrage von Business Insider reagierte OpenAI zunächst nicht.
Wie so oft bei EU-Technologieregeln reicht die Wirkung über den Kontinent hinaus: Anthropic wendet das Wasserzeichen weltweit an.
Zur Begründung schreibt das Unternehmen, man rolle die Kennzeichnung „zum Start global aus, weil wir noch keine verlässliche Möglichkeit haben, sie regional einzugrenzen“. Zunächst greift das Wasserzeichen bei neuen Anthropic-Modellen, in den kommenden Monaten sollen ältere folgen. Betroffen sind laut den Angaben alle Claude-Produkte, die Modelle nach dem 2. August nutzen.
Auf Kündigungssorgen reagiert das Unternehmen gelassen
Auf die von Kunden geäußerten Bedenken geht Anthropic direkt ein. Einen Trend zu vermehrten Kündigungen habe man seit der Ankündigung nicht beobachtet, teilte das Unternehmen Business Insider mit. Wer befürchtet, das Wasserzeichen könnte ihm die Urheberschaft an eigenem Text oder Code absprechen, den will Anthropic beruhigen: Das Erscheinen des Wasserzeichens zeige lediglich an, dass Claude den Inhalt verarbeitet habe, und ändere nichts an den Rechten oder am Eigentum des Nutzers am Text.
Das Wasserzeichen steckt allein in der Wortwahl
Einen großen Teil des Beitrags verwendet Anthropic auf eine Grundfrage: Wie lässt sich ein Nachweis für KI in einer Wortfolge verankern, ohne den menschlich klingenden Ton zu ruinieren? Die Antwort liegt in der Art, wie Sprachmodelle Wort für Wort auswählen. Für ein lächelndes Kind kann ein Modell etwa „joyful“ oder „cheerful“ wählen – normalerweise entscheidet ein Zufallsgenerator. Anthropic ersetzt diesen durch einen Mechanismus, der mit einem „Schlüssel“ arbeitet. In einem Beispiel nutzt das Unternehmen die Ziffern der Kreiszahl Pi, um die Wortwahl zu steuern.
Für Leserinnen und Leser sei der Unterschied nicht erkennbar, betont Anthropic; es gebe keine versteckten Zeichen, keine merkwürdigen Schriftarten und keinen Geheimtext. Die Qualität und Geschwindigkeit der Ausgabe leide nicht, zusätzliche Kosten entstünden ebenfalls nicht. Die Methode ist eine Anpassung des SynthID-Text-Ansatzes von Google DeepMind, der in einem Fachaufsatz in Nature beschrieben wurde. Um Texte zu prüfen, will Anthropic eine Programmierschnittstelle (API) bereitstellen, mit der Nutzer und Dritte die Kennzeichnung selbst auslesen können.
Das Unternehmen räumt klare Grenzen der Technik ein
Immer wieder verweist der Beitrag auf die Schwächen des Verfahrens. Der Schlüssel weise nur auf Claude hin, nicht auf KI allgemein. „Mit unserem Schlüssel lässt sich nur die Frage beantworten: Wie wahrscheinlich ist es, dass dies teilweise von Claude geschrieben wurde?“, heißt es. Längere Passagen seien leichter zu erkennen, weil das Modell dort mehr Wortentscheidungen getroffen habe. Bei „faktischen Passagen“, in denen eine falsche Wortwahl die Richtigkeit gefährden könnte, werde weniger markiert. Das gilt auch für Code: Weil dieser präzise sein muss und oft keine Wahlmöglichkeiten bietet, erhält er laut Anthropic „generell weniger Wasserzeichen“.
Auch Bearbeitungen und Übersetzungen durch Claude werden gekennzeichnet – das System kann also nicht unterscheiden, ob Claude einen Text verfasst oder nur überarbeitet hat. Für Bilder setzt Anthropic auf einen anderen Weg: einen kryptografisch signierten Vermerk in den Metadaten. Wie leicht sich die Kennzeichnung entfernen lässt, umreißt das Unternehmen selbst: „Leichtes Bearbeiten wird das Wasserzeichen wahrscheinlich nicht vollständig entfernen; ein kompletter Neuschrieb, bei dem jedes Wort ersetzt wird, schon.“ Und weiter: „Im letzteren Fall ist natürlich fraglich, ob der Text überhaupt noch als KI-generiert bezeichnet werden kann.“
Würde ein Wasserzeichen Ihr Vertrauen in KI-Texte stärken – oder wäre es für Sie ein Grund, den Dienst zu wechseln? Teilen Sie Ihre Sicht in den Kommentaren.































