Anthropic hat begonnen, Textausgaben von einigen Claude-Modellen mit unsichtbaren «Wasserzeichen» zu versehen. Klingt nach reiner Technik, nach EU-Pflicht, nach Compliance-Thema. Ist es aber nicht, jedenfalls nicht nur.
Wer nämlich genau hinschaut, erkennt: Ein Wasserzeichen zeigt nicht nur, dass KI mitschrieb. Es legt auch offen, wessen Sicht auf die Welt mitgedacht hat. Diese Frage ist für mich weitaus interessanter, als die technische Funktionsweise von Wasserzeichen oder die Frage, ob man Texte von Claude erkennen kann.
Schauen wir uns zuerst die technischen Fragen an – und ordnen die Wasserzeichen danach in einen grösseren Kontext ein.
Claude lässt aufhorchen
Seit Anthropic angekündigt hat, seine Claude-Textausgaben mit einem Wasserzeichen zu kennzeichnen ist die Verunsicherung gross.
Was bedeutet das für mich? Können jetzt meine Chefin, mein Kunde, meine Leserinnen und Leser sehen, dass meine Texte, Ideen oder Konzepte mit Claude erstellt wurden?
Wer kann das Muster überhaupt entdecken? Was müssen Unternehmen jetzt beachten, was gilt für Studierende? Und was beweist ein Wasserzeichen eigentlich, und was beweist es nicht?
Klären wir das der Reihe nach.
«Nur» Claude?
Zunächst einmal: Google macht das bei Gemini schon länger. Doch die Ankündigung von Anthropic schürt Nervosität.
Hintergrund ist die Pflicht zur Kennzeichnung. Seit dem 2. August 2026 gelten nämlich die Transparenzpflichten nach Artikel 50 des EU AI Act. Anbieter müssen KI-generierte Inhalte maschinenlesbar kennzeichnen. Für bestimmte öffentlich relevante Texte gelten zusätzlich Offenlegungspflichten für diejenigen, die sie veröffentlichen.
Für Schweizer Unternehmen mag das nach einem reinen EU-Thema klingen. Doch auch Schweizer Unternehmen können betroffen sein, wenn sie KI-Systeme oder deren Ergebnisse im EU-Kontext anbieten.
Unsichtbar, aber da
Anthropic setzt bei Claude-Modellen ein statistisches Textwasserzeichen ein. Die Einführung erfolgt schrittweise und gilt nicht automatisch für jeden Claude-Text. (Europäische Kommission, Anthropic Help Center)
Stell dir eine Banknote vor. In der Hand sieht sie aus wie bedrucktes Papier, nichts Besonderes. Erst wer sie gegen das Licht hält, erkennt das Muster, das die ganze Zeit schon da war, eingearbeitet in die Fasern selbst, nicht aufgedruckt.
Ähnlich funktioniert das Wasserzeichen bei Claude.
Grosse Sprachmodelle wählen bei der Texterstellung Wort für Wort aus mehreren möglichen Kandidaten, jeweils mit unterschiedlicher Wahrscheinlichkeit. Normalerweise entscheidet ein Zufallsmechanismus, welches Wort am Ende gewählt wird.
Beim Wasserzeichen wird dieser Auswahlschritt durch eine Funktion ersetzt, die einem geheimen Schlüssel folgt. Wer diesen Schlüssel besitzt, kann im Nachhinein statistisch prüfen, ob ein Text diesem Muster folgt. (TechCrunch)
Das Modell selbst, sein Training, seine Gewichtung – sein eigentliches Betriebsgeheimnis – bleibt davon unberührt. Nur der letzte, an sich zufällige Griff aus der Kandidatenliste möglicher Wörter trägt jetzt eine Handschrift.
Die Methode habe dabei, sagt Antrophic, keinen wesentlichen Einfluss auf Qualität oder Inhalt der Ausgaben; der Unterschied zwischen wasserzeichenmarkiertem und normalem Text ist für Leserinnen und Leser in der Regel also nicht erkennbar.
Nach den vorliegenden Informationen werden keine zusätzlichen sichtbaren Zeichen oder klassische Metadaten eingefügt.
Konkret:
Einen allgemein veröffentlichten Schwellenwert gibt es allerdings nicht. Wie so oft beim Thema KI, bewegen wir uns auch hier in einer Blackbox. Vollständige Gewissheit gibt es nicht. (Anthropic Help Center)
Welche Anbieter arbeiten womit
Drei grosse Anbieter, drei völlig unterschiedliche Tempi.
Google setzt SynthID-Text bereits seit 2024 in Gemini ein und hat das Verfahren im grossen Massstab getestet. Die Technik wurde von Google DeepMind entwickelt, in der Fachzeitschrift Nature veröffentlicht und wissenschaftlich beschrieben. Sie funktioniert über sogenanntes Tournament-Sampling: Eine Schlüsselfunktion beeinflusst, welches Wort gewählt wird, ohne dass der Text für Leserinnen und Leser anders wirkt.
SynthID-Text ist seit 2024 in Gemini im Produktivbetrieb und damit das bisher am längsten erprobte Textwasserzeichen für KI-generierte Inhalte. Google DeepMind hat eine Referenzimplementierung veröffentlicht; die produktive Umsetzung, insbesondere Schlüsselverwaltung und Detektionsinfrastruktur, ist damit jedoch nicht vollständig öffentlich einsehbar. (Google DeepMind)
Anthropic zieht mit Claude nach, nutzt technisch eine Variante von SynthID-Text. Bisher ist sie aber nur eingeschränkt zugänglich. Die Einführung der Wasserzeichen erfolgt modell- und plattformspezifisch und schrittweise.
Die Erkennbarkeit ist über eine Detection API in Private Preview für berechtigte Organisationen verfügbar – nicht für die Allgemeinheit. (Anthropic Help Center)
OpenAI hat ebenfalls eine Text-Wasserzeichen-Technologie entwickelt. Eine allgemeine Einführung eines Textwasserzeichens für ChatGPT- oder API-Texte ist Stand heute jedoch nicht erfolgt. OpenAI setzt derzeit unter anderem SynthID für Bilder und Audio ein und arbeitet daran, Provenienz-Massnahmen auch auf Text auszuweiten.
OpenAI hat den freiwilligen Code of Practice zur Transparenz von KI-generierten Inhalten unterzeichnet; die Unterzeichnung allein bedeutet jedoch nicht, dass jede spätere gesetzliche Pflicht bereits vollständig erfüllt ist.
Erkannt, aber nicht erkennbar
Hier wird es interessant, und ein wenig ernüchternd.
Wer kann das Wasserzeichen bei Claude überhaupt prüfen? Die Antwort: kaum jemand, noch nicht.
Anthropics Detection API ist derzeit im Private Preview verfügbar. Sie befindet sich in einer begrenzten Testphase für ausgewählte Organisationen. Dazu gehören: Regulatoren, Strafverfolgung, Medien, Fact-Checker, unabhängige Forscher, Bildungseinrichtungen und zivilgesellschaftliche Gruppen in der EU. Auch Unternehmen mit eigener Prüfpflicht können Zugang beantragen. Zugang gibt es über ein Registrierungsverfahren. (Anthropic Help Center)
Selbst wenn man Zugang hätte, wäre das Wasserzeichen kein endgültiger Beweis. Es überlebt Copy-Paste und leichtes Lektorat. Wird ein Text jedoch stark umformuliert, verliert das Signal an Stärke. Bei einer vollständigen Neufassung kann es ganz zerstört werden. Einen dokumentierten Grenzwert, ab wann genau das passiert, gibt es nicht.
Selbst ein klar erkennbares Muster beweist nur, dass ein Modell oder ein Anbieter wahrscheinlich beteiligt war. Es beweist nicht, dass kein Mensch mitgeschrieben hat, wer konkret der Verfasser ist, oder dass ein Regelverstoss vorliegt.
Die Kennzeichnungspflichten gelten bereits. Eine allgemein zugängliche und unabhängig überprüfbare Kontrollmöglichkeit besteht jedoch weiterhin nicht. Die offizielle Detection API befindet sich in einer eingeschränkten Private Preview. (Anthropic Help Center)
Was das für Studierende bedeutet
Ein kurzer Einschub für alle, die gerade an einer Abschlussarbeit sitzen. Für Studierende gelten die Regeln ihrer Hochschule, Fakultät und Prüfungsordnung. Viele Institutionen verlangen eine Offenlegung der KI-Nutzung oder machen Vorgaben dazu, wie KI verwendet werden darf. Diese akademischen Regeln sind von den Transparenzpflichten des EU AI Act zu unterscheiden.
Die Kennzeichnung von KI-generierten Inhalten in einer Bachelorarbeit, Masterarbeit, Hausarbeit oder Dissertation dient der wissenschaftlichen Redlichkeit und der Sicherheit der Bewertung. Ein Wasserzeichen im Text ersetzt diese Pflicht zur eigenen, ehrlichen Angabe nicht! (Anthropic Help Center)
Artikel 50 – worum geht’s
Hier ein kurzer Einschub, worum es im Artikel 50 geht. Artikel 50 unterscheidet zwei Pflichten, die gerne vermischt werden.
Erstens, für Anbieter wie Anthropic, OpenAI und Co: KI-generierte Audio-, Bild-, Video- und Textinhalte müssen in einem maschinenlesbaren Format gekennzeichnet werden. Das ist die Kennzeichnungspflicht nach Artikel 50 Absatz 2. (Europäische Kommission)
Zweitens, für Betreiber, also für Unternehmen und andere Stellen, die KI-Texte veröffentlichen: Wer KI-generierte oder KI-bearbeitete Texte mit dem Zweck veröffentlicht, die Öffentlichkeit über Angelegenheiten von öffentlichem Interesse zu informieren, muss diese Beteiligung offenlegen. Das ist die Transparenzpflicht nach Artikel 50 Absatz 4.
Diese Pflicht kann entfallen, wenn der Text einer substanziellen menschlichen Prüfung oder redaktionellen Kontrolle unterzogen wurde und eine natürliche oder juristische Person die redaktionelle Verantwortung übernimmt. Achtung: Eine blosse Rechtschreibprüfung oder ein formales Abzeichnen genügt nicht.
Auch Schweizer Unternehmen können unter den EU AI Act fallen. Das ist beispielsweise der Fall, wenn sie ein KI-System auf dem EU-Markt anbieten oder wenn der Output eines von ihnen eingesetzten KI-Systems in der EU verwendet wird. Ob dies bei öffentlich zugänglichen Inhalten bereits aufgrund der Abrufbarkeit aus der EU der Fall ist, lässt sich nicht pauschal beantworten.
Bei Verstössen gegen bestimmte Betreiber- und Transparenzpflichten kann der EU AI Act empfindlich hohe Geldbussen verhängen. Die konkrete Sanktion wird nach den Umständen des Einzelfalls und den zuständigen Vollzugsregeln festgelegt. (Digital Chiefs, Out-Smart)
Zeigt her, wer wirklich gedacht hat
Zuletzt noch der Blick über die Technik heraus.
Unsere These: Ein KI-Wasserzeichen zeigt nicht nur, dass KI an einem Text beteiligt war. Es macht auch sichtbar, dass mit jedem KI-System eine bestimmte Perspektive in den Arbeitsprozess einfliesst.
KI ist ein Werkzeug. Aber anders als ein Bohrer oder ein Schraubenschlüssel wurde dieses Werkzeug mit Daten, Gewichtungen und Entscheidungen von Menschen geprägt. Wer Trainingsdaten auswählt und festlegt, welche Quellen stärker oder schwächer gewichtet werden, beeinflusst damit auch, welche Antworten ein Modell wahrscheinlich macht und welche weniger.
Diese Entscheidung treffen nicht wir. Diese Entscheidung treffen die Tech-Konzerne, die ein Modell entwickeln und trainieren.
Deshalb reicht es nicht, ein Wasserzeichen nur als Herkunftsnachweis zu lesen, nach dem Motto, da war KI beteiligt.
Es ist mehr als das: Es ist ein Hinweis darauf, dass in diesem Text eine «fremde» Sicht auf die Welt mitgedacht hat. Es weist darauf hin, dass an einem Text nicht nur die eigene Perspektive beteiligt war, sondern auch ein System, dessen Entstehung und Gewichtungen wir nur begrenzt einsehen können.
Wer das offenlegt, zeigt nicht nur, welches Werkzeug sie oder er benutzt hat. Er zeigt her, wer wirklich gedacht hat, und wie viel davon die eigene Stimme ist.
Mit Claude und Perplexity recherchiert und entworfen, redaktionell von Hand und mit Herz und Verstand ausgearbeitet.
