Anthropic skjuler nu et vandmærke i al tekst, som Claude skriver. Læserne kan ikke se det, og det følger med, hvis nogen kopierer teksten et andet sted hen.
De nye modeller har mærket på verdensplan. Anthropic oplyser også, at der senere vil komme detekteringsværktøjer til brugere og andre parter.
Sådan fungerer Claude-vandmærket
Anthropic tilføjer mærket på modelniveau. Derfor følger det med al output fra API’en, Claude-apps og Claude Code.
Dækningen gælder også Claude Cowork, Anthropics fil- og opgaveløsning til generelt kontorarbejde. Claude Tag, som lægger modellen ind i Slack, får også mærket.
Det samme gælder for Claude-modeller, der bruges via AWS, Google Cloud og Microsoft Foundry. Regionen gør ingen forskel. Anthropic har ikke offentliggjort deres metode. Offentlig research om tekst-vandmærkning peger dog på en såkaldt green list-tilgang.
Den metode deler ordforrådet op i en green list og en red list ved hvert ord. Det foregående ord bestemmer opdelingen, så mønsteret ser tilfældigt ud for en læser.
Modellen foretrækker derefter green-ord frem for at vælge efter fast regel. En detektor tæller dem og undersøger, om andelen overstiger tilfældige udfald. Sådan forklares de to huller, Anthropic nævner: Korte passager har for få ord til at kunne måles pålideligt, mens en omskrivning bytter green-ordene ud.
Filer behandles anderledes. Genererede .svg, .png og .jpg-filer har underskrevet ophavsmetadata ifølge C2PA open standarden, der også markerer, hvis filen bliver ændret.
Hvad Claude-brugere kan forvente fremover
Ældre modeller får mærket under en overgangsperiode. Den opdatering gælder kun fremtidig output, ikke tekst, som modellerne allerede har lavet. Så intet, der er skrevet før mærkningen, kan spores senere. Tilbagevirkende vandmærkning af gamle dokumenter er ikke med i planen.
Detektering er omdrejningspunktet for udrulningen. Anthropic har lovet værktøjer til både brugere og tredjepart, og der kommer flere detaljer i kommende teknisk dokumentation. Et positivt resultat betyder mindre, end mange tror. Det viser blot, at indholdet muligvis er behandlet af Claude, og ikke andet.
Folk bruger også modellen til at korrekturlæse, oversætte og sammenfatte deres egne tekster. Derfor er et mærket dokument ikke et bevis på snyd.
Reglerne bag ændringen stammer fra EU’s AI-forordning. Anthropic har underskrevet Artikel 50(2) Code of Practice om gennemsigtighed i AI-genereret indhold, der trådte i kraft den 2. august 2026. Andre myndigheder har valgt mere simple metoder, og i Kina fjernede man 14.000 AI-produkter denne sommer.
Anthropics tidligere praksis får betydning for, hvor meget brugerne stoler på systemet. Selskabet har tidligere offentliggjort tre tilfælde, hvor Claude fik uautoriseret adgang under evalueringer. En dommer har også godkendt indscanning af bøger til træning.
Protester er sandsynlige, da modelændringer tidligere har udløst modstand, hvilket Fable 5 guardrail-modstanden viser. Men få udviklere vil forlade en model, der stadig fører an i kodnings-målinger. Udbredelsen vil formentlig ske stille og roligt.
Systemerne på markedet har frist til 2. december 2026 til at overholde kravene. Indtil detektoren udkommer, bliver vandmærket bare en skjult følgesvend.









