OpenAI tilføjer nu et usynligt ChatGPT-vandmærke til tekst fra chatbotten og Codex kode-output i hele EU. Men egne tests viser, at hvis man udskifter en fjerdedel af ordene med synonymer, falder genkendelsen til kun 17%.
Det sker som svar på EU’s AI Act, blokkens regelsæt for kunstig intelligens, der kræver maskinlæsbare mærkater på AI-genereret tekst. OpenAI indrømmer dog, at teknologien stadig er umoden, så deres detektor ikke er offentligt tilgængelig endnu.
Hvor stærkt er ChatGPT-vandmærket, når nogen redigerer teksten?
Ifølge meddelelsen hedder systemet textGrain, og det får modellen til at vælge ord, så en skjult statistisk struktur dannes. En separat detektor scanner tekster for dette mønster.
Vandmærket findes i selve ordvalget, forklarer OpenAI i deres FAQ. Der tilføjes ingen skjulte tegn, usynlige mellemrum eller mærkelig tegnsætning. Det betyder, at den almindelige metode med fjerning af skjulte tegn intet har at tage væk.
Længden betyder meget. OpenAI måler tekst i tokens, som er de orddele, AI-modeller behandler. Én token svarer til cirka tre fjerdedele af et engelsk ord.
I OpenAI’s tests fangede detektoren cirka 66% af uredigerede svar på omkring 150 ord. Ved cirka 300 ord steg raten til omkring 92%.
Let redigering svækker også ChatGPT-vandmærket. I tekster på 300 ord faldt genkendelsen fra 92% til 66%, hvis man byttede ét ud af ti ord til et synonym. Udskiftning af ét ud af fire ord fik den helt ned på kun 17%.
Vandmærket ændrede næsten ikke benchmarks for OpenAI’s GPT-6 Astra, selskabets nyeste frontlinje-model.
Hvorfor må offentligheden ikke bruge detektoren fra OpenAI?
I stedet for et offentligt værktøj tager OpenAI imod ansøgninger fra godkendte forskere og eksperter. Virksomheden oplyser, at et positivt resultat ikke afslører bruger, prompt eller samtale.
Et negativt svar siger heller ikke meget. Korte, redigerede eller oversatte tekster kan let gå fri af detektoren, og det gælder også output fra konkurrenters AI-værktøjer.
Manglende fund af et vandmærke beviser ikke, at teksten er skrevet af et menneske.
Kilde: OpenAI
Billeder og lyd fungerer anderledes. Alle kan uploade sådanne filer til OpenAIs offentlige værktøj, og kontrollere om der er et SynthID-vandmærke.
Uden for Europa er ChatGPT-vandmærket som udgangspunkt slået fra. Men API-kunder verden over kan nu tilvælge det for udvalgte modeller i indstillingerne for deres projekt eller organisation.
Udrulningen kommer efter, at EU i august startede gennemsigtighedsregler under AI Act. For krypto ser konsekvenserne ud til at være tydelige, idet kriminel AI-udbredelse steg 40% år for år ifølge TRM Labs.
Derfor vil forskellen mellem myndighedernes krav og det detektorer faktisk kan bevise formentlig afgøre, hvordan alle store AI-laboratorier håndterer efterlevelsen.









