Claude begynte å vannmerke tekst 2. august – her er hva vi faktisk vet

Claude begynte å vannmerke tekst 2. august – her er hva vi faktisk vet

Fra 2. august 2026 vever Claude et usynlig mønster inn i tekst modellen genererer. Dette er ikke en spekulasjon eller et rykte – Anthropic har bekreftet det offisielt og publisert dokumentasjon om hvordan det fungerer.

Hvorfor: EU AI Act, ikke bare "EU-regler generelt"

Bakgrunnen er konkret: Artikkel 50(2) i EUs AI Act krever at output fra generative AI-systemer merkes maskinlesbart og gjøres oppdagbart som kunstig generert. Anthropic signerte EUs Code of Practice for transparens rundt AI-generert innhold, sammen med rundt 190 andre signaturer, inkludert Google, Meta, Microsoft, OpenAI og flere. Merkingen gjelder globalt for alle nylanserte Claude-modeller, ikke bare for brukere i Europa – noe Anthropic selv har vært tydelige på.

Hvordan det faktisk fungerer

Her kan vi faktisk være mer presise enn "et skjult mønster". Når en språkmodell genererer tekst, velger den mellom flere ord som alle er like gyldige i konteksten. Vannmerket fungerer ved å subtilt vri denne ordvalg-prosessen i et statistisk mønster – metoden er basert på SynthID-Text, opprinnelig utviklet av Google DeepMind. Mønsteret er ikke synlig for et menneske som leser teksten, og det følger med teksten hvis du kopierer og limer den inn andre steder.

For genererte filer (som .svg, .png og .jpg) brukes en annen metode: signert C2PA-metadata, samme åpne standard som allerede brukes av kameraprodusenter og bilderedigeringsverktøy. Denne kan derimot forsvinne ved formatkonvertering, omlagring eller skjermbilder.

Deteksjon: fortsatt begrenset tilgjengelig

Her stemmer usikkerheten i råteksten delvis: et offentlig deteksjons-API er varslet, men ikke live ennå. Anthropic er selv åpne om begrensningene – lett redigert, omskrevet eller oversatt tekst beholder kanskje ikke merket, og deteksjon gir en sannsynlighet, ikke et bevis. Merket inneholder ingen identifiserende informasjon – det kan ikke spores til en spesifikk person, organisasjon eller samtale, og det endrer ingenting ved eierskap eller juridisk ansvar for teksten.

Reaksjonene kom raskt

En interessant detalj råteksten ikke kunne vite: innen få timer etter kunngjøringen hadde en utvikler publisert et verktøy for å fjerne vannmerket, som siden har fått over 20 000 bokmerker på X og over 100 bidragsytere på GitHub. Andre har vist at det holder å oversette Claudes tekst til arabisk og tilbake for å fjerne merket. Det illustrerer godt hvorfor Anthropic selv er forsiktige med å kalle deteksjon for et "bevis".

Påvirker det kvaliteten på svarene?

Anthropic hevder påvirkningen er ubetydelig, akkurat som råteksten nevner. Det er verdt å presisere at dette er Anthropics egen påstand – det finnes foreløpig ikke uavhengige, systematiske tester som bekrefter eller avkrefter dette i detalj.

Ressurser

Read more