Nyhet! Vi har lansert ny nettside. Del gjerne feedback enten på epost eller på Jodel.

Annonsere?

EU krever vannmerking av KI-tekst – enda ikke lovfestet i Norge

Flere av de største KI-aktørene innfører vannmerking av materiale generert med deres nyere modeller etter nye EU-regler. Det er derimot ikke innlemmet i EØS-avtalen som gjelder Norge.

Foto: Christian Lue / Unsplash

Den 2. august begynte et nytt EU-reglement å gjelde. Artikkel 50 av EU AI Act regulerer hvordan KI-generert materiale skal kunne gjenkjennes til noe som er produsert av en språkmodell.

Dette regelverket påvirker selskaper som ønsker å tilby KI-tjenester innenfor EU. Brudd på regelverket kan straffes med bøter – inntil det høyeste beløpet av 15 millioner euro, eller 3 prosent av årlig global omsetning.

Bransjen svarer

Anthropic, selskapet bak Claude-modellene, har annonsert at deres nyere modeller nå vannmerker teksten den skaper globalt – inkludert Norge.

Det samme gjelder Google sine Gemini-modeller som har brukt sin SynthID-vannmerking på tekst siden 2024.

Denne metoden er utviklet av Google DeepMind – og er den Anthropic bygger på til egen bruk.

OpenAI har angivelig hatt verktøyene til å vannmerke i flere år nå. Likevel har de ikke iverksatt det for tekst.

Ifølge Wall Street Journal foretok OpenAI en intern brukerundersøkelse fra 2023, og fant at nesten 30 prosent ville bruke ChatGPT mindre dersom de innførte vannmerker uten at konkurransen gjorde det.

Slik fungerer det

Når en KI-modell genererer tekst, brukes det sannsynlighetsfordelinger for å velge neste ord, der det velges mellom ord som ville passet inn. Det er denne mekanismen som skaper grunnlaget for vannmerkingen.

I stedet for å bruke en vanlig tilfeldighetsgenerator, brukes det heller en hemmelig nøkkel i kombinasjon med de tidligere ordene. Anthropic forklarer at ordvalgene fremdeles er tilfeldige, men at kilden til tilfeldighetene er annerledes.

Vannmerket er ikke synlig for det blotte øye – og det er heller ingenting som legges til i selve teksten. Det er et statistisk mønster som kan avleses med riktig nøkkel. 

Er ordsekvensen i samsvar med hva KI-modellen ville valgt om den brukte en gitt nøkkel, er det mulig å angi en sannsynlighet for at den står bak teksten.

Foto: Suzy Hazelwood / Pexels

Anthropic bruker Monopol og tallet pi som metafor: I stedet for å kaste terning, blir trekkene valgt fra et utvalg av desimalene til pi. I ettertid kan hele rekken av trekk gjenkjennes som en rekkefølge i pi, og dermed kan man se sannsynligheten for at spillet ble spilt med terning eller desimalene.

KI-aktørene vannmerker også andre medieformer enn tekst. Lyd, bilde og video er alle formater som kan merkes av SynthID eller C2PA. Dette har foregått i flere år nå.

For å se etter vannmerker trenger man et deteksjonsverktøy. Dette er ikke nødvendigvis enkelt å få tilgang på i dag. 

Google sin SynthID Detector har en venteliste, forbeholdt journalister, medieaktører og forskere. Anthropic opplyser at de snart vil gi ut en deteksjons-API, men tidspunktet for lansering er uvisst.

Langt fra feilfritt

En undersøkelse fra Google DeepMind der nesten 20 millioner Gemini-svar ble evaluert, fant at KI-brukere ikke merket forskjell i kvalitet eller nytte fra responser som var merkede. Likevel erkjenner de at SynthID-merkingen ikke er noen sølvkule.

Først og fremst fungerer det dårlig med mindre tekstvolum, fordi det er færre ordvalg å legge mønsteret i. Det samme gjelder presise tekster og kode, der hvor det ofte bare er ett ord som er det neste riktige.

I tillegg kan det ikke skilles mellom hva en modell har skrevet, eller bare har berørt i teksten.

Original tekst som kun oversettes eller oppsummeres av KI kan derfor potensielt flagges.

På den andre siden beviser ikke negative funn noe konkret. Nøkkelen kan ikke forklare om et menneske er forfatteren til teksten.

En KI-tilbyder sin nøkkel kan heller ikke brukes på andres KI-modeller som bruker andre nøkler – og det er heller ikke alle tilbyderne som vannmerker teksten sin i det hele tatt per dags dato.

Flere veier rundt

For mange har ikke vannmerking akkurat vært en høydare. Ifølge Business Insider har flere gått ut på plattformen X og hevdet at de nå kansellerer sine Claude-abonnementer. 

Kort tid etter Anthropic sin kunngjøring, dukket verktøyet “Watermarks Remover” opp på GitHub for å fjerne deres vannmerker, samt OpenAI og Gemini sine.

Likevel er det ingen som kan bevise at slike verktøy faktisk fungerer per nå.

Anthropic har også vært åpne om hvordan man kan jobbe seg rundt det. Større omskrivninger kan fjerne merkingen.

Å legge inn KI-generert tekst i en annen KI-modell som ikke merker teksten er derfor en mulighet – noe mange tross alt har gjort i årevis nå for å komme seg rundt plagiatkontroll. 

Problemet stammer fra at KI-aktørene må ta høyde for enhver endring KI-brukeren kan gjøre til en tekst eller fil, og at én metode er nok til å ødelegge vannmerket.

Ennå ikke vedtatt i Norge

Selv om EU sine nye regler har vært gjeldende siden starten av august, er de ennå ikke innført i EØS-avtalen. Reglene gjelder derfor ikke i norsk rett ennå.

Norske KI-tilbydere som opererer i det europeiske markedet må likevel følge EUs regler.

Hvor raskt det nye reglementet kan innføres i EØS-avtalen som gjelder for Norge, avhenger av forhandlingene med EU. Digitaliserings- og forvaltningsminsiter Karianne Tung (Ap) har varslet høring i løpet av høsten, og en proposisjon til en ny KI-lov våren 2027.

Relaterte innlegg

linkedin facebook pinterest youtube rss twitter instagram facebook-blank rss-blank linkedin-blank pinterest youtube twitter instagram