Hva skal til for å beskytte seg mot KI-trening?
Hjem / Artikler / Teknologi, IT og AI / Hva skal til for å beskytte seg mot KI-trening?
KI-trening

Hva skal til for å beskytte seg mot KI-trening?

Nye regler som snart gjennomføres i norsk rett, gir rettighetshavere mulighet til å reservere seg mot at verk brukes til KI-trening. Vi ser nærmere på hva som kreves, og hvilken rolle brukervilkår, robots.txt og metadata kan spille.
Publisert: 24.09.26

Trening av generative KI-modeller krever enorme mengder data. Mye av datagrunnlaget er opphavsrettslig beskyttede verk som hentes fra åpent tilgjengelige kilder på internett. I praksis skjer dette ved at automatiserte programmer (KI-boter) gjennomsøker og laster ned innhold fra nettsider. Denne prosessen kalles «webcrawling» og «webskraping», og blir gjerne omtalt som høsting av innhold. En nedlastning gjort av en KI-bot med hensikt å trene en generativ KI-modell utgjør en eksemplarfremstilling som i utgangspunktet krever samtykke fra rettighetshaveren.

Digitalmarkedsdirektivet (DSM-direktivet) artikkel 4 er nå i ferd med å bli gjennomført i norsk rett. Bestemmelsen åpner for at den som har lovlig tilgang til et verk, kan fremstille eksemplarer for tekst- og datautvinningsformål. Det følger imidlertid av artikkel 4 nr. 3 at rettighetshavere har rett til å reservere seg mot at verkene brukes til slik trening. Bestemmelsen i tredje ledd har derfor blitt kalt for reservasjonsretten.

Den 27. mars 2026 fremmet Kultur- og likestillingsdepartementet forslag til gjennomføring av DSM-direktivet i åndsverkloven gjennom lovproposisjonen Prop. 41 LS (2025-2026). Proposisjonen behandles nå i Stortingets familie- og kulturkomité, med frist for innstilling 3. november 2026. I proposisjonen legger departementet til grunn at trening av generativ KI regnes som tekst- og datautvinning etter DSM-direktivet.

Nye regler for KI-trening i Norge

DSM-direktivet artikkel 4 er foreslått gjennomført i åndsverkloven som ny § 50 e. Bestemmelsens første og tredje ledd lyder:

«Den som har tilgang til et lovlig tilgjengelig verk, kan fremstille eksemplar av verket for tekst- og datautvinningsformål.» (første ledd)

«Første ledd gjelder ikke hvis opphaveren på hensiktsmessig måte har forbeholdt seg retten til slik bruk av verket.» (tredje ledd)

Et av de mest sentrale spørsmålene er hva som ligger i kravet til en «hensiktsmessig» reservasjon etter tredje ledd. Spørsmålet har vært blant de mest omdiskuterte i proposisjonen, og flere aktører, blant andre kollektive rettighetsorganisasjoner som TONO og Advokatforeningen, har reist innvendinger mot ordlyden.

Hva kreves for at en reservasjon mot KI-trening skal være gyldig?

Departementet begrunner den åpne formuleringen med behovet for fleksibilitet i møte med ny teknologi. Ordlyden i seg selv gir imidlertid begrenset veiledning om hva som skal til for å være hensiktsmessig.

For innhold på internett følger det av fortalepunkt 18 i DSM-direktivet at det «bare» bør anses hensiktsmessig å reservere seg ved bruk av maskinlesbare metoder. Departementet følger dette sporet i proposisjonen og uttaler i denne sammenhengen at maskinlesbare metoder antagelig er det eneste hensiktsmessige for store deler av materialet på internett.

Hva som nærmere ligger i kravet til maskinlesbarhet, er heller ikke helt klart. Begrepet er ikke definert i DSM-direktivet. Ordlyden «maskinlesbar» tilsier at reservasjonen må være uttrykt i et format som kan leses og tolkes automatisk av programvare, uten behov for menneskelig tolkning. Departementet legger til grunn at reservasjonen må utformes «slik at den effektivt kan oppfattes av automatiserte systemer». Det finnes i dag ingen etablert standard, men departementet gjennomgår i proposisjonen flere metoder som kan være aktuelle for innhold tilgjengelig på internett.

Tre måter å reservere innhold mot KI-trening

Brukervilkår å nettsted

Dette er den enkleste formen for reservasjon. I et slikt tilfelle skriver rettighetshaveren i brukervilkårene at innholdet ikke kan brukes til KI-trening. KI-boter leser imidlertid vanligvis ikke slik tekst, fordi de er programmert til å lese tekniske instruksjoner, og ikke naturlig språk. Metoden mangler standardisering og gir ingen garanti for at reservasjonen faktisk oppdages. Koda, TONOs søsterorganisasjon i Danmark, har for eksempel reservert seg i sine brukervilkår, se mer om Koda her.

Robot.txt som reservasjonsmetode

Robots.txt er en annen reservasjonsmetode, der en tekstfil legges på et nettsted for å gi instrukser til søkemotorer og KI-boter. Filen angir hvilke deler av nettstedet som kan høstes, og hvilke som er sperret. Når en KI-bot besøker et nettsted, leser den robots.txt-filen før den laster ned innhold. Robots.txt er maskinlesbar og enkel å implementere, og er derfor den mest utbredte reservasjonsmetoden. Et eksempel finner vi hos VG, som i sin robots.txt skriver følgende.

«VG does not permit unlicensed use of our content for training large language models. […] We explicitly disallow text and data mining and other technical means designed to or with the effect that they enable unlicensed use of our content for training AI models

User-agent: […] anthropic-ai

Disallow: /»

Instruksen angir hvilke KI-boter som nektes tilgang («User-agent»), og at all høsting er forbudt («Disallow: /»). Den store svakheten med robots.txt er at det bare er en instruks som KI-botene kan velge å ignorere, og at reservasjonen er knyttet til det konkrete nettstedet. For at systemet skal fungere, må reservasjonen finnes der innholdet høstes, og KI-aktørene må faktisk respektere den. Her kan den nye Code of Practice under KI-forordningen få betydning. Code of Practice fastslår blant annet at tilbydere av KI-modeller skal identifisere og respektere reservasjoner gjort gjennom maskinlesbare metoder, herunder robots.txt. Dersom store KI-selskaper følger opp disse forpliktelsene, vil det øke sannsynligheten for at reservasjoner faktisk blir respektert.

Metadata-baserte løsninger

Metadata-baserte løsninger er en tredje mulig reservasjonsmetode. Slike løsninger bygger på at rettighetshaveren legger inn en maskinlesbar markering i selve nettsiden eller i kommunikasjonen mellom server og nettleser. I praksis kan en reservasjon i metadata gjøres på to måter. Forskjellen kan illustreres med en forenklet analogi: Se for deg at nettsiden ønsker å formidle en reservasjon mot tekst- og datautvinning ved å sende en konvolutt til KI-boten.

Den ene metoden er gjennom HTTP-headere (Hypertext Transfer Protocol), som er teknisk informasjon som sendes med når en nettside lastes ned. En HTTP-header tilsvarer informasjon skrevet på utsiden av konvolutten. KI-boten kan lese reservasjonen allerede før den åpner selve konvolutten. Den andre metoden er gjennom HTML-metatagger (HyperText Markup Language), som er instruksjoner plassert inne i selve koden til nettsiden. Her må KI-boten «åpne konvolutten» og lese innholdet for å finne reservasjonen.

Konkret kan en rettighetshaver reservere seg ved å legge inn en kodelinje som «tdm-reservation: 1» i HTTP-headeren eller HTML-koden, som forteller KI-boten at innholdet er reservert. Også for reservasjoner i metadata er svakheten den samme som for robots.txt, nemlig at reservasjonen gjelder den konkrete nettsiden, ikke selve verket. Blir verket kopiert eller publisert på en annen plattform, følger ikke reservasjonen med.

Ingen «one size fits all»

Reservasjonsrettens praktiske virkning varierer betydelig mellom bransjer, avhengig av hvordan innholdet distribueres og hvem som kontrollerer plattformene.

For nyhetsmedier kan robots.txt fungere godt. Mesteparten av innholdet er knyttet til samme nettsted, og en reservasjon i robots.txt treffer da det vesentlige av det redaksjonelle innholdet. For rettighetshavere som har innholdet samlet på én plattform, er robots.txt en praktisk og tilgjengelig løsning så lenge det ikke finnes standardiserte alternativer.

For musikkverk er situasjonen en helt annen. Musikk distribueres på tvers av strømmetjenester, videoplattformer og sosiale medier. Rettighetshaverne har sjelden kontroll over plattformene der verkene er tilgjengelige, og kan derfor ikke plassere en reservasjon der innholdet faktisk høstes fra. En robots.txt på én plattform gir ingen beskyttelse for det samme verket på en annen. Det er også vanskelig å plassere en maskinlesbar reservasjon i selve masterfilen til et musikkverk. Det er likevel verdt å nevne at strømmetjenester som Spotify allerede har mekanismer for å spore innhold på plattformene med tanke på rettighetsadministrasjon og inntektsfordeling. Det kan derfor tenkes at problemet med maskinlesbar reservasjon kan løses i samarbeid med distributører og digitale tjenestetilbydere.

For fotografiske verk og bilder kan metadata være et aktuelt alternativ. HTTP-headere eller HTML-metatagger kan fungere godt dersom bildene publiseres på egne nettsider. Reservasjoner gjennom metadata lider likevel langt på vei av samme svakhet som robots.txt, ved at de kan miste virkning når bildene deles videre på andre plattformer.

Det er tvilsomt at det vil finnes en standardisert reservasjonsmetode som passer for alle bransjer. Det vil trolig kreve en kombinasjon av ulike metoder som er tilpasset den enkelte bransjes behov.

— Lisa Digneres, partner i Advokatfirmaet Bull

Det kan tenkes tilfeller der rettighetshaveren ikke har praktisk mulighet til å bruke maskinlesbare metoder, for eksempel på grunn av manglende teknisk kompetanse eller fordi plattformene innholdet er distribuert på ikke er samarbeidsvillige. I slike tilfeller kan det EU-rettslige effektivitetsprinsippet, som innebærer at en lovbestemmelse skal tolkes slik at den får en effektiv virkning, tale for at kravet til «hensiktsmessig» må tolkes slik at flere reservasjonsmetoder er omfattet. Det blir interessant å følge hvordan norske domstoler vil håndtere denne avveiningen.

Hva skjer med opphavsrett og KI i EU?

Utviklingen på EU-nivå peker i retning av styrket vern for rettighetshavere. Europaparlamentet vedtok 10. mars 2026 et forslag til resolusjon om opphavsrett og generativ KI med overveldende flertall. Resolusjonen, som var basert på den såkalte Voss-rapporten, foreslår at rettighetshavere skal kunne reservere seg ved bruk av standardiserte maskinlesbare formater, og at reservasjoner skal kunne registreres i et sentralt register forvaltet av EUIPO (EUs kontor for immaterielle rettigheter). Resolusjonen er ikke rettslig bindende, men gir et klart signal om at Europaparlamentet anser dagens regelverk rundt reservasjonsretten som utilstrekkelig.

For EU-domstolen verserer nå Like Company v. Google (sak C-250/25), som er den første saken domstoler behandler om tekst- og datautvinning. Det sentrale spørsmålet i saken er om et chatbotsvar som gjengir presseinnhold uten lisens, utgjør en opphavsrettskrenkelse. Generaladvokatens uttalelse i saken er ventet i nær fremtid. Uttalelsen er en ikke-bindende rådgivende innstilling til EU-domstolen, men den følges erfaringsmessig i et flertall av sakene og kan derfor gi viktige signaler om rettstilstanden. Saken vil likevel neppe gi svar på reservasjonsrettens effektivitet, ettersom den i hovedsak dreier seg om chatbotens gjengivelse av innhold (output), og ikke selve treningsprosessen (input) som reiser de sentrale spørsmålene ved trening av generativ KI.

Parallelt med den rettslige utviklingen inngås det stadig flere lisensavtaler mellom KI-selskaper og rettighetshavere. Warner Music Group forlikte i november 2025 et søksmål mot Suno om påstått opphavsrettskrenkelse ved bruk av innspillinger til å trene KI-modeller. De nærmere innholdet i forliket er ikke offentlig kjent, men vi vet at partene ble enige om en opt-in-modell der artister tilknyttet Warner kan velge å la Suno bruke deres navn, stemmer og komposisjoner til å trene modeller og skape ny KI-musikk, mot betaling. Universal Music Group annonserte i september 2026 en flerårig avtale med ElevenLabs om en lisensiert KI-musikkplattform. Avtalene kan tyde på at flere KI-selskapene ser behovet for å klarere rettigheter til treningsdata. Det verserer samtidig fortsatt søksmål mellom rettighetshavere og KI-selskaper, og det gjenstår å se om lisensavtaler blir normen.

Fremover vil fortsatt rettsutvikling nasjonalt og internasjonalt, i kombinasjon med teknologisk utvikling og bedre maskinlesbare løsninger avgjøre om rettighetshaverne faktisk får et vern som fungerer mot KI-trening.

— Simon Rydland, advokatfullmektig i Advokafirmaet Bull

Selv om DSM-direktivet ikke er gjennomført i norsk rett, anbefaler vi allikevel rettighetshavere, forvaltere og organisasjoner og implementere reservasjonsretten allerede nå.

Har du spørsmål om regelverket eller behov for veiledning, ta gjerne kontakt med oss.

Les mer om vår faggruppe innen media, underholdning og kultur

Relaterte artikler

Hvordan kan vi hjelpe deg?

Trenger du juridisk hjelp? Ring oss eller send en e-post for en helt uforpliktende prat.