Statsbudsjett 2027
Manglende finansiering setter KI-avtale om bøker i fare
I regjeringens forslag til statsbudsjett for 2027 som ble presentert i går, er det ikke satt av midler til den framforhandlede avtalen mellom Nasjonalbiblioteket og Kopinor om å trene norske språkmodeller på bokinnhold.
Midlene skulle gå til kompensasjon til rettighetshavere for bruk av norsk bokinnhold til Nasjonalbibliotekets trening av norske språkmodeller. Hensynet til nynorsk og de samiske språkene gjør det viktig med bedre språkmodeller, og trening på bokinnhold vil tilføre langt mer norsk- og samiskspråklig kvalitetsinnhold.
Bevilgningen skulle også gjøre det mulig å bygge videre på en norsk KI-infrastruktur innenfor tydelige rammer for opphavsrett og betaling til rettighetshaverne, skriver Kopinor i en pressemelding.
– Vi er forundret over at de ikke har funnet midler i det som frontes som et rekordstort kulturbudsjett, uttaler administrerende direktør i Kopinor Hege Munch Gundersen i en pressemelding.
– Det har vært bred politisk oppslutning om behovet for en sterk og bærekraftig norsk KI-infrastruktur. Regjeringen har selv sagt i sin «Plan for Norge» at de skal skape muligheter og trygge rammer for kunstig intelligens. De har også lagt vekt på at de skal videreutvikle norske språkmodeller. Da er det vanskelig å forstå at de ikke bevilger støtte og følger opp en konkret løsning som både gir tilgang til norsk kvalitetsinnhold og sikrer at rettighetshaverne får betalt. For å sikre språkmodeller som utgjør en positiv forskjell i det norske samfunnet, er det særlig behov for å trene på et større volum av bokinnhold på samisk og nynorsk, sier Gundersen.
– Ubegripelig
Generalsekretær i Norsk Faglitterær forfatter og Oversetterforening (NFFO) Cathrine Sandnes liker også svært dårlig at regjeringen ikke har funnet plass til de ventede KI-millionene.
– Dette er generelt et oppsiktsvekkende svakt kulturbudsjett for en regjering som sier de skal jobbe for et leseløft blant voksne, sier hun i en pressemelding.
– Det mest alvorlige er likevel at løftet om 45 millioner til å trene en norsk språkmodell, ikke blir fulgt opp. I en tid hvor alle ser at KI er den største trusselen mot opphavsretten, den nyskapende litteraturen, utviklingen av norsk språk og kunnskap, er det ubegripelig at ministeren ikke prioriterer å utvikle den norske modellen. Dette går også på tvers av hva vi har fått høre av lovnader fra henne og departementet, at dette er et viktig satsingsområde.
– Hvis dette går gjennom i Stortinget, vil det praksis innebære en langt svakere og knapt brukbar språkmodell, på de måtene disse brukes i dag, sier NFFOs generalsekretær Cathrine Sandnes.
NFFOs styreleder Marte Blikstad-Balas er også opprørt over gårsdagens budsjettpresentasjon.
– En norsk språkmodell, utviklet i samarbeid med opphaverne, er en internasjonal og banebrytende viktig ting. Det er lagt ned enormt mye arbeid i å gjøre dette mulig fra både Kopinor, forfatterorganisasjoner og Nasjonalbiblioteket, det er viktig for norsk språkpolitikk og norsk beredskap, så det er helt uvirkelig at finansieringen ikke ligger inne i statsbudsjettet. Betyr det i praksis at regjeringen ikke vil ha en norsk språkmodell?
Avtalen er klar
Kopinor og Nasjonalbiblioteket har framforhandlet en avtale som gir Nasjonalbiblioteket adgang til å bruke et utvalg norske bøker og liknende publikasjoner i trening av språkmodeller.
Avtalen setter klare grenser for hvilke verk som skal brukes og bruken av de ferdig trente modellene. Rettighetshaverne får også mulighet til å reservere seg.
Avtalen er laget for å sikre at modellene kan bygges på norsk og samisk språk, historie, kultur- og kunnskapsproduksjon, samtidig som rettighetshavernes interesser ivaretas gjennom rammer som nettopp sikrer en slik kultur- og kunnskapsproduksjon også i framtiden.
Når midlene ikke bevilges, kan ikke en slik avtale inngås, forklarer Hege Munch Gundersen.
– Dette handler om mer enn én avtale og én budsjettpost. Norge må velge om vi skal bygge vår egen KI-infrastruktur på lovlig tilgang til norsk innhold og respekt for dem som har skapt det, eller gjøre oss enda mer avhengige av utenlandske modeller utviklet på premisser vi i liten grad kontrollerer. Vi håper Stortinget vil rette opp dette i budsjettbehandlingen, sier Gundersen.
Ifølge Cathrine Sandnes vil NFFO følge den politiske behandlingen av budsjettet nøye i ukene og månedene framover.
– I de neste månedene med budsjettforhandlinger som følger nå, må vi bare fortsette å være på ballen sammen med Kopinor. Med avisavtalen er det nå satt et veldig viktig prinsipp om lisensiering, og det er allerede en unik modell i verdenssammenheng. Dette arbeidet må for all del ikke stoppe opp nå, men fortsette med uforminsket styrke, sier Cathrine Sandnes.
Dagens modeller er trent på avisinnhold
Fra januar i år har Nasjonalbiblioteket hatt anledning til å trene språkmodeller på avisinnhold, etter en avtale som ble inngått i desember i fjor. Avtalen ble inngått mellom Nasjonalbiblioteket og Kopinor på vegne av Mediebedriftenes Landsforening og norske aviser. Dette var den første avtalen av sitt slag i verden – en offentlig finansiert vederlagsavtale som muliggjør trening av åpne språkmodeller på opphavsrettsbeskyttet materiale og der rettighetshaverne blir kompensert.
Ifølge KOPINOR har språkmodellene som leveres av de store, internasjonale teknologiselskapene vesentlige mangler blant annet når det gjelder forståelse av norsk og samisk språk, kultur og samfunnsforhold. I 2025 ga derfor regjeringen Nasjonalbiblioteket i oppdrag å trene, oppdatere og tilgjengeliggjøre norske og samiske språkmodeller.
Som hovedregel skal Nasjonalbiblioteket tilby åpne språkmodeller som aktører i offentlig sektor eller næringslivet kan bruke for å utvikle KI-baserte verktøy og tjenester. Oppdraget er en del av regjeringens arbeid med å etablere en nasjonal infrastruktur for kunstig intelligens, og vil innebære nær kontakt og dialog med relevante forskningsmiljø, utviklermiljø og brukere.
For å gjøre språkmodellene best mulig for norsk og samisk bruk må modellene trenes på store mengder tekstdata av høy kvalitet. Mye av materialet som Nasjonalbiblioteket har i sine samlinger er beskyttet av opphavsrett, og kan ikke brukes i trening av språkmodeller uten egne avtaler med rettighetshavere.