Så skete det endelig! EU har smidt sine bureaukratiske tøvende fornemmelser i skraldespanden og rullet et sandt monstermodel af en kunstig intelligens ud på landingsbanen. Mød EU-Institutional-LLM – EU-Kommissionens spritnye sprogmodel, der er sat i verden for at gøre op med Silicon Valleys tendens til at ignorere de mindre sprog. Og ja, den taler flydende dansk uden at lyde som en dårlig Google Translate-oversættelse fra 00’erne!
Supercomputere og 47 milliarder parametre
Hvad får du, hvis du tager en stærk fransk-udviklet Mixtral-8x7B-model, pumper den fuld af officiel EU-data og kører den igennem nogle af verdens absolut vildeste supercomputere som Leonardo i Italien, MeluXina i Luxembourg og MareNostrum 5 i Spanien?
Du får en digital muskelbunt på omkring 47 milliarder parametre, bygget på en såkaldt Mixture-of-Experts-arkitektur. Modellen udgives i både en rå base-version og en finjusteret “instruct”-version, der er klar til at chatte og løse opgaver med det samme.
Men i modsætning til ChatGPT og Claude, som ofte brillerer på engelsk og halter bagefter på mindre sprog, er EU-Institutional-LLM designet til at behandle alle 24 officielle EU-sprog fuldstændigt lige.
Farvel til digital sproglig udryddelse
Det er ingen hemmelighed, at tech-giganternes AI-modeller er stærkt engelskcentrerede. Det efterlader sprog som dansk, estisk, græsk og maltesisk i overhængende fare for “digital sprogdød”, hvis fremtidens infrastruktur kun forstår engelsk slang og amerikansk kultur.
Det har EU-Kommissionens Generaldirektorat for Oversættelse (DGT) sat en effektiv stopper for. Ved at fodre modellen med Euramis-databasen – årtiers guldgrube af højkvalitetsdata fra EU’s egne oversættere – forstår den nye AI ikke bare hverdagssprog. Den er en absolut verdensmester i snørklede juratekster, specialiseret terminologi og politiske kontekster, som normalt ville få almindelige dødelige til at falde i søvn i lænestolen.
Kun for klubbens medlemmer
Lyder det som noget, du gerne vil hente ned på din bærbare med det samme? Tja, der er en lille krølle på halen. Modellen er åben, men den er ikke helt fri for alle på internettet. Den kan downloades via European Language Data Space, men kun af juridiske enheder baseret i EU. Så hvis du er et amerikansk Big Tech-selskab, der håbede på at støvsuge EU’s fine træningsdata gratis… tja, så må du kigge langt efter adgangskoden.
For at sikre, at AI-verdenen opfører sig ordentligt, har DGT samtidig udgivet evalueringssættet EU MMLU. Det er et spritnyt benchmark, der skal teste, om fremtidige sprogmodeller reelt yder retfærdig og præcis ydeevne på tværs af alle EU’s medlemslande og emner.
Europa tager kontrollen over sin egen AI
Udrulningen af EU-Institutional-LLM er ikke bare en enkeltstående solohistorie – det er et højoktan-skud i armen på den europæiske strategi om digital suverænitet. Europa vil ikke længere være afhængig af proprietære modeller fra USA eller Kina, når offentlige myndigheder, forskere og virksomheder skal automatisere deres arbejdsgange.
Projekter som OpenEuroLLM, søsterprojektet EuroLLM (der nyligt har lanceret EuroLLM-9B) og konsortium-satsningen LLMs4Europe arbejder i døgndrift på at skabe domænespecifikke modeller til alt fra sundhedsvæsenet og energisektoren til turisme og offentlig administration.
EU-bureaukrati har sjældent lydt så højteknologisk eller spændende. Så næste gang du skal pløje dig igennem et 200-siders EU-direktiv om landbrugsstøtte eller databeskyttelse, kan du roligt læne dig tilbage: Den europæiske AI har ryggen på dig – og den taler dit modersmål helt uden akcent!




