Det lyder næsten som et plot fra en spionfilm for nørder: Kinesiske udviklere forsøgte i hemmelighed at aflure OpenAI’s nyeste modeller deres dybeste tanker. Men i stedet for at bryde ind i serverrummet med natsynsbriller og koben, valgte de en noget mere snedig digital genvej – de fik bare AI-modellen til at sladre om sig selv.
OpenAI har netop afsløret og bremset en massiv, koordineret kampagne, der forsøgte at trække beskyttet ræsonnering ud af selskabets mest avancerede modeller. Sporene peger direkte mod personer med tilknytning til den fremadstormende kinesiske AI-startup Moonshot AI, der står bag chatbotten Kimi.
### En digital hjerneflugt uden indbrud
Lad os slå én ting fast med det samme: Ingen servere blev hacket, ingen databaser blev lækket, og dine private chats er stadig i sikkerhed. Angriberne brød slet ikke krypteringen. I stedet brugte de en metode kaldet *adversarial distillation* – på godt dansk: at snyde en AI til at lære en anden AI alt, hvad den ved, uden at have fået lov.
Metoden var lige så udspekuleret, som den var fræk. Angriberne kopierede krypterede bidder af modellens interne tankeprocesser fra én samtale, åbnede en helt ny chatsession og bad modellen om pænt at dekryptere og renskrive sine egne skjulte tanker. Det svarer lidt til at stjæle en hemmelig dagbog på et uforståeligt kodesprog og derefter spørge forfatteren: *”Hey, gider du lige læse det her højt for mig?”* – og så gjorde den det!
### Tusindvis af konti gik til angreb
Operationen var ikke bare et lille weekendprojekt for et par nysgerrige programmører. Det startede i det små den 1. juli, men kulminerede i et sandt festfyrværkeri af forespørgsler den 24. og 25. juli. Her væltede over 16.000 ekstraktionsforsøg ind fra mere end 4.000 forskellige brugere.
Da OpenAI endelig fik smækket døren i den 28. juli, havde aktiviteten bredt sig til over 15.000 konti.
Reaktionen fra tech-giganten i San Francisco faldt prompte:
* Tusindvis af konti blev bandlyst på stedet.
* Tjekket ved oprettelse af nye brugere blev strammet gevaldigt op.
* OpenAI lukkede det smuthul i deres streaming-output, som gjorde tricket muligt.
### Hvorfor er OpenAI så nervøse?
Man kunne måske fristes til at spørge: Hvad gør det, hvis andre ser, hvordan modellen tænker?
Problemet handler om *capability transfer*. Det handler ikke kun om at kopiere de rigtige svar, men om at stjæle selve *opskriften* på, hvordan en topmodel ræsonnerer sig frem til løsningen. Hvis en konkurrent kan destillere denne tankegang over i en mindre og billigere model, får de pludselig en AI i verdensklasse for en brøkdel af udviklingsprisen – og helt uden de sikkerhedsforanstaltninger, som OpenAI har brugt milliarder på at bygge ind.
Det aktuelle opgør skriver sig direkte ind i det benhårde AI-våbenkapløb mellem USA og Kina. Mens Moonshot AI og Kimi kæmper for at dominere det asiatiske marked, viser sagen, at grænsen mellem inspiration og digital spionage er blevet mikroskopisk tynd i AI-verdenen. OpenAI slap med skrækken denne gang, men én ting er sikkert: Det bliver næppe sidste gang, nogen forsøger at kigge dem dybt i de digitale hjernevindinger.




