
Samsung Galaxy Z Fold8 Ultra:
Kimi K3 fra kinesiske Moonshot AI slo både Claude og GPT i en kodetest. Modellen har 2,8 billioner parametre. Fra mandag kan hvem som helst laste den ned.

Moonshot AI slapp Kimi K3 den 16. juli, og modellen gikk rett til topps på Frontend Code Arena, en test der språkmodeller bygger faktiske brukergrensesnitt og blir rangert på hva de får til. Kimi K3 fikk 1679 poeng og la seg foran både Claude Fable 5 og GPT-5.6 Sol.
Moonshot AI er kinesisk, og modellen er den største åpne som noen gang er sluppet: 2,8 billioner parametre.
Modellen er bygget som en mixture-of-experts, altså delt opp i mange spesialiserte deler der bare noen få er i sving for hvert ord som produseres. Av 896 eksperter er 16 aktive per token, omtrent 1,8 prosent av bunken.
Regnestykket for å kjøre den er derfor langt mindre skremmende enn 2,8 billioner parametre skulle tilsi. Kontekstvinduet er på én million tokens, og modellen håndterer bilder direkte uten omvei.
Gjennom API-et koster Kimi K3 3 dollar per million tokens inn og 15 dollar per million ut, med 0,30 dollar for treff i hurtigbufferen.
Moonshot beskriver modellen som laget for lange, sammenhengende arbeidsøkter heller enn korte spørsmål og svar. Den skal navigere store kodebaser, bruke verktøy underveis, feilsøke og gå flere runder mot bilder, logger, tester og tilbakemeldinger fra kjørende kode.
Det er den samme retningen hele bransjen beveger seg i akkurat nå. Modellene skal ikke lenger bare svare, de skal holde på med en oppgave over tid uten at noen sitter og dulter dem videre for hvert steg.
Kontekstvinduet på én million tokens henger sammen med dette. Skal en modell jobbe seg gjennom et helt prosjekt, må den kunne ha hele prosjektet i hodet samtidig.
Førsteplassen gjelder én bestemt test, og selskapet selger den ikke inn som mer enn det. Moonshot opplyser selv at modellen fortsatt ligger bak Claude Fable 5 og GPT-5.6 Sol målt på samlet ytelse.
På Frontend Code Arena vant den fem av seks kategorier, blant annet data og analyse, forbrukerprodukt og merkevare. Den tapte på gaming.
Det er en nyttig påminnelse om hvordan slike tester fungerer. En modell kan være best i verden på å bygge brukergrensesnitt og likevel ligge et stykke bak på alt annet.

Det som skiller Kimi K3 fra de amerikanske konkurrentene er at hvem som helst snart kan laste den ned. Moonshot har varslet at de fullstendige vektene publiseres innen 27. juli, under en modifisert MIT-lisens som gjør det tillatt å kjøre modellen på egen maskinvare.
Vektene er alle tallene modellen består av, altså det den har lært seg gjennom treningen, lagret som en fil. Det er nøyaktig de samme 2,8 billionene som er nevnt over: Parametre og vekter er i praksis to ord for de samme tallene. Legger du dem ut, har du gitt bort hele modellen.
En nedlastbar modell kan kjøres bak brannmuren i en bedrift som ikke vil sende data ut av huset, den kan finjusteres på egne fagdata, og den slutter ikke å virke fordi en leverandør endrer prisen eller legger ned tjenesten.
Claude og GPT kan du leie. Denne kan du ta hjem.
Her stopper drømmen for de aller fleste. Filen med de ferdige vektene er på rundt 1,4 terabyte, og for å kjøre modellen må hele filen ligge i minnet samtidig. Ikke på harddisken. I minnet.
En godt utstyrt bærbar PC har 32 gigabyte. Du mangler altså ikke litt minne, du mangler over førti ganger så mye.
Krymper du modellen med hardhendt komprimering, som koster nøyaktighet, lander du fortsatt på mellom 650 og 700 gigabyte. Mac Studio med 512 gigabyte delt minne, den mest minnerike personlige datamaskinen Apple har laget, er for liten. Har maskinen for lite minne, begynner den å lese fra disk i stedet, og da faller farten under ett ord i sekundet.
Den realistiske oppskriften er åtte H100-kort med 80 gigabyte hver, eller en rackserver med over en terabyte minne. Dette er utstyr for bedrifter, universiteter og skytjenester. Ikke for hjemmekontoret.
For vanlige folk er veien inn den samme som til Claude og GPT: Appen eller API-et. Moonshot har egen chatbot og kodeassistent, og gjennom API-et koster det de 3 og 15 dollarene per million tokens som er nevnt over. Du slipper altså å eie noe som helst.
Åpne vekter er med andre ord ikke det samme som vekter du kan kjøre. Gevinsten for folk flest er indirekte, men reell: Når en modell som kan lastes ned gratis puster de amerikanske i nakken, presses prisene nedover hos alle sammen.
Vil du kjøre noe helt lokalt, på din egen maskin, uten at data forlater huset, finnes det langt mindre åpne modeller som gjør nettopp det. De er ikke i nærheten av Kimi K3 i kapasitet, men de kjører på en vanlig PC med 16 gigabyte minne, og de har blitt overraskende gode de siste par årene.
Kina er underlagt amerikanske eksportrestriksjoner på de kraftigste AI-brikkene, og modellen er utviklet innenfor de begrensningene. Det er en del av poenget med å gi den bort: Når du ikke kan kjøpe deg til den samme regnekraften som konkurrentene, blir distribusjon og tilgjengelighet våpenet i stedet.
En modell som ligger fritt tilgjengelig sprer seg til utviklere, universiteter og bedrifter over hele verden uten at noen trenger å be om lov. Det er en helt annen strategi enn den amerikanske, der de sterkeste modellene holdes lukket og selges som tjeneste.
Teknokratiet skrev i januar 2025 om DeepSeek, som sendte gravitasjonsbølger gjennom bransjen da en kinesisk modell plutselig målte seg med de amerikanske til en langt lavere kostnad. Enda tidligere, i 2024, lanserte SenseTime en språkmodell som banket GPT-4 Turbo på nesten alle punkter.
Mønsteret gjentar seg med jevne mellomrom, og hver gang virker Silicon Valley like overrasket.
Om Kimi K3 faktisk er bedre enn Claude i praktisk bruk, avhenger helt av hva du bruker den til. Men at en åpen kinesisk modell topper en kodetest i det hele tatt, er ikke lenger en engangshendelse.
25. juli kl. 14:07

Samsung Galaxy Z Fold8 Ultra:

Samsung Galaxy Z Fold8:

Samsung Galaxy Z Flip8:

Apple saksøker OpenAI:

