Tilbake
AI-nyheter

Å betale for frontier-AI gir 4,4 måneders forsprang — til fem ganger prisen

Mozillas nye rapport om åpen kildekode-AI finner at de beste kinesiske åpne modellene nå ligger bare 4,4 måneder bak USAs lukkede frontier-modeller.

AIMag.no
AIMag.no
16. september 2026 · 3 min
To nesten like papirblokker, en høy og en litt lavere, med en rød målelinjal som viser den lille avstanden mellom dem – en illustrasjon av at kinesiske åpne modeller har nesten tatt igjen amerikanske grensemodeller, til en brøkdel av prisen.

Å betale for frontier-AI gir 4,4 måneders forsprang — til fem ganger prisen

Mozillas nye rapport om åpen kildekode-AI finner at de beste kinesiske åpne modellene nå ligger bare 4,4 måneder bak USAs lukkede frontier-modeller. Forspranget er ikke generelt: Lukkede modeller tjener prisen sin særlig på ekspertarbeid, krevende søk og lang kontekst — og delingen går grovt sett mellom oppgaver på åtte og tolv timer.

Mozilla publiserte sin rapport State of Open Source AI 15. september 2026, og Ars Technica har hatt et eksklusivt forhåndsblikk. Alle tallene nedenfor stammer fra Ars' forhåndsvisning; AIMag har ikke sett selve rapporten.

Tallet som teller: 4,4 måneder

Rapportens hovedfunn er at ytelsesgapet mellom USAs lukkede frontier-modeller og de beste kinesiske åpen-vekt-modellene er krympet til 4,4 måneder. For en bransje der modellene forbedres raskt, er det en kort avstand — kort nok til at spørsmålet ikke lenger er om åpne modeller når frontieren, men når, og hva man faktisk betaler for i mellomtiden.

Det konkrete eksemplet er Moonshot AIs Kimi K3. Ifølge rapporten ligger modellen bare tre poeng bak Anthropics lukkede frontier-modell Fable 5 på Artificial Analysis Intelligence Index — til omtrent 30 prosent av prisen. Det er dette som ligger bak regnet om fem ganger kostnaden for et relativt lite ytelsesløft.

Hvor delingen faktisk går

Gapet er imidlertid ikke jevnt. Rapportens mest praktiske tall gjelder oppgavelengde: Den beste lukkede modellen kan pålitelig fullføre en jobb som er 1,7 ganger så lang som den lengste jobben den beste åpne modellen klarer. Målingene bygger på METRs tidshorisont-metrikk, som måler hvor lang tid et menneske trenger på en oppgave modellen kan fullføre — en metrikk som har doblet seg etter en kadens som har akselerert over tid (beskrevet av Ars, med henvisning til METR).

Fordelingen går ifølge Mozilla, gjengitt av Ars, omtrent slik: De beste åpne modellene pålitelig fullfører oppgaver på opptil rundt åtte timer. I spennet mellom åtte og tolv timer blir forskjellen avgjørende — det er der lukkede modeller fortsatt klarer jobber som åpne modeller ikke fullfører pålitelig.

Mozillas teknologidirektør Raffi Krikorian rammer det inn som et arbeidsdelingsspørsmål: «[En lukket modell] tjener premiumen sin på noen få steder: ekspertfaglig arbeid, høyintensivt søk og lang kontekst», sa han i en e-post til Ars.

Det forklarer også hvorfor organisasjoner fortsatt betaler. Lukkede modeller fungerer rett ut av boksen og kommer med det Krikorian kaller «compliance-pakking, støtte og ansvarliggjøring» — og mange organisasjoner mangler personalet som kreves for å drifte åpen-vekt-modeller godt.

Slik deler en reell bruker arbeidet

Rapportens illustrasjon er DoorDash. Ifølge Ars, med henvisning til Mozillas rapport, bruker leveringsselskapet Kimi til rutinearbeid, mens Fable reserveres til vanskeligere oppgaver som normalt ville tatt menneskelige eksperter lengre tid. Det er ett sitert eksempel fra rapporten — ikke et dokumentert bransjemønster, og verken Mozillas tall eller DoorDash-bruken er uavhengig verifisert av AIMag.

Mønsteret er likevel lesverdt: Det samme selskapet bruker begge modelltyper, fordelt etter oppgave, ikke etter ideologi.

Forbeholdene

Alle tallene kommer via én sekundærkilde — Ars Technicas forhåndsvisning av en rapport AIMag ikke har sett. Ars flagger dessuten at egendefinerte test-oppsett bygget av AI-labber kan gi oppblåste benchmarkscores sammenlignet med tredjeparts oppsett. Ars' tekst er også avkortet der sammenligningsmetodikken introduseres, så det fulle bildet av hvordan ulike målinger utjevnes er ukjent.

Med det forbeholdet er rapportens budskap tydelig: Premiumen for lukkede frontier-modeller er reell, men smal — den måles i måneder, ikke år, og den gjelder ikke alle oppgaver, bare de vanskeligste.

Kilder

  1. Exclusive: Paying for frontier AI models buys 4-month head start at 5x the cost - Ars Technicaarstechnica.com