Googles Gemini 4 Argon: 1 million tokens output, men kodingsresultatene henger etter konkurrentene

Google lanserte sin nye frontier-modell Gemini 4 Argon onsdag 30. september 2026, men de fleste betalende kundene må vente: modellen går først til godkjente cyber-forsvarere gjennom selskapets Fairwind-program, uten dato for bredere…

Illustrasjon: en enorm papirrull ruller ut over et mørkt gulv, mens en liten haug med tråd ligger uferdig ved kanten – et bilde på enorm skala og etterslepende resultater.
Illustrasjon
Gi artikkelen

Googles Gemini 4 Argon: 1 million tokens output, men kodingsresultatene henger etter konkurrentene

Google lanserte sin nye frontier-modell Gemini 4 Argon onsdag 30. september 2026, men de fleste betalende kundene må vente: modellen går først til godkjente cyber-forsvarere gjennom selskapets Fairwind-program, uten dato for bredere tilgang. Introduksjonsprisen er $2 per million input-tokens og $10 per million output-tokens – halvparten av normalprisen – og output-grensen er hevet fra 64 000 til 1 million tokens. Alle benchmark-tallene kommer fra Google selv, og de er blandede: Argon toppscorer på 13 av 19 resultater i Googles egen tabell, men tapper tydelig mot konkurrentene på sentrale kodingsprøver.

Hva som ble lansert – og av hvem

Modellen ble annonsert i et Google-blogginnlegg av Koray Kavukcuoglu, seniorvisepresident i Google DeepMind og Googles sjefs-AI-arkitekt. Google posisjonerer Argon som en frontier-modell for programvareutvikling, kunnskapsarbeid og cybersikkerhet (Yahoo Finance).

Baklengs utrulling: cyber-forsvarerne først

Det mest uvanlige ved lanseringen er tilgangsmodellen. Argon går først til «vetted» cyber-forsvarere gjennom Fairwind-programmet, som Google lanserte 2. september for offentlige etater, Google Cloud-kunder og sikkerhetspartnere, og som nå har over 650 partnere. Google deltar i tillegg i den frivillige amerikanske regjeringsprosessen for pre-release-modelltilgang (AIStockWire).

Google sier at selskapet vil fortsette å samle tilbakemeldinger fra tidlige testere og justere sikkerhetsrelingene før en bredere lansering. Når den kommer, starter den med betalende API-kunder og abonnenter på Google AI Ultra, selskapets øverste forbrukerabonnement. Google oppga ingen dato (MadRobot).

Mest iøynefallende: Google sier at betrodde forsvarere og egne team får en variant «uten cyber-sikkerhetsreling, slik at de kan utnytte dens fulle frontier-nivå cybersikkerhetsforsvarsevner» (AIStockWire). Med andre ord: den mest kapable versjonen av en frontier-modell på cyber-området reserveres til en kontrollert krets – ifølge Google nettopp fordi evnene ellers kunne misbrukes. Ifølge Futunn innebærer overvåkingstiltakene at modellen kan termineres hvis den avviker fra intendert virkefelt. Tulsee Doshi, senior direktør og produktsjef for Gemini, sier: «Vi har observert at disse beskyttende tiltakene er effektive» (Futunn).

Pris og kapasitet

Google kaster seg inn i prismessig konkurranse. Introduksjonsprisen er $2 per million input-tokens og $10 per million output-tokens. Etter introduksjonsperioden dobles prisene til $4 og $20, og Google har ikke sagt hvor lenge introduksjonsperioden varer. Cachet input er 95 % billigere (Yahoo Finance; MadRobot; AIStockWire). AIStockWire anslår at prisen tilsvarer rundt en femtedel av GPT-6 Astra (AIStockWire).

I tillegg har Google hevet Argons output-grense fra 64 000 til 1 million tokens, angitt som et svar på komplekse problemløsningsscenarioer (Stocktwits via TradingView).

Benchmarkene: sterke på Googles bord, svakere i hodet mot konkurrentene

I benchmark-tabellen Google publiserte, har Argon toppscore på 13 av 19 resultater mot GPT-6 Astra, Claude Fable 5.1 og Claude Opus 5.5, og uavgjort med GPT-6 Astra på én. Alle tallene er Googles egne og dermed ikke uavhengig verifiserte, og selskapet har lagt ut evalueringsmetodikken sin ved siden av (AIStockWire).

Men tabellen rommer også tydelige nederlag. På FrontierSWE v2 scorer Argon 55,0 %, mot Astras 65,5 % – et gap på 10,5 prosentpoeng. På Terminal-bench 4.0 ligger Argons 57,4 % nesten 9 prosentpoeng bak Opus 5.5s 66,4 % (Futunn).

Et metodisk forbehold gjør sammenligningene ekstra vanskelige å lese: vilkårene var ikke standardisert. På DeepSWE – der Argon leder med 77,9 % – brukte Google sitt proprietære mini-swe-agentrammeverk for å beregne Argons poengsum, mens konkurrentenes resultater var hentet fra offentlige ledetavler og modellenes egne rapporter (Futunn). Alle tall altså fortjener forsiktig lesing: de er selvrapporert, og flere av sammenligningene måler ikke det samme på samme måte.

Googles egne bruksområder – påstanden om det kritiske funnet

Brukseksemplene Google legger frem, kommer i hovedsak fra internt og partnerdrevet cyber-arbeid. Sikkerhetsselskapet Wiz bruker Argon til gratis skanning av kritisk offentlig infrastruktur, og Google hevder at modellen fant en kritisk sårbarhet som eksponerte personopplysninger i helseprogramvare brukt av sykehus verden over – en sårbarhet tidligere modeller skal ha oversett (MadRobot). Dette er Googles påstand, ikke uavhengig verifisert.

Internt skal Argon ifølge Google blant annet ha frigjort over 300 TiB minne i datasentre ved å analysere telemetri fra klyngeytelse og implementere optimaliseringer, med et estimert potensial på 500 TiB til 1 PiB (Futunn). Også her gjelder: tallene er Googles egne, fra egne miljøer, uten ekstern kontroll.

Dokumentert skepsis – og Googles motsvar

Samtidig med lanseringen rapporterte Bloomberg, med henvisning til folk som kjenner saken, at enkelte Google-ansatte mener Gemini 4 gjør det bra på benchmarks, men sliter med enkelte virkelige kodingsoppgaver. Google bestrider den karakteristikken (MadRobot). Motsetningen er verdt å holde fast i: selskapet selv fremhever kodingsprestasjoner, mens de interne tvilene peker mot nettopp gapet mellom selvrapporerte benchmark-tall og praktisk ytelse – et gap som forsterkes av de ikke-standardiserte sammenligningsvilkårene ovenfor.

Markedsresponsen: kildene er uenige

Alphabet-aksjen lukket onsdag opp 0,9 % til $344,15, og handlet til $349,45 etter børsstenging per kl. 16:51 ET, ifølge AIStockWire (AIStockWire). Stocktwits melder tilsvarende at GOOGL steg rundt 1 % etter handel (Stocktwits via TradingView). Yahoo Finance rapporterer derimot at Alphabet-aksjen var flat på nyheten (Yahoo Finance). Forskjellen kan handle om måletidspunkt – Yahoo-oppdateringen kan være tatt før den etter-børs-bevegelsen de andre kildene fanger – men det er uavklart, og det finnes ingen entydig markedslesning av lanseringen ennå.

Det som står åpent

Tre spørsmål forblir uten svar. Når får betalende API-kunder og AI Ultra-abonnenter tilgang – Google har ikke gitt noen dato? Hvor lenge varer introduksjonsprisen på $2/$10 før den dobles til $4/$20 – uspesifisert? Og hvor representerer benchmark-tabellen faktisk en reell forsprang fremfor konkurrentene, når tallene er Googles egne og sammenligningsvilkårene delvis avviker fra det konkurrentene har rapportert? Uavhengig benchmarking av Argon må komme fra tredjeparter med tilgang – noe den restrikterte utrullingen så langt begrenser.

Få de viktigste AI-nyhetene i innboksen

Nyheter, analyser og verktøy samlet for deg.