Anthropic senker Haiku 5.5-prisen til 0,10 dollar per million tokens – men med viktig grense

Anthropic lanserte onsdag sin nye småmodell Claude Haiku 5.5 med en pris som matcher OpenAIs GPT-6 Luna – men bare for forespørsler under 100 000 tokens.

Illustrasjon: en lang rekke små identiske metallskiver på papir, avskåret ved ett punkt, som symboliserer lav tokenpris med en grense.
Illustrasjon
Gi artikkelen

Anthropic senker Haiku 5.5-prisen til 0,10 dollar per million tokens – men med viktig grense

Anthropic lanserte onsdag sin nye småmodell Claude Haiku 5.5 med en pris som matcher OpenAIs GPT-6 Luna – men bare for forespørsler under 100 000 tokens. Over terskelen stiger prisene femdoblet, og en uavhengig prisberegning antyder at lange kall kan ende på det femdobelte av Lunas pris. Samme dag halverte selskapet cache-leseprisene på Sonnet 5.5 og introduserte månedlige API-kreditter.

Prislisten i sin helhet

Haiku 5.5 ble lansert 7. oktober 2026 til 0,10 dollar per million inngangstokens og 0,50 dollar per million utgangstokens for forespørsler under 100 000 tokens – nøyaktig samme nivå som OpenAIs GPT-6 Luna, og en nedgang på 90 prosent fra forgjengeren (VentureBeat).

Men prisstrukturen har to nivåer. Over 100 000 tokens koster inngang 0,50 dollar og utgang 2,50 dollar per million tokens. Det er fortsatt en nedgang på 50 prosent fra Haiku 4.5, men langt fra overskriftstallet. SiliconANGLE rapporterer at Anthropic priser den nye modellen til omtrent en fjerdedel av det Haiku 4.5 koster i drift (SiliconANGLE).

Terskelen er ikke tilfeldig: Ifølge Anthropic dekket prompter på inntil 100 000 tokens rundt 90 prosent av forespørslene til den gamle modellen (SiliconANGLE). De fleste eksisterende brukere skal altså lande på det billige nivået – men de 10 prosent med lange kontekster, typisk agentoppdrag som leser store dokumentmengder, treffer dyrere priser.

Hvor mye koster det egentlig? En beregning av forskjellen

Den japanske analyse­nettstedet XenoSpectrum har regnet på hva terskelen betyr i praksis. For et enkelt API-kall med 200 000 inngangstokens og 20 000 utgangstokens koster Haiku 5.5 anslått 0,15 dollar, mens GPT-6 Luna koster 0,03 dollar – altså om lag fem ganger dyrere (XenoSpectrum). Forskjellen skyldes at Lunas tilleggsgebyr først trer i kraft over 272 000 tokens.

Det er viktig å understreke at dette er en prisberegning, ikke en målt benchmark: tallene følger mekanisk av de publiserte takstene, men forutsetter et bestemt kall-format. Poenget står likevel: For arbeidsmengder med lange innganger er ikke «90 prosent billigere» overførbart – der er Haiku 5.5 vesentlig dyrere enn konkurrenten den offisielt matcher.

Tallet om 75 prosent er et estimat med forbehold

Anthropic oppgir selv at arbeidsmengder samlet sett koster omtrent 75 prosent mindre enn på Haiku 4.5, når forespørselfor­delingen og endringer i tokenforbruket er tatt høyde for (VentureBeat). Estimatet hviler på to forutsetninger som begge kommer fra Anthropic selv: at rundt 90 prosent av forespørslene ligger under terskelen, og at en oppdatert tokenizer teller samme tekst som et noe høyere antall tokens. Hvor mye tokenizerendringen spiller inn, er ikke kvantifisert. XenoSpectrum advarer eksplisitt mot å overføre 75-prosent-tallet direkte til en vilkårlig arbeidsmengde.

Ytelse: sterkere tall, men alle fra Anthropic

Ifølge Anthropics egne, publiserte benchmarks scorer Haiku 5.5 72,4 prosent på OSWorld 2.1 (offlinedelen, en test der agenter betjener en ekte datamaskin gjennom flertrinnsoppgaver) mot 48,9 prosent for GPT-6 Luna. På Terminal-Bench 4.0 er tallene 39,2 mot 16,4 prosent (SiliconANGLE). Modellen er den første Haiku med justerbar innsatsinnstilling (effort).

Kunden Asana rapporterer fra forhåndstesting at latens ved fullførte oppgaver var mer enn 30 prosent lavere enn med modellen de bruker i dag, og at inferensen per agent-sving gikk opptil 2,5 ganger raskere – oppgitt av Asanas staff software engineer Aaron Vinh gjennom Anthropics lanseringsmateriell (SiliconANGLE). Ingen av ytelsestallene er uavhengig verifisert; de gjentas av flere medier, men stammer alle fra Anthropic.

TechTarget plasserer modellen som best egnet for hastighetsfølsomme oppgaver som nettleserbruk og kundestøtte (TechTarget).

Sonnet 5.5 blir også billigere

Samme dag senket Anthropic cache-leseprisene på Sonnet 5.5 – som ble lansert 28. september – fra 0,20 til 0,10 dollar per million tokens. Ettersom bufrede tokens utgjør en stor andel av det modeller faktisk konsumerer, regner Anthropic med at kuttet fjerner rundt 20 prosent av kostnaden ved det meste agentbaserte arbeid på modellen (SiliconANGLE). Også dette er selskapets eget anslag.

Sikkerhet, tilgjengelighet og API-kreditter

Anthropic oppgir at Haiku 5.5 viste færre tilfeller av feiljustert atferd enn Haiku 4.5. For cybersikkerhet skriver selskapet at modellens sikkerhets­rammer «tillater et bredere spekter av defensive oppgaver enn våre rammer for Sonnet 5.5, men de blokkerer fortsatt penetrationstesting og andre teknikker som er mer sannsynlig brukt av angripere» (Seeking Alpha via MSN).

Modellen er tilgjengelig på alle større plattformer, inkludert AWS, Google Cloud og Microsoft Azure. Anthropic innfører også månedlige API-kreditter: 100 dollar i måneden for Max 5x-brukere, 200 dollar for Max 20x og inntil 500 dollar for Team-abonnenter (Seeking Alpha via MSN).

Konteksten: full familie og et mulig børsnoteringstrykk

Lanseringen fullfører Claude 5.5-familien ni dager etter Sonnet 5.5, med Opus 5.5 og Sonnet 5.5 lansert i september. Den kommer også mens Anthropic skal utvide produktporteføljen forut for en mulig børsnotering som kan komme så tidlig som i midten av november (Benzinga via MSN). Det rapporteres i tillegg om en målsetning om en verdivurdering på rundt 2 billioner dollar – men dette er kilder baserte på pågående diskusjoner, ikke bekreftet av selskapet, og kan endre seg.

Åpne spørsmål

Flere ting gjenstår uavklart. Det er uspesifisert hvordan forespørsler på nøyaktig 100 000 tokens faktureres, og hvilke tokens som avgjør terskelen – en reell tvetydighet for kostnadsplanlegging. Videre er alle ytelsestall publisert av Anthropic selv, og 75-prosent-besparelsen hviler på selskapets egne data om forespørselfordeling og tokenizerendringer. Og om den aggressive prisstrategien mot GPT-6 Luna er varig eller en markedsførings­fase rundt en mulig notering, er det ingen av kildene som kan si noe sikkert om.

Få de viktigste AI-nyhetene i innboksen

Nyheter, analyser og verktøy samlet for deg.