
En ny AI-modell kan kosta mer per token och ändå bli billigare, om den klarar jobbet på färre steg. Ett jobb som tog förra modellen över 20 timmar gjorde Opus 5.5 på under tre.
Anthropics nya modell Claude Opus 5.5 fick granska och rätta en kodbas på 200 000 rader. Enligt en testare var den klar på under tre timmar. Den tidigare modellen, Opus 5, tog över 20 timmar och använde 2,5 gånger så många tokens. Priset per token sänktes också. Men den stora skillnaden var att den nya modellen behövde mindre arbete för att bli klar.
För en agent, en AI som arbetar på egen hand med en uppgift i många steg, spelar det mindre roll vad varje token kostar om den nya modellen:
- behöver färre steg för att lösa samma uppgift. GitHub testade Opus 5.5 i sin kodmiljö och säger att den löste fler uppgifter än Opus 5 på mindre än hälften så många steg.
- fastnar mer sällan och behöver färre omtag. Hos Quantium krävde en svår kodningsuppgift tidigare 38 instruktioner under fyra dagar. Med Opus 5.5 räckte 11 instruktioner under tre timmar.
- kan återanvända tidigare kontext billigare. En agent läser om samma material gång på gång och enligt Anthropic står den delen för det mesta av kostnaden i agentarbete. Anthropic sänkte det priset med 60 procent. OpenAI ger 90 procent rabatt på text som Sol redan har läst.
- kan fortsätta arbeta självständigt i många timmar. En utvecklare på Clio lät Opus 5.5 arbeta obevakad över natten och modellen höll sig till uppgiften i över 18 timmar.
- och oftare faktiskt slutför uppgiften. Anthropic bad Opus 5.5 korta laddtiderna på varje sida i en webbapp. Enligt Anthropic lyckades den 39 gånger av 40, medan Opus 5 bara gav mindre förbättringar.
Opus 5.5 och GPT-6 Sol släpptes samma dag, den 22 september. Båda bolagen sänkte priset per token. Men när de ville visa vad modellerna är värda pekade de på vad ett färdigt jobb kostade. OpenAI skriver själva att kostnaden för att låta agenter arbeta länge blir viktigare när uppgifterna blir längre.
Den som bara jämför prislistor jämför fel siffra. När AI börjar utföra längre arbetsuppgifter är den intressanta frågan inte vad en token kostar, utan vad det kostade att få jobbet gjort.
Fråga upplyst.ai
Varför spelar det roll?
Den som jämför AI-modeller tittar oftast på priset per token. För en agent som arbetar i timmar avgör antalet steg och omtag vad jobbet kostar. Det gör också hur ofta den faktiskt blir klar. En modell med högre pris per token kan därför bli billigare per färdigt jobb.
Vad är bakgrunden?
Claude Opus 5.5 är Anthropics nya modell och GPT-6 Sol är OpenAIs. Båda släpptes den 22 september. En agent är en AI som arbetar på egen hand med en uppgift i många steg, till exempel att granska och rätta kod. Kontext är det material agenten redan har läst. När agenten läser om det tar bolagen ett eget, lägre pris.
Vad är osäkert?
Exemplen från GitHub, Quantium och Clio är bolagens egna uppgifter om sina egna tester. Kodgranskningen kommer från en testare som inte namnges. Webbapptestet är Anthropics eget. Källorna säger inte vad körningarna kostade i pengar, bara hur många tokens och timmar de tog. Artikeln visar inget fall där en modell med högre pris per token blev billigare per jobb, bara varför det kan hända.