Teknik

Claude Opus 5.5 lanseras 40% billigare just när Anthropic manar till AI-återhållsamhet

Susan Hill
Lägg till oss på Google

Claude Opus 5.5 gör något som Anthropics tidigare modeller inte gjorde: den kostar mindre och arbetar snabbare, samtidigt som den matchar eller överträffar ett större och dyrare system. Modellen hanterar agentisk programmering, datoranvändning, diagramtolkning och tvärvetenskapligt resonemang på nivåer som, enligt Anthropics egna data, överträffar Claude Fable 5.1 – företagets tidigare mest kapabla modell – på flera mått. För användare och utvecklare som ansåg att Opus 5 var användbar men dyr har avståndet mellan modellens kapacitet och dess kostnad förändrats avsevärt.

Prisskillnaden är konkret. Opus 5.5 kostar 4 dollar per miljon indatatoken och 20 dollar per miljon utdatatoken; Opus 5 kostade 5 respektive 25 dollar. Cachelagda läsningar sjunker från 0,50 till 0,20 dollar per miljon token. Anthropic uppger att typiska arbetsbelastningar totalt sett blir omkring 40 procent billigare. Hastigheten följer samma riktning: standardmodellen genererar text mer än 30 procent snabbare än Opus 5. Ett separat snabb-läge, prissatt till 8 dollar för indata och 40 dollar för utdata per miljon token, når upp till 2,5 gånger hastigheten hos standardversionen av Opus 5 – en användbar inställning för applikationer som är känsliga för fördröjningar.

Anthropics publicerade prestandasiffror placerar Opus 5.5 före Fable 5.1, Opus 5 och GPT-6 Astra i fyra av sex riktmärken. I Terminal-Bench 4.0, som testar kodexekvering i en aktiv terminalmiljö, får Opus 5.5 66,4 procent jämfört med Fable 5.1:s 55,8 procent. I Humanity’s Last Exam, ett test som omfattar akademisk och professionell kunskap från olika discipliner, blir resultatet 67,7 procent mot 65,6 procent. OSWorld 2.0, som mäter användning av datorgränssnitt, visar 81,8 procent mot 80,7 procent. Ett Deloitte-test fann att Opus 5.5, vid sin lägsta ansträngningsnivå, upptäckte 72 procent av kända kodfel vid granskning, jämfört med 56 procent för Opus 5 vid hög ansträngningsnivå. Siffrorna kommer från Anthropic och dess utvalda partner; de angivna felmarginalerna sträcker sig från ±1,6 till ±5 procentenheter, och någon oberoende verifiering från tredje part har inte publicerats vid lanseringen.

Två områden bryter mönstret. I AutomationBench får GPT-6 Astra 41,4 procent mot Opus 5.5:s 40,0 procent. I Terminal-Bench-Science är skillnaden större: Astra når 64,6 procent medan Opus 5.5 landar på 58,7 procent. Båda skillnaderna ligger inom de angivna felmarginalerna – de kan vara brus – men de behöver inte vara det. Anthropic inkluderar dessa rader i sin egen publicerade tabell, vilket är mer än de flesta AI-företag gör vid en lansering. Siffrorna behöver fortfarande granskas oberoende innan de kan betraktas som fastslagna.

När det gäller säkerhet uppger Anthropic att Opus 5.5 före lanseringen utvärderades av externa team, däribland METR. I företagets egen interna beteendegranskning, med närmare 2 000 scenarier utformade för att testa om modellen försöker kringgå begränsningar som lagts på den, beskrivs Opus 5.5 som 85 procent mindre benägen än Opus 5 att försöka med sådant kringgående. Starkare modeller tenderar att vara bättre på att hitta sätt runt begränsningar, vilket gör förbättringen betydelsefull om den håller i sig. Erfarenheterna från faktisk användning blir det verkliga testet.

Det som gör lanseringen ovanlig är tidpunkten. Tidigare denna månad publicerade Anthropics vd Dario Amodei en essä där han skrev att han blivit övertygad om att en fullständig hantering av AI-risker kräver att man ”anpassar takten i kapacitetsutvecklingen så att riskförebyggandet hinner med”. OpenAI:s Sam Altman och Elon Musk uttryckte enighet med den övergripande oron. Nvidias Jensen Huang sade att den underliggande vetenskapen inte stöder den. Och sedan släppte Anthropic en modell som är snabbare, billigare och mer kapabel än sin föregångare. En tolkning är att en modell med bättre säkerhetsutvärderingar och bredare tillgång är precis vad Amodei hade i åtanke. En annan är att essän pekade ut kapacitetsutvecklingen som problemet, och kapaciteten gick framåt. Båda tolkningarna ryms inom samma faktaunderlag, och Anthropics riktmärken kan på egen hand inte avgöra vilken som är rätt.

Claude Opus 5.5 är tillgänglig från och med den 22 september 2026 under API-modell-ID:t claude-opus-5-5. Den körs i Claude för abonnemangen Pro, Max, Team och Enterprise, och är tillgänglig via AWS, Google Cloud och Microsoft Azure. Anthropic höjer användningsgränserna för abonnemangsnivåer om fem timmar. Sonnet 5.5 och Haiku 5.5, de återstående medlemmarna i 5.5-familjen, är planerade att följa under de kommande veckorna, utan att något pris eller specifikt lanseringsdatum har meddelats för någon av dem.

Taggar: , , , , ,

Lägg till oss på Google

Diskussion

Det finns 0 kommentarer.