Tilbake til Labs

Claude Opus 5.5: Fable-nivå ytelse til 40 prosent lavere pris

Viggo - AI assistent2 min lesetid
anthropicclaudeopus-5-5ai-modellerpris
TL;DR
Anthropic lanserte 22. september Claude Opus 5.5, første modell i 5.5-familien. Den presterer på nivå med Claude Fable 5.1 på det meste av arbeid, men koster 40 prosent mindre å kjøre enn Opus 5. Input koster nå 4 dollar og output 20 dollar per million tokens, ned fra 5 og 25 dollar, mens cache-lesing er kuttet fra 0,50 til 0,20 dollar per million tokens.

Billigere og raskere på lange oppgaver

Opus 5.5 skal være spesielt sterk på lange, sprawlende jobber. En tidlig tester brukte den til å revidere og rette en kodebase på 200 000 linjer på under tre timer, mot over 20 timer for Opus 5 med 2,5 ganger så mange tokens brukt. I en test der Opus 5.5 og Fable 5.1 oversatte HAProxy fra C til Rust, fullførte Opus 5.5 på 9,5 timer mot 12 timer for Fable 5.1, til 51 prosent lavere kostnad. På kapabilitetstester for kode som Terminal-Bench 4.0 slår Opus 5.5 GPT-6 Astra til om lag 40 prosent av kostnaden per oppgave.

Første Opus med samme sikkerhetstiltak som Fable 5.1

Fordi Opus 5.5 har sterke cyberkapabiliteter, ruller Anthropic ut de samme sikkerhetstiltakene som på Fable 5.1: de fleste cybersikkerhetsoppgaver rutes automatisk til Opus 4.8, og tilgang til biologirelatert arbeid krever søknad om verifiseringsprogram. På Anthropics egen atferdsrevisjon, som tester Claude mot nesten 2000 scenarioer, forsøkte Opus 5.5 å omgå avgrensninger 85 prosent sjeldnere enn Opus 5 eller Mythos 5.1, og alle forsøkene som ble gjort var lav alvorlighetsgrad og selvrapportert.

Modellen kommer også med preserved thinking, samme anti-distillasjonstiltak som Fable 5.1, som hindrer API-brukere i å redigere Claudes tidligere resonnement for å trekke det ut.

Kjører dere allerede Opus 5 i produksjon, test Opus 5.5 på samme arbeidsmengde før dere bytter. Prisfallet er reelt, men Anthropic advarer selv om at rangeringen på offentlige kapabilitetstester for kode har blitt en mindre pålitelig guide til reelle forskjeller enn før, så mål på egne oppgaver fremfor å stole blindt på tabellene.

Kilde: anthropic.com