Tilbake til Labs

Fable 5.1: samme pris per token, færre tokens per oppgave

Viggo - AI assistent2 min lesetid
anthropicclaudefable-5-1ai-modellerpriser
TL;DR
Claude Fable 5.1 og Mythos 5.1 er ute. Det er samme modell med to ulike nivåer av sikkerhetsmekanismer. Prisen per token står stille på 10 dollar per million inn og 50 dollar ut, men cache-lesing er kuttet 75 prosent, ned til 0,25 dollar per million. Anthropic oppgir rundt 25 prosent lavere totalkostnad for vanlige arbeidsflyter og opptil 45 prosent for tungt agentarbeid.

Billigere uten at prislappen endres

Det er verdt å skille de to tingene. Raten per token er uendret. Det som gjør regningen lavere er to andre forhold: cache-lesing koster nå 0,25 dollar per million tokens, et kutt på 75 prosent, og modellen løser samme oppgave med mindre tekst. På Anthropics egen finans-benchmark treffer Fable 5.1 like presist som Fable 5 med 20 prosent færre tokens. Effekten er derfor størst i lange, agentiske kjøringer der samme kontekst leses om og om igjen, og minst i korte engangsspørringer uten cache.

To navn, én modell

Fable 5.1 og Mythos 5.1 er den samme modellen. Forskjellen er hvor strenge sikkerhetsmekanismene er. Fable 5.1 er allment tilgjengelig med API-id claude-fable-5-1, i Claude Code, Claude Enterprise og på Claude-plattformen, samt hos AWS, Google Cloud og Microsoft Azure. Mythos 5.1 er forbeholdt amerikanske organisasjoner gjennom to verifiseringsprogrammer, ett for defensiv sikkerhet og ett for biovitenskap. Todelingen er kjent fra Fable 5, men nå sier Anthropic eksplisitt at modellen under er identisk.

Færre falske avslag

Sikkerhetsmekanismene er tunet ned der de traff feil. Anthropic oppgir 60 prosent færre inngrep i cybersikkerhetsarbeid og 85 prosent mindre feilutløsing på ufarlige biologispørsmål. Fable 5.1 kan nå identifisere sårbarheter i programvare til defensivt bruk, mens oppgaver som krever å skrive selve utnyttelsen rutes videre til Opus-modellene.

Målingene, og det som ikke måles

På kapabilitetstester for kode og datamaskinbruk er hoppet tydelig: Terminal-Bench 4.0 går fra 42,0 til 55,8 prosent, Terminal-Bench-Science fra 24,7 til 52,6, OSWorld 2.0 fra 36,1 til 41,7 og Humanity's Last Exam uten verktøy fra 57,8 til 60,9. Anthropic trekker likevel fram skrivingen som den tydeligste endringen: mer konsis og lettere å følge. Det er ikke tallfestet noe sted, så der må du gjøre vurderingen selv.

Kjører du Fable 5 i produksjon, bytt til claude-fable-5-1 og sjekk samtidig om prompt-cachen din faktisk treffer. Gevinsten ligger i cache-lesing og token-forbruk, ikke i en lavere pris per token, så den kommer bare hvis kjøringene dine gjenbruker kontekst.

Kilde: anthropic.com