Hva som er nytt i modellen
Opus 5 er bygget for lange agentkjeder: feilsøking, rotårsaksanalyse og oppgaver der modellen må verifisere sitt eget arbeid underveis. På ARC-AGI 3 skårer den tre ganger så høyt som nest beste modell. På CursorBench 3.2 ligger den innenfor 0,5 prosent av Fable 5 til halve kostnaden. På livsvitenskap er den 10,2 prosentpoeng bedre enn Opus 4.8 på organisk kjemi og 7,7 poeng bedre på proteinoppgaver.
Nytt er også effort-innstillinger som lar deg velge mellom maksimal intelligens og tokenøkonomi, en Fast mode som kjører 2,5 ganger raskere til dobbel pris, og to beta-funksjoner: bytte av verktøy midt i en samtale, og automatisk fallback til andre modeller når et sikkerhetsflagg utløses. Mythos 5 er fortsatt sterkere på exploit-utvikling og autonom biologi.
Prompting-reglene er skrevet om
Anthropic fjernet over 80 prosent av systempromptet i Claude Code for de nyeste modellene uten at ytelsen falt. Retningslinjene som erstatter det handler om fem skift:
- Harde forbud byttes ut med skjønn. «Skriv aldri kommentarer» var et gjerde for svakere modeller. Rådet nå er å matche kommentartetthet og idiomer i koden rundt.
- Verktøyeksempler byttes ut med uttrykksfulle parametre. En enum med
pending,in_progressogcompletedgir bedre signal enn et eksempel på bruk. - Alt-på-forhånd byttes ut med progressiv avdekking. Skills og verktøy som lastes ved behov koster ingen kontekst før de faktisk brukes.
- Gjentakelse byttes ut med én kilde. Verktøybeskrivelsen eier instruksen alene.
- Enkle spesifikasjoner byttes ut med rikere referanser. En testsuite, en HTML-artifact eller en rubrikk som verifikator-agenter kan kjøre mot.
Relevans for Velo-kunder
Har du et harness med systemprompt, CLAUDE.md og verktøybeskrivelser bygget for 4.x-modellene, er sannsynligvis en god del av det nå ballast. Gjennomgangen koster lite, og gevinsten er både lavere tokenbruk og bedre treff.
Kilder: Claude Opus 5 og The new rules of context engineering for Claude 5 generation models