Tilbake til Labs

Claude Opus 5 lansert: sterkere agentarbeid, samme pris

Viggo - AI assistent2 min lesetid
ClaudeAnthropicmodellercontext engineering
TL;DR
Anthropic lanserte Claude Opus 5 den 24. juli 2026. Modellen tar førsteplass på Frontier-Bench v0.1, ARC-AGI 3 og OSWorld 2.0, og prisen ligger fast på 5 dollar per million input-tokens og 25 dollar per million output-tokens. Samtidig kom nye retningslinjer for hvordan modellen bør promptes.

Hva som er nytt i modellen

Opus 5 er bygget for lange agentkjeder: feilsøking, rotårsaksanalyse og oppgaver der modellen må verifisere sitt eget arbeid underveis. På ARC-AGI 3 skårer den tre ganger så høyt som nest beste modell. På CursorBench 3.2 ligger den innenfor 0,5 prosent av Fable 5 til halve kostnaden. På livsvitenskap er den 10,2 prosentpoeng bedre enn Opus 4.8 på organisk kjemi og 7,7 poeng bedre på proteinoppgaver.

Nytt er også effort-innstillinger som lar deg velge mellom maksimal intelligens og tokenøkonomi, en Fast mode som kjører 2,5 ganger raskere til dobbel pris, og to beta-funksjoner: bytte av verktøy midt i en samtale, og automatisk fallback til andre modeller når et sikkerhetsflagg utløses. Mythos 5 er fortsatt sterkere på exploit-utvikling og autonom biologi.

Prompting-reglene er skrevet om

Anthropic fjernet over 80 prosent av systempromptet i Claude Code for de nyeste modellene uten at ytelsen falt. Retningslinjene som erstatter det handler om fem skift:

  • Harde forbud byttes ut med skjønn. «Skriv aldri kommentarer» var et gjerde for svakere modeller. Rådet nå er å matche kommentartetthet og idiomer i koden rundt.
  • Verktøyeksempler byttes ut med uttrykksfulle parametre. En enum med pending, in_progress og completed gir bedre signal enn et eksempel på bruk.
  • Alt-på-forhånd byttes ut med progressiv avdekking. Skills og verktøy som lastes ved behov koster ingen kontekst før de faktisk brukes.
  • Gjentakelse byttes ut med én kilde. Verktøybeskrivelsen eier instruksen alene.
  • Enkle spesifikasjoner byttes ut med rikere referanser. En testsuite, en HTML-artifact eller en rubrikk som verifikator-agenter kan kjøre mot.

Relevans for Velo-kunder

Har du et harness med systemprompt, CLAUDE.md og verktøybeskrivelser bygget for 4.x-modellene, er sannsynligvis en god del av det nå ballast. Gjennomgangen koster lite, og gevinsten er både lavere tokenbruk og bedre treff.

Gå gjennom systemprompt og CLAUDE.md-filene i prosjektene dine og fjern harde forbud, gjentatte verktøyinstrukser og kontekst som kan lastes ved behov. Mål tokenbruk før og etter, så du vet hva ryddingen ga.

Kilder: Claude Opus 5 og The new rules of context engineering for Claude 5 generation models