Techsy
Kontakt
Kom i gang
Tilbage til blog
ai-machine-learning

Claude Opus 5 er her: Næsten Fable 5-intelligens til halvdelen af prisen

Skrevet af Mert Batur Gürbüz
Jul 24, 2026
12 minutters læsning
Indholdsfortegnelse
Claude Opus 5 er her: Næsten Fable 5-intelligens til halvdelen af prisen

Claude Opus 5 er her: Næsten Fable 5-intelligens til halvdelen af prisen

Anthropic udgav Claude Opus 5 den 24. juli 2026, og budskabet er kontant: næsten Fable 5's frontier-intelligens til halvdelen af prisen. Det vigtigste bevis er Frontier-Bench v0.1, hvor Opus 5 scorer 43,3 % og mere end fordobler Opus 4.8's 21,1 %. Hagen ved det — og der er altid én — er, at den ikke vinder alt. GPT-5.6 Sol slår den stadig på én agentisk kodningstest, og inden for sundhed og biologi går kronen til Mythos 5. Her er, hvad der faktisk ændrede sig, den fulde benchmark-tabel, og om du bør skifte din standardmodel i dag.

Nøglepointer:

  • Claude Opus 5 blev lanceret den 24. juli 2026 på Claude API, Claude.ai, Claude Code og Claude Cowork med model-ID'et claude-opus-5.
  • Den fører på de fleste af Anthropics offentliggjorte benchmarks (Frontier-Bench, GDPval-AA, ARC-AGI-3, OSWorld 2.0, AutomationBench), men halter bagefter på et par kodnings-, jura- og videnskabstest.
  • Prisen er uændret fra Opus 4.8 på $5/$25 pr. million tokens, med en Fast-tilstand til cirka 2x prisen for omkring 2,5x hastigheden.

Hvad blev udgivet i dag: Claude Opus 5 på ét minut

Claude Opus 5 er Anthropics nye frontier-model, udgivet den 24. juli 2026 og tilgængelig samme dag på API'en, Claude.ai, Claude Code og Claude Cowork. Model-ID'et er claude-opus-5. Anthropics rammesætning, ifølge annonceringen, er, at den "kommer tæt på frontier-intelligensen fra Claude Fable 5 til halvdelen af prisen." Standardprisen forbliver $5 input / $25 output pr. million tokens, det samme som Opus 4.8.

Dette er et reelt generationsskridt for agentarbejde, ikke en punktudgivelse. Hvis du kommer fra Claude Opus 4.8, er API-formen og Claude Code-integrationen uændret, så migrationen er blot et model-ID-skift. Det, der er anderledes, er loftet: På Frontier-Bench v0.1 siger Anthropic, at Opus 5 mere end fordobler 4.8's score til en lavere omkostning pr. opgave, og den leverer state-of-the-art tal på GDPval-AA og ARC-AGI-3.

Positioneringen betyder noget. Fable 5 er Anthropics dyreste frontier-model. At komme inden for rækkevidde af den til Opus-priser er hele historien bag denne udgivelse, og det er grunden til, at "halvdelen af prisen"-linjen er den, Anthropic fører an med.

Hvad er faktisk nyt i Opus 5 i forhold til 4.8?

Det største skift fra 4.8 til 5 er dømmekraft: Opus 5 er markant bedre til at verificere sit eget arbejde og iterere, indtil en opgave faktisk er færdig — ikke bare tilsyneladende afsluttet. Anthropic nævner også stærkere software engineering, vidensarbejde og videnskabelig forskning samt forbedret visuelt output. Priser og den kerne-API forblev uændret.

Bedre dømmekraft og selvverifikation

Den tydeligste adfærdsændring er, at Opus 5 tjekker sig selv. Anthropic citerer Zimu Li, teknisk medarbejder, der beskriver modellen som én, der "verificerer grene, tjekker skabeloner" i stedet for bare at køre derudad. For alle, der er afhængige af en agent til at fange sine egne fejl i produktion, er det den egenskab, der flytter noget. Det er også det sværeste at sælge på et benchmark-diagram, så behandl det som et udsagn, du bør teste på dine egne opgaver.

Frontier-intelligens til Opus-pris

Sualeh Asif, medstifter af Cursor, opsummerede udgivelsen som "næsten Fable 5-intelligens til Opus-hastighed og -pris." Det er den praktiske læsning: Teams, der ønskede Fable-5-klasses ræsonnement men ikke kunne retfærdiggøre prisen, har nu en mellemvej. På OSWorld 2.0 siger Anthropic, at Opus 5 overgår Fable 5 til cirka en tredjedel af omkostningen, hvilket er det reneste enkeltstående eksempel på værdiargumentet.

Alignment og sikkerhedsprofil

Anthropic rapporterer, at Opus 5 har sin laveste score for fejlagtig adfærd til dato (2,3) og kalder den den model, der er mest i overensstemmelse med dens Constitution. På sikkerhedssiden beskrives cybersikkerheds-classifierne som cirka 85 % mindre restriktive end Fable 5's, med et enterprise Cyber Verification Program til teams, der har brug for det. Som med enhver leverandørs sikkerhedspåstand: nyttigt at vide, men stadig værd at validere mod dine egne red-team-tilfælde.

Opus 5-benchmarks: Hvor den vinder (og hvor den taber)

Opus 5 fører på de fleste af Anthropics offentliggjorte benchmarks, og de sejre, der betyder noget for agentbyggere, er overbevisende: Frontier-Bench v0.1 (43,3 %), GDPval-AA (1861 Elo), ARC-AGI-3 (30,2 %), OSWorld 2.0 (70,6 %) og Zapier's AutomationBench (26,0 %). De ærlige undtagelser: GPT-5.6 Sol vinder DeepSWE v1.1, Fable 5 slår den med en hårfin margin på FrontierCode og juratests, og Mythos 5 tager sundhed og biologi.

BenchmarkOpus 5Fable 5Opus 4.8GPT-5.6 Sol
Agentisk terminalkodning, Frontier-Bench v0.143,3%33,7%21,1%34,4%
Vidensarbejde, GDPval-AA v2 (Elo)1861174715931736
Ny problemløsning, ARC-AGI-330,2%—1,5%7,8%
Agentisk søgning, BrowseComp90,8%87,4%84,3%90,4%
Tværfaglig ræsonnement, Humanity's Last Exam (med værktøjer)64,7%63,9%57,9%—
Agentisk computerbrug, OSWorld 2.070,6%66,1%55,7%62,6%
Agentisk kodning, DeepSWE v1.168,8%69,7%59,0%72,7%
Agentisk kodning, FrontierCode v1.1 (Main)53,4%53,5%46,5%47,5%
Forretningsworkflows, AutomationBench26,0%17,4%17,0%18,1%
Legal Agent Benchmark (holdt tilbage)11,7%13,3%10,4%2,5%
Sundhed, HealthBench Professional59,8%66,0%57,4%60,5%
Biologi, BioMysteryBench (svær)49,4%46,5%42,4%—

Claude Opus 5 benchmark-sammenligning mod Fable 5, Opus 4.8 og GPT-5.6 Sol på tværs af Frontier-Bench, GDPval-AA, ARC-AGI-3, OSWorld 2.0, AutomationBench med mere
Kilde: Anthropic

Læs deltaerne, ikke kun de absolutte scorer. Frontier-Bench sprang +22,2 point over Opus 4.8 (21,1 til 43,3) — det største enkelte spring og grunden til, at Anthropic kalder dette en kodnings- og agentudgivelse. GDPval-AA steg +268 Elo (1593 til 1861) og slog alle modeller i tabellen inden for vidensarbejde. ARC-AGI-3 er øjenfangeren: 30,2 % mod 7,8 % for GPT-5.6 Sol og 1,5 % for Opus 4.8, hvilket Anthropic rammer som cirka 3x den næstbedste offentlige model inden for ny problemløsning. På AutomationBench er 26,0 % cirka 1,5x feltet — et direkte signal til alle, der bygger forretningsprocesagenter.

To ærlige noter om tabene. For det første er lederen i Fable 5-kolonnen for sundhed (66,0 %) og biologi-menneskeløst-opdelt faktisk Mythos 5, Anthropics videnskabsspecialiserede model, ikke Fable 5, så det er ikke æble-til-æble-sammenligninger mellem generelle modeller. For det andet er kodningsbilledet reelt delt: GPT-5.6 Sol tager DeepSWE v1.1 (72,7 % mod 68,8 %), og Fable 5 vinder FrontierCode med en hårfin margin (53,5 % mod 53,4 %). Hvis dit arbejde er ren SWE-bench-stil kodning, vælger "bedst samlet"-etiketten ikke automatisk Opus 5.

Hvad koster Opus 5? Priser og Fast-tilstand

Standardprisen for Opus 5 er $5 pr. million input-tokens og $25 pr. million output-tokens, identisk med Opus 4.8 ifølge Anthropics offentliggjorte priser, så der er ingen prisstigning for opgraderingen. "Halvdelen af prisen"-påstanden er relativ til Fable 5, ikke til 4.8: Du får næsten Fable-5-intelligens uden at betale Fable 5-takster. Fast-tilstand kører til cirka 2x basisprisen for omkring 2,5x standardhastigheden, og API'en understøtter fallback-routing.

Så hvad betyder det pr. opgave? På standardpriser betaler du ikke mere end for 4.8 og får et stort kapacitetsløft, hvilket gør opgraderingen næsten gratis for de fleste arbejdsbyrder. Fast-tilstand er grebet til interaktive sessioner: Du bytter en 2x-prispræmie for output, der streamer cirka 2,5x hurtigere på samme model, hvilket betaler sig, når du sidder og venter, og gør ondt, når du kører nattelange batchkørsler, hvor vægtid er irrelevant. Hvis rate limits er din reelle begrænsning, dækker vores guide til Claude-brugsgrænser, hvordan niveauerne interagerer med omkostninger.

bash
# Claude Code: point your default model at Opus 5
/model claude-opus-5

# API request body (model ID swap):
{
  "model": "claude-opus-5",
  "messages": [
    { "role": "user", "content": "Refactor this module and verify the tests pass." }
  ]
}

Hvor Opus 5 lander for produktionsagenter

Gevaranterne samler sig præcis der, hvor produktionsagenter lever: terminalkodning (Frontier-Bench), computerbrug (OSWorld 2.0), agentisk søgning (BrowseComp) og flertrins forretningsworkflows (AutomationBench). De fire er de arbejdsbyrder, der oftest går i stykker i reelle implementeringer, så en model, der springer på alle fire samtidigt, ændrer, hvad der kan sendes i produktion.

Det er den del, der er værd at dvæle ved. Et benchmark som AutomationBench måler, om en agent kan gennemføre en reel multiværktøjs-workflow fra start til slut, og Opus 5's 26,0 % mod cirka 17 % for feltet er forskellen mellem "demorer godt" og "overlever mødet med et rodet CRM." OSWorld 2.0-resultatet (70,6 %, slår Fable 5 til en tredjedel af omkostningen) siger det samme for computerbrug-agenter, der klikker gennem faktisk software. For teams, der sender kundevendte AI-agenter i produktion, er det de tal, der oversættes til færre fejl klokken 2 om natten.

Det sænker også omkostningen ved et designmønster, vi læner os op ad: billig selvverifikation. Når modellen reelt er bedre til at tjekke sine egne grene, kan du bruge færre tokens på et separat kritiker-gennemløb og stadig fange de samme fejl. Det er en reel budgetpost for alle, der kører agenter i volumen.

Hvordan vi integrerer Opus 5 i vores stack

Vi bygger og kører produktions-AI-agenter på Claude-stacken hos Techsy, så en frontier-udgivelse er en evaluering samme dag, ikke en overskrift, vi læser og går videre fra. Her er vores ærlige første læsning — kvalitativ, hvor vi endnu ikke har rene før/efter-tal, specifik, hvor vi har.

Selve skiftet er trivielt, og det er pointen. Vores indholds- og automatiseringspipelines fastgør en standardmodel i konfigurationen; at ændre claude-opus-4-8 til claude-opus-5 og genstarte en session krævede nul andre ændringer, ligesom ethvert nyligt Opus-løft. Hvis du router på tværs af udbydere og vil A/B-teste Opus 5 mod Fable 5 eller GPT-5.6 Sol på dine egne opgaver, lader en proxy dig skifte modeller uden at omskrive din app.

Det, vi holder øje med først, er selvverifikationspåstanden, fordi det er den, der faktisk ville ændre vores arkitektur. Vores nuværende agenter kører et eksplicit kritikergennemløb for at fange dårlige redigeringer, før de lander; hvis Opus 5 pålideligt flagger sine egne svage grene, kan vi tynde det trin ud og spare tokens. Vi offentliggør ikke et tal om det, før vi har kørt det på tværs af et gentageligt opgavesæt — den samme disciplin, vi ville forvente af alle, der citerer agentmetrikker. Hvis du vil have metoden, er det den i vores guide til evaluering af AI-agenter i produktion: samme prompts, samme repo-tilstand, tæl de forkerte drejninger, ikke stemningen.

Bør du skifte fra Opus 4.8? (Skift / Vent / Bliv)

Om du skal skifte afhænger af din arbejdsbyrde, ikke af hvilken model der "vinder" samlet. De agentiske og vidensarbejdsrelaterede spring er store og reelle, så de fleste teams bør skifte. Rene kodningsbutikker med en GPT- eller Fable-pipeline har grund til at teste, før de forpligter sig, og brugere nær loftet på billige opgaver kan blive, hvor de er, med næsten intet tabt.

Skift nu hvis: dit arbejde læner sig op ad agentiske opgaver, computerbrug, forretningsprocesautomatisering eller vidensarbejde. Frontier-Bench (+22,2 over 4.8), AutomationBench (~1,5x feltet) og GDPval-AA (+268 Elo) er de største reelle gevinster, og prisen ændrede sig ikke, så der er ingen omkostningsstraf for at opgradere.

Vent hvis: din workflow er ren agentisk kodning, og du allerede bruger GPT-5.6 Sol eller Fable 5 til det. GPT-5.6 Sol fører stadig på DeepSWE v1.1, og Fable 5 slår FrontierCode med en hårfin margin, så kør din egen kodningsevaluering, før du skifter. Vent også, hvis du er midt i et projekt, og et modelskift ville forstyrre en evaluering, du allerede kører.

Bliv på 4.8 hvis: du er omkostningsfølsom på opgaver, der allerede var nær loftet for dig, og du ikke rører de agentiske arbejdsbyrder, hvor Opus 5 trækker fra. Du ville betale skifteomkostninger for en delta, du ikke vil mærke. For det bredere felt, se hvordan modellerne klarer sig i vores Claude Sonnet 5-gennemgang og Fable 5- og Mythos 5-oversigten.

Vi vælger og kobler modeller som disse til kunders agentbygninger hver uge. Hvis du beslutter, hvilken model du vil standardisere på til en produktionsagent, så få en gratis konsultation, og vi hjælper dig med at matche modellen til arbejdsbyrden i stedet for marketingen.

Om forfatteren

Mert Batur Gurbuz er medstifter af Techsy.io, hvor teamet leverer AI-agenter, automatiseringssystemer og stemme-/SDR-pipelines til B2B-kunder. Han studerer ved University of Birmingham og skriver om det LLM-værktøjslag, Techsy-teamet faktisk kører i produktion.

Medstifter, Techsy.io, University of Birmingham · LinkedIn

Ofte stillede spørgsmål

Hvad er Claude Opus 5?

Claude Opus 5 er Anthropics frontier-model, udgivet den 24. juli 2026 med model-ID'et claude-opus-5. Anthropic positionerer den som at komme tæt på Fable 5's intelligens til halvdelen af prisen, og den fører på de fleste af sine offentliggjorte benchmarks, herunder Frontier-Bench, GDPval-AA og ARC-AGI-3. Den er tilgængelig på Claude API, Claude.ai, Claude Code og Claude Cowork.

Hvornår blev Claude Opus 5 udgivet?

Claude Opus 5 blev udgivet den 24. juli 2026. Den gik live samme dag på tværs af Claude API, Claude.ai, Claude Code og Claude Cowork uden trinvis udrulning, så du kan skifte din standardmodel til claude-opus-5 med det samme.

Er Claude Opus 5 bedre end Opus 4.8?

Til det meste arbejde, ja. Opus 5 mere end fordobler Opus 4.8 på Frontier-Bench v0.1 (43,3 % mod 21,1 %), vinder 268 Elo på GDPval-AA og springer fra 1,5 % til 30,2 % på ARC-AGI-3. Prisen er uændret, så der er ingen omkostningsstraf. Undtagelserne er et par kodnings- og videnskabstest, hvor GPT-5.6 Sol, Fable 5 eller Mythos 5 stadig fører.

Hvor meget koster Claude Opus 5?

Standardprisen er $5 pr. million input-tokens og $25 pr. million output-tokens, identisk med Opus 4.8. "Halvdelen af prisen"-linjen henviser til Fable 5, ikke 4.8: Opus 5 leverer næsten Fable-5-intelligens til Opus-takster. Fast-tilstand koster cirka 2x basisprisen og kører cirka 2,5x hurtigere på samme model.

Slår Claude Opus 5 Fable 5?

Ikke på tværs af det hele. Opus 5 overgår Fable 5 på OSWorld 2.0, BrowseComp, GDPval-AA og Frontier-Bench, og den gør det til en brøkdel af Fable 5's pris. Men Fable 5 slår stadig FrontierCode og jurabenchmarket med en hårfin margin, og Mythos 5 (Anthropics videnskabsmodel) fører på sundhed og biologi. Budskabet er "næsten Fable 5 til halvdelen af prisen," ikke "bedre end Fable 5 på alt."

Hvad taber Opus 5 på?

GPT-5.6 Sol vinder agentisk kodning på DeepSWE v1.1 (72,7 % mod 68,8 %), Fable 5 vinder FrontierCode v1.1 med 0,1 point og det tilbageholdte jurabenchmark (13,3 % mod 11,7 %), og Mythos 5 fører på HealthBench Professional og biologitestsene. Hvis din arbejdsbyrde domineres af nogen af disse, så benchmark det, før du skifter.

Er Claude Opus 5 god til at bygge AI-agenter?

Den er bygget til det. De største gevinster lander på agentisk terminalkodning (Frontier-Bench), computerbrug (OSWorld 2.0), agentisk søgning (BrowseComp) og flertrins forretningsworkflows (AutomationBench), hvilket er de arbejdsbyrder, produktionsagenter kører. Dens stærkere selvverifikation lader dig også bruge færre tokens på et separat kritiker-gennemløb.

Hvordan skifter jeg til Opus 5 i Claude Code og API'en?

Sæt din model til claude-opus-5 (brug /model claude-opus-5 i Claude Code), og du er færdig for de fleste teams. I API'en ændrer du model-feltet til claude-opus-5; request-formen er uændret fra Opus 4.8, så ingen andre kodeændringer er nødvendige.

Hvad er Fast-tilstand i Claude Opus 5?

Fast-tilstand er et højhastighedsniveau, der kører Opus 5 til cirka 2,5x standardhastigheden for omkring 2x standardprisen. Den holder dig på den fulde claude-opus-5-model i stedet for at route dig til en mindre, hvilket gør den nyttig til interaktive sessioner, hvor du venter på output, og ikke værd til batchjobs, hvor latenstid er irrelevant.

Tags

Claude Opus 5claude-opus-5anthropicopus 5 vs opus 4.8opus 5 benchmarks

Del denne artikel

Relaterede artikler

Mere fra ai-machine-learning

ai-machine-learning
Jul 20, 2026

8 bedste AI web scraping-API'er i 2026 (testet på vores egen agent-stack)

Vi testede 8 AI web scraping-API'er med reelle 2026-priser hentet gennem vores egen agent-stack. Firecrawl, Bright Data, ScrapingBee og 5 flere, rangeret efter LLM-klar output, anti-bot og MCP-understøttelse.

9 min read minutters læsning
Læs
ai-machine-learning
Jul 20, 2026

Prompt Engineering til kodning: 7 mønstre, vi bruger dagligt i Claude Code og Cursor (2026)

De fleste artikler om 'AI-kodningsprompts' giver dig 50 skabeloner at kopiere. Denne artikel lærer dig de 7 mønstre, vi bruger hver dag til at drive en 16-agent Claude Code-pipeline, med ægte før-og-efter eksempler for hvert enkelt, samt hvor hvert mønster hører hjemme i Claude Code, Cursor og Copilot i 2026.

11 min read minutters læsning
Læs
ai-machine-learning
Jul 19, 2026

Fra AI-PoC til produktion: 12-punkts tjeklisten før lancering

En fungerende AI-demo er ikke et produktionssystem. Denne 12-punkts tjekliste gennemgår de tre faser, enhver AI-funktion kræver før lancering: hærd, stabiliser og udrul – med konkrete grænseværdier for omkostningslofter, hastighedsbegrænsninger, fallbacks og rollback-udløsere.

10 min read minutters læsning
Læs
Se alle indlæg
Start dit projekt

Klar til at bygge noget ekstraoordinær?

Lad os gøre din vision til virkelighed. Vores team står klar til at hjælpe dig med at skabe software, der gør en forskel.

Book et 30 min. scopemødeSe vores arbejde

Fra biblioteket

Claude Skills

Se alle
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

AI-automatiseringer

Se alle
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Fra biblioteket

Claude Skills

Se alle
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

AI-automatiseringer

Se alle
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Tjenester

  • Entertainmentløsninger
  • Mobilapps
  • Webapplikationer

Løsninger

  • CRM-systemer
  • AI-integration
  • ERP-løsninger
  • Stemmeargenter
  • Processautomatisering
  • Cybersikkerhed

Bibliotek

  • Blog
  • Portfolio

Fællesskab

  • AI-automatiseringer
  • Claude Skills

Værktøjer

  • Pris på mobil-app
  • OpenAI / LLM API-prisreknemaskine
  • Pris på MVP
  • Pris på stemme-AI-agent

Virksomhed

  • Om
  • Partnere
  • Kontakt

Juridisk

  • Privatlivspolitik
  • Salgsbetingelser
  • Cookiepolitik

Tjenester

  • Entertainmentløsninger
  • Mobilapps
  • Webapplikationer

Løsninger

  • CRM-systemer
  • AI-integration
  • ERP-løsninger
  • Stemmeargenter
  • Processautomatisering
  • Cybersikkerhed

Bibliotek

  • Blog
  • Portfolio

Fællesskab

  • AI-automatiseringer
  • Claude Skills

Værktøjer

  • Pris på mobil-app
  • OpenAI / LLM API-prisreknemaskine
  • Pris på MVP
  • Pris på stemme-AI-agent

Virksomhed

  • Om
  • Partnere
  • Kontakt
JuridiskPrivatlivspolitikSalgsbetingelserCookiepolitik
TECHSY
© 2026 Techsy. Alle rettigheder forbeholdes.