Techsy
Otetttaa yhteyte
Aloita
Takaisin blogiin
ai-machine-learning

Claude Fable 5 vs. Opus 4.8: kannattaako oikeasti vaihtaa? (Mythos-luokka, benchmarkattu)

Kirjoittanut Mert Batur Gürbüz
Jun 9, 2026
12 lukuaika
Sisällys
Claude Fable 5 vs. Opus 4.8: kannattaako oikeasti vaihtaa? (Mythos-luokka, benchmarkattu)

Claude Fable 5 vs. Opus 4.8: kannattaako oikeasti vaihtaa? (Mythos-luokka, benchmarkattu)

Anthropic julkaisi Claude Fable 5 -mallin tänään 9. kesäkuuta 2026. Se saavuttaa 80,3 % SWE-Bench Prossa, agenttisen koodauksen benchmarkissa, jossa Opus 4.8 yltää 69,2 prosenttiin ja GPT-5.5 jää 58,6 prosenttiin. Ero ei ole mikään pyöristysvirhe. Ja mukana on käänne: Fable 5 on uuden "Mythos-luokan" mallin julkinen, suojattu puolisko, ja sen sisarmalli Claude Mythos 5 pidetään rajatun pääsyn ohjelman takana. Tässä on, mitä muuttui, mitä todellinen tehtävä maksaa 10 $/50 $ hintatasolla miljoonaa tokenia kohden ja kannattaako sinun todella siirtää pinosi pois Opus 4.8:sta.

Pikavastaus

  • Fable 5 saavuttaa SWE-Bench Prossa 80,3 % vs. Opus 4.8:n 69,2 % ja GPT-5.5:n 58,6 %.
  • Hinnoittelu on 10 $ sisääntulo / 50 $ lähtö miljoonaa tokenia kohden, alle puolet Mythos Previewn hinnasta.
  • Fable 5 vaihtaa automaattisesti Opus 4.8:aan korkean riskin kyber-/bio-/kemiakyselyissä (alle 5 % istunnoista).
  • Ilmainen Pro/Max/Team/Enterprise-tilauksissa 22. kesäkuuta 2026 asti; käyttöhyvitykset astuvat voimaan 23. kesäkuuta.

Mitä todella julkaistiin: Fable 5, Mythos 5 ja "Mythos-luokan" mallisto

Mythos-luokka on Anthropicin uusi huippukykytaso, ja se julkaistaan kahtena mallina. Claude Fable 5 on julkinen, suojattu versio, jota voit kutsua jo tänään. Claude Mythos 5 on sama frontier-malli ilman suojauksia, pidettynä rajatun pääsyn takana. Samat aivot, kaksi julkaisutapaa.

Tämä jako on koko tarina. Anthropicin uutishuonetiedotteen mukaan Mythos 5 säilyttää täydet frontier-kyvyt, mukaan lukien hyökkäävät kyberkyvyt, jotka voivat aiheuttaa todellista vahinkoa, joten Anthropic ei anna sitä kaikille. Fable 5 ottaa saman mallin ja käärii sen luokittelijoihin, jotka tunnistavat korkean riskin pyynnöt ja ohjaavat ne hiljaisesti Opus 4.8:lle.

Kun siis kutsut Fable 5:tä, saat Mythos-luokan päättelyä kaikkeen, mikä ei ole vaarallista, ja turvallisemman varallaomallin siihen pieneen osaan, joka on. CNBC kuvasi sitä niin, että Anthropic julkaisee "Mythosin kaltaisen tekoälyn yleisölle", mikä pitää paikkansa, mutta tarkka mekanismi on otsikkoa tärkeämpi.

Fable 5 ja Mythos 5 ovat sama frontier-malli kahtia jaettuna: toista voit käyttää jo tänään, toisen Anthropic pitää rajattuna. Jos muistat nimeämisestä vain yhden asian, muista tämä. Mythos-luokka on taso; Fable ja Mythos ovat kaksi ovea siihen.

Mitä muuttui verrattuna Opus 4.x -sarjaan

Jokaisessa Anthropicin julkaisemassa koodaus- ja päättelyarviossa Fable 5 voittaa Opus 4.8:n, ei hienoisesti vaan kaksinumeroisin eroin. SWE-Bench Pro hyppää 69,2 prosentista 80,3 prosenttiin. FrontierCode Diamond nousee 13,4:stä 29,3:een. Myös hinnoittelu laski, ja malli skaalautuu uudella päättelytehon säätimellä. Tämä on aito frontier-harppaus Opus 4.x -sarjan yli, ei vain päivitysversio.

Claude Mythos 5 / Fable 5 -benchmark-taulukko vs. Mythos Preview, Opus 4.8, GPT-5.5 ja Gemini 3.1 Pro 13 arvioinnin laajuisesti
Claude Mythos 5 / Fable 5 13 benchmarkin laajuisesti vs. Opus 4.8, GPT-5.5 ja Gemini 3.1 Pro. Lähde: Anthropic.

Yllä oleva 13 benchmarkin kokonaiskatsaus antaa yleiskuvan yhdellä silmäyksellä. Tässä tärkein osajoukko verrattuna kolmeen malliin, joihin useimmat tiimit todella vertaavat:

BenchmarkClaude Fable 5Claude Opus 4.8GPT-5.5
SWE-Bench Pro (agenttinen koodaus)80,3 %69,2 %58,6 %
FrontierCode Diamond (vaikein koodaus)29,313,45,7
Terminal-Bench 2.1 (agenttinen shell)88,0 %––
GPQA-AA (jatko-opintotason päättely, Elo)1932––
ExploitBench78,0 %––

Vertailun ankkuri tässä on Claude Opus 4.8, malli, jonka Fable 5 korvaa frontierissä, ja sama malli, johon Fable 5 vaihtaa korkean riskin kyselyissä. Jos olet seurannut Opus 4.x -sarjaa kahden viime julkaisun aikana, kuvio oli asteittainen parantuminen. Fable 5 rikkoo tuon kuvion.

Kaksi asiaa, jotka kannattaa huomioida, ennen kuin pidät taulukkoa ehdottomana totuutena. Ensinnäkin nämä ovat Anthropicin omia julkaisemia arvioita, ei riippumaton testi. Toiseksi päättelytehon säädin tarkoittaa, että yksittäinen benchmark-luku kätkee taakseen kustannuskäyrän. Enemmän tästä hinnoitteluosiossa, koska se muuttaa laskutoimitusta.

Benchmarkit, joilla on merkitystä rakentajille

Neljä lukua kantavat käytännön painoarvon: SWE-Bench Pro 80,3 %, FrontierCode Diamond 29,3, Terminal-Bench 2.1 88,0 % ja GPQA-AA 1932 Eloa. Yhdessä ne kattavat todellisen repo-työn, vaikeimmat synteettiset koodausongelmat, agenttiset shell-tehtävät ja jatko-opintotason päättelyn. Jos työsi sivuaa mitä tahansa näistä, tämä osio kertoo, vastaako luku sinun työtäsi.

Tämän artikkelin yläosassa oleva pääkaavio on todiste: SWE-Bench Pro 80,3 vs. 69,2 vs. 58,6 ja FrontierCode 29,3 vs. 13,4 vs. 5,7. Mutta mitä nämä oikeasti mittaavat?

  • SWE-Bench Pro testaa, pystyykö malli toimittamaan todellisen pull requestin todelliseen repoon: kloonaamaan, ymmärtämään, paikkaamaan ja läpäisemään testit. SWE-Bench Pro mittaa, pystyykö malli toimittamaan todellisen pull requestin todelliseen repoon, ja Fable 5 onnistuu siinä 8 kertaa 10:stä. Tämä on lähin vastine kysymykselle "pystyykö se tekemään oikeaa työtäni".
  • Terminal-Bench 2.1 arvioi agenttisia shell-tehtäviä: komentojen ajamista, tulosteiden lukemista ja virheistä palautumista. 88,0 % merkitsee, jos rakennat tekoälykoodausagentteja, jotka elävät terminaalissa.
  • FrontierCode Diamond on koodausongelmien vaikein taso, ne, joissa useimmat mallit saavat yksinumeroisia pisteitä. 29,3 on absoluuttisesti matala, mutta yli kaksinkertainen Opus 4.8:n 13,4:ään nähden.
  • GPQA-AA on jatko-opintotason tieteellistä päättelyä, pisteytettynä Elo-lukuna. 1932 kertoo vahvasta monivaiheisesta päättelystä koodin tuolla puolen.

Claude Code -työnkuluissamme Opus 4.x -sarjan aikana toistuva katto olivat pitkäjänteiset agenttiset tehtävät: malli menetti langan keskellä usean tiedoston muutosta. Fable 5:n Terminal-Bench- ja SWE-Bench Pro -luvut viittaavat siihen, että tuo katto siirtyi. Siirtyikö se sinun repollesi, on ainoa testi, jolla on merkitystä, mutta julkaistut luvut ovat juuri oikeanlaista lukua, josta kannattaa välittää.

Todelliset testitapaukset: mitä Fable 5 tekee, mihin aiemmat mallit eivät pystyneet

Anthropic julkaisi kolme konkreettista esimerkkiä, jotka osoittavat, minkä luokan ongelmia Fable 5 pystyy nyt käsittelemään: Stripen koodipohjan migraatio, joka puristui kuukausista päivään, yksinomaan näön avulla läpipelattu videopeli ja 3-kertainen suorituskykyharppaus itsevalidoinnista. Jokainen niistä osoittaa kyvyn, johon aiemmat mallit eivät yltäneet. Kaikki kolme ovat Anthropicin lähteistä; siteeraamme heidän tiedotettaan, emme omaa testiämme.

Tässä on, mitä kukin niistä todistaa:

  1. Stripen Ruby-migraatio. Anthropicin mukaan Fable 5 puristi Ruby-koodipohjan migraation noin kahdesta kuukaudesta noin yhteen päivään. Stripe puristi Ruby-migraation kahdesta kuukaudesta yhteen päivään, ja juuri sen kokoisen ongelman tämä malli muuttaa. Tämä on sitä luokkaa oleva pitkäjänteinen refaktorointi, joka aiemmin vaati ihmisryhmän pitämään koko koodipohjan mielessään.

  2. Pokémon FireRed pelkällä näöllä. Anthropicin mukaan Fable 5 läpäisi Pokémon FireRedin käyttäen pelkkää näköä, kun aiemmat mallit tarvitsivat monimutkaisia räätälöityjä valjaita syöttämään pelin tilan tekstinä. Se on tilallisen ja visuaalisen päättelyn harppaus: malli lukee ruudun ja toimii, ilman tukirakenteita.

  3. Slay the Spire, 3-kertaisesti. Anthropicin mukaan Fable 5 itsevalidoi omat siirtonsa maksimipäättelyteholla ja saavutti 3-kertaisen suorituskyvyn pysyvän muistin avulla. Opetus ei ole peli; se on, että malli pystyy tarkistamaan omaa työtään pitkällä suunnitteluhorisontilla ja parantamaan siitä.

Mitään näistä ei kannata ottaa uskossa oman työsi osalta. Mutta ne vastaavat siististi yllä olevan taulukon benchmark-harppauksia: pitkäjänteinen koodaus (SWE-Bench Pro), tilallinen päättely (näkö) ja itsevalidointi (päättelytehon säädin). Laadulliset ja määrälliset voitot kertovat samaa tarinaa.

Hinnoittelu ja tehtäväkohtaisten kustannusten todellisuus

Fable 5 maksaa 10 $ miljoonaa sisääntulevaa tokenia kohden ja 50 $ miljoonaa lähtevää tokenia kohden. Anthropic kehystää sen niin, että hinta on "alle puolet Claude Mythos Previewn hinnasta". Se on myös noin 2-kertainen Opus 4.8:aan nähden tokenia kohden. Molemmat pitävät paikkansa. Ongelma on, että tokenin hinta on väärä yksikkö. Todellisuudessa maksat valmiista tehtävästä, ja siinä Fable 5:n laskutoimitus muuttuu kiinnostavaksi.

FrontierCode-tarkkuus vs. tehtäväkohtaiset kustannukset — Claude Fable 5 skaalautuu matalasta maksimipäättelytehoon voittaen Opus 4.8:n ja GPT-5.5:n
FrontierCode-pisteet vs. keskimääräinen tehtäväkohtainen kustannus päättelytehon skaalautuessa matalasta maksimiin. Lähde: Anthropic.

Päättelyteho on säädin, jonka asetat pyyntöä kohden. Matala teho tarkoittaa vähemmän sisäisiä päättelytokeneita ja halvempaa, nopeampaa vastausta; maksimiteho tarkoittaa, että malli ajattelee pidempään, kuluttaa enemmän lähtötokeneita ja saa korkeammat pisteet. Yllä oleva kaavio näyttää Fable 5:n nousevan noin 11 prosentista noin 31 prosenttiin FrontierCodessa tehon skaalautuessa matalasta maksimiin, kun taas Opus 4.8 huippuu noin 13 prosenttiin ja GPT-5.5 pysyy tasaisena lähellä 5–6 prosenttia. Joten tehtäväkohtainen kustannus ei ole yksi luku; se on käyrä, jolta valitset pisteen.

Käydään läpi konkreettinen esimerkki julkaistusta 10 $/50 $ -hinnoittelusta. Tämä on laskutoimitusta Anthropicin ilmoittamista hinnoista, ei benchmarkattu tulos.

Otetaan yksittäinen agenttinen kutsu, jossa on 50 000 sisääntulevaa tokenia ja 15 000 lähtevää tokenia korkealla teholla:

text
Input:  50,000 / 1,000,000 × $10 = $0.50
Output: 15,000 / 1,000,000 × $50 = $0.75
Per call:                          $1.25

Todellinen agenttinen tehtävä ketjuttaa monta tällaista kutsua: lue repo, suunnittele, muokkaa, aja testit, korjaa, toista. Oletetaan, että silmukka ajaa 12 tällaista kutsua: noin 15 $ valmiista tehtävästä. Maksimipäättelyteholla ja raskaammalla kontekstilla Anthropicin oma kustannuskäyrä asettaa vaikeat FrontierCode-tehtävät lähemmäs 20 dollarin tehtäväkohtaista tasoa. Aja sama tehtävä GPT-5.5:llä, niin maksat vähemmän tokenia kohden. Mutta jos se ei pysty saamaan tehtävää valmiiksi millään tehotasolla, valmiin tehtävän kustannus on ääretön. Fable 5 maksaa enemmän tokenia kohden kuin GPT-5.5 ja voittaa silti valmiin tehtävän kustannuksissa, koska se saa valmiiksi työtä, johon GPT-5.5 ei pysty.

Tässä on minimaalinen kutsu. Anthropicin tiedote antaa claude-fable-5:n mallitunnukseksi; varmista tarkka versioitu merkkijono Anthropicin API-dokumentaatiosta ennen julkaisua, koska päivätyt aliakset voivat joskus erota:

python
import anthropic

client = anthropic.Anthropic()

message = client.messages.create(
    model="claude-fable-5",          # verify exact dated id in API docs
    max_tokens=4096,
    thinking={"type": "enabled", "budget_tokens": 8000},  # reasoning effort
    messages=[
        {"role": "user", "content": "Migrate this module from Ruby 2.7 to 3.3 and run the tests."}
    ],
)

print(message.content)

Taloudellinen ydin yhdellä rivillä: maksat enemmän tokenia kohden kuin GPT-5.5, mutta saat valmiiksi tehtäviä, joita GPT-5.5 ei saa valmiiksi millään hinnalla. Matalan panoksen suurivolyymisessä työssä tuo laskutoimitus suosii halvempaa mallia. Vaikeassa agenttisessa koodauksessa se suosii Fable 5:tä.

Suojausten jako: miksi Fable vaihtaa Opus 4.8:aan

Fable 5 ajaa luokittelijat jokaiselle pyynnölle. Kun se havaitsee korkean riskin kyselyn (hyökkäävä kyber, bio, kemia tai mallitislausyritykset), se vaihtaa Opus 4.8:aan sen sijaan, että vastaisi täydellä Mythos-luokan kyvyllä. Anthropicin mukaan tämä varallaolo laukeaa alle 5 prosentissa istunnoista, joten useimmat käyttäjät eivät koskaan laukaise sitä. Tarkoitus on pitää vaarallinen kyky portin takana samalla, kun arkityö jää koskematta.

Kyberhyökkäysten kestävyys — Claude Fable 5:n hyökkäysten onnistumisprosentti 5,4 % vs. Opus 4.8:n 56,6 % automaattisessa red-teamingissa
Hyökkäyksen onnistuminen automaattisessa red-teamingissa (matalampi on parempi): Fable 5 5,4 % vs. Opus 4.8 56,6 %. Lähde: Anthropic.

Kovempi luku on hyökkäyksen onnistumisprosentti: kuinka usein automaattinen hyökkääjä voi murtaa mallin suojauksen ja saada sen tekemään jotain, mitä sen ei pitäisi. Matalampi on parempi. Anthropicin red-team-tulokset näyttävät jyrkän pudotuksen julkaisujen välillä: Opus 4.6:lla 83,2 %, Opus 4.7:llä 72,7 %, Opus 4.8:lla 56,6 % ja lopulta Fable 5:llä 5,4 %. Automaattisessa red-teamingissa hyökkäykset onnistuivat Fable 5:tä vastaan vain 5,4 prosentissa tapauksista, kun Opus 4.8:lla luku oli 56,6 %.

Miksi sinun pitäisi välittää? Jos otat käyttöön agentin, jolla on pääsy työkaluihin (shell, tiedostojärjestelmä, verkko), suojausmurtuma ei ole huono chat-vastaus, vaan malli, joka suorittaa todellisia komentoja, joihin hyökkääjä on sen ohjannut. 5,4 prosentin hyökkäyksen onnistumisprosentti tarkoittaa, että sen aseistaminen on noin kymmenen kertaa vaikeampaa kuin Opus 4.8:n. IT Pron uutisointi nosti esiin juuri varallaolomekanismin tästä syystä: se on ominaisuus, joka tekee frontier-mallista riittävän turvallisen yleisölle annettavaksi.

Kääntöpuoli on latenssi. Jos työsi sivuaa aidosti tietoturvatyökaluja, varallaolo voi laueta kesken tehtävän ja vaihtaa mallia kesken kaiken — se kannattaa huomioida suunnittelussa.

Claude Mythos 5 ja kaksoiskäytön kysymys

Claude Mythos 5 on rajattu sisarmalli, sama malli ilman suojauksen varallaoloa. Se säilyttää hyökkäävän kyberkyvyn, jonka Fable 5 estää, ja juuri siksi Anthropic ei julkaise sitä avoimesti. Pääsy kulkee Project Glasswingin kautta, joka on seulottu ohjelma puolustajille ja tutkijoille, jotka tarvitsevat täyden kyvyn. Sama malli, kaksi julkaisutapaa: toinen avoin, toinen rajattu.

Hyökkäävän kyberkyvyn arviointitulokset — Claude Mythos 5:llä korkea kyky, Claude Fable palauttaa 0,0 kun suojaukset laukeavat
Hyökkäävän kyberkyvyn arvioinnit: Mythos 5 säilyttää kyvyn; Fable palauttaa 0,0 kun estävät suojaukset laukeavat. Lähde: Anthropic.

Kaavio tekee rajauksesta näkyvän. Hyökkäävän kyberkyvyn arvioinneissa (Firefox, OSS-Fuzz, CyberGym, CyScenarioBench) Mythos 5 saa pisteet 88,4, 24,0, 83,8 ja 38,7. Fable 5 palauttaa tasaisen 0,0:n kaikissa neljässä. Hyökkäävän kyberkyvyn arvioinneissa Mythos 5 yltää jopa 88,4:ään, kun Fable 5 palauttaa tasaisen 0,0:n: suojauksien jako tehtynä näkyväksi.

Tuo nolla ei ole kykyvajetta. Se on varallaolo, joka laukeaa joka kerta ja estää pyynnön ennen kuin Mythos-luokan malli vastaa. TechCrunch huomioi ajoituksen: Anthropic julkaisi tämän päiviä sen jälkeen, kun se varoitti tekoälyn käyvän liian vaaralliseksi avoimeen julkaisuun. Fable/Mythos-jako on poliittinen vastaus tuohon varoitukseen: julkaise kyky, rajaa vaara.

Useimmille kehittäjille Mythos 5 on yhdentekevä. Et koskaan täytä Project Glasswingin kriteerejä, eikä sinun tarvitsekaan. Tärkeää on tietää, että kutsumasi malli on tarkoituksella rajattu kapealla tehtäväalueella, suunnitelmallisesti.

Mitä tämä tarkoittaa: kannattaako vaihtaa?

Vaihda Fable 5:een vaikeassa agenttisessa koodauksessa, pitkäjänteisissä monivaiheisissa tehtävissä sekä näkö- tai tilallisessa päättelyssä — kaikkialla, missä tehtävän saaminen valmiiksi voittaa tokenien senttien säästämisen. Pysy Opus 4.8:ssa kustannusherkässä suurivolyymisessä työssä tai missä tahansa, joka muutenkin laukaisee varallaolon. Siinä koko viitekehys. Loput ovat työsi sovittamista sen oikealle puolelle.

Kun Fable 5 voittaa:

  • Vaikea agenttinen koodaus, jossa Opus 4.8 pysähtyy; SWE-Bench Pro -ero on todellinen
  • Pitkäjänteiset tehtävät (usean tiedoston refaktoroinnit, migraatiot), joissa itsevalidointi kannattaa
  • Näkö- ja tilallisen päättelyn työkuormat
  • Mikä tahansa työ, jossa yksi valmis tehtävä on arvokkaampi kuin token-preemio

Kun Opus 4.8 voittaa yhä:

  • Suurivolyyminen, kustannusherkkä työ, jossa tokenikohtainen hinta ratkaisee
  • Kyber-/bio-/kemiakuormat, joissa Fable 5 vaihtaa muutenkin Opus 4.8:aan, joten kutsu sitä suoraan
  • Latenssiherkät virrat, jotka eivät siedä mallin vaihtoa kesken tehtävän
KäyttötapausSuositeltu malli
Vaikea agenttinen koodaus / migraatiotClaude Fable 5
Näkö / tilallinen päättelyClaude Fable 5
Suurivolyyminen halpa luokitteluClaude Opus 4.8
Tietoturva / red-team-työkalutClaude Opus 4.8 (suoraan)

Saatavuudesta: Fable 5 on ilmainen Pro/Max/Team/Enterprise-tilauksissa 22. kesäkuuta 2026 asti, ja käyttöhyvitykset astuvat voimaan 23. kesäkuuta. Se on yleisesti saatavilla API:ssa, AWS Bedrockissa, GitHub Copilotissa GitHubin muutoslokin mukaan sekä Harveyssa. Joten voit testata vaihtoa editorissasi jo tänään muuttamatta laskutustasi.

Kirjoittajasta

Mert Batur Gurbuz on Techsy.io:n perustajaosakas, jossa tiimi toimittaa tekoälyagentteja, automaatiojärjestelmiä ja ääni-/SDR-putkia B2B-asiakkaille. Hän opiskelee Birminghamin yliopistossa ja kirjoittaa LLM-työkalupinosta, jota Techsyn tiimi todella käyttää tuotannossa. Ota yhteyttä LinkedInissä.

Perustajaosakas, Techsy.io · Birminghamin yliopisto

Usein kysytyt kysymykset

Mikä on Claude Fable 5?

Claude Fable 5 on Anthropicin ensimmäinen julkisesti saatavilla oleva Mythos-luokan malli, joka julkaistiin 9. kesäkuuta 2026. Se saavuttaa 80,3 % SWE-Bench Prossa ja ajaa suojaluokittelijoita, jotka vaihtavat Opus 4.8:aan korkean riskin kyselyissä. Se maksaa 10 $ sisääntulo / 50 $ lähtö miljoonaa tokenia kohden.

Mitä eroa Fable 5:llä ja Mythos 5:llä on?

Ne ovat sama frontier-malli eri julkaisutavoilla. Fable 5 on julkinen ja suojattu; se vaihtaa Opus 4.8:aan vaarallisissa kyselyissä. Mythos 5 on rajattu täyskykyinen versio, johon pääsee vain Anthropicin Project Glasswing -ohjelman kautta, joka on tarkoitettu seulotuille puolustajille ja tutkijoille.

Onko Claude Fable 5 oikeasti parempi kuin Opus 4.8?

Kyllä vaikeassa agenttisessa koodauksessa, näössä ja tilallisessa päättelyssä: Fable 5 saavuttaa 80,3 % SWE-Bench Prossa vs. Opus 4.8:n 69,2 %. Mutta Opus 4.8 voittaa yhä kustannusherkässä suurivolyymisessä työssä, ja Fable 5 vaihtaa muutenkin Opus 4.8:aan korkean riskin kyber-/bio-/kemia-aiheissa. "Parempi" riippuu työkuormastasi.

Paljonko Claude Fable 5 maksaa?

Claude Fable 5 maksaa 10 $ miljoonaa sisääntulevaa tokenia kohden ja 50 $ miljoonaa lähtevää tokenia kohden. Anthropicin kehystys on "alle puolet Mythos Previewn hinnasta". Se on noin 2-kertainen Opus 4.8:aan nähden tokenia kohden, mutta arvolupaus perustuu valmiiseen tehtävään, koska Fable 5 saa valmiiksi työtä, johon halvemmat mallit eivät pysty.

Mikä on "Mythos-luokan" malli?

Mythos-luokka on Anthropicin uusi huippukykytaso, joka julkaistiin Fable 5:n ja Mythos 5:n myötä. Se edustaa frontier-harppausta Opus 4.x -sarjan yli koodaus- ja päättelybenchmarkeissa. Fable 5 ja Mythos 5 ovat kaksi julkaisuversiota samasta Mythos-luokan mallista: toinen julkinen ja suojattu, toinen rajattu.

Miksi Fable 5 vaihtaa Opus 4.8:aan?

Fable 5 ajaa luokittelijoita, jotka tunnistavat korkean riskin pyynnöt (hyökkäävä kyber, bio, kemia tai mallitislaus) ja ohjaavat ne Opus 4.8:lle sen sijaan, että vastaisi täydellä Mythos-luokan kyvyllä. Tämä laukeaa alle 5 prosentissa istunnoista. Se pudotti vastustajan hyökkäysten onnistumisen 56,6 prosentista (Opus 4.8) 5,4 prosenttiin.

Pääsenkö käsiksi Claude Mythos 5:een?

Todennäköisesti et. Mythos 5 on rajattu Project Glasswingin taakse, Anthropicin seulottuun pääsyohjelmaan puolustajille ja tietoturvatoimijoille, jotka tarvitsevat täyden hyökkäävän kyberkyvyn, jonka Fable 5 estää. Useimmat kehittäjät eivät täytä kriteerejä eivätkä tarvitsekaan, koska Fable 5 kattaa arkisen agenttisen ja koodaustyön.

Missä voin käyttää Claude Fable 5:tä?

Claude Fable 5 on yleisesti saatavilla Anthropicin API:ssa, AWS Bedrockissa, GitHub Copilotissa ja Harveyssa. Se on ilmainen Pro-, Max-, Team- ja paikkaperusteisissa Enterprise-tilauksissa 22. kesäkuuta 2026 asti; käyttöhyvitykset astuvat voimaan 23. kesäkuuta. Voit testata sitä editorissasi tai API:n kautta jo tänään.

Yhteenveto

Claude Fable 5 on aito frontier-harppaus Opus 4.8:n yli: 80,3 % vs. 69,2 % SWE-Bench Prossa, kaksinkertainen FrontierCode-pistemäärä ja 5,4 prosentin hyökkäyksen onnistumisprosentti, joka tekee siitä paljon turvallisemman ottaa käyttöön työkalujen kanssa. Vaihda vaikeaan agenttiseen koodaukseen, pitkäjänteisiin tehtäviin ja näkötyöhön. Pysy Opus 4.8:ssa kustannusherkässä volyymissa tai missä tahansa, joka muutenkin laukaisee varallaolon. Se on ilmainen 22. kesäkuuta asti, joten voit testata vaihtoa ennen kuin se maksaa mitään. Techsyn tiimi rakentaa tuotantoagentteja juuri tällä pinolla, joten ota yhteyttä, jos haluat apua.

Aihepiirit

Claude Fable 5 ja Claude Mythos 5Claude Opus 4.8SWE-Bench ProMythos-luokkaagenttinen koodaus

Jaa tämä artikkeli

Aiheeseen liittyvät julkaisut

Lisää aiheesta ai-machine-learning

ai-machine-learning
Jul 24, 2026

Claude Opus 5 on täällä: Lähes Fable 5:n älykkyys puoleen hintaan

Anthropic julkaisi Claude Opus 5:n 24. heinäkuuta 2026. Se yli kaksinkertaistaa Opus 4.8:n tuloksen Frontier-Benchissä ja pitää Opus-hinnoittelun, mutta häviää muutamia testejä Fable 5:lle ja Mythos 5:lle. Tässä benchmark-taulukko, hinnoittelu ja vaihda/odota/pysy-suositus.

10 min read lukuaika
Lue
ai-machine-learning
Jul 20, 2026

8 parasta tekoälypohjaista web scraping -APIa vuonna 2026 (testattu omalla agenttipinollamme)

Testasimme 8 tekoälypohjaista web scraping -APIa todellisilla vuoden 2026 hinnoilla, jotka haimme oman agenttipinomme kautta. Firecrawl, Bright Data, ScrapingBee ja 5 muuta – sijoitettuna LLM-valmiin tulosteen, bottitorjunnan ja MCP-tuen mukaan.

9 min read lukuaika
Lue
ai-machine-learning
Jul 20, 2026

Kehitystyön prompt-suunnittelu: 7 mallia, joita käytämme päivittäin Claude Codessa ja Cursorissa (2026)

Useimmat 'tekoälyn koodausprompteja' käsittelevät artikkelit tarjoavat 50 valmista mallia kopioitavaksi. Tämä opettaa 7 mallia, joita käytämme joka päivä 16 agentin Claude Code -putkiston ajamiseen, mukana todelliset ennen-jälkeen-esimerkit kustakin sekä tieto siitä, missä kukin malli sijaitsee Claude Codessa, Cursorissa ja Copilotissa vuonna 2026.

11 min read lukuaika
Lue
Katso kaikki julkaisut
Aloita projekti

Valmiina rakentamaan jotain erinomainen?

Muutetaan visiosi todellisuudeksi. Tiimimme on valmis auttamaan sinua luomaan ohjelmistoja, joilla on todellinen vaikutus.

Varaa lyhyt suunnittelukeskusteluKatso töitämme

Suosittuja kirjastosta

Claude-taidot

Katso kaikki
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

Tekoäly automatisoinnit

Katso kaikki
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Suosittuja kirjastosta

Claude-taidot

Katso kaikki
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

Tekoäly automatisoinnit

Katso kaikki
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Palvelut

  • Yritysratkaisut
  • Mobiilisovellukset
  • Verkkosovellukset

Ratkaisut

  • CRM-järjestelmät
  • Tekoälyintegraatio
  • ERP-ratkaisut
  • Ääniapurarit
  • Prosessien automatisointi
  • Kyberturvallisuus

Kirjasto

  • Blogi
  • Portfolio

Yhteisö

  • Tekoäly automatisoinnit
  • Claude-taidot

Työkalut

  • Mobile sovelluksen hintalaskuri
  • OpenAI / LLM API -hintalaskuri
  • MVP-hintalaskuri
  • Puhe-tekoälyasiamies-hintalaskuri

Yritys

  • Tietoja
  • Kumppanit
  • Ota yhteyttä

Juridiset asiat

  • Tietosuopolitiiikka
  • Käyttöehdot
  • Evästekäytäntö

Palvelut

  • Yritysratkaisut
  • Mobiilisovellukset
  • Verkkosovellukset

Ratkaisut

  • CRM-järjestelmät
  • Tekoälyintegraatio
  • ERP-ratkaisut
  • Ääniapurarit
  • Prosessien automatisointi
  • Kyberturvallisuus

Kirjasto

  • Blogi
  • Portfolio

Yhteisö

  • Tekoäly automatisoinnit
  • Claude-taidot

Työkalut

  • Mobile sovelluksen hintalaskuri
  • OpenAI / LLM API -hintalaskuri
  • MVP-hintalaskuri
  • Puhe-tekoälyasiamies-hintalaskuri

Yritys

  • Tietoja
  • Kumppanit
  • Ota yhteyttä
Juridiset asiatTietosuopolitiiikkaKäyttöehdotEvästekäytäntö
TECHSY
© 2026 Techsy. Kaikki oikeudet pidätetään.