
Claude Fable 5 проти Opus 4.8: чи варто переходити? (клас Mythos, з бенчмарками)
Сьогодні, 9 червня 2026 року, Anthropic випустила Claude Fable 5. Вона набирає 80,3% у SWE-Bench Pro — бенчмарку агентного програмування, де Opus 4.8 видає 69,2%, а GPT-5.5 плететься позаду з 58,6%. Це не похибка округлення. І є нюанс: Fable 5 — це публічна, захищена половина нової моделі «класу Mythos», а її закритий двійник під назвою Claude Mythos 5 тримають у програмі з обмеженим доступом. Розповідаємо, що змінилося, скільки коштує реальна задача при $10/$50 за мільйон токенів і чи варто вам справді переводити свій стек з Opus 4.8.
Коротка відповідь
- Fable 5 набирає 80,3% у SWE-Bench Pro проти 69,2% в Opus 4.8 і 58,6% у GPT-5.5.
- Ціна — $10 за вхід / $50 за вихід на мільйон токенів, менше половини ціни Mythos Preview.
- Fable 5 автоматично перемикається на Opus 4.8 для високоризикових запитів у сфері кібер/біо/хімії (менше 5% сесій).
- Безкоштовно на тарифах Pro/Max/Team/Enterprise до 22 червня 2026 року; з 23 червня діють кредити використання.
Що насправді вийшло: Fable 5, Mythos 5 і лінійка «класу Mythos»
Клас Mythos — це новий найвищий рівень можливостей Anthropic, і він виходить у вигляді двох моделей. Claude Fable 5 — це публічна, захищена версія, яку ви можете викликати вже сьогодні. Claude Mythos 5 — це та сама передова модель без запобіжників, яка лишається за закритим доступом. Той самий розум, два підходи до випуску.
У цьому поділі й полягає вся суть. Згідно з анонсом у ньюзрумі Anthropic, Mythos 5 зберігає повні передові можливості, зокрема навички наступального кіберхарактеру, які можуть завдати реальної шкоди, тож Anthropic не роздає його всім. Fable 5 бере ту саму модель і загортає її в класифікатори, які виявляють високоризикові запити й тихо перенаправляють їх на Opus 4.8.
Тож коли ви викликаєте Fable 5, ви отримуєте міркування класу Mythos для всього, що не є небезпечним, і безпечнішу резервну модель для тієї невеликої частки, яка є. CNBC описав це як те, що Anthropic випускає «подібний до Mythos ШІ для загалу», і це точно, але точний механізм важливіший за заголовок.
Fable 5 і Mythos 5 — це та сама передова модель, розділена надвоє: одну ви можете використовувати сьогодні, іншу Anthropic тримає закритою. Якщо запам'ятати щось одне про неймінг, то нехай це буде саме воно. Клас Mythos — це рівень; Fable і Mythos — двоє дверей до нього.
Що змінилося порівняно з лінійкою Opus 4.x
У кожному бенчмарку на програмування та міркування, який опублікувала Anthropic, Fable 5 перевершує Opus 4.8 — не на волосину, а на двозначні величини. SWE-Bench Pro стрибає з 69,2% до 80,3%. FrontierCode Diamond росте з 13,4 до 29,3. Ціна також впала, а модель масштабується за допомогою нового регулятора зусилля міркування. Це справжній передовий стрибок порівняно з лінійкою Opus 4.x, а не точковий реліз.

Наведений вище огляд із 13 бенчмарків — це стисла версія. Ось головний набір проти трьох моделей, які більшість команд насправді порівнюють:
| Бенчмарк | Claude Fable 5 | Claude Opus 4.8 | GPT-5.5 |
|---|---|---|---|
| SWE-Bench Pro (агентне програмування) | 80,3% | 69,2% | 58,6% |
| FrontierCode Diamond (найскладніше програмування) | 29,3 | 13,4 | 5,7 |
| Terminal-Bench 2.1 (агентна оболонка) | 88,0% | н/д | н/д |
| GPQA-AA (аспірантське міркування, Elo) | 1932 | н/д | н/д |
| ExploitBench | 78,0% | н/д | н/д |
Точкою відліку тут є Claude Opus 4.8 — модель, яку Fable 5 замінює на передовій, і та сама модель, на яку Fable 5 перемикається для високоризикових запитів. Якщо ви стежили за лінійкою Opus 4.x протягом останніх двох релізів, то тенденцією були поступові прирости. Fable 5 ламає цю тенденцію.
Два застереження, перш ніж сприймати таблицю як істину в останній інстанції. По-перше, це власні опубліковані бенчмарки Anthropic, а не незалежне тестування. По-друге, регулятор зусилля міркування означає, що за одним числом бенчмарку ховається крива вартості. Про це детальніше в розділі про ціни, бо це змінює розрахунки.
Бенчмарки, які важливі для розробників
Практичну вагу мають чотири числа: SWE-Bench Pro 80,3%, FrontierCode Diamond 29,3, Terminal-Bench 2.1 88,0% і GPQA-AA 1932 Elo. Разом вони охоплюють реальну роботу з репозиторієм, найскладніші синтетичні задачі з програмування, агентні задачі в оболонці та міркування на рівні аспірантури. Якщо ваше навантаження стосується будь-чого з цього, саме цей розділ підкаже, чи відповідає число вашій роботі.
Головний графік на початку цієї статті — доказ: SWE-Bench Pro 80,3 проти 69,2 проти 58,6, і FrontierCode 29,3 проти 13,4 проти 5,7. Але що вони насправді вимірюють?
- SWE-Bench Pro перевіряє, чи може модель відправити реальний pull request у реальний репозиторій: клонувати, зрозуміти, пропатчити, пройти тести. SWE-Bench Pro вимірює, чи може модель відправити реальний pull request у реальний репозиторій, і Fable 5 виконує 8 із 10. Це найближчий індикатор до «чи може вона виконувати мою справжню роботу».
- Terminal-Bench 2.1 оцінює агентні задачі в оболонці: виконання команд, читання виводу, відновлення після помилок. 88,0% важливо, якщо ви будуєте ШІ-агентів для програмування, які живуть у терміналі.
- FrontierCode Diamond — найскладніший рівень задач із програмування, тих, де більшість моделей набирає однозначні числа. 29,3 — це мало в абсолютному вираженні, але більш ніж удвічі перевищує 13,4 в Opus 4.8.
- GPQA-AA — це наукове міркування на рівні аспірантури, що оцінюється як рейтинг Elo. 1932 свідчить про сильне багатокрокове міркування за межами коду.
У наших робочих процесах Claude Code на лінійці Opus 4.x постійною стелею були довгострокові агентні задачі: модель втрачала нитку на половині багатофайлової зміни. Показники Fable 5 у Terminal-Bench і SWE-Bench Pro свідчать, що ця стеля зсунулася. Чи зсунулася вона для вашого репозиторію — єдиний тест, який має значення, але опубліковані числа — це саме той тип чисел, на який варто зважати.
Реальні кейси: що Fable 5 вміє, чого не могли попередні моделі
Anthropic опублікувала три конкретні приклади, які показують клас задач, який тепер під силу Fable 5: міграція кодової бази Stripe, стиснута з місяців до дня, відеогра, завершена лише на основі зору, і трикратний стрибок продуктивності завдяки самоперевірці. Кожен із них вказує на можливість, якої попередні моделі не досягали. Усі три — від Anthropic; ми посилаємося на їхній анонс, а не на власне тестування.
Ось що доводить кожен із них:
-
Міграція Stripe Ruby. Anthropic повідомляє, що Fable 5 стиснула міграцію кодової бази Ruby з приблизно двох місяців до близько одного дня. Stripe стиснула міграцію Ruby з двох місяців до одного дня, і саме такий масштаб задач змінює ця модель. Це клас довгострокового рефакторингу, який раніше потребував команди людей, що тримають усю кодову базу в голові.
-
Pokémon FireRed лише на зорі. За словами Anthropic, Fable 5 завершила Pokémon FireRed, використовуючи лише зір, тоді як попереднім моделям потрібні були складні кастомні обв'язки, щоб подавати стан гри у вигляді тексту. Це стрибок у просторовому та візуальному міркуванні: модель читає екран і діє, без риштувань.
-
Slay the Spire, 3×. За максимального зусилля міркування, каже Anthropic, Fable 5 перевіряє власні ходи й досягла утричі кращої продуктивності завдяки постійній пам'яті. Висновок не в грі; він у тому, що модель може перевіряти власну роботу на довгому горизонті планування й покращуватися завдяки цьому.
Жодне з цього не варто сприймати на віру для вашого навантаження. Але вони чітко відповідають стрибкам у бенчмарках із таблиці вище: довгострокове програмування (SWE-Bench Pro), просторове міркування (зір) і самоперевірка (регулятор зусилля міркування). Якісні та кількісні перемоги розповідають ту саму історію.
Ціни та реальність вартості за задачу
Fable 5 коштує $10 за мільйон вхідних токенів і $50 за мільйон вихідних токенів. Anthropic подає це як «менше половини ціни Claude Mythos Preview». Це також приблизно у 2 рази більше за Opus 4.8 за токен. Обидва твердження правдиві. Пастка в тому, що ціна за токен — неправильна одиниця виміру. Насправді ви платите за завершену задачу, і саме тут математика Fable 5 стає цікавою.

Зусилля міркування — це регулятор, який ви встановлюєте для кожного запиту. Низьке зусилля означає менше внутрішніх токенів міркування й дешевшу, швидшу відповідь; максимальне зусилля означає, що модель думає довше, витрачає більше вихідних токенів і набирає вищий бал. Наведений вище графік показує, як Fable 5 піднімається з ~11% до ~31% у FrontierCode зі зростанням зусилля від низького до максимального, тоді як Opus 4.8 досягає піку близько 13%, а GPT-5.5 тримається рівно біля 5-6%. Тож вартість за задачу — це не одне число; це крива, на якій ви обираєте точку.
Розберемо конкретний приклад з опублікованої ціни $10/$50. Це арифметика з оприлюднених тарифів Anthropic, а не результат бенчмарку.
Візьмемо один агентний виклик із 50 000 вхідних токенів і 15 000 вихідних токенів за високого зусилля:
Input: 50,000 / 1,000,000 × $10 = $0.50
Output: 15,000 / 1,000,000 × $50 = $0.75
Per call: $1.25Реальна агентна задача зчіплює багато таких викликів: прочитати репозиторій, спланувати, відредагувати, запустити тести, виправити, повторити. Скажімо, цикл виконує 12 викликів такого вигляду: приблизно $15 за завершену задачу. За максимального зусилля міркування з важчим контекстом власна крива вартості Anthropic поміщає складні задачі FrontierCode ближче до діапазону $20 за задачу. Запустіть ту саму задачу на GPT-5.5 — і ви заплатите менше за токен. Але якщо вона не може завершити задачу на жодному рівні зусилля, ваша вартість за завершену задачу — нескінченна. Fable 5 коштує більше за токен, ніж GPT-5.5, і все одно виграє за вартістю за завершену задачу, бо виконує роботу, яку GPT-5.5 не може.
Ось мінімальний виклик. В анонсі Anthropic claude-fable-5 вказано як ідентифікатор моделі; перевірте точний версіонований рядок у документації Anthropic API перед релізом, бо датовані аліаси іноді відрізняються:
import anthropic
client = anthropic.Anthropic()
message = client.messages.create(
model="claude-fable-5", # verify exact dated id in API docs
max_tokens=4096,
thinking={"type": "enabled", "budget_tokens": 8000}, # reasoning effort
messages=[
{"role": "user", "content": "Migrate this module from Ruby 2.7 to 3.3 and run the tests."}
],
)
print(message.content)Тезис про економіку одним рядком: ви платите більше за токен, ніж GPT-5.5, але завершуєте задачі, які GPT-5.5 не може завершити за жодну ціну. Для маловідповідальної високооб'ємної роботи ця математика на користь дешевшої моделі. Для складного агентного програмування — на користь Fable 5.
Поділ запобіжників: чому Fable перемикається на Opus 4.8
Fable 5 запускає класифікатори на кожному запиті. Коли вона виявляє високоризиковий запит (наступальна кіберсфера, біо, хімія або спроби дистиляції моделі), вона перемикається на Opus 4.8 замість того, щоб відповідати з повними можливостями класу Mythos. Anthropic каже, що це перемикання спрацьовує менш ніж у 5% сесій, тож більшість користувачів ніколи його не запускає. Мета — тримати небезпечну можливість за бар'єром, не чіпаючи повсякденну роботу.

Складніше число — частота успішних атак: як часто автоматизований зловмисник може зламати модель, щоб вона зробила те, чого не повинна. Менше — краще. Результати ред-тіму Anthropic показують стрімке падіння між релізами: від Opus 4.6 з 83,2%, до Opus 4.7 з 72,7%, до Opus 4.8 з 56,6%, аж до Fable 5 з 5,4%. За автоматичного ред-тімінгу атаки проти Fable 5 були успішними лише у 5,4% випадків, проти 56,6% на Opus 4.8.
Чому вас це має хвилювати? Якщо ви розгортаєте агента з доступом до інструментів (оболонка, файлова система, мережа), злам — це не погана відповідь у чаті, це модель, яка виконує реальні команди, до яких її підштовхнув зловмисник. Частота успішних атак 5,4% означає, що її приблизно вдесятеро складніше перетворити на зброю, ніж Opus 4.8. Матеріал IT Pro почався саме з механізму перемикання з цієї причини: це та функція, яка робить передову модель достатньо безпечною, щоб віддати її загалу.
Компроміс — затримка. Якщо ваш робочий процес легітимно торкається інструментів безпеки, перемикання може спрацювати посеред задачі й підмінити модель — це треба враховувати.
Claude Mythos 5 і питання подвійного використання
Claude Mythos 5 — закритий двійник, та сама модель без резервного перемикання запобіжників. Вона зберігає наступальні кіберможливості, які Fable 5 блокує, і саме тому Anthropic не випускає її публічно. Доступ іде через Project Glasswing — перевірену програму для захисників і дослідників, яким потрібні повні можливості. Та сама модель, два підходи до випуску: один відкритий, один закритий.

Графік робить закритість видимою. В оцінках наступальної кіберсфери (Firefox, OSS-Fuzz, CyberGym, CyScenarioBench) Mythos 5 набирає 88,4, 24,0, 83,8 і 38,7. Fable 5 повертає рівні 0,0 по всіх чотирьох. В оцінках наступальної кіберсфери Mythos 5 набирає до 88,4, тоді як Fable 5 повертає рівні 0,0: поділ запобіжників, зроблений видимим.
Цей нуль — не прогалина в можливостях. Це перемикання, яке спрацьовує щоразу, блокуючи запит до того, як відповість модель класу Mythos. TechCrunch відзначив таймінг: Anthropic випустила це за кілька днів після попередження, що ШІ стає занадто небезпечним для відкритого випуску. Поділ Fable/Mythos — це політична відповідь на те попередження: опублікувати можливість, закрити небезпеку.
Для більшості розробників Mythos 5 не має значення. Ви ніколи не пройдете відбір у Project Glasswing, і вам це не потрібно. Важливо знати, що модель, яку ви викликаєте, свідомо обмежена на вузькому класі задач — за задумом.
Що це означає: чи варто переходити?
Переходьте на Fable 5 для складного агентного програмування, довгострокових багатоетапних задач і зорового чи просторового міркування — скрізь, де завершення задачі важливіше за економію копійок на токенах. Лишайтеся на Opus 4.8 для чутливої до вартості високооб'ємної роботи або для будь-чого, що все одно запускає перемикання. Це весь фреймворк. Решта — це зіставити ваше навантаження з правильним боком.
Коли Fable 5 виграє:
- Складне агентне програмування, де Opus 4.8 застрягає; розрив у SWE-Bench Pro реальний
- Довгострокові задачі (багатофайлові рефакторинги, міграції), де самоперевірка окупається
- Навантаження зору та просторового міркування
- Будь-яка робота, де одна завершена задача варта більше за премію в ціні токенів
Коли Opus 4.8 досі виграє:
- Високооб'ємна, чутлива до вартості робота, де домінує ціна за токен
- Навантаження кібер/біо/хімії, де Fable 5 все одно перемикається на Opus 4.8, тож викликайте його напряму
- Чутливі до затримки процеси, які не терплять підміни моделі посеред задачі
| Кейс використання | Рекомендована модель |
|---|---|
| Складне агентне програмування / міграції | Claude Fable 5 |
| Зір / просторове міркування | Claude Fable 5 |
| Високооб'ємна дешева класифікація | Claude Opus 4.8 |
| Інструменти безпеки / ред-тіму | Claude Opus 4.8 (напряму) |
Щодо доступності: Fable 5 безкоштовна на тарифах Pro/Max/Team/Enterprise до 22 червня 2026 року, кредити використання діють з 23 червня. Вона загальнодоступна в API, AWS Bedrock, GitHub Copilot згідно з чейнджлогом GitHub і Harvey. Тож ви можете випробувати перехід у своєму редакторі вже сьогодні, не змінюючи білінг.
Про автора
Мерт Батур Гюрбюз — співзасновник Techsy.io, де команда випускає ШІ-агентів, системи автоматизації та голосові/SDR-конвеєри для B2B-клієнтів. Він навчається в Бірмінгемському університеті й пише про стек інструментів LLM, який команда Techsy реально використовує в продакшені. Зв'язатися в LinkedIn.
Співзасновник Techsy.io · Бірмінгемський університет
Часті запитання
Що таке Claude Fable 5?
Claude Fable 5 — перша публічно доступна модель класу Mythos від Anthropic, випущена 9 червня 2026 року. Вона набирає 80,3% у SWE-Bench Pro і запускає класифікатори захисту, які перемикаються на Opus 4.8 для високоризикових запитів. Вона коштує $10 за вхід / $50 за вихід на мільйон токенів.
У чому різниця між Fable 5 і Mythos 5?
Це та сама передова модель з різними підходами до випуску. Fable 5 — публічна й захищена; вона перемикається на Opus 4.8 для небезпечних запитів. Mythos 5 — закрита версія з повними можливостями, доступна лише через програму Anthropic Project Glasswing для перевірених захисників і дослідників.
Чи Claude Fable 5 насправді краща за Opus 4.8?
Так, у складному агентному програмуванні, зорі та просторовому міркуванні: Fable 5 набирає 80,3% у SWE-Bench Pro проти 69,2% в Opus 4.8. Але Opus 4.8 досі виграє в чутливій до вартості високооб'ємній роботі, а Fable 5 все одно перемикається на Opus 4.8 для високоризикових тем кібер/біо/хімії. «Краще» залежить від вашого навантаження.
Скільки коштує Claude Fable 5?
Claude Fable 5 коштує $10 за мільйон вхідних токенів і $50 за мільйон вихідних токенів. Формулювання Anthropic — «менше половини ціни Mythos Preview». Це приблизно у 2 рази більше за Opus 4.8 за токен, але аргумент цінності — за завершену задачу, оскільки Fable 5 виконує роботу, яку дешевші моделі не можуть.
Що таке модель «класу Mythos»?
Клас Mythos — новий найвищий рівень можливостей Anthropic, запущений разом з Fable 5 і Mythos 5. Він являє собою передовий стрибок порівняно з лінійкою Opus 4.x у бенчмарках програмування та міркування. Fable 5 і Mythos 5 — дві версії випуску тієї самої моделі класу Mythos: одна публічна й захищена, одна закрита.
Чому Fable 5 перемикається на Opus 4.8?
Fable 5 запускає класифікатори, які виявляють високоризикові запити (наступальна кіберсфера, біо, хімія або дистиляція моделі) і перенаправляє їх на Opus 4.8 замість відповіді з повними можливостями класу Mythos. Це спрацьовує менш ніж у 5% сесій. Це скоротило успішність ворожих атак з 56,6% (Opus 4.8) до 5,4%.
Чи можу я отримати доступ до Claude Mythos 5?
Мабуть, ні. Mythos 5 закрита за Project Glasswing — перевіреною програмою доступу Anthropic для захисників і дослідників безпеки, яким потрібні повні наступальні кіберможливості, які Fable 5 блокує. Більшість розробників не пройдуть відбір, і їм це не потрібно, оскільки Fable 5 покриває повсякденну агентну роботу та програмування.
Де можна використовувати Claude Fable 5?
Claude Fable 5 загальнодоступна в Anthropic API, AWS Bedrock, GitHub Copilot і Harvey. Вона безкоштовна на тарифах Pro, Max, Team і покористувацькому Enterprise до 22 червня 2026 року; кредити використання діють з 23 червня. Ви можете випробувати її у своєму редакторі або через API вже сьогодні.
Підсумок
Claude Fable 5 — справжній передовий крок порівняно з Opus 4.8: 80,3% проти 69,2% у SWE-Bench Pro, удвічі вища оцінка FrontierCode і частота успішних атак 5,4%, яка робить її набагато безпечнішою для розгортання з інструментами. Переходьте для складного агентного програмування, довгострокових задач і роботи із зором. Лишайтеся на Opus 4.8 для чутливого до вартості об'єму або будь-чого, що все одно запускає перемикання. Вона безкоштовна до 22 червня, тож ви можете випробувати перехід, перш ніж це коштуватиме вам хоч щось. Команда Techsy будує продакшн-агентів саме на цьому стеку, тож звертайтеся, якщо потрібна допомога.