
Claude Opus 5 вже тут: інтелект рівня Fable 5 за пів ціни
Anthropic випустив Claude Opus 5 24 липня 2026 року, і посил прямий: інтелект, близький до фронтірного Fable 5, за пів ціни. Головний доказ — Frontier-Bench v0.1, де Opus 5 набирає 43,3% і більш ніж удвічі перевершує 21,1% Opus 4.8. Підступ, а він є завжди: він не виграє все. GPT-5.6 Sol досі обходить його в одному тесті агентного кодування, а в здоров'ї та біології корона дістається Mythos 5. Ось що насправді змінилося, повна таблиця бенчмарків і чи варто вже сьогодні перемикати модель за замовчуванням.
Ключові висновки:
- Claude Opus 5 запущено 24 липня 2026 року на Claude API, Claude.ai, Claude Code та Claude Cowork, з ідентифікатором моделі
claude-opus-5. - Він лідирує у більшості опублікованих бенчмарків Anthropic (Frontier-Bench, GDPval-AA, ARC-AGI-3, OSWorld 2.0, AutomationBench), але поступається в кількох тестах кодування, права та науки.
- Ціна не змінилася порівняно з Opus 4.8: $5/$25 за мільйон токенів, з режимом Fast приблизно за подвійну ціну і швидкістю приблизно в 2,5 раза вищою.
Що вийшло сьогодні: Claude Opus 5 за одну хвилину
Claude Opus 5 — нова фронтірна модель Anthropic, випущена 24 липня 2026 року і доступна того ж дня на API, Claude.ai, Claude Code та Claude Cowork. Ідентифікатор моделі — claude-opus-5. Формулювання Anthropic згідно з оголошенням: вона «наближається до фронтірного інтелекту Claude Fable 5 за пів ціни». Стандартна ціна залишається $5 вхід / $25 вихід за мільйон токенів, як у Opus 4.8.
Це справжній поколіннєвий стрибок для агентної роботи, а не точкове оновлення. Якщо ви переходите з Claude Opus 4.8, форма API та інтеграція Claude Code залишаються незмінними, тож міграція — це лише заміна ідентифікатора моделі. Що інше — це стеля: на Frontier-Bench v0.1 Anthropic каже, що Opus 5 більш ніж удвічі перевищує результат 4.8 при нижчій вартості на завдання, і демонструє найкращі показники на GDPval-AA та ARC-AGI-3.
Позиціонування має значення. Fable 5 — найдорожча фронтірна модель Anthropic. Наблизитися до неї за ціною Opus — це вся історія цього релізу, і саме тому фраза «за пів ціни» є тією, з якою Anthropic виступає.
Що насправді нового в Opus 5 порівняно з 4.8?
Найбільший зсув від 4.8 до 5 — це судження: Opus 5 помітно кращий у перевірці власної роботи та ітерації, поки завдання не буде фактично виконано, а не просто правдоподібно завершено. Anthropic також відзначає сильнішу програмну інженерію, інтелектуальну роботу та наукові дослідження, плюс покращений візуальний вивід. Ціна та основний API залишилися без змін.
Краще судження та самоперевірка
Найясніша поведінкова зміна — Opus 5 перевіряє себе. Anthropic цитує Зіму Лі, технічного співробітника, який описує модель як ту, що «перевіряє гілки, перевіряє шаблони», замість того щоб мчати вперед. Для будь-кого, хто покладається на агента, щоб виявляти власні помилки в продакшні, це та риса, яка вирішує. Водночас це найважче продати в таблиці бенчмарків, тож ставтеся до цього як до твердження, яке варто перевірити на власних завданнях.
Фронтірний інтелект за ціною Opus
Суалех Асіф, співзасновник Cursor, підсумував реліз як «інтелект рівня Fable 5 за швидкістю та вартістю Opus». Це практичне прочитання: команди, які хотіли міркування рівня Fable 5, але не могли обґрунтувати ціну, тепер мають середній варіант. На OSWorld 2.0 Anthropic каже, що Opus 5 перевершує Fable 5 приблизно за третину вартості, і це найчистіший окремий приклад аргументу цінності.
Позиція щодо вирівнювання та безпеки
Anthropic повідомляє, що Opus 5 має найнижчий на сьогодні бал невирівняної поведінки (2,3) і називає його моделлю, найбільш вирівняною з його Конституцією. З боку безпеки кібербезпекові класифікатори описуються як приблизно на 85% менш обмежувальні, ніж у Fable 5, з корпоративною програмою Cyber Verification для команд, яким вона потрібна. Як і будь-яке твердження постачальника про безпеку — корисно знати, але все одно варто перевірити на власних випадках ред-тіму.
Бенчмарки Opus 5: де він виграє (і де програє)
Opus 5 лідирує у більшості опублікованих бенчмарків Anthropic, і перемоги, важливі для розробників агентів, переконливі: Frontier-Bench v0.1 (43,3%), GDPval-AA (1861 Elo), ARC-AGI-3 (30,2%), OSWorld 2.0 (70,6%) та AutomationBench від Zapier (26,0%). Чесні винятки: GPT-5.6 Sol виграє DeepSWE v1.1, Fable 5 обходить у FrontierCode та правових тестах, а Mythos 5 забирає здоров'я та біологію.
| Бенчмарк | Opus 5 | Fable 5 | Opus 4.8 | GPT-5.6 Sol |
|---|---|---|---|---|
| Агентне термінальне кодування, Frontier-Bench v0.1 | 43,3% | 33,7% | 21,1% | 34,4% |
| Інтелектуальна робота, GDPval-AA v2 (Elo) | 1861 | 1747 | 1593 | 1736 |
| Вирішення нових задач, ARC-AGI-3 | 30,2% | — | 1,5% | 7,8% |
| Агентний пошук, BrowseComp | 90,8% | 87,4% | 84,3% | 90,4% |
| Мультидисциплінарне міркування, Humanity's Last Exam (з інструментами) | 64,7% | 63,9% | 57,9% | — |
| Агентне використання комп'ютера, OSWorld 2.0 | 70,6% | 66,1% | 55,7% | 62,6% |
| Агентне кодування, DeepSWE v1.1 | 68,8% | 69,7% | 59,0% | 72,7% |
| Агентне кодування, FrontierCode v1.1 (Main) | 53,4% | 53,5% | 46,5% | 47,5% |
| Бізнес-процеси, AutomationBench | 26,0% | 17,4% | 17,0% | 18,1% |
| Legal Agent Benchmark (held-out) | 11,7% | 13,3% | 10,4% | 2,5% |
| Здоров'я, HealthBench Professional | 59,8% | 66,0% | 57,4% | 60,5% |
| Біологія, BioMysteryBench (hard) | 49,4% | 46,5% | 42,4% | — |

Читайте дельти, а не лише абсолютні бали. Frontier-Bench стрибнув на +22,2 пункту порівняно з Opus 4.8 (з 21,1 до 43,3) — найбільший окремий стрибок і причина, чому Anthropic називає це релізом для кодування та агентів. GDPval-AA додав +268 Elo (з 1593 до 1861), обійшовши кожну модель у таблиці в інтелектуальній роботі. ARC-AGI-3 привертає увагу: 30,2% проти 7,8% у GPT-5.6 Sol і 1,5% у Opus 4.8, що Anthropic подає як приблизно в 3 рази краще за наступну найкращу публічну модель у вирішенні нових задач. На AutomationBench 26,0% — це приблизно в 1,5 раза більше за поле, прямий сигнал для будь-кого, хто будує агентів для бізнес-процесів.
Дві чесні примітки щодо поразок. По-перше, лідер у стовпці Fable 5 для здоров'я (66,0%) і біологічного тесту, розв'язаного людьми, — це насправді Mythos 5, науково спеціалізована модель Anthropic, а не Fable 5, тож це не порівнянні перемоги загальної моделі. По-друге, картина кодування справді розділена: GPT-5.6 Sol забирає DeepSWE v1.1 (72,7% проти 68,8%), а Fable 5 виграє FrontierCode на волосину (53,5% проти 53,4%). Якщо ваша робота — чисте кодування у стилі SWE-bench, мітка «найкращий загалом» не обирає автоматично Opus 5.
Скільки коштує Opus 5? Ціна та режим Fast
Стандартна ціна Opus 5 — $5 за мільйон вхідних токенів і $25 за мільйон вихідних токенів, ідентична Opus 4.8 згідно з опублікованими цінами Anthropic, тож за оновлення нічого не доплачуєте. Твердження «за пів ціни» стосується Fable 5, а не 4.8: ви отримуєте інтелект рівня Fable 5, не платячи тарифи Fable 5. Режим Fast працює приблизно за подвійну базову ціну зі швидкістю приблизно в 2,5 раза вищою за стандартну, а API підтримує резервне маршрутування.
Що це означає на завдання? Зі стандартною ціною ви не платите нічого додатково порівняно з 4.8 і отримуєте великий стрибок у можливостях, що робить оновлення майже безкоштовним для більшості навантажень. Режим Fast — важіль для інтерактивних сесій: ви обмінюєте подвійну цінову надбавку на вивід, який транслюється приблизно в 2,5 раза швидше на тій самій моделі, що окуповується, коли ви сидите і чекаєте, і болить, коли запускаєте нічні пакетні завдання, де час не має значення. Якщо вашим справжнім обмеженням є ліміти швидкості, наш посібник з лімітів використання Claude пояснює, як рівні взаємодіють із вартістю.
# Claude Code: point your default model at Opus 5
/model claude-opus-5
# API request body (model ID swap):
{
"model": "claude-opus-5",
"messages": [
{ "role": "user", "content": "Refactor this module and verify the tests pass." }
]
}Де Opus 5 приземляється для продакшн-агентів
Прибутки зосереджені саме там, де живуть продакшн-агенти: термінальне кодування (Frontier-Bench), використання комп'ютера (OSWorld 2.0), агентний пошук (BrowseComp) та багатокрокові бізнес-процеси (AutomationBench). Ці чотири — навантаження, які найчастіше ламаються в реальних розгортаннях, тож модель, яка стрибає на всіх чотирьох одразу, змінює те, що можна розгортати.
Ось частина, над якою варто замислитися. Бенчмарк на кшталт AutomationBench вимірює, чи може агент завершити справжній багатоінструментний робочий процес від початку до кінця, і 26,0% Opus 5 проти приблизно 17% поля — це різниця між «добре демонструється» і «виживає при контакті з безладною CRM». Результат OSWorld 2.0 (70,6%, перевершує Fable 5 за третину вартості) каже те саме для агентів використання комп'ютера, які клацають у реальному програмному забезпеченні. Для команд, що розгортають AI-агентів для клієнтів, це цифри, які перетворюються на менше збоїв о другій ночі.
Це також знижує вартість проєктного патерну, на який ми покладаємося: дешева самоперевірка. Коли модель справді краща у перевірці власних гілок, можна витрачати менше токенів на окремий критичний прохід і все одно ловити ті самі помилки. Це реальний бюджетний рядок для будь-кого, хто запускає агентів у великих обсягах.
Як ми впроваджуємо Opus 5 у наш стек
У Techsy ми будуємо та запускаємо продакшн AI-агентів на стеку Claude, тож фронтірний реліз для нас — це оцінка того ж дня, а не заголовок, який ми читаємо й гортаємо далі. Ось наше чесне перше враження — якісне там, де ще немає чистих цифр до/після, конкретне там, де вони є.
Сама заміна тривіальна, і в цьому суть. Наші контентні та автоматизаційні пайплайни фіксують модель за замовчуванням у конфігурації; зміна claude-opus-4-8 на claude-opus-5 і перезапуск сесії не потребували жодних інших змін, як і кожне нещодавнє оновлення Opus. Якщо ви маршрутизуєте між провайдерами і хочете A/B-тестувати Opus 5 проти Fable 5 або GPT-5.6 Sol на власних завданнях, проксі дозволяє перемикати моделі без переписування застосунку.
Що ми спостерігаємо першим — це твердження про самоперевірку, бо саме воно реально змінило б нашу архітектуру. Наші поточні агенти виконують явний критичний крок, щоб ловити погані правки до їх застосування; якщо Opus 5 надійно позначає власні слабкі гілки, ми можемо скоротити цей крок і заощадити токени. Ми не публікуватимемо цифру, доки не проженемо це на повторюваному наборі завдань — та сама дисципліна, якої ми б хотіли від будь-кого, хто цитує метрики агентів. Якщо хочете метод, він у нашому посібнику з оцінювання AI-агентів у продакшні: ті самі промпти, той самий стан репозиторію, рахуйте хибні повороти, а не враження.
Чи варто переходити з Opus 4.8? (Перейти / Почекати / Залишитися)
Чи переходити, залежить від вашого навантаження, а не від того, яка модель «виграє» загалом. Стрибки в агентній та інтелектуальній роботі великі й реальні, тож більшості команд варто перейти. Чисто кодувальні команди з пайплайном на GPT або Fable мають причину протестувати перед фіксацією, а користувачі біля стелі на дешевих завданнях можуть залишитися, майже нічого не втративши.
Переходьте зараз, якщо: ваша робота спирається на агентні завдання, використання комп'ютера, автоматизацію бізнес-процесів або інтелектуальну роботу. Frontier-Bench (+22,2 порівняно з 4.8), AutomationBench (~1,5× поля) та GDPval-AA (+268 Elo) — найбільші реальні прибутки, а ціна не змінилася, тож немає цінового штрафу за оновлення.
Почекайте, якщо: ваш робочий процес — чисте агентне кодування і ви вже використовуєте для нього GPT-5.6 Sol або Fable 5. GPT-5.6 Sol досі лідирує в DeepSWE v1.1, а Fable 5 обходить у FrontierCode, тож проженіть власну оцінку кодування перед перемиканням. Також почекайте, якщо ви посеред проєкту і заміна моделі розмиє оцінку, яку ви вже проводите.
Залишайтеся на 4.8, якщо: ви чутливі до вартості на завданнях, які для вас вже були біля стелі, і не торкаєтеся агентних навантажень, де Opus 5 виривається вперед. Ви платитимете вартість переходу за дельту, яку не відчуєте. Для ширшого поля дивіться, як моделі виглядають у нашому розборі Claude Sonnet 5 та огляді Fable 5 і Mythos 5.
Ми щотижня обираємо та підключаємо моделі для клієнтських збірок агентів. Якщо вирішуєте, яку модель стандартизувати для продакшн-агента, отримайте безкоштовну консультацію — ми допоможемо підібрати модель під навантаження, а не під маркетинг.
Про автора
Мерт Батур Гюрбюз — співзасновник Techsy.io, де команда розгортає AI-агентів, автоматизаційні системи та голосові/SDR-пайплайни для B2B-клієнтів. Він навчається в Бірмінгемському університеті та пише про стек інструментів LLM, який команда Techsy фактично використовує в продакшні.
Співзасновник, Techsy.io, Бірмінгемський університет · LinkedIn
Часті запитання
Що таке Claude Opus 5?
Claude Opus 5 — фронтірна модель Anthropic, випущена 24 липня 2026 року, з ідентифікатором моделі claude-opus-5. Anthropic позиціонує її як таку, що наближається до інтелекту Fable 5 за пів ціни, і вона лідирує у більшості опублікованих бенчмарків, включно з Frontier-Bench, GDPval-AA та ARC-AGI-3. Доступна на Claude API, Claude.ai, Claude Code та Claude Cowork.
Коли вийшов Claude Opus 5?
Claude Opus 5 вийшов 24 липня 2026 року. Він став доступний того ж дня на Claude API, Claude.ai, Claude Code та Claude Cowork, без поетапного розгортання, тож ви можете одразу перемкнути модель за замовчуванням на claude-opus-5.
Чи Claude Opus 5 кращий за Opus 4.8?
Для більшості роботи — так. Opus 5 більш ніж удвічі перевершує Opus 4.8 на Frontier-Bench v0.1 (43,3% проти 21,1%), додає 268 Elo на GDPval-AA і стрибає з 1,5% до 30,2% на ARC-AGI-3. Ціна не змінилася, тож цінового штрафу немає. Винятки — кілька тестів кодування та науки, де досі лідирують GPT-5.6 Sol, Fable 5 або Mythos 5.
Скільки коштує Claude Opus 5?
Стандартна ціна — $5 за мільйон вхідних токенів і $25 за мільйон вихідних токенів, ідентична Opus 4.8. Фраза «за пів ціни» стосується Fable 5, а не 4.8: Opus 5 дає інтелект рівня Fable 5 за тарифами Opus. Режим Fast коштує приблизно вдвічі більше за базову ціну і працює приблизно в 2,5 раза швидше на тій самій моделі.
Чи Claude Opus 5 перемагає Fable 5?
Не в усьому. Opus 5 перевершує Fable 5 на OSWorld 2.0, BrowseComp, GDPval-AA та Frontier-Bench, і робить це за частку ціни Fable 5. Але Fable 5 досі обходить у FrontierCode та правовому бенчмарку, а Mythos 5 (наукова модель Anthropic) лідирує в здоров'ї та біології. Посил — «близький до Fable 5 за пів ціни», а не «кращий за Fable 5 в усьому».
У чому Opus 5 програє?
GPT-5.6 Sol виграє агентне кодування на DeepSWE v1.1 (72,7% проти 68,8%), Fable 5 виграє FrontierCode v1.1 на 0,1 пункту та held-out правовий бенчмарк (13,3% проти 11,7%), а Mythos 5 лідирує в HealthBench Professional та біологічних тестах. Якщо ваше навантаження домінується будь-яким із них, протестуйте перед переходом.
Чи Claude Opus 5 підходить для створення AI-агентів?
Він для цього створений. Найбільші прибутки припадають на агентне термінальне кодування (Frontier-Bench), використання комп'ютера (OSWorld 2.0), агентний пошук (BrowseComp) та багатокрокові бізнес-процеси (AutomationBench) — це навантаження, які виконують продакшн-агенти. Його сильніша самоперевірка також дозволяє витрачати менше токенів на окремий критичний прохід.
Як перейти на Opus 5 у Claude Code та API?
Встановіть модель на claude-opus-5 (використайте /model claude-opus-5 у Claude Code) — і для більшості команд готово. В API змініть поле model на claude-opus-5; форма запиту не змінилася порівняно з Opus 4.8, тож інших змін коду не потрібно.
Що таке режим Fast у Claude Opus 5?
Режим Fast — це швидкісний рівень, який запускає Opus 5 приблизно в 2,5 раза швидше за стандартну швидкість приблизно за подвійну стандартну ціну. Він тримає вас на повній моделі claude-opus-5, а не маршрутизує на меншу, що робить його корисним для інтерактивних сесій, де ви чекаєте на вивід, і непотрібним для пакетних завдань, де затримка не має значення.