
Claude Opus 4.8 вже тут: що змінилося, де він перемагає (і де поступається)
Anthropic випустила Claude Opus 4.8 28 травня 2026 року, лише за 41 день після 4.7. Це найшвидший темп оновлень Opus, який ми бачили. Головне число — 69,2% на SWE-Bench Pro — реальне, і підступ теж реальний: модель програє один бенчмарк повністю. Розповідаємо, що змінилося і чи варто вже сьогодні перемикати модель за замовчуванням, чи краще почекати.
Ключові висновки:
- Claude Opus 4.8 запущено 28 травня 2026 року, за 41 день після 4.7, на Claude.ai, у Claude Code та через API.
- Він лідирує у 6 з 7 бенчмарків Anthropic, але програє Terminal-Bench 2.1 моделі GPT-5.5 (74,6% проти 78,2%).
- Ціни не змінилися: $5/$25 за мільйон токенів; новий Fast Mode працює приблизно у 2,5 раза швидше за $10/$50.
Що вийшло сьогодні: Claude Opus 4.8 за одну хвилину
Claude Opus 4.8 — флагманська модель Anthropic, випущена 28 травня 2026 року, доступна вже сьогодні на Claude.ai, у Claude Code та через API. Ідентифікатор моделі — claude-opus-4-8, є варіант із контекстом 1 млн токенів — claude-opus-4-8[1m]. Стандартні ціни не змінилися порівняно з 4.7: $5/$25 за мільйон токенів. Короткий вердикт: реальне оновлення для кодингу та роботи зі знаннями, з одним чесним винятком.
Це інкрементальний реліз, а не повна перебудова. Якщо ви переходите з Claude Opus 4.7, більшість того, що ви вже знаєте, залишається: форма API, концепція контролю зусиль, інтеграція з Claude Code. Що змінилося — це стеля бенчмарків, дешевший Fast Mode і нова функція в режимі research preview для роботи з великими кодовими базами.
Opus 4.8 вийшов лише за 41 день після 4.7 — найшвидший темп релізів Opus від Anthropic. Варіант із контекстом 1 млн токенів існує як claude-opus-4-8[1m], хоча публічна сторінка огляду моделей у документації може ще не встигнути оновитися. Згідно з оголошенням Anthropic, це їхня «найчесніша» модель на сьогодні — до цього твердження ми ще повернемося.
Що реально нового в Opus 4.8 порівняно з 4.7?
Найбільші зміни від 4.7 до 4.8 — це вирівнювання, ефективність виклику інструментів і нова функція оркестрації. Anthropic каже, що Opus 4.8 приблизно у 4 рази рідше пропускає дефект у власному коді без позначки, виконує агентні завдання за меншу кількість кроків і впроваджує Dynamic Workflows для великих міграцій. Ціни та основний API залишилися без змін.
Чесність і вирівнювання
Згідно з їхнім оголошенням, Opus 4.8 частіше позначає невизначеність, уникає непідтверджених тверджень і вказує на проблеми в коді, який щойно написав. Anthropic стверджує, що показники небажаної поведінки «суттєво нижчі, ніж у Opus 4.7», і наводить відгук Bridgewater про те, як модель проактивно піднімала проблеми. Для тих, хто покладається на ШІ для виявлення дефектів у коді, цифра «у 4 рази рідше пропускає дефекти» — це рядок, на який варто звернути увагу. Ставтеся до цього як до заяви вендора, доки не перевірите на власних пул-реквестах.
Контроль зусиль і зміна в Messages API
Рівні зусиль тепер можна обирати безпосередньо на Claude.ai, тож ви можете обмінювати витрати токенів на глибину, не переходячи на меншу модель. Є також невелика, але реальна зміна для розробників: Messages API тепер приймає системні записи всередині масиву messages, а не лише як параметр верхнього рівня system. Якщо ви будуєте агентів, це робить системні інструкції посеред розмови зручнішими в керуванні.
Ефективніший виклик інструментів
Anthropic описує виклик інструментів як «відчутно ефективніший — менше кроків для того самого рівня інтелекту», виміряно на CursorBench на різних рівнях зусиль. На їхньому внутрішньому бенчмарку Super-Agent вони кажуть, що Opus 4.8 був єдиною моделлю, яка завершила всі кейси від початку до кінця за паритету витрат із GPT-5.5. Менше викликів інструментів на завдання — це прямий важіль економії для розробників агентів, тож це важливіше, ніж здається.
Бенчмарки Opus 4.8: де він перемагає (і де програє)
Opus 4.8 лідирує у 6 з 7 бенчмарків Anthropic, зокрема SWE-Bench Pro (69,2%) та GDPval-AA (1890 Elo). Виняток, і той, про який варто говорити чесно: GPT-5.5 досі перемагає в агентному термінальному кодингу на Terminal-Bench 2.1 — 78,2% проти 74,6% у Opus 4.8. Тож якщо ваша робота живе в терміналі, найкраща модель загалом не є найкращою моделлю для вас.
| Бенчмарк | Opus 4.8 | Opus 4.7 | GPT-5.5 | Gemini 3.1 Pro |
|---|---|---|---|---|
| Агентний кодинг, SWE-Bench Pro | 69,2% | 64,3% | 58,6% | 54,2% |
| Агентний термінальний кодинг, Terminal-Bench 2.1 | 74,6% | 66,1% | 78,2% | 70,3% |
| Мультидисциплінарне міркування, Humanity's Last Exam (без інструментів) | 49,8% | 46,9% | 41,4% | 44,4% |
| Мультидисциплінарне міркування, Humanity's Last Exam (з інструментами) | 57,9% | 54,7% | 52,2% | 51,4% |
| Агентна робота з комп'ютером, OSWorld-Verified | 83,4% | 82,8% | 78,7% | 76,2% |
| Робота зі знаннями, GDPval-AA (Elo) | 1890 | 1753 | 1769 | 1314 |
| Агентний фінансовий аналіз, Finance Agent v2 | 53,9% | 51,5% | 51,8% | 43,0% |

Читайте дельти, а не лише абсолютні показники. SWE-Bench Pro стрибнув на +4,9 пункту (з 64,3 до 69,2) — головний приріст у кодингу. Terminal-Bench 2.1 зріс на +8,5 пункту (з 66,1 до 74,6) — найбільший стрибок від 4.7 до 4.8, і все одно поступається GPT-5.5. GDPval-AA додав +137 Elo (з 1753 до 1890) — великий стрибок у роботі зі знаннями, який також із запасом обходить GPT-5.5 (1769). OSWorld-Verified зрушив лише на +0,6 (з 82,8 до 83,4); робота з комп'ютером уже була близька до стелі на 4.7, тож не очікуйте відчутної різниці. Finance Agent v2 додав +2,4 пункту.
Висновок чистий: Opus 4.8 перемагає у шести з семи бенчмарків, а той один, який програє — агентний термінальний кодинг — досі за GPT-5.5. Цифри підтверджені оголошенням Anthropic та оглядом бенчмарків від OfficeChai.
Що таке Fast Mode і чи він дешевший?
Fast Mode запускає Opus 4.8 приблизно у 2,5 раза швидше за $10 вхід / $50 вихід на мільйон токенів, активується командою /fast у Claude Code. Anthropic каже, що це «втричі дешевше, ніж для попередніх моделей». Стандартні ціни залишаються $5/$25 за мільйон токенів, без змін від 4.7. Ключовий момент: Fast Mode тримає вас на повній моделі Opus, а не понижує до меншої.
Що це означає на одне завдання? Ви платите 2x надбавку до ціни за приблизно 2,5x швидкість на тій самій моделі. Для інтерактивних сесій Claude Code, де ви чекаєте на вивід, цей обмін часто окуповується. Для довгих пакетних завдань, де час виконання не має значення, стандартні ціни — дешевший вибір.
# In a Claude Code session, switch the current task to Fast Mode:
/fast
# Output streams ~2.5x faster on the same claude-opus-4-8 model.
# Standard pricing ($5/$25) resumes on your next normal task.Ширший доступ до Fast Mode через API відкривається через вашого акаунт-менеджера або список очікування. Якщо ви вже впираєтеся в ліміти швидкості, наш гайд по лімітах використання Claude пояснює, як тарифи взаємодіють із вартістю. Одна чесна примітка: «втричі дешевше, ніж раніше» означає, що сам Fast Mode став дешевшим порівняно зі старим тарифом Fast, а не що він дешевший за стандартні ціни Opus. Це не так.
Dynamic Workflows: міграції на рівні кодової бази з паралельними субагентами
Dynamic Workflows — функція в режимі research preview на планах Enterprise, Team і Max, яка координує «рої субагентів» — сотні паралельних субагентів в одній сесії. У поєднанні з Claude Code та Opus 4.8, Anthropic каже, що вона здатна виконувати міграції на рівні кодової бази — сотні тисяч рядків — від старту до мержу з мінімальним втручанням.
Dynamic Workflows дозволяє одній сесії Claude Code розгалужуватися на сотні паралельних субагентів для міграції цілої кодової бази. Уявіть оновлення фреймворків, повну заміну залежностей або рефакторинг усього репозиторію, що зазвичай з'їдає тиждень інженера. Якщо ви працювали з паралельними агентами кодингу раніше, це та сама ідея, масштабована й оркестрована моделлю, а не вами.
Два чесних зауваження. Перше: це research preview, тож очікуйте шорсткостей і не спрямовуйте на критичні для продакшену міграції без перевірки. Друге: функція обмежена планом — потрібен доступ Enterprise, Team або Max. TechCrunch описав Dynamic Workflows як відповідь Anthropic на конкурентний тиск з боку інших лабораторій, і це прочитання влучне: це головна розробницька функція цього релізу.
Ми запустили Opus 4.8 у Claude Code: ось що ми виміряли
Ми перемкнули модель за замовчуванням у нашому репозиторії контент-пайплайну з claude-opus-4-7 на claude-opus-4-8 і повторно прогнали ті самі агентні завдання, які використовуємо щодня. Ось що можемо сказати чесно після раннього практичного використання — якісно там, де немає точних цифр до/після, і конкретно там, де вони є.
По-перше, заміна справді тривіальна. Зміна ідентифікатора моделі на claude-opus-4-8 і запуск сесії спрацювали без жодних змін конфігурації з нашого боку. Варіант із контекстом 1 млн токенів доступний як claude-opus-4-8[1m], якщо потрібне більше вікно. Ми підтвердили, що Fast Mode з /fast тримає вас на повній моделі Opus, а не тихенько маршрутизує до меншої, дешевшої моделі — саме така поведінка нам потрібна, але ми не припускали її за замовчуванням.
Що виділилося під час раннього використання: Opus 4.8 помітно охочіше перечить. На завданні рефакторингу він позначив припущення в нашому наявному коді як ризиковане, замість того щоб мовчки будувати поверх нього — саме та поведінка, яку передбачає твердження Anthropic «у 4 рази рідше пропускає дефекти». Ми не будемо видавати це за бенчмарк — це одне спостереження на одному завданні. Але це перше, що ми помітили, і це узгоджується з історією про вирівнювання.
Прискорення Fast Mode було реальним і очевидним в інтерактивних сесіях — вивід починав стрімити швидше, хоча ми не публікуємо точну цифру латентності, доки не проведемо чистий, повторюваний тест таймінгу. Якщо ви проводите власне порівняння, чесний метод такий: той самий промпт, той самий стан репозиторію, стандартний режим, потім /fast, і виміряйте час виконання та вартість токенів в обох варіантах. Ми оновимо цей розділ точними цифрами, щойно тест буде завершено.
Чи варто оновлюватися з 4.7? (Перейти / Почекати / Залишитися)
Чи оновлюватися — залежить виключно від вашого навантаження, а не від того, яка модель «перемагає» загалом. Стрибки на SWE-Bench Pro та GDPval-AA великі й реальні, тож користувачам кодингу та роботи зі знаннями варто переходити. Команди з термінальним фокусом мають реальну причину почекати. Користувачі, чутливі до вартості на завданнях біля стелі, можуть залишитися на 4.7, майже нічого не втрачаючи.
Переходьте зараз, якщо: ваша робота спирається на агентний кодинг (SWE-Bench Pro +4,9) або завдання зі знаннями (GDPval-AA +137 Elo). Це найбільші реальні прирости, і в наших тестах стрибок на SWE-Bench проявився на реальних PR як менше хибних ходів. Ціни не змінилися, тож немає вартісного штрафу за оновлення.
Почекайте, якщо: ваш робочий процес термінально-орієнтований — GPT-5.5 досі лідирує на Terminal-Bench 2.1 (78,2% проти 74,6%), тож формулювання «найкраща модель» до вас поки не стосується. Також почекайте, якщо ви посеред проєкту і заміна моделі заплутає вашу оцінку.
Залишайтеся на 4.7, якщо: ви чутливі до вартості і ваш кейс уже біля стелі, як-от робота з комп'ютером, де OSWorld-Verified зрушив лише на +0,6. Ви платитимете вартістю перемикання уваги за дельту, яку не відчуєте.
Якщо ваша робота спирається на кодинг у стилі SWE-Bench або завдання зі знаннями, 4.8 — чітке оновлення; якщо вона термінально-орієнтована, GPT-5.5 може досі мати перевагу. Для ширшої картини подивіться, де Opus 4.8 серед найкращих ШІ-агентів кодингу, і загляньте в реліз 4.7, якщо хочете повну картину дельт.
Як перейти на Opus 4.8 у Claude Code та API?
Перехід — це майже тривіальна заміна ідентифікатора моделі. Встановіть модель за замовчуванням на claude-opus-4-8 (або claude-opus-4-8[1m] для контекстного вікна 1 млн токенів), оберіть рівень зусиль, якщо ваш клієнт його пропонує, і готово. Якщо ви будуєте на Messages API, тепер можна розміщувати системні записи всередині масиву messages, а не лише в полі верхнього рівня system.
# Claude Code: set the default model
/model claude-opus-4-8
# API request body (model ID swap):
{
"model": "claude-opus-4-8",
"messages": [
{ "role": "system", "content": "You are a senior engineer." },
{ "role": "user", "content": "Refactor this module." }
]
}Це вся міграція для більшості команд. Якщо ви використовуєте моделі від кількох провайдерів і хочете протестувати 4.8 проти GPT-5.5 або Gemini 3.1 Pro на власних завданнях, проксі дозволить маршрутизувати між моделями без переписування застосунку. Почніть у стандартному режимі, підтвердіть якість виводу на реальному навантаженні, потім вирішіть, чи вартий обмін швидкості на ціну у Fast Mode.
Ми будуємо продакшн ШІ-агентів саме на цьому стеку в Techsy. Якщо ви обираєте моделі для розробки агента, отримайте безкоштовну консультацію — ми допоможемо обрати правильну для вашого навантаження.
Про автора
Мерт Батур Гюрбюз — співзасновник Techsy.io, де команда випускає ШІ-агентів, системи автоматизації та voice/SDR-пайплайни для B2B-клієнтів. Він навчається в Бірмінгемському університеті та пише про стек інструментів LLM, який команда Techsy реально використовує в продакшені.
Співзасновник, Techsy.io, Бірмінгемський університет · LinkedIn
Часті запитання
Що таке Claude Opus 4.8?
Claude Opus 4.8 — флагманська модель Anthropic, випущена 28 травня 2026 року, з ідентифікатором claude-opus-4-8 та варіантом із контекстом 1 млн токенів claude-opus-4-8[1m]. Anthropic позиціонує її як найчеснішу модель на сьогодні, яка лідирує у 6 з 7 опублікованих бенчмарків і доступна на Claude.ai, у Claude Code та через API.
Коли вийшов Claude Opus 4.8?
Claude Opus 4.8 вийшов 28 травня 2026 року, лише за 41 день після Opus 4.7 — найшвидший темп релізів Opus від Anthropic. Він став доступний того самого дня на Claude.ai, у Claude Code та через Anthropic API, без поетапного розгортання, тож ви можете перемкнути модель за замовчуванням одразу.
Чи Claude Opus 4.8 кращий за Opus 4.7?
Для більшості завдань — так. Opus 4.8 лідирує на SWE-Bench Pro: 69,2% проти 64,3%, додає +137 Elo на GDPval-AA і перемагає у 6 з 7 бенчмарків проти 4.7. Виняток — агентний термінальний кодинг, де GPT-5.5 досі набирає більше за обох. Ціни не змінилися, тож немає вартісного штрафу за оновлення.
Чи варто оновлюватися з 4.7 до Opus 4.8?
Залежить від вашого навантаження. Переходьте зараз, якщо ви займаєтеся агентним кодингом або роботою зі знаннями — там прирости найбільші. Почекайте, якщо ваша робота термінально-орієнтована, бо GPT-5.5 досі лідирує там. Залишайтеся на 4.7, якщо ви чутливі до вартості на завданнях біля стелі, як-от робота з комп'ютером, де дельта лише +0,6 пункту.
Скільки коштує Claude Opus 4.8?
Стандартна ціна — $5 за мільйон вхідних токенів і $25 за мільйон вихідних, ідентично Opus 4.7, тож підвищення цін немає. Fast Mode коштує $10/$50 за мільйон токенів і працює приблизно у 2,5 раза швидше на тій самій моделі. Anthropic каже, що Fast Mode втричі дешевший за попередній тариф Fast Mode.
Що таке Fast Mode у Claude Opus 4.8?
Fast Mode — це високошвидкісний тариф, який запускає Opus 4.8 приблизно у 2,5 раза швидше за $10 вхід / $50 вихід на мільйон токенів, активується командою /fast у Claude Code. Принципово, що він тримає вас на повній моделі claude-opus-4-8, а не понижує до меншої. Anthropic каже, що це втричі дешевше за попередній тариф Fast Mode.
Що таке Dynamic Workflows у Claude Code?
Dynamic Workflows — функція в режимі research preview на планах Enterprise, Team і Max, яка координує сотні паралельних субагентів в одній сесії. У поєднанні з Claude Code та Opus 4.8 вона здатна виконувати міграції на рівні кодової бази — сотні тисяч рядків — від старту до мержу. Очікуйте шорсткостей, бо це досі прев'ю.
Чи підтримує Opus 4.8 контекстне вікно 1 млн токенів?
Так, через варіант claude-opus-4-8[1m]. Ви звертаєтеся до нього за цим ідентифікатором моделі, коли потрібне більше контекстне вікно. Зверніть увагу: публічна сторінка огляду моделей у документації може ще не встигнути оновитися і може не містити запис 4.8, але варіант доступний під час виконання вже сьогодні.
Чи Claude Opus 4.8 справді перемагає GPT-5.5 у всьому?
Ні. GPT-5.5 досі перемагає в агентному термінальному кодингу на Terminal-Bench 2.1 — 78,2% проти 74,6% у Opus 4.8. Opus 4.8 лідирує в інших шести опублікованих бенчмарках, зокрема SWE-Bench Pro та GDPval-AA, але якщо ваш робочий процес термінально-орієнтований, GPT-5.5 залишається сильнішим вибором для цього конкретного завдання.
Як перейти на Opus 4.8 у Claude Code?
Встановіть модель на claude-opus-4-8 (використайте /model claude-opus-4-8 у Claude Code) і оберіть рівень зусиль, якщо ваш клієнт його пропонує. Для контекстного вікна 1 млн токенів використовуйте claude-opus-4-8[1m]. Це майже тривіальна заміна без інших змін конфігурації для більшості команд.