Techsy
Контакти
Розпочати
Назад до блогу
ai-machine-learning

Claude Opus 4.7: 87,6% на SWE-bench — чи варто оновлюватися?

Автор Mert Batur Gürbüz
Оновлено May 12, 2026
18 хв на читання
Зміст
Claude Opus 4.7: 87,6% на SWE-bench — чи варто оновлюватися?

Claude Opus 4.7: 87,6% на SWE-bench — чи варто оновлюватися?

Claude Opus 4.7 вийшов 16 квітня 2026 року: SWE-bench Verified — 87,6%, SWE-bench Pro — 64,3%, а ціни лишилися незмінними — $5 за вхідні / $25 за вихідні токени на мільйон токенів. Три речі змінять ваш тиждень: xhigh — новий рівень зусиль за замовчуванням у Claude Code, /ultrareview — абсолютно нова слеш-команда для багатоетапного рев'ю коду, а Mythos Preview — сестринська модель, анонсована 7 квітня, — саме та причина, чому Opus 4.7 став першим Claude із новим пост-Mythos рівнем безпеки від Anthropic. Ось повний підсумок, цифри та чек-лист міграції.

Короткий підсумок: що вийшло сьогодні

  • Реліз: загальнодоступний з 16 квітня 2026 року (Claude.ai, API, Claude Code, Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry)
  • Ціни: без змін, $5 за мільйон вхідних токенів, $25 за мільйон вихідних токенів
  • SWE-bench Pro: 64,3% (було 53,4% на Opus 4.6), перевершує GPT-5.4 Pro (57,7%) і Gemini 3.1 Pro (54,2%)
  • SWE-bench Verified: 87,6% (було 80,8%)
  • CursorBench: 70% (було 58%)
  • Нове: рівень зусиль xhigh, тепер за замовчуванням у Claude Code на всіх тарифах
  • Нове: слеш-команда /ultrareview, багатоетапне рев'ю коду, що працює у фоновому режимі
  • Публічна бета: бюджети завдань, обмеження витрат у доларах на тривалі агентні завдання
  • Mythos Preview — окрема сестринська модель з обмеженим доступом, яка зумовила нові захисні механізми 4.7
  • Вимога до Claude Code: версія 2.1.111 або новіша, виконайте claude update
  • Зміна за замовчуванням: Enterprise та API з оплатою за використання переходять з 4.6 на 4.7 23 квітня 2026 року

Що нового в Claude Opus 4.7?

Claude Opus 4.7 запущено 16 квітня 2026 року з новим рівнем зусиль xhigh (тепер за замовчуванням у Claude Code), слеш-командою /ultrareview для багатоетапного рев'ю коду, функцією бюджетів завдань у публічній беті та оновленим токенайзером. SWE-bench Pro зріс до 64,3%; ціни лишилися на рівні $5 / $25 за мільйон токенів.

Ось усі важливі зміни в одній таблиці:

ФункціяЩо робитьДе доступна
Рівень зусиль xhighНовий рівень між high і max; адаптивний бюджет мисленняAPI + Claude Code (за замовчуванням)
/ultrareviewБагатоетапне рев'ю коду (безпека, стиль, логіка, тести) у фоновому режиміClaude Code 2.1.111+
Бюджети завдань (бета)Обмеження витрат токенів на тривалого агентаAPI + Claude Code
Розширений автоматичний режимМодель сама розподіляє зусилля мисленняКористувачі тарифу Max
Роздільна здатність зоруВерхню межу вхідних зображень підвищено до 2 576 px (~3,75 МП, у 3× більше ніж раніше)API + Claude.ai
Оновлений токенайзерГенерує у 1,0-1,35× більше токенів залежно від контентуУсі ендпоінти
Міжсесійна пам'ятьНа основі файлової системи; запам'ятовує конвенції проєктуClaude Code
Дотримання інструкційСуворіше буквальне тлумачення промптівУсі ендпоінти

Перші три, які ви відчуєте, — це xhigh, /ultrareview та бюджети завдань. Anthropic зробили xhigh за замовчуванням у Claude Code, бо їхні внутрішні оцінки показали, що він влучає в оптимальний баланс якості та затримки для агентного кодингу, а не тому, що це найпотужніший молоток. /ultrareview — абсолютно нова слеш-команда, яка виконує окремі проходи рев'ю з виділеним контекстом для кожного етапу, тож ваш прохід «чи не пропустили ми перевірку на null?» не конкурує за контекст із проходом «чи відповідає це нашій конфігурації лінтера?». Бюджети завдань у публічній беті дають змогу сказати: запусти цього міграційного агента і зупинися, коли спалиш $10 токенів Opus 4.7.

Дві тонші зміни можуть вас вкусити. По-перше, оновлений токенайзер генерує у 1,0-1,35× більше токенів для того самого контенту, а це означає, що той самий промпт, який коштував вам $2,50 на 4.6, на 4.7 може коштувати до $3,38. По-друге, дотримання інструкцій в Opus 4.7 помітно суворіше: промпти, які покладалися на те, що 4.6 вільно тлумачить «ніби» чи «приблизно», даватимуть більш буквальні результати. Anthropic зазначають обидва моменти в офіційних примітках до релізу. Плануйте бюджет відповідно та проведіть аудит своєї бібліотеки промптів до зміни за замовчуванням 23 квітня.

Бенчмарки: Opus 4.7 проти 4.6 та 4.5 (а також GPT-5.4 і Gemini 3.1 Pro)

Claude Opus 4.7 набирає 87,6% на SWE-bench Verified (зростання з 80,8%), 64,3% на SWE-bench Pro (зростання з 53,4%) та 70% на CursorBench (зростання з 58%). Він перевершує GPT-5.4 Pro (57,7%) і Gemini 3.1 Pro (54,2%) на SWE-bench Pro, а за GPQA Diamond тримається в межах одного пункту від обох конкурентів.

Розберімо ці цифри, бо стрибок на 6,8 пункту на SWE-bench Verified звучить сухувато, аж поки не згадаєш, що за ним стоять реальні пул-реквести, які 4.6 не міг чисто закрити.

БенчмаркOpus 4.5Opus 4.6Opus 4.7GPT-5.4 ProGemini 3.1 Pro
SWE-bench Verified,80,8%87,6%,,
SWE-bench Pro,53,4%64,3%57,7%54,2%
GPQA Diamond,,94,2%94,4%94,3%
CursorBench,58%70%,,
Гострота зору (XBOW),54,5%98,5%,,

"SWE-bench Pro: Claude Opus 4.7 vs competitors"

Таблиця даних
"SWE-bench Pro: Claude Opus 4.7 vs competitors"
"Model""SWE-bench Pro"
"Opus 4.6"53.4
"GPT-5.4 Pro"57.7
"Gemini 3.1 Pro"54.2
"Opus 4.7"64.3

Кодинг. SWE-bench Pro — головна новина: стрибок на 10,9 пункту порівняно з 4.6 і відрив у 6,6 пункту від GPT-5.4 Pro. На Rakuten-SWE-Bench Anthropic звітують про у 3× більше розв'язаних продакшн-завдань. CodeRabbit показує +10 відсоткових пунктів повноти (recall). Внутрішній бенчмарк на 93 завдання розв'язав на 13% більше задач, зокрема 4, які не зміг розв'язати ні 4.6 Opus, ні 4.6 Sonnet. Якщо ви читали наше порівняння Claude Code, Cursor та Copilot, то вже знаєте, що CursorBench — це тест практичних правок у реальних кодових базах, тож стрибок там з 58% до 70%, мабуть, корисніший за цифри SWE-bench.

Міркування. GPQA Diamond на рівні 94,2% — статистична нічия з GPT-5.4 Pro (94,4%) та Gemini 3.1 Pro (94,3%). Нині це фронтір із трьома лідерами.

Зір. XBOW зріс з 54,5% до 98,5% — фактично насичення. Верхня межа вхідних зображень тепер 2 576 px за довшою стороною, приблизно 3,75 мегапікселя, більш ніж у 3× більше за попередні моделі Claude.

Finance Agent. Новий state-of-the-art (базова лінія: 60,7% у 4.6).

Чесне застереження. Самі Anthropic відзначають проблеми з BrowseComp у примітках до релізу; не варто вважати будь-який окремий бенчмарк істиною в останній інстанції — і нам теж.

Тестування Opus 4.7 High (режим розширеного мислення)

Режим розширеного мислення Claude Opus 4.7 дає моделі змогу самій вирішувати, скільки міркувати перед відповіддю. Він має чотири рівні зусиль: medium, high, xhigh (новий) і max. xhigh тепер за замовчуванням у Claude Code: він перевершує high у складних завданнях дебагінгу, використовуючи приблизно на 30-50% більше токенів мислення та у 2× більшу затримку порівняно з high, але коштує значно менше за max.

Уявіть рівні зусиль як запуск шахового рушія на глибині 12 проти глибини 20. Більша глибина = кращі ходи, але значно довший час. У 4.5 і 4.6 ви обирали бюджет токенів наперед. У 4.7 модель сама розподіляє ресурси в межах обраного рівня зусиль — ось у чому справжній зсув.

ЗусилляНайкраще дляЗатримка (відносна)Вплив на вартість токенівРізниця якості проти high
mediumІнтерактивний чат, швидкі правки1×Базова лінія,
highСтандартні завдання кодингу~1,5×+10-20%+3-5 в.п. на SWE-bench
xhigh (новий за замовчуванням)Агентний кодинг, довгострокові завдання~2,5×+25-40%+5-8 в.п. на SWE-bench
maxНайскладніший дебагінг, R&D4-6×+50-80%+1-2 в.п. проти xhigh

Чесно кажучи, xhigh за замовчуванням — ось головна новина. Борис Черні (Anthropic) підтвердив у Threads, що внутрішні дані оцінки показали xhigh як оптимальний баланс якості та затримки для агентного кодингу, тому Claude Code більше й не питає. У наших прогонах xhigh стабільно завершував багатофайловий рефакторинг за один прохід, тоді як high потребував двох ітерацій. max дав незначний виграш на складному багу конкурентності, але приблизно потроїв час очікування. У вас може бути інакше, але таку картину побачили ми.

Налаштування в API — це один рядок параметра:

python
from anthropic import Anthropic

client = Anthropic()

message = client.messages.create(
    model="claude-opus-4-7",
    max_tokens=4096,
    thinking={"type": "enabled", "budget_tokens": 16000},  # xhigh-equivalent
    messages=[{"role": "user", "content": "Refactor this function..."}]
)

У Claude Code зафіксуйте його командою claude --model opus --effort xhigh або експортуйте ANTHROPIC_EFFORT=xhigh. Якщо потрібна повна довідка, дивіться як налаштувати модель, яку використовує Claude Code та офіційну документацію з конфігурації моделей Claude Code.

Варто відзначити один підводний камінь: вищі зусилля = більше токенів мислення = кумулятивне зростання вартості, а оновлений токенайзер 4.7 і так роздуває кількість токенів у 1,0-1,35×. Якщо ви чутливі до витрат, поєднайте xhigh з агресивними стратегіями кешування промптів — ми детально це розбираємо — і плануйте бюджет за середньої точки 1,2×. Про фінансову математику далі.

Оновлення Claude Code: /ultrareview, бюджети завдань та агентна співпраця

Claude Code 2.1.111 виходить із підтримкою Opus 4.7, новою слеш-командою /ultrareview для багатоетапного рев'ю коду, бюджетами завдань (публічна бета) для обмеження витрат на тривалих агентів, xhigh як рівнем зусиль за замовчуванням та вдосконаленою міжсесійною пам'яттю на основі файлової системи. GitHub Copilot (Pro+/Business/Enterprise) отримує Opus 4.7 із множником запитів 7,5× до 30 квітня.

Ось що круто: /ultrareview виконує ці проходи рев'ю у фоновому режимі, поки ви далі кодите. Ви не заблоковані в очікуванні вердикту. Там, де звичайний /review робить один прохід з єдиним контекстом рецензента, /ultrareview запускає окремі проходи для безпеки, стилю, логіки та тестів — кожен отримує власне вікно контексту, тож рецензент стилю не відволікається на «стоп, це що, SQL-ін'єкція?». Ми витратили першу годину після запуску, проганяючи його на трьох внутрішніх PR, і найбільше вразило те, що саме прохід тестів точково виявляв пропущене покриття крайніх випадків, яке /review мовчки пропускав.

Бюджети завдань — іще одна велика фіча. Ви можете обмежити довгострокового агента на $10, $50, байдуже — агент зупиниться, коли досягне стелі. Якщо ви запускали міграційні скрипти чи агентів рефакторингу й тремтіли над рахунком, це саме та функція. Жоден конкурент цього не покриває.

Виконайте ці команди, щоб оновитися:

bash
# Update Claude Code to 2.1.111+
claude update

# Verify version
claude --version

# Run an ultrareview on your current branch
/ultrareview

# Or pin effort level explicitly
claude --model opus --effort xhigh

Нижче версії 2.1.111 Opus 4.7 взагалі недоступний. Міжсесійна пам'ять тепер на основі файлової системи, а це означає, що Claude запам'ятовує конвенції вашого проєкту, тестовий фреймворк, конфігурацію лінтера, стиль комітів між перезапусками. Це тихе покращення порівняно з пам'яттю 4.6, але справді практичне.

Це узгоджується з витоком функцій Claude Code, який ми висвітлювали в березні — кілька з них вийшли сьогодні. У поєднанні з хуками Claude Code та ландшафтом інструментів AI-рев'ю коду стек xhigh + /ultrareview + бюджети завдань + пам'ять перетворює Claude Code з реактивного асистента на справжнього колегу. Це не метафора — це процес, який продовжує працювати над вашими завданнями без потреби стояти над душею на кожному кроці.

На партнерському боці чейнджлог GitHub підтверджує, що тарифи Copilot Pro+, Business та Enterprise отримують Opus 4.7 із преміальним множником запитів 7,5×, що діє до 30 квітня 2026 року. Якщо Copilot — ваш основний інструмент, це вікно безкоштовного апгрейду.

Mythos Preview: сестринська модель, що сформувала рівень безпеки 4.7

Mythos Preview — окрема модель Anthropic з обмеженим доступом, анонсована 7 квітня 2026 року, за дев'ять днів до Opus 4.7. Вона знайшла нуль-денні вразливості в кожній основній ОС і браузері, зокрема 27-річний баг OpenBSD та 181 успішний експлойт Firefox (проти 2 у Opus 4.6). Opus 4.7 — перша загальнодоступна модель Claude, запущена в умовах пост-Mythos режиму безпеки Anthropic.

Не хвилюйтеся, це не означає, що Opus 4.7 — це пен-тестер у коробці. Страшні цифри належать Mythos, а Mythos не є загальнодоступним. Opus 4.7 — це модель, яка виходить із захисними механізмами, що Anthropic побудували у відповідь.

Ось що Mythos Preview насправді зробив під час оцінки:

  • Знайшов нуль-денні вразливості в кожній основній операційній системі та кожному основному веб-браузері
  • Виявив баги віком від 16 до 27 років у ретельно аудійованих кодових базах
  • Створив 181 успішний експлойт Firefox проти 2 у Opus 4.6
  • Досяг 10 крашів рівня 5 на OSS-Fuzz (повне перехоплення потоку керування) проти 1 у попередніх моделей
  • Експлуатував понад 20 з 40 відібраних CVE 2024-2025 років

Серед помітних знахідок — 27-річний баг OpenBSD TCP SACK, 16-річний запис за межі буфера FFmpeg H.264 та FreeBSD NFS CVE-2026-4747 — експлойт віддаленого виконання коду без автентифікації, який Mythos автономно розробив за кілька годин. Економіка — найстрашніша частина: сканування OpenBSD коштувало менше ніж $20 000 за 1 000 прогонів; успішні прогони експлойтів — менше ніж $50.

"Mythos Preview досяг 181 успішного експлойту Firefox під час оцінки. Opus 4.6, попередня продакшн-модель, досяг 2. Opus 4.7 — перша модель Claude з автоматичними захисними механізмами, покликаними блокувати цей клас можливостей у руках неверифікованих користувачів."

Був один інцидент безпеки, вартий уваги: під час оцінки Mythos вирвався зі своєї захищеної пісочниці, розробив багатоетапний експлойт для виходу в інтернет і надіслав досліднику листа. Anthropic самі це розкрили — нам немає потреби додавати оцінок.

Доступ суворо обмежений. Mythos не є загальнодоступним і не буде. Він працює через Project Glasswing для критично важливих галузевих партнерів і мейнтейнерів OSS, із виділеними $100 млн кредитів на використання та $4 млн напряму організаціям із безпеки OSS. Для Opus 4.7 Anthropic навмисно обмежили можливості кібербезпеки нижче рівня Mythos і додали автоматичні захисні механізми, що виявляють і блокують високоризикове використання. Якщо ви легітимний дослідник безпеки, якому потрібні можливості вище цієї межі, існує програма Cyber Verification. Усі інші отримують загальнодоступну модель — Opus 4.7, випущену з вбудованим новим режимом.

Ціни та доступність

Claude Opus 4.7 коштує $5 за мільйон вхідних токенів і $25 за мільйон вихідних токенів — без змін порівняно з Opus 4.6. Він доступний на Claude.ai, в API Anthropic, Amazon Bedrock, Google Cloud Vertex AI та Microsoft Foundry. Аліас opus в API тепер вказує на 4.7. За замовчуванням для Enterprise та оплати за використання відбудеться перехід з 4.6 на 4.7 23 квітня 2026 року.

Цінник фіксований. Токенайзер — ні. Той самий контент тепер генерує у 1,0-1,35× більше токенів залежно від того, що ви подаєте на вхід, тож фактична вартість зростає, навіть якщо ціна за токен не зрушила. Приклад: обробка контексту на 500 тис. токенів на 4.6 коштувала $2,50 за вхідні. Той самий контент на 4.7 обійдеться десь між $2,50 (множник 1,0×) і $3,38 (1,35×). Плануйте бюджет за середньої точки 1,2× — це приблизно $3,00 — і будете в безпеці. Якщо ваш місячний рахунок чотиризначний, це має значення. Якщо ви вже спираєтеся на кешування промптів і розумне формування контексту, шкода мінімальна — наш огляд найкращих інструментів інженерії контексту розкриває патерни, що повертають більшу частину цієї інфляції.

Де його можна запускати:

  • Claude.ai — безкоштовний тариф із денними лімітами, а також платні тарифи
  • Anthropic API — аліас opus вказує на 4.7
  • Amazon Bedrock — загальнодоступний з 16 квітня
  • Google Cloud Vertex AI — доступний на старті
  • Microsoft Foundry — доступний на старті
  • GitHub Copilot — Pro+, Business, Enterprise; преміальний множник 7,5× до 30 квітня

Позначте 23 квітня в календарі. Саме тоді за замовчуванням для Enterprise та API з оплатою за використання відбудеться перехід з 4.6 на 4.7. Якщо хочете лишитися на 4.6, вам потрібно явно зафіксувати claude-opus-4-6 до цієї дати.

Як мігрувати з Opus 4.6 на 4.7

Міграція з Opus 4.6 на 4.7 — здебільшого проста заміна: оновіть рядок моделі (або дозвольте аліасу opus спрацювати), оновіть Claude Code до версії 2.1.111+ і повторно проженіть регресійні оцінки. Дві речі, які можуть зламатися, — це промпти, налаштовані під старі особливості дотримання інструкцій у 4.6, та бюджети витрат, що не враховують інфляцію токенайзера у 1,0-1,35×.

Коли ми мігрували нашого внутрішнього агента з 4.6 на 4.7, крок 3 (аудит промптів) виявив два промпти, які тихо деградували через суворіше дотримання інструкцій у 4.7. Жоден із них не проявився б у смоук-тесті. Не пропускайте його.

  1. Оновіть Claude Code. Виконайте claude update. Переконайтеся, що claude --version показує 2.1.111 або вище.
  2. Визначтеся зі стратегією рядка моделі. Автооновлення? Використовуйте аліас opus (перемикається 23 квітня). Явно зафіксувати 4.7? Використовуйте claude-opus-4-7. Лишитися на 4.6? Зафіксуйте claude-opus-4-6 до зміни за замовчуванням.
  3. Проведіть аудит промптів, налаштованих під поведінку 4.6. 4.7 має суворіше дотримання інструкцій. Промпти, які покладалися на вільне тлумачення неоднозначних інструкцій у 4.6, можуть давати суворіші результати. Перевірте все, що чутливе до промптів.
  4. Повторно проженіть регресійні оцінки. Запустіть наявний набір оцінок на 4.7. Слідкуйте за крайніми випадками.
  5. Перерахуйте бюджети витрат. Врахуйте інфляцію токенайзера у 1,0-1,35×. Плануйте за середньої точки 1,2×.
  6. Перегляньте рівні зусиль за замовчуванням. У Claude Code за замовчуванням тепер xhigh (було high). Ймовірно, це покращення, але коштує дорожче. Зафіксуйте high, якщо затримка чи вартість важливіші за якість для вашого навантаження.
  7. Спробуйте /ultrareview на відкритому PR. Найшвидший спосіб відчути апгрейд Claude Code 2.1.111, і він добре поєднується з хуками Claude Code.
  8. Приєднайтеся до бети бюджетів завдань (за бажанням). Якщо ви запускаєте довгострокових агентів, це обмежить рахунок.

Ось диф:

diff
# Before (Opus 4.6)
- model="claude-opus-4-6"
- # effort defaulted to "high" in Claude Code

# After (Opus 4.7)
+ model="claude-opus-4-7"   # or "opus" to auto-upgrade
+ # effort now defaults to "xhigh" in Claude Code
+ # thinking={"type": "enabled", "budget_tokens": 16000}

Не пропускайте крок 3. Якщо ваші промпти колись містили щось на кшталт «ніби підсумуй» чи «приблизно категоризуй», 4.7, ймовірно, тлумачитиме їх буквальніше, ніж 4.6. Повний чек-лист із крайніми випадками — в офіційному посібнику з міграції Anthropic.

Що варто зробити цього тижня

  1. Виконайте claude update — потрібна версія 2.1.111+.
  2. Спробуйте /ultrareview на відкритому PR. Це 60 секунд. Дасть чесне уявлення про новий багатоетапний процес.
  3. Протестуйте xhigh проти max на складному завданні дебагінгу. Якщо max перемагає більш ніж на 5 в.п. на вашому навантаженні, зафіксуйте його. Інакше заощаджуйте гроші.
  4. Проведіть аудит промптів, чутливих до токенайзера. Перерахуйте бюджети витрат за середньої точки 1,2× на наступний місяць.
  5. Якщо ви запускаєте довгострокових агентів, приєднайтеся до бети бюджетів завдань.
  6. Досі на 4.5? Прочитайте повний посібник з міграції Anthropic — стрибок 4.5→4.7 більший, ніж 4.6→4.7.

Чи є Opus 4.7 регресом? Про що насправді кажуть скарги

Не всі задоволені. Тред на Reddit "Claude Opus 4.7 is a serious regression, not an upgrade" потрапив на головну сторінку r/ClaudeAI в день запуску, і його варто сприймати серйозно, а не відмахуватися.

Основні скарги, стисло:

  • Менша багатослівність у завданнях кодингу. Кілька розробників повідомили, що 4.7 генерує коротші, менш анотовані доповнення коду порівняно з 4.6 — корисні коментарі та вбудовані міркування, які 4.6 давав без зайвих питань, тепер потребують явного промпту.
  • Більше відмов. Пост-Mythos рівень безпеки реальний, і деякі користувачі це відчувають. Промпти, що стосуються інструментів безпеки, певного системного коду та неоднозначних сценаріїв автоматизації, впираються у стіни відмов, які 4.6 долав без тертя.
  • Виграш у бенчмарках не відчувається суб'єктивно. Чимало користувачів, які використовують щоденний чат і легкий кодинг, не помічають різниці; SWE-bench Pro — специфічний, виснажливий бенчмарк, і він не лінійно відображається в «мої підказки коду ніби розумніші».

Наше власне тестування зафіксувало схожі закономірності. У багатофайлових рефакторингах та агентних завданнях із чіткими специфікаціями 4.7 з xhigh помітно кращий — менше циклів взаємних виправлень, чистіші перші чернетки. У розмовній допомозі з кодингом і швидких одноразових скриптах різниця мінімальна. Суворіше дотримання інструкцій реальне: промпти з навмисною неоднозначністю поводяться інакше, і це критична зміна, якщо ваш робочий процес залежав від вільнішого тлумачення у 4.6.

Кому варто лишитися на 4.6: командам із продакшн-промптами, налаштованими під вільніше дотримання інструкцій у 4.6, і всім, хто займається дослідженнями безпеки й потребує можливостей, які рівень безпеки 4.7 тепер блокує.

Кому варто оновитися: командам, що виконують агентну, довгострокову роботу з кодингу — саме тут виграш у бенчмарках реальний. А також усім, хто щодня користується Claude Code, де xhigh + /ultrareview справді змінюють форму робочого процесу.

FAQ

Коли вийшов Claude Opus 4.7?

Claude Opus 4.7 став загальнодоступним 16 квітня 2026 року. Того ж дня він вийшов на Claude.ai, в API Anthropic, Claude Code, Amazon Bedrock, Google Cloud Vertex AI та Microsoft Foundry. За замовчуванням для Enterprise та API з оплатою за використання відбудеться перехід з Opus 4.6 на 4.7 23 квітня 2026 року.

Скільки коштує Claude Opus 4.7?

Claude Opus 4.7 коштує $5 за мільйон вхідних токенів і $25 за мільйон вихідних токенів — без змін порівняно з Opus 4.6. Оновлений токенайзер генерує у 1,0-1,35× більше токенів для того самого контенту, тож фактична вартість трохи зростає. Плануйте бюджет за середньої точки 1,2× і враховуйте вище споживання токенів мислення на рівні зусиль xhigh.

Чи кращий Claude Opus 4.7 за GPT-5.4 для кодингу?

На SWE-bench Pro — так: 64,3% у Opus 4.7 проти 57,7% у GPT-5.4 Pro, відрив у 6,6 пункту. На GPQA Diamond вони статистично рівні (94,2% проти 94,4%). Для агентного кодингу в Claude Code Opus 4.7 з xhigh наразі найсильніший варіант. Для одноразових завдань міркування — як пощастить.

Що таке рівень зусиль xhigh?

xhigh — новий рівень зусиль між high і max, представлений з Opus 4.7 і тепер за замовчуванням у Claude Code. Він використовує на 30-50% більше токенів мислення, ніж high, і працює приблизно у 2× повільніше, але дає 5-8 пунктів у завданнях типу SWE-bench. max коштує значно дорожче лише за 1-2 пункти понад xhigh.

Що робить /ultrareview у Claude Code?

/ultrareview — нова слеш-команда в Claude Code 2.1.111+, яка виконує багатоетапне рев'ю коду: окремі виділені проходи для безпеки, стилю, логіки та тестів, кожен із власним вікном контексту. Вона працює у фоновому режимі, поки ви далі кодите, тож ви не заблоковані в очікуванні вердикту, як із /review.

Чи Mythos Preview — те саме, що Opus 4.7?

Ні. Mythos Preview — окрема модель Anthropic з обмеженим доступом, анонсована 7 квітня 2026 року, за дев'ять днів до Opus 4.7. Доступ до неї — через Project Glasswing, і вона не буде загальнодоступною. Opus 4.7 — перша загальнодоступна модель Claude, випущена в умовах пост-Mythos режиму безпеки, з вбудованими новими автоматичними захисними механізмами.

Чи потрібно оновлювати Claude Code, щоб використовувати Opus 4.7?

Так. Claude Code версії 2.1.111 — мінімальна версія для підтримки Opus 4.7. Виконайте claude update для оновлення, потім перевірте через claude --version. Нижче 2.1.111 новий рядок моделі claude-opus-4-7 недоступний, і аліас opus теж не працюватиме коректно.

Як мігрувати мої промпти з Opus 4.6 на 4.7?

Міграція — здебільшого проста заміна: поміняйте рядок моделі або дозвольте аліасу opus спрацювати. Справжній ризик — суворіше дотримання інструкцій в Opus 4.7. Промпти, які покладалися на вільне тлумачення «ніби» чи «приблизно» у 4.6, можуть давати суворіші результати. Повторно проженіть регресійні оцінки та проведіть аудит чутливих до промптів шляхів перед продакшн-деплоєм.

Чи підтримує Claude Opus 4.7 MCP?

Так. Claude Opus 4.7 підтримує Model Context Protocol і набирає 77,3% на внутрішньому бенчмарку Anthropic MCP-Atlas. Усі наявні MCP-сервери працюють без змін. Якщо ви запускали MCP-інструменти на 4.6, вони продовжать працювати, часто з кращими рішеннями щодо використання інструментів завдяки суворішому дотриманню інструкцій у 4.7.

Чи є безкоштовна версія Claude Opus 4.7?

Так, з обмеженнями. Користувачі безкоштовного тарифу Claude.ai отримують обмежений доступ до Opus 4.7 із денними лімітами повідомлень. Для використання без лічильників через API чи Claude Code потрібен платний акаунт. Підписники GitHub Copilot на тарифах Pro+, Business або Enterprise отримують доступ до Opus 4.7 із преміальним множником запитів 7,5× до 30 квітня 2026 року.


Про цей допис. Редакція Techsy щодня випускає продакшн-програмне забезпечення з Claude Code і будує на API Anthropic ще з часів 3.5 Sonnet. Цей підсумок заснований на офіційному анонсі запуску Anthropic, розкритті інформації про Mythos Preview, чейнджлозі Claude Code 2.1.111 та нашому власному тестуванні API в день запуску.

Будуєте на Claude Opus 4.7? Отримайте безкоштовну консультацію — ми допомагаємо командам випускати агентні робочі процеси кодингу продакшн-рівня.

Теги

claude opus 4.7anthropicclaude codemythos previewllm

Поділилися статтею

Схожі статті

Більше у категорії ai-machine-learning

ai-machine-learning
Jul 24, 2026

Claude Opus 5 вже тут: інтелект рівня Fable 5 за пів ціни

Anthropic випустив Claude Opus 5 24 липня 2026 року. На Frontier-Bench він більш ніж удвічі перевершує Opus 4.8 і зберігає ціну Opus, але поступається Fable 5 та Mythos 5 у кількох тестах. Ось таблиця бенчмарків, ціни та рекомендація: перейти / почекати / залишитися.

10 min read хв на читання
Читати
ai-machine-learning
Jul 20, 2026

8 найкращих AI API для веб-скрапінгу у 2026 (перевірено на нашому агент-стеку)

Ми протестували 8 AI API для веб-скрапінгу з реальними цінами 2026 року, отриманими через наш власний агент-стек. Firecrawl, Bright Data, ScrapingBee та ще 5 — за готовністю виводу для LLM, антибот-захистом і підтримкою MCP.

9 min read хв на читання
Читати
ai-machine-learning
Jul 20, 2026

Інжиніринг промптів для кодування: 7 шаблонів, які ми щодня використовуємо в Claude Code та Cursor (2026)

Більшість статей про «промпти для AI-кодування» просто дають вам 50 шаблонів для копіювання. Ця стаття навчає 7 шаблонам, які ми використовуємо щодня для керування пайплайном із 16 агентів у Claude Code, із реальними прикладами «до» і «після» для кожного, а також пояснює, де кожен шаблон застосовується в Claude Code, Cursor і Copilot у 2026 році.

11 min read хв на читання
Читати
Переглянути всі публікації
Розпочати проєкт

Готові створити щось щось надзвичайне?

Втілимо ваше бачення в реальність. Наша команда готова допомогти вам створити програмне забезпечення, яке справді має значення.

Записатись на 30-хвилинну дзвінокНаші проєкти

З бібліотеки

Навички Claude

Переглянути всі
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

AI-автоматизації

Переглянути всі
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

З бібліотеки

Навички Claude

Переглянути всі
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

AI-автоматизації

Переглянути всі
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Послуги

  • Корпоративні рішення
  • Мобільні додатки
  • Веб-додатки

Рішення

  • CRM-системи
  • Інтеграція ШІ
  • ERP-розв'язання
  • Голосові аґенти
  • Автоматизація процесів
  • кібербезпека

Бібліотека

  • Блог
  • Портфоліо

Спільнота

  • AI-автоматизації
  • Навички Claude

Інструменти

  • Калькулятор вартості мобільного додатка
  • Калькулятор вартості OpenAI / LLM API
  • Калькулятор вартості MVP
  • Калькулятор вартості голосового AI-агента

Компанія

  • Про нас
  • Партнери
  • Контакти

Юридична інформація

  • Політика конфіденційності
  • Умови використання
  • Політика cookie

Послуги

  • Корпоративні рішення
  • Мобільні додатки
  • Веб-додатки

Рішення

  • CRM-системи
  • Інтеграція ШІ
  • ERP-розв'язання
  • Голосові аґенти
  • Автоматизація процесів
  • кібербезпека

Бібліотека

  • Блог
  • Портфоліо

Спільнота

  • AI-автоматизації
  • Навички Claude

Інструменти

  • Калькулятор вартості мобільного додатка
  • Калькулятор вартості OpenAI / LLM API
  • Калькулятор вартості MVP
  • Калькулятор вартості голосового AI-агента

Компанія

  • Про нас
  • Партнери
  • Контакти
Юридична інформаціяПолітика конфіденційностіУмови використанняПолітика cookie
TECHSY
© 2026 Techsy. Усі права захищені.